登顶HF榜首!MemSlides Agent 做PPT还是太强了
登顶HF榜首!MemSlides Agent 做PPT还是太强了来自清华、上交、北邮的学者们提出了一个面向个性化幻灯片生成和多轮局部修改的记忆驱动Slides Agent框架——MemSlides。它专门针对AI PPT痛点而生,不仅能够为你量身定制私人专属的PPT生成风格,还能够贴心地记住你在制作过程中随口提出的新要求
搜索
来自清华、上交、北邮的学者们提出了一个面向个性化幻灯片生成和多轮局部修改的记忆驱动Slides Agent框架——MemSlides。它专门针对AI PPT痛点而生,不仅能够为你量身定制私人专属的PPT生成风格,还能够贴心地记住你在制作过程中随口提出的新要求
让 AI 生成纯正的中国音乐,为什么这么难? 作者|Cynthia 编辑|郑玄 歌歌 AI 创始人龙勇,或许是全中文 AI 产品圈里,最会整活儿,也最懂网络冲浪的 CEO。 如果你对这个名字不熟悉,没
今天 AI 圈的国际头版头条,比往常还要激烈。前有收获不少好评的 Grok-4.5,后有虎视眈眈的 GPT-5.6。结果就在刚刚,Meta 超级智能实验室 (MSI) 杀出, 甩出新模型 Muse Spark 1.1。
今天分享一家很新的公司,Mecka AI,Mecka AI 是一家给机器人公司提供训练数据的公司。更具体一点,Mecka AI 做的是“人类动作数据”。也就是说,Mecka 做的事情很像“机器人时代的 Scale AI”。
今天原力灵机正式发布的 DM0.5 往前推进了一步。它不只是继续提高某些固定任务上的表现,而是围绕真实世界里的泛化问题做了一次系统突。 如果深入分析,就会发现 DM0.5 这几个核心提升,都是想解决一个问题:如何让具身模型从可控环境里的能力演示,走向开放环境里的稳定执行。
来自浙江大学 APRIL 实验室、快手主站技术部和清华大学的研究团队提出了 MobileForge,试图把手机 GUI Agent 的适配过程变成一个 “无标注、自探索、自反馈、自优化” 的闭环系统。
本文是北京大学彭宇新教授团队联合福州大学柯逍教授团队在细粒度多模态动作质量评价领域的最新研究成果,相关论文已被 ICML 2026 接收为 Spotlight,并已开源。真实世界中的多模态数据往往并不完整。在动作质量评价任务中,视频、光流、音频等模态能够从不同角度描述动作执行过程,但在实际采集时,传感器故障、环境噪声、隐私限制等因素都会导致模态缺失。
一家法国公司完成了一轮 4.8 亿欧元(约 5.5 亿美元)的融资,估值一举冲到 55 亿欧元(约 63 亿美元)。这家公司叫 Alan。它做的恰恰就是最不被看好的健康保险。但它的故事之所以值得讲,是因为 Alan 根本不是一家「用了 AI 的保险公司」,它更像是一家「顺便卖保险的 AI 公司」。
多模态 Agent 的记忆系统,过去很容易被理解成一个升级版 RAG:图片、图表、PDF 进来之后,先抽取内容、做 embedding、写进向量库;用户提问时,再用 query 做检索,把命中的top-k图片、文档页或图表一并塞进上下文,再交给多模态模型回答。整个过程中,所有原始模态信息都会不加选择的塞给大模型。
现在,我依然会使用AI,但是我不再把AI的产出当成最终答案。AI可以帮我提高效率,却不能替我承担结果。它写错一个字、弄错一条信息,最后向客户解释的是我,被领导追责的也是我。该自己做的判断,一个都不能省。