AI技术研报-这里有最前沿的人工智能技术解读

首个统一的图像与视频AIGC可解释性检测框架，多榜单SOTA性能

想象一下：你正在浏览社交媒体，看到一张震撼的图片或一段令人震撼的视频。它栩栩如生，细节丰富，让你不禁信以为真。但它究竟是真实记录，还是由顶尖 AI 精心炮制的「杰作」？如果一个 AI 工具告诉你这是「假的」，它能进一步解释理由吗？它能清晰指出图像中不合常理的光影，或是视频里一闪而过的时序破绽吗？

来自主题: AI技术研报

8074 点击 2025-06-15 12:39

多智能体在「燃烧」Token！Anthropic公开发现的一切

研究多智能体必读指南。Anthropic 发布了他们如何使用多个 Claude AI 智能体构建多智能体研究系统的精彩解释。

来自主题: AI技术研报

7841 点击 2025-06-14 17:52

模型遗忘不代表记忆抹除！首次系统发现「可逆性遗忘」背后规律

研究人员发现，大语言模型的遗忘并非简单的信息删除，而是可能隐藏在模型内部。通过构建表示空间分析工具，区分了可逆遗忘和不可逆遗忘，揭示了真正遗忘的本质是结构性的抹除，而非行为的抑制。

来自主题: AI技术研报

7112 点击 2025-06-14 16:09

腾讯开源最强3D生成模型，消费级显卡就能跑 | CVPR

就在刚刚的CVPR上，鹅厂3D生成模型混元3D 2.1正式宣布开源！

来自主题: AI技术研报

8348 点击 2025-06-14 15:15

全球首次，Transformer「混血」速度狂飙65倍！英伟达已下注

扩散建模+自回归，打通文本生成任督二脉！这一次，来自康奈尔、CMU等机构的研究者，提出了前所未有的「混合体」——Eso-LM。有人惊呼：「自回归危险了。」

来自主题: AI技术研报

6982 点击 2025-06-14 15:07

LLM已能自我更新权重，自适应、知识整合能力大幅提升，AI醒了？

近段时间，关于 AI 自我演进/进化这一话题的研究和讨论开始变得愈渐密集。

来自主题: AI技术研报

7364 点击 2025-06-14 14:28

Figure自曝完整技术：60分钟不间断打工，我们的机器人如何做到？

好家伙，机器人进厂打工原视频流出，整整60分钟，完全未剪辑。

来自主题: AI技术研报

8202 点击 2025-06-14 13:33

AGI真方向？谷歌证明：智能体在自研世界模型，世界模型is all You Need

越通用，就越World Models。我们知道，大模型技术爆发的原点可能在谷歌一篇名为《Attention is All You Need》的论文上。

来自主题: AI技术研报

7539 点击 2025-06-14 13:22

视频扩散模型新突破！清华腾讯联合实现高保真3D生成，告别多视图依赖

三维场景是构建世界模型、具身智能等前沿科技的关键环节之一。

来自主题: AI技术研报

7615 点击 2025-06-14 12:43

AI自己给自己当网管，实现安全“顿悟时刻”，风险率直降9.6%

大型推理模型（LRMs）在解决复杂任务时展现出的强大能力令人惊叹，但其背后隐藏的安全风险不容忽视。

来自主题: AI技术研报

8167 点击 2025-06-14 12:35

知识类型视角切入，全面评测图像编辑模型推理能力：所有模型在「程序性推理」方面表现不佳

人类在学习新知识时，总是遵循从“记忆事实”到“理解概念”再到“掌握技能”的认知路径。

来自主题: AI技术研报

7328 点击 2025-06-14 12:27

DeepSeek研究员1200行代码复刻vLLM，H800硬件实测性能反超原版

仅用不到1200行代码，实现最小化且完全可读的vLLM！DeepSeek研究员俞星凯搞了个开源项目引得大伙拍手叫绝。项目名为Nano-vLLM（纳米级-vLLM），有三大特点：快速离线推理：推理速度可与vLLM相媲美

来自主题: AI技术研报

8539 点击 2025-06-13 15:41

统一20+多智能体方法，MASLab震撼发布

为了推动该领域加速健康发展，由上海交通大学、上海 AI 实验室、牛津大学、普林斯顿大学、Meta 等十个机构联合推出的 MASLab，带来首个统一、全面、研究友好的大模型多智能体系统代码库：

来自主题: AI技术研报

8756 点击 2025-06-13 15:31

黄铁军对大模型的四个预判：洗牌、安全核爆、GPT-5与再造DeepSeek

4月份，李飞飞教授领先编制的《2025年人工智能指数报告》提供的数据显示，2024年全年具有特殊影响力的模型（Notable AI models）当中，排名前5的几乎都来自美国、中国的科技巨头。

来自主题: AI技术研报

8408 点击 2025-06-13 14:14

何恺明新作：给扩散模型加正则化，无需预训练无需数据增强，超简单实现性能提升

扩散模型风头正盛，何恺明最新论文也与此相关。研究的是如何把扩散模型和表征学习联系起来—— 给扩散模型加上“整理收纳”功能，使其内部特征更加有序，从而生成效果更加自然逼真的图片。

来自主题: AI技术研报

7398 点击 2025-06-13 12:49

GraphRAG太慢LightRAG延迟高？华东师大新方法一招破解双重难题

GraphRAG的索引速度慢，LightRAG的查询延迟高？

来自主题: AI技术研报

7418 点击 2025-06-13 12:29

CVPR2025视频生成统一评估架构，上交x斯坦福联合提出让MLLM像人类一样打分

视频生成技术正以前所未有的速度革新着当前的视觉内容创作方式，从电影制作到广告设计，从虚拟现实到社交媒体，高质量且符合人类期望的视频生成模型正变得越来越重要。

来自主题: AI技术研报

6739 点击 2025-06-13 11:46

专治不服！Amazon重磅发布！AI的SOP高考来了！顶级Agent能考几分？

您可能会问，LLM Agent的SOP到底是什么，为什么称它为AI的高考？SOP全称是标准操作程序（Standard Operating Procedures）很多朋友可能很熟悉，但它绝不是简单的步骤清单——它更像是AI能否在工业环境中真正"上岗"的终极考验。

来自主题: AI技术研报

7493 点击 2025-06-13 11:35

AI代码补全哪家强？两个新指标+一套新框架，让模型更懂开发者

如何让AI代码补全更懂开发者？

来自主题: AI技术研报

8593 点击 2025-06-13 11:02

用Cursor「自动开发」Playwright网页自动化脚本，并打包成api给工作流调用

虽然我前面文章介绍了很多AI 工作流，但它们都是局限在自己平台里的操作，对于外部的页面，大多无能为力。

来自主题: AI技术研报

9158 点击 2025-06-13 10:53

四万字·深度求索｜泛聊一下强化学习(RL)下的深度推理(DR)对真实世界(RW)建模与泛化的本质

强化学习·RL范式尝试为LLMs应用于广泛的Agentic AI甚至构建AGI打开了一扇“深度推理”的大门，而RL是否是唯一且work的一扇门，先按下不表（不作为今天跟大家唠的重点），至少目前看来，随着o1/o3/r1/qwq..等一众语言推理模型的快速发展，正推动着LLMs和Agentic AI在不同领域的价值与作用，

来自主题: AI技术研报

10065 点击 2025-06-13 10:48