AI技术研报-这里有最前沿的人工智能技术解读

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
CC、Codex都没防住:13种攻击全部打穿,连权限审查都能绕过,问题竟出在SubAgent

CC、Codex都没防住:13种攻击全部打穿,连权限审查都能绕过,问题竟出在SubAgent

CC、Codex都没防住:13种攻击全部打穿,连权限审查都能绕过,问题竟出在SubAgent

研究发现SubAgent等上下文重建机制会将工具层的恶意指令提权为用户消息或系统指令,导致Claude Code、Codex、Gemini CLI、Qwen Code、Kimi和OpenCode六款AI编码框架在13类攻击上全部沦陷,连自动权限审核(Auto PR)也被绕过。

来自主题: AI技术研报
7198 点击    2026-09-04 15:51
ScienceDiscovery实现树搜索驱动RSI,加速科学发现,小时级写出通用积分器,低成本找出物理科学规律

ScienceDiscovery实现树搜索驱动RSI,加速科学发现,小时级写出通用积分器,低成本找出物理科学规律

ScienceDiscovery实现树搜索驱动RSI,加速科学发现,小时级写出通用积分器,低成本找出物理科学规律

openJiuwen社区的ScienceDiscovery通过树搜索驱动科研产物RSI,无需训练模型,在积分求解、代码加速和符号回归任务中分别以小时级产出通用积分器、实现平均2.279倍加速,并以低成本在111道方程反推题中正确找出41.4%。

来自主题: AI技术研报
6766 点击    2026-09-04 15:49
从像素空间走向数据流形:生成模型的对抗净化新范式 | TPAMI'26

从像素空间走向数据流形:生成模型的对抗净化新范式 | TPAMI'26

从像素空间走向数据流形:生成模型的对抗净化新范式 | TPAMI'26

CMAP团队发表于TPAMI 2026的工作提出基于一致性模型的对抗净化方法,将传统像素空间去噪转化为隐空间流形优化,使对抗样本映射回干净数据流形,在多种攻击类型与自适应攻击条件下均有效提升深度神经网络的鲁棒性。

来自主题: AI技术研报
7749 点击    2026-09-04 15:48
T-RO综述重构Foundation Model时代机器人操作知识版图

T-RO综述重构Foundation Model时代机器人操作知识版图

T-RO综述重构Foundation Model时代机器人操作知识版图

过去几年,机器人操作领域几乎被一批新概念重新 “刷屏”。 LLM Planner、VLA、Diffusion Policy、Flow Matching、Latent Action、World Mode

来自主题: AI技术研报
7913 点击    2026-09-04 15:48
英伟达官方推理指南来了!6倍无损加速,最优解全是华人写的

英伟达官方推理指南来了!6倍无损加速,最优解全是华人写的

英伟达官方推理指南来了!6倍无损加速,最优解全是华人写的

最近,英伟达发了篇官方的大模型推理指南,结果翻着翻着,硬是让人看成了一本华人团队的论文合集。

来自主题: AI技术研报
8997 点击    2026-09-04 11:07
蚂蚁VLDB最佳论文:用一张“逻辑表”驯服3050亿条训练数据

蚂蚁VLDB最佳论文:用一张“逻辑表”驯服3050亿条训练数据

蚂蚁VLDB最佳论文:用一张“逻辑表”驯服3050亿条训练数据

训练一个大模型之前,语料需要经过解析、清洗、去重、质量评分、Token化和样本组装。

来自主题: AI技术研报
5797 点击    2026-09-04 10:45
苹果新作:内化视觉思考,推理提速 5 倍

苹果新作:内化视觉思考,推理提速 5 倍

苹果新作:内化视觉思考,推理提速 5 倍

苹果研究团队提出 Internalized Visual Thinking(IVT)后训练框架,通过在训练阶段联合学习文本答案与未来帧隐空间表征、在推理阶段完全移除未来视觉预测过程,使模型在主动视频推理任务上相比 Visual CoT 获得超过 5 倍的推理加速,且在六项评测设置中均优于 Answer-Only SFT。

来自主题: AI技术研报
7504 点击    2026-09-04 10:36
微软×UIUC:给每个学生造一个「数字分身」,AI教师终于有了陪练

微软×UIUC:给每个学生造一个「数字分身」,AI教师终于有了陪练

微软×UIUC:给每个学生造一个「数字分身」,AI教师终于有了陪练

微软与UIUC合作研究StudentSim框架,基于真实学生数据训练个性化学生模拟器,具备behavioral fidelity和guidance responsiveness两项能力,在国际象棋等三个领域验证其优于现有基线,并可作为AI教师强化学习的高通量奖励信号。

来自主题: AI技术研报
7981 点击    2026-09-04 10:35
黎曼猜想推至理论边界99.55%!元代理架构AI:在思考中重塑大脑

黎曼猜想推至理论边界99.55%!元代理架构AI:在思考中重塑大脑

黎曼猜想推至理论边界99.55%!元代理架构AI:在思考中重塑大脑

当我们惊叹于大语言模型能写诗、会编程时,科学家们正面临一个更棘手的问题:如何让AI像真正的科研工作者一样,去解决那些需要数月甚至数年持续思考、且充满未知的科学难题?

来自主题: AI技术研报
6443 点击    2026-09-04 10:27
全球首个通用决策大模型,AI推演现实世界的技术揭秘

全球首个通用决策大模型,AI推演现实世界的技术揭秘

全球首个通用决策大模型,AI推演现实世界的技术揭秘

生成答案正在成为 AI 的基础能力,而推演现实世界,才是下一阶段更难的命题。

来自主题: AI技术研报
8880 点击    2026-09-03 14:52
答对了却没看图?EASE给多模态RLVR装上「视线校正器」

答对了却没看图?EASE给多模态RLVR装上「视线校正器」

答对了却没看图?EASE给多模态RLVR装上「视线校正器」

强化学习与可验证奖励(RLVR)已成为提升视觉语言模型(VLM)推理能力的标配手段。但一个隐蔽的问题始终存在:最终答案的奖励信号,只告诉模型「答对了没有」,却从不告诉它「答案应该从图像的哪个区域得出」。答对,可能是因为真的看懂了图,也可能只是语言先验的捷径、数据集的偏差,甚至是一次幸运的瞎猜。

来自主题: AI技术研报
6733 点击    2026-09-03 14:17
RSI离我们有多远?这家中国团队给出了第一梯队的工程解

RSI离我们有多远?这家中国团队给出了第一梯队的工程解

RSI离我们有多远?这家中国团队给出了第一梯队的工程解

Agent 经常遇到这样一种幻觉:你给模型接入了终端,下发了一个复杂的 debug 任务,看着它顺藤摸瓜排查了几个小时,最终完美修复了依赖冲突,甚至连测试用例都帮你补齐了。

来自主题: AI技术研报
8859 点击    2026-09-03 14:17
0.25秒识破未见攻击,这套检测方法没看过任何越狱样本 | EMNLP'26

0.25秒识破未见攻击,这套检测方法没看过任何越狱样本 | EMNLP'26

0.25秒识破未见攻击,这套检测方法没看过任何越狱样本 | EMNLP'26

大视觉语言模型(LVLM)把语言理解扩展到了图像等多模态输入,同时,也带来了更隐蔽的攻击面。

来自主题: AI技术研报
5483 点击    2026-09-03 09:50
33%!Claude、GPT、Gemini 在真实网站上集体翻车,ClawBench 把 AI agent 打回原形

33%!Claude、GPT、Gemini 在真实网站上集体翻车,ClawBench 把 AI agent 打回原形

33%!Claude、GPT、Gemini 在真实网站上集体翻车,ClawBench 把 AI agent 打回原形

如果你觉得 AI agent 离帮你订机票、填报销单、投简历只有一步之遥,那 MMLU-Pro 的作者联合滑铁卢大学 TIGER Lab,UBC NAIL Group 和 UniPat AI,CMU 等机构刚刚放出的这项研究,可能会让你冷静下来。

来自主题: AI技术研报
8067 点击    2026-09-02 14:33
UniSteer用机械臂「拼豆」:让人类指导进入VLA噪声空间强化学习

UniSteer用机械臂「拼豆」:让人类指导进入VLA噪声空间强化学习

UniSteer用机械臂「拼豆」:让人类指导进入VLA噪声空间强化学习

视觉 - 语言 - 动作模型(Vision-Language-Action Model,VLA)正在成为机器人操作的重要基础模型。经过少量示范微调后,VLA 已经能够完成抓取、放置、堆叠等多种任务。然而,一旦任务涉及精密接触、狭小容差或分布外位置,模型的成功率仍会明显下降。

来自主题: AI技术研报
8806 点击    2026-09-02 14:32
李飞飞发布:全球首个多模态世界模型

李飞飞发布:全球首个多模态世界模型

李飞飞发布:全球首个多模态世界模型

「全球首个」多模态世界模型,来了!

来自主题: AI技术研报
7276 点击    2026-09-02 10:07
AI到底能不能自己造AI?别吵了,有人做出来了

AI到底能不能自己造AI?别吵了,有人做出来了

AI到底能不能自己造AI?别吵了,有人做出来了

RSI,可能是 AI 世界里最像科幻的一个词。

来自主题: AI技术研报
6553 点击    2026-09-02 09:28
AI能挖漏洞吗?北航等机构把真实漏洞炼进了模型参数

AI能挖漏洞吗?北航等机构把真实漏洞炼进了模型参数

AI能挖漏洞吗?北航等机构把真实漏洞炼进了模型参数

给一个大模型漏洞描述和代码仓库,它能否像安全研究人员一样,读代码、找入口、调用工具、构造输入,并反复验证自己的判断?

来自主题: AI技术研报
8956 点击    2026-09-02 09:27
DeepSeek V4 多模态开源,我们把它的视觉链路拆了一遍

DeepSeek V4 多模态开源,我们把它的视觉链路拆了一遍

DeepSeek V4 多模态开源,我们把它的视觉链路拆了一遍

图片不只被编码,还直接参与 Attention、MoE 与 Agent 推理。

来自主题: AI技术研报
9798 点击    2026-09-02 09:27
AIVC只是前菜!复旦提出生命算子,统一生命建模

AIVC只是前菜!复旦提出生命算子,统一生命建模

AIVC只是前菜!复旦提出生命算子,统一生命建模

虚拟细胞,已经成为AI与生物交叉领域最火热的方向之一。

来自主题: AI技术研报
10120 点击    2026-09-01 14:43
当AI从工具到认知主体,我们需要警惕哪些新风险?

当AI从工具到认知主体,我们需要警惕哪些新风险?

当AI从工具到认知主体,我们需要警惕哪些新风险?

导读:随着智能体系统(Agentic AI System)处理任务能力的持续提升,AI 正在逐渐从传统意义上的工具,演变为能够自主决策、独立执行任务,并与人类及社会群体进行持续交互的智能主体。但是一个越来越值得关注的问题是:当 AI 的认知能力不断扩展,其潜在风险不再局限于单一任务中的幻觉、偏见或决策错误,而是进一步影响人类用户的能动性、自主性,乃至人类对 AI 系统的控制权。

来自主题: AI技术研报
10123 点击    2026-09-01 14:21
少数Full Attention层如何重塑内部计算?混合线性注意力大模型中的「尖峰」与「平台」之谜首次揭开

少数Full Attention层如何重塑内部计算?混合线性注意力大模型中的「尖峰」与「平台」之谜首次揭开

少数Full Attention层如何重塑内部计算?混合线性注意力大模型中的「尖峰」与「平台」之谜首次揭开

Full Attention 层尚未开始计算,它前一层的激活值已提前「冲上峰值」—— 这就像演唱会主角尚未登台,观众席已提前沸腾。来自 StartLux、清华大学等机构的研究者以 Massive Activations 为探针,首次系统刻画了少数 Full Attention 层在混合线性注意力大模型中留下的「跨层痕迹」,并识别出「注意力前尖峰」(PAS)与「尖峰间平台」(ISP)两种核心形态。

来自主题: AI技术研报
7822 点击    2026-09-01 14:21