AI技术研报-这里有最前沿的人工智能技术解读

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
系统综述259项工作:AI创作如何从「会生成」走到「能交付」?

系统综述259项工作:AI创作如何从「会生成」走到「能交付」?

系统综述259项工作:AI创作如何从「会生成」走到「能交付」?

长文、网页、视频和代码经常停在这样的「半成品」状态:海报文案没有写错,却挤出了页面;网站首屏很漂亮,按钮点下去毫无反应;视频里的镜头单看都成立,连起来却丢了人物和节奏;程序刚修好一个模块,另一处又出现回归。

来自主题: AI技术研报
5467 点击    2026-09-08 15:29
Agent长时工作如何不跑偏?WorkSwarm用「永续会话」给出解法

Agent长时工作如何不跑偏?WorkSwarm用「永续会话」给出解法

Agent长时工作如何不跑偏?WorkSwarm用「永续会话」给出解法

让 Agent 完成一个任务并不难。它会整理材料、修改文件、检查结果,再交付答案。

来自主题: AI技术研报
5218 点击    2026-09-08 15:28
EMNLP 2026 Main|预测越像真实环境,Agent反而做得更差?我们把世界模型的训练目标从"状态一致"换成了"行为一致"

EMNLP 2026 Main|预测越像真实环境,Agent反而做得更差?我们把世界模型的训练目标从"状态一致"换成了"行为一致"

EMNLP 2026 Main|预测越像真实环境,Agent反而做得更差?我们把世界模型的训练目标从"状态一致"换成了"行为一致"

一句话概括:文本世界模型都在比 "生成文本像不像真实环境",但我们发现文本更接近真实环境的预测反而可能让智能体错得更离谱。把训练目标从 "状态一致" 换成 "行为一致" 后,16 组实验配置下世界模型的轨迹级一致性几乎全面提升,弱智能体离线评测的假阳性率从 42.5% 降到 9.5%。

来自主题: AI技术研报
5845 点击    2026-09-08 15:06
用GPT-6 Astra操控Blender玩3D,保姆级教程来了。

用GPT-6 Astra操控Blender玩3D,保姆级教程来了。

用GPT-6 Astra操控Blender玩3D,保姆级教程来了。

Blender,可能就是这次GPT-6 Astra上线后的最大受益者。

来自主题: AI技术研报
6913 点击    2026-09-08 11:52
王云鹤创业后交出首个模型

王云鹤创业后交出首个模型

王云鹤创业后交出首个模型

王云鹤创业后,首次交卷了大模型成果。

来自主题: AI技术研报
10085 点击    2026-09-08 11:51
颜水成团队重磅发布VoiceMem,提出「流式双脑架构」打造下一代实时交互基础设施

颜水成团队重磅发布VoiceMem,提出「流式双脑架构」打造下一代实时交互基础设施

颜水成团队重磅发布VoiceMem,提出「流式双脑架构」打造下一代实时交互基础设施

科幻早就预演过这一天,而这两年 AI 的真实进展,正把它推成一个可讨论的命题:AI 或许不会停在「工具」上,而会成为与人类共生的存在 ——AGI Being。

来自主题: AI技术研报
8822 点击    2026-09-08 11:03
全扩散架构、无需图文对预训练,LLaDA杀穿开源文生图

全扩散架构、无需图文对预训练,LLaDA杀穿开源文生图

全扩散架构、无需图文对预训练,LLaDA杀穿开源文生图

先学会画,再学会听话。 LLaDA-Image 在预训练和中期训练阶段直接从图片学习视觉先验,超过 90% 的累计生成训练样本采用 image-only 监督;图文对则集中用于后续语言对齐。模型权重、训练代码和完整配方同步开放。

来自主题: AI技术研报
5993 点击    2026-09-08 11:02
同等预算下,Looped Transformer更强吗?清华、字节Seed给出答案

同等预算下,Looped Transformer更强吗?清华、字节Seed给出答案

同等预算下,Looped Transformer更强吗?清华、字节Seed给出答案

在大模型的发展中,提升能力的主要手段一直是 "做大"—— 更多参数、更多数据、更多算力。如今,另一条思路开始受到关注:与其不断堆叠新的层,不如让已有的层再跑一遍。这就是 Looped Transformer。普通 Transformer 的每一层只执行一次,而 Looped Transformer 会把其中一部分层重复执行,让模型在不增加参数的情况下获得更深的计算。

来自主题: AI技术研报
6001 点击    2026-09-08 11:01
虚幻引擎CEO围观最新世界模型:代码驱动,视频模型生成画面

虚幻引擎CEO围观最新世界模型:代码驱动,视频模型生成画面

虚幻引擎CEO围观最新世界模型:代码驱动,视频模型生成画面

近年来,视频生成模型在清晰度、时序一致性和可控性上快速进步。给定文本、图像、相机轨迹或玩家动作,模型已经能够合成连贯的后续画面,也让「可交互视频世界」逐渐从概念走向可观看、可操作的原型。

来自主题: AI技术研报
6635 点击    2026-09-08 10:42
20%数据超GR00T N1.6、RoboDojo超WAM!StarVLA只用16卡训出全新VLA!

20%数据超GR00T N1.6、RoboDojo超WAM!StarVLA只用16卡训出全新VLA!

20%数据超GR00T N1.6、RoboDojo超WAM!StarVLA只用16卡训出全新VLA!

机器人 VLA 还在疯狂卷数据,StarVLA 团队这次却把目光放到了另一个问题上:除了继续 scale 数据以外,能不能让每一条数据都学得更值?

来自主题: AI技术研报
9755 点击    2026-09-07 09:53
AI开始「研究自己」:Mechanist开启机器智能机制科学

AI开始「研究自己」:Mechanist开启机器智能机制科学

AI开始「研究自己」:Mechanist开启机器智能机制科学

近期发表于 Nature Machine Intelligence 的论文 Towards principled knowledge editing methods for large language model reasoning [1],从知识编辑切入,进一步探索大模型如何使用知识进行推理以及如何通过主动干预观察模型内部变化。

来自主题: AI技术研报
10067 点击    2026-09-07 09:53
突发!Claude黎曼猜想最大突破,已被人类数学家验证

突发!Claude黎曼猜想最大突破,已被人类数学家验证

突发!Claude黎曼猜想最大突破,已被人类数学家验证

Claude证明超67%黎曼zeta零点位于临界线上,数学家Youness Lamzouri随后用更简洁的希尔伯特空间不等式给出了优雅的重新证明,AI工具AxiomProver在数小时内于Lean中完成自动形式化验证。

来自主题: AI技术研报
8416 点击    2026-09-06 11:06
Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

我们自建的"你画我猜 Benchmark"第一期用150个词、1350张SVG画作对8款模型进行互画互猜测试,最终GPT-6 Astra以75.5分险胜Gemini 3.8 Flash与Claude Fable 5.1,结果显示思考更多或花费更多的模型并未稳定取得更高分,且部分模型连自己的画都认不出。

来自主题: AI技术研报
9006 点击    2026-09-06 11:05
谷歌让AI互怼几天!小模型竟复现3道博士级难题

谷歌让AI互怼几天!小模型竟复现3道博士级难题

谷歌让AI互怼几天!小模型竟复现3道博士级难题

谷歌Antigravity团队公布Teamwork多智能体编排框架成果,轻量级Gemini 3.7 Flash复现了Gemini 3.1 Pro解出的3道博士级数学难题,并从零构建RISC-V CPU模拟器、改进Eigen和ParlayHash开源库代码,证明小模型通过制度化博弈编排也能完成顶尖科研与工程任务。

来自主题: AI技术研报
5551 点击    2026-09-06 11:04
北航团队让AI开始“造地球”:一句话生成无界三维世界

北航团队让AI开始“造地球”:一句话生成无界三维世界

北航团队让AI开始“造地球”:一句话生成无界三维世界

北京航空航天大学史振威与邹征夏教授团队开发了面向广域地球观测的生成式基础模型MetaEarth3D,只需给定文字或卫星图即可生成无界连续一致的三维世界场景,并自带空间标注使空天AI模型空间理解能力平均提升22.85%。

来自主题: AI技术研报
7691 点击    2026-09-06 11:03
角色离场再回来,AI就换了个人?浙大、港大开源轻量化记忆路由器

角色离场再回来,AI就换了个人?浙大、港大开源轻量化记忆路由器

角色离场再回来,AI就换了个人?浙大、港大开源轻量化记忆路由器

浙大与港大团队开源轻量化记忆路由器LayerRecall,通过选择性检索历史记忆并仅注入对长程信息敏感的特定DiT层,解决长视频生成中角色离场再返回时身份与属性丢失的问题,在MemoBench和MovieBench评测中取得Overall第一,且约6.6MB的路由权重可零再训练迁移至其他视频生成骨干。

来自主题: AI技术研报
7791 点击    2026-09-06 11:02
TikTok SRE 技术负责人:AI Agents 说到底就是分布式系统

TikTok SRE 技术负责人:AI Agents 说到底就是分布式系统

TikTok SRE 技术负责人:AI Agents 说到底就是分布式系统

TikTok SRE 技术负责人 Salman Munaf 在演讲中指出,AI Agent 一旦调用外部服务就演化为分布式系统,开发者必须引入请求标识符、幂等键、状态查询、熔断器、范围权限与可观测性等工具,并将记忆视作缓存、审批绑定具体参数,才能避免重试风暴和不可逆事故。

来自主题: AI技术研报
8233 点击    2026-09-06 11:02
一文读ASI、AGI、RSI与Agentic AI,AI进化的四条曲线

一文读ASI、AGI、RSI与Agentic AI,AI进化的四条曲线

一文读ASI、AGI、RSI与Agentic AI,AI进化的四条曲线

文章系统拆解了ASI、AGI、RSI与Agentic AI四个核心AI概念,指出AI进化并非从ANI到ASI的单一直线,而是智能、行动、自我进化与组织协作四条曲线同时推进,行业真正的分水岭在于这四条曲线的交汇时刻。

来自主题: AI技术研报
5519 点击    2026-09-05 10:46
Meta全开源HumanCLAW:基础模型正进入具身智能的决策层

Meta全开源HumanCLAW:基础模型正进入具身智能的决策层

Meta全开源HumanCLAW:基础模型正进入具身智能的决策层

Meta联合南洋理工大学等多所高校全开源HumanCLAW基准,将高层行动决策与低层运动控制分离以单独测量视觉语言模型的行动智能,九个前沿模型完整交互成功率仅16.8%,揭示出当前基础模型缺乏持续维护自身身体状态估计的具身自我感知缺口。

来自主题: AI技术研报
8635 点击    2026-09-05 10:45
给大模型「投机解码」松绑:免训练,即插即用近似验证,速度再提15%

给大模型「投机解码」松绑:免训练,即插即用近似验证,速度再提15%

给大模型「投机解码」松绑:免训练,即插即用近似验证,速度再提15%

北航、清华、港大、北大联合团队提出近似投机解码(ASD),作为即插即用的验证器模块,在严格预算内接受极少数低遗憾分歧字并复用大模型已算好的后缀,免训练地挂载于DSpark、EAGLE3、Medusa等主流投机解码算法,吞吐最高提升15.26%。

来自主题: AI技术研报
7571 点击    2026-09-05 10:34
ECCV 2026|突破伪目标天花板:ART重新定义高保真妆容迁移

ECCV 2026|突破伪目标天花板:ART重新定义高保真妆容迁移

ECCV 2026|突破伪目标天花板:ART重新定义高保真妆容迁移

ECCV 2026论文ART由vivo BlueImage Lab联合哈工大与南大提出,通过将真实参考图作为可微分监督信号的两阶段训练框架,突破了复杂妆容迁移中的伪目标天花板,同步发布了首个2K分辨率妆容数据集MF2K。

来自主题: AI技术研报
8193 点击    2026-09-05 10:33
CC、Codex都没防住:13种攻击全部打穿,连权限审查都能绕过,问题竟出在SubAgent

CC、Codex都没防住:13种攻击全部打穿,连权限审查都能绕过,问题竟出在SubAgent

CC、Codex都没防住:13种攻击全部打穿,连权限审查都能绕过,问题竟出在SubAgent

研究发现SubAgent等上下文重建机制会将工具层的恶意指令提权为用户消息或系统指令,导致Claude Code、Codex、Gemini CLI、Qwen Code、Kimi和OpenCode六款AI编码框架在13类攻击上全部沦陷,连自动权限审核(Auto PR)也被绕过。

来自主题: AI技术研报
7474 点击    2026-09-04 15:51
ScienceDiscovery实现树搜索驱动RSI,加速科学发现,小时级写出通用积分器,低成本找出物理科学规律

ScienceDiscovery实现树搜索驱动RSI,加速科学发现,小时级写出通用积分器,低成本找出物理科学规律

ScienceDiscovery实现树搜索驱动RSI,加速科学发现,小时级写出通用积分器,低成本找出物理科学规律

openJiuwen社区的ScienceDiscovery通过树搜索驱动科研产物RSI,无需训练模型,在积分求解、代码加速和符号回归任务中分别以小时级产出通用积分器、实现平均2.279倍加速,并以低成本在111道方程反推题中正确找出41.4%。

来自主题: AI技术研报
7000 点击    2026-09-04 15:49
从像素空间走向数据流形:生成模型的对抗净化新范式 | TPAMI'26

从像素空间走向数据流形:生成模型的对抗净化新范式 | TPAMI'26

从像素空间走向数据流形:生成模型的对抗净化新范式 | TPAMI'26

CMAP团队发表于TPAMI 2026的工作提出基于一致性模型的对抗净化方法,将传统像素空间去噪转化为隐空间流形优化,使对抗样本映射回干净数据流形,在多种攻击类型与自适应攻击条件下均有效提升深度神经网络的鲁棒性。

来自主题: AI技术研报
7957 点击    2026-09-04 15:48
T-RO综述重构Foundation Model时代机器人操作知识版图

T-RO综述重构Foundation Model时代机器人操作知识版图

T-RO综述重构Foundation Model时代机器人操作知识版图

过去几年,机器人操作领域几乎被一批新概念重新 “刷屏”。 LLM Planner、VLA、Diffusion Policy、Flow Matching、Latent Action、World Mode

来自主题: AI技术研报
8132 点击    2026-09-04 15:48