AI资讯新闻榜单内容搜索-研究

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 研究
Hinton 联合 20 多位 AI 大牛警告:「智能爆炸」时代要来了

Hinton 联合 20 多位 AI 大牛警告:「智能爆炸」时代要来了

Hinton 联合 20 多位 AI 大牛警告:「智能爆炸」时代要来了

Geoffrey Hinton联合Yoshua Bengio、OpenAI首席科学家Jakub Pachocki、Anthropic联合创始人Jack Clark等20多位AI研究者发布剑桥CASP报告,指出AI已深度参与自身研发,Anthropic内部AI生成代码占比已超80%,警告递归自我改进可能引发技术进步突然加速的「智能爆炸」。

来自主题: AI资讯
8422 点击    2026-10-04 22:07
万分之一——大模型后训练中的极端稀疏监督

万分之一——大模型后训练中的极端稀疏监督

万分之一——大模型后训练中的极端稀疏监督

亚马逊公司与杜克大学的研究表明,在大模型后训练的在线策略蒸馏(OPD)中,仅保留万分之一的极端稀疏监督信号即可显著提升学生模型的推理能力,且性能可匹配甚至超越密集全信号训练。

来自主题: AI技术研报
7868 点击    2026-10-04 22:03
Agent Harness到底怎么选?南洋理工大学安波团队最新研究给出答案

Agent Harness到底怎么选?南洋理工大学安波团队最新研究给出答案

Agent Harness到底怎么选?南洋理工大学安波团队最新研究给出答案

南洋理工大学安波团队最新研究指出,Agent Harness的选型应将模型、Harness与任务作为完整配置联合评估,不同任务下最佳组合会变化,原生搭配也未必优于其他可配置Harness。

来自主题: AI技术研报
8145 点击    2026-10-04 22:01
刚刚,AI 击穿了「视频图灵测试」,1700 万网友在线围观

刚刚,AI 击穿了「视频图灵测试」,1700 万网友在线围观

刚刚,AI 击穿了「视频图灵测试」,1700 万网友在线围观

最近,AI 研究团队 Tavus 发布实时视频交互模型 Griffin,并公布了一项实验结果。在与其研究预览版 Griffin-Lite 进行一分钟视频通话后,54 名参与者中有 26 人认为,屏幕另一端坐着一个真人,占比约为 48%。

来自主题: AI资讯
9056 点击    2026-10-03 10:33
投资人开始堵姚顺宇

投资人开始堵姚顺宇

投资人开始堵姚顺宇

“身边VC在打听姚顺宇创业。” 这位天才少年已为创投圈所熟知:清华物理系传奇、斯坦福物理学博士、顶尖AI研究员,并且才29岁。2025年9月,姚顺宇从Anthropic霸气离职,后加入Google D

来自主题: AI资讯
8669 点击    2026-10-02 21:58
奥特曼开掉3人,OpenAI又出大事了!

奥特曼开掉3人,OpenAI又出大事了!

奥特曼开掉3人,OpenAI又出大事了!

OpenAI三员大将,同一天被扫地出门!就在刚刚,外媒爆出猛料,OpenAI以「泄密」为由,开掉了安全团队的三名研究员。他们全是那篇CoT监控论文的作者,其中两位还是一作。

来自主题: AI资讯
8247 点击    2026-10-02 12:53
丘成桐新论文致谢了GPT和Claude

丘成桐新论文致谢了GPT和Claude

丘成桐新论文致谢了GPT和Claude

克雷西 发自 凹非寺 量子位 | 公众号 QbitAI 「AI不可能对最尖端的数学家有任何影响」……吗? 说出这句话的丘成桐,现在已经用上AI辅助研究了。 而且解决的问题,还是44年前他亲自列入自己的

来自主题: AI资讯
8659 点击    2026-10-02 12:52
AI搜索的下一站:可信度三层过滤机制,从点击监督到答案级反馈

AI搜索的下一站:可信度三层过滤机制,从点击监督到答案级反馈

AI搜索的下一站:可信度三层过滤机制,从点击监督到答案级反馈

百度联合中国科学院计算技术研究所与武汉大学的研究者围绕这一现状,提出答案支撑、内容可信与上下文组织三阶段框架,并结合百度搜索工业实践,梳理了从检索排序、可信度判断、结构化上下文组织到生成后反馈的优化链路。

来自主题: AI技术研报
10263 点击    2026-10-02 12:48
刚刚,320B中国开源黑马杀出!模型自己抓Bug,凶手是一个空格

刚刚,320B中国开源黑马杀出!模型自己抓Bug,凶手是一个空格

刚刚,320B中国开源黑马杀出!模型自己抓Bug,凶手是一个空格

至知创新研究院开源320B大模型IQuest-Q1,该模型在代码生成、安全漏洞挖掘等评测中表现优异,并能自主排查训练Bug,在交通调度、仓库管理、电梯调度等真实场景中展现出强大的任务解决能力。

来自主题: AI资讯
8677 点击    2026-09-30 15:42
给AI装上记忆,它就真的记对了吗?HaluMem拆解智能体记忆幻觉

给AI装上记忆,它就真的记对了吗?HaluMem拆解智能体记忆幻觉

给AI装上记忆,它就真的记对了吗?HaluMem拆解智能体记忆幻觉

中国电信研究院与MemTensor等机构提出首个面向智能体记忆系统的操作级幻觉评测基准HaluMem,已被EMNLP 2026主会接收,该基准分别对记忆提取、更新和问答三个环节进行检查,并对Mem0、MemOS等六套系统实测,发现高召回率可能伴随虚假信息写入、低更新幻觉率背后存在大量遗漏、上游记忆问题最终会影响回答等核心现象。

来自主题: AI技术研报
9937 点击    2026-09-30 15:39