AI资讯新闻榜单内容搜索-研究

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 研究
政策研究|工信部:“培育AI服务商”的政策机遇

政策研究|工信部:“培育AI服务商”的政策机遇

政策研究|工信部:“培育AI服务商”的政策机遇

工信部印发《关于开展人工智能应用服务商培育专项行动的通知》,明确到2027年底建成不少于3000家服务商的全国资源池,并通过资源池认证、应用服务团组建、"小快轻准"产品开发、采购与出海支持等举措,为民营企业提供明确政策机遇。

来自主题: AI监管政策
7278 点击    2026-09-05 10:50
Manus团队测模型一点微小的经验

Manus团队测模型一点微小的经验

Manus团队测模型一点微小的经验

Manus团队在评测模型深度研究报告质量时,构建了"信息量"与"隐喻率"两项指标,分别通过抽取事实点和统计每百句隐喻数量来衡量信息密度与文风易读性,在覆盖9个主流模型36道题目的Research Bench测试中发现Claude Fable-5隐喻率最高、GPT旗舰模型信息密度低于Claude系列。

来自主题: AI资讯
8424 点击    2026-09-05 10:46
GPT-6突破「素数间隔」纪录!这次是加入OpenAI的北大数院07级校友

GPT-6突破「素数间隔」纪录!这次是加入OpenAI的北大数院07级校友

GPT-6突破「素数间隔」纪录!这次是加入OpenAI的北大数院07级校友

OpenAI 的 GPT-6 Astra 在有界素数间隔问题上将上界从 246 推进至 186,并完成 Lean 形式化验证,显示 AI 正从数学解题工具走向研究伙伴。

来自主题: AI资讯
8950 点击    2026-09-04 15:53
CC、Codex都没防住:13种攻击全部打穿,连权限审查都能绕过,问题竟出在SubAgent

CC、Codex都没防住:13种攻击全部打穿,连权限审查都能绕过,问题竟出在SubAgent

CC、Codex都没防住:13种攻击全部打穿,连权限审查都能绕过,问题竟出在SubAgent

研究发现SubAgent等上下文重建机制会将工具层的恶意指令提权为用户消息或系统指令,导致Claude Code、Codex、Gemini CLI、Qwen Code、Kimi和OpenCode六款AI编码框架在13类攻击上全部沦陷,连自动权限审核(Auto PR)也被绕过。

来自主题: AI技术研报
7343 点击    2026-09-04 15:51
苹果新作:内化视觉思考,推理提速 5 倍

苹果新作:内化视觉思考,推理提速 5 倍

苹果新作:内化视觉思考,推理提速 5 倍

苹果研究团队提出 Internalized Visual Thinking(IVT)后训练框架,通过在训练阶段联合学习文本答案与未来帧隐空间表征、在推理阶段完全移除未来视觉预测过程,使模型在主动视频推理任务上相比 Visual CoT 获得超过 5 倍的推理加速,且在六项评测设置中均优于 Answer-Only SFT。

来自主题: AI技术研报
7566 点击    2026-09-04 10:36
微软×UIUC:给每个学生造一个「数字分身」,AI教师终于有了陪练

微软×UIUC:给每个学生造一个「数字分身」,AI教师终于有了陪练

微软×UIUC:给每个学生造一个「数字分身」,AI教师终于有了陪练

微软与UIUC合作研究StudentSim框架,基于真实学生数据训练个性化学生模拟器,具备behavioral fidelity和guidance responsiveness两项能力,在国际象棋等三个领域验证其优于现有基线,并可作为AI教师强化学习的高通量奖励信号。

来自主题: AI技术研报
8052 点击    2026-09-04 10:35
独家 | 前腾讯AI Lab高级研究员吴秉哲创业项目Knevo内测,锚定AI决策

独家 | 前腾讯AI Lab高级研究员吴秉哲创业项目Knevo内测,锚定AI决策

独家 | 前腾讯AI Lab高级研究员吴秉哲创业项目Knevo内测,锚定AI决策

前腾讯AI Lab可信AI负责人吴秉哲的创业项目Knevo(思演智能助手)目前处于内测阶段,聚焦金融方向的AI决策,整合流式推理、工具调用、长期记忆与断线恢复等模块,并提出"千人千面+自净化"的Agent建设逻辑。

来自主题: AI资讯
7987 点击    2026-09-02 15:12
33%!Claude、GPT、Gemini 在真实网站上集体翻车,ClawBench 把 AI agent 打回原形

33%!Claude、GPT、Gemini 在真实网站上集体翻车,ClawBench 把 AI agent 打回原形

33%!Claude、GPT、Gemini 在真实网站上集体翻车,ClawBench 把 AI agent 打回原形

如果你觉得 AI agent 离帮你订机票、填报销单、投简历只有一步之遥,那 MMLU-Pro 的作者联合滑铁卢大学 TIGER Lab,UBC NAIL Group 和 UniPat AI,CMU 等机构刚刚放出的这项研究,可能会让你冷静下来。

来自主题: AI技术研报
8105 点击    2026-09-02 14:33
AI能挖漏洞吗?北航等机构把真实漏洞炼进了模型参数

AI能挖漏洞吗?北航等机构把真实漏洞炼进了模型参数

AI能挖漏洞吗?北航等机构把真实漏洞炼进了模型参数

给一个大模型漏洞描述和代码仓库,它能否像安全研究人员一样,读代码、找入口、调用工具、构造输入,并反复验证自己的判断?

来自主题: AI技术研报
8998 点击    2026-09-02 09:27
少数Full Attention层如何重塑内部计算?混合线性注意力大模型中的「尖峰」与「平台」之谜首次揭开

少数Full Attention层如何重塑内部计算?混合线性注意力大模型中的「尖峰」与「平台」之谜首次揭开

少数Full Attention层如何重塑内部计算?混合线性注意力大模型中的「尖峰」与「平台」之谜首次揭开

Full Attention 层尚未开始计算,它前一层的激活值已提前「冲上峰值」—— 这就像演唱会主角尚未登台,观众席已提前沸腾。来自 StartLux、清华大学等机构的研究者以 Massive Activations 为探针,首次系统刻画了少数 Full Attention 层在混合线性注意力大模型中留下的「跨层痕迹」,并识别出「注意力前尖峰」(PAS)与「尖峰间平台」(ISP)两种核心形态。

来自主题: AI技术研报
7888 点击    2026-09-01 14:21