AI资讯新闻榜单内容搜索-框架

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 框架
Claude Opus 5震撼发布!半价超越Fable 5,内部觉醒「自我保护」意识

Claude Opus 5震撼发布!半价超越Fable 5,内部觉醒「自我保护」意识

Claude Opus 5震撼发布!半价超越Fable 5,内部觉醒「自我保护」意识

就在刚刚,Anthropic正式发布了Opus 5。这款定位是「深思熟虑且积极主动」的模型,不仅成本只要Fable 5的一半,而且在大多数跑分上直接碾压。在最近的IMO 2026中,它不靠任何外部工具和Agent框架,就拿下了42/42的满分!

来自主题: AI资讯
8938 点击    2026-07-25 11:03
一个Skill为什么越改越好?腾讯SkillHone让Agent记住每次优化决策

一个Skill为什么越改越好?腾讯SkillHone让Agent记住每次优化决策

一个Skill为什么越改越好?腾讯SkillHone让Agent记住每次优化决策

腾讯微信在论文 SkillHone 中,将这个问题归结为优化历史丢失,进而提出了面向持续 Skill 进化的开发框架。 SkillHone 把每轮诊断、候选修改、评估证据和最终决定组织成持久决策历史。同时,持续优化的对象也从单一的 SKILL.md 文件扩展到了整个 Skill 文件夹及其修改过程。

来自主题: AI技术研报
8256 点击    2026-07-24 15:56
让Agent学会「如何演化」:清华、华为提出层次化技能元演化框架HiSME

让Agent学会「如何演化」:清华、华为提出层次化技能元演化框架HiSME

让Agent学会「如何演化」:清华、华为提出层次化技能元演化框架HiSME

当大模型 Agent 被部署到工具调用、长程任务和开放环境中,一个关键问题会随之出现:能否在不更新模型参数的情况下,将执行经验沉淀下来,并在下一次做得更好?

来自主题: AI技术研报
5644 点击    2026-07-24 10:45
99分=0分!用《孙子兵法》《隆中对》做物理 AI,吴甘沙十年拿下全球机场 91% 份额

99分=0分!用《孙子兵法》《隆中对》做物理 AI,吴甘沙十年拿下全球机场 91% 份额

99分=0分!用《孙子兵法》《隆中对》做物理 AI,吴甘沙十年拿下全球机场 91% 份额

7 月 17 日,北京,2026 奇点智能产品大会主会场。吴甘沙站在台上,用一个极其东方的思维框架,拆解了一家物理 AI 公司如何在巨头环伺中活过十年——他把《孙子兵法》的“不败”与“不战”,和诸葛亮《隆中对》的“益州”“荆州”格局,嵌入了一套完整的创业竞争策略。

来自主题: AI资讯
8104 点击    2026-07-24 10:13
视觉推理「囫囵吞枣」靠不住!ProLaViT教会多模态大模型在隐空间里「步步为营」

视觉推理「囫囵吞枣」靠不住!ProLaViT教会多模态大模型在隐空间里「步步为营」

视觉推理「囫囵吞枣」靠不住!ProLaViT教会多模态大模型在隐空间里「步步为营」

针对这一挑战,腾讯内容服务部 BAC 提出了一个名为 ProLaViT(Progressive Latent Visual Thought) 的全新框架。它的核心思想是:别急着下结论,先在连续隐空间里像人一样「步步推导」。 即让模型遵循 「定位 → 聚焦 → 分离」(Locate → Focus → Isolate) 的因果链,逐步收紧视觉注意力,最终精准锁定目标。

来自主题: AI技术研报
8470 点击    2026-07-21 16:55
现在还不会给Agent选装记忆?清华上交大横评12个主流记忆框架,省掉你3个月的试错

现在还不会给Agent选装记忆?清华上交大横评12个主流记忆框架,省掉你3个月的试错

现在还不会给Agent选装记忆?清华上交大横评12个主流记忆框架,省掉你3个月的试错

市面上已有几十种Agent记忆方案,有的基于向量检索,有的基于知识图谱,有的靠定期总结“压缩”对话,有的则完全依赖模型自身的上下文窗口。它们各有各的说法,但在系统层面,到底哪种方案靠得住?哪种方案在你的工作负载下既不贵又准?

来自主题: AI技术研报
8389 点击    2026-07-20 10:42
ARC-AGI-3近被完美攻破,这个Harness能让AI掌握物理学家思维

ARC-AGI-3近被完美攻破,这个Harness能让AI掌握物理学家思维

ARC-AGI-3近被完美攻破,这个Harness能让AI掌握物理学家思维

7 月 16 日,伯克利博士后 Haven Feng 的一条推文火了。原因无他,结果很震撼:在 ARC-AGI-3 Public 集上,一套名为 [schema] 的智能体框架,与 Claude Opus 4.8、Fable 5 组合后达到 98.98% 的 RHAE;换成 GPT-5.6 Sol 组合,分数也有 95.35%。

来自主题: AI技术研报
9580 点击    2026-07-18 14:22
马斯克连夜开源Grok Build,但84万行代码里还留着上传用户整个代码库的痕迹

马斯克连夜开源Grok Build,但84万行代码里还留着上传用户整个代码库的痕迹

马斯克连夜开源Grok Build,但84万行代码里还留着上传用户整个代码库的痕迹

随后,SpaceXAI 兑现了承诺,在 GitHub 上正式开源了这套智能体编程框架。该公司在一篇 X 帖子中表示:“开源 Grok Build 可以让任何人都能参与构建可靠且强大的框架。”开源不到 20 个小时,Grok Build 已在 GitHub 上收获 1.21 万颗 Star。

来自主题: AI资讯
9268 点击    2026-07-17 14:59
世界模型迎来「真考场」:WorldArena 2.0 Challenge正式启动

世界模型迎来「真考场」:WorldArena 2.0 Challenge正式启动

世界模型迎来「真考场」:WorldArena 2.0 Challenge正式启动

WorldArena 1.0 的核心意义,在于将世界模型评测从 “好不好看” 推进到 “是否真的有用”。它不再只关注视频观感,而是把物理一致性、可控性、3D 准确性和具身任务功能性纳入统一评测框架,使许多看似流畅的生成结果第一次在机器人具身任务中接受检验。

来自主题: AI技术研报
9121 点击    2026-07-16 10:10