AI资讯新闻榜单内容搜索-claude

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: claude
Anthropic开源全套电商Agent:工程实操全盘托出

Anthropic开源全套电商Agent:工程实操全盘托出

Anthropic开源全套电商Agent:工程实操全盘托出

Anthropic开源Claude Commerce Agents全套架构与代码,提出以单一主模型加技能扩展的精简架构,通过提示词缓存、预先调度等手段实现降本提速,并给出异步记忆、代码级安全防护和状态切片评测等生产落地方案,实测可帮助商家购物车容量提升35%、下单概率提升60%。

来自主题: AI资讯
8789 点击    2026-09-06 16:30
突发!Claude黎曼猜想最大突破,已被人类数学家验证

突发!Claude黎曼猜想最大突破,已被人类数学家验证

突发!Claude黎曼猜想最大突破,已被人类数学家验证

Claude证明超67%黎曼zeta零点位于临界线上,数学家Youness Lamzouri随后用更简洁的希尔伯特空间不等式给出了优雅的重新证明,AI工具AxiomProver在数小时内于Lean中完成自动形式化验证。

来自主题: AI技术研报
8143 点击    2026-09-06 11:06
Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

我们自建的"你画我猜 Benchmark"第一期用150个词、1350张SVG画作对8款模型进行互画互猜测试,最终GPT-6 Astra以75.5分险胜Gemini 3.8 Flash与Claude Fable 5.1,结果显示思考更多或花费更多的模型并未稳定取得更高分,且部分模型连自己的画都认不出。

来自主题: AI技术研报
8770 点击    2026-09-06 11:05
海外用户爱中国模型,为何不爱大厂AI办公

海外用户爱中国模型,为何不爱大厂AI办公

海外用户爱中国模型,为何不爱大厂AI办公

腾讯WorkBuddy、阿里QwenWork等中国大厂AI办公产品出海面临获客成本高企、难以撼动Claude Code和Codex等海外成熟工具用户心智、品牌信任与数据合规门槛较高以及本地化不足等现实阻力,尽管中国AI模型凭借性价比在海外广受欢迎,国产AI办公Agent却尚未打开海外市场。

来自主题: AI资讯
8559 点击    2026-09-06 11:03
GPT-6第1天直接攻破5道Erdős难题!Fable 5.1交了白卷

GPT-6第1天直接攻破5道Erdős难题!Fable 5.1交了白卷

GPT-6第1天直接攻破5道Erdős难题!Fable 5.1交了白卷

在Epoch AI与曼彻斯特大学发布的FrontierMath Erdős基准测试中,GPT-6 Astra以3%得分率成为唯一非零分模型并解开5道Erdős难题,而GPT-5.6 Sol、GPT-5.5、Fable 5.1与Claude Fable 5均交白卷。

来自主题: AI资讯
7409 点击    2026-09-05 10:53
刚刚,Claude首次形式化证明费马大定理!清华姚班大神出手了

刚刚,Claude首次形式化证明费马大定理!清华姚班大神出手了

刚刚,Claude首次形式化证明费马大定理!清华姚班大神出手了

清华姚班出身的彭天翼带队,Anthropic旗下Claude仅用11天、消耗60亿Token和1300万行代码,首次端到端形式化证明了困扰数学界350年的费马大定理,并产出29500条可验证中间定理,成为迄今为止最大的Lean证明。

来自主题: AI资讯
7553 点击    2026-09-05 10:52
Manus团队测模型一点微小的经验

Manus团队测模型一点微小的经验

Manus团队测模型一点微小的经验

Manus团队在评测模型深度研究报告质量时,构建了"信息量"与"隐喻率"两项指标,分别通过抽取事实点和统计每百句隐喻数量来衡量信息密度与文风易读性,在覆盖9个主流模型36道题目的Research Bench测试中发现Claude Fable-5隐喻率最高、GPT旗舰模型信息密度低于Claude系列。

来自主题: AI资讯
8499 点击    2026-09-05 10:46
刚刚,Claude完成费马大定理首个完整形式化证明

刚刚,Claude完成费马大定理首个完整形式化证明

刚刚,Claude完成费马大定理首个完整形式化证明

Anthropic声称其模型Claude在11天内完成了费马大定理的完整形式化证明,写下约1300万行Lean代码,人类仅提供少量高层指导,其中30300个定理获得机器可验证证明,标志着大规模自动形式化首次接近工程化落地。

来自主题: AI资讯
8662 点击    2026-09-05 09:18
CC、Codex都没防住:13种攻击全部打穿,连权限审查都能绕过,问题竟出在SubAgent

CC、Codex都没防住:13种攻击全部打穿,连权限审查都能绕过,问题竟出在SubAgent

CC、Codex都没防住:13种攻击全部打穿,连权限审查都能绕过,问题竟出在SubAgent

研究发现SubAgent等上下文重建机制会将工具层的恶意指令提权为用户消息或系统指令,导致Claude Code、Codex、Gemini CLI、Qwen Code、Kimi和OpenCode六款AI编码框架在13类攻击上全部沦陷,连自动权限审核(Auto PR)也被绕过。

来自主题: AI技术研报
7374 点击    2026-09-04 15:51
刚刚,Anthropic公布Fable 5.1保姆级使用技巧,看完少走十天弯路

刚刚,Anthropic公布Fable 5.1保姆级使用技巧,看完少走十天弯路

刚刚,Anthropic公布Fable 5.1保姆级使用技巧,看完少走十天弯路

Anthropic发布Fable 5.1完整提示词与工程落地指南,涵盖思考档位选择、工具调用进度汇报、历史对话管理、上下文压缩、写作密度控制、检索引用规范、安全策略调优、多智能体并行及视觉任务处理等多方面的使用技巧与避坑要点。

来自主题: AI资讯
10004 点击    2026-09-04 00:02