Scaling 的不只是模型:EvoX 想做下一个入口
Scaling 的不只是模型:EvoX 想做下一个入口EvoMap团队推出自进化智能体EvoX,采用无中心调度的蜂群模式让大量Agent平级协作、自主组队,在563道逻辑、数学、物理题上将Claude Haiku 4.5的正确率从单Agent的26.29%提升至70%以上,并开源AutoResearch项目构建Agent经验基础设施。
搜索
EvoMap团队推出自进化智能体EvoX,采用无中心调度的蜂群模式让大量Agent平级协作、自主组队,在563道逻辑、数学、物理题上将Claude Haiku 4.5的正确率从单Agent的26.29%提升至70%以上,并开源AutoResearch项目构建Agent经验基础设施。
就在最近,Anthropic突然爆料了一个被自己故意「训坏」的Opus级模型!挑80个有毛病的训练环境,把模型丢进去,撤掉所有纠偏机制,然后看它长成什么样。
如果你觉得 AI agent 离帮你订机票、填报销单、投简历只有一步之遥,那 MMLU-Pro 的作者联合滑铁卢大学 TIGER Lab,UBC NAIL Group 和 UniPat AI,CMU 等机构刚刚放出的这项研究,可能会让你冷静下来。
Claude Fable 5.1发布数小时内即遭知名黑客Pliny the Liberator越狱,其在GitHub公开泄露了超27万字的完整系统提示词,曝光了模型的安全规则、记忆禁区及46个内置工具架构等核心细节。
一觉醒来,Anthropic再次改写了机器智能的坐标系。
Anthropic 发布 Claude Fable 5.1 和 Claude Mythos 5.1,Fable 5.1 多项基准测试超越上一代,缓存读取成本降低 75%,典型任务整体费用降低约 25%、高 Agent 化任务最高降低约 45%,Mythos 5.1 则面向经审核的高风险领域合作伙伴提供更宽松能力并采用更严格的访问控制。
“你如果不能在几个小时内重建 Cursor,下次面试会非常艰难——那不过是 300 行代码的一个 while 循环。”
Anthropic突发大规模账号安全事件,黑客利用Vidar、LummaC2等窃密木马盗取大批Claude用户的登录会话凭证并转卖牟利,Anthropic紧急强制注销受影响用户的账号并清空其绑定的支付方式,以阻止黑客盗刷AI算力。
GitHub热榜第一的开源项目Archify是一款可嵌入Claude Code等AI编程Agent的架构图生成工具,能将代码仓库一键转化为可搜索、可交互的HTML格式架构图,其开发者"也无风雨也雾晴"凭借该项目从专升本背景成功斩获上海大厂Offer。
OpenClaw数月内GitHub Star飙至38万成现象级爆款,但因Token消耗与安全风险被Claude Code、Codex等Harness取代而迅速降温,国内已涌现30余款衍生产品,创始人Peter Steinberger已加入OpenAI研发下一代Agent。