PhyAgentOS v1.0.0 正式发布,开启物理智能递归自进化时代 | GAIR Paper 128
PhyAgentOS v1.0.0 正式发布,开启物理智能递归自进化时代 | GAIR Paper 128模型竞争的下一站,是让智能体在真实世界里可执行、可验证、可进化。
搜索
模型竞争的下一站,是让智能体在真实世界里可执行、可验证、可进化。
如果你觉得 AI agent 离帮你订机票、填报销单、投简历只有一步之遥,那 MMLU-Pro 的作者联合滑铁卢大学 TIGER Lab,UBC NAIL Group 和 UniPat AI,CMU 等机构刚刚放出的这项研究,可能会让你冷静下来。
大模型越来越强之后,企业究竟愿意为什么样的AI付钱?
Hermes Agent发布代号"万神殿"的新版本,重点优化Bot Mode并支持多Agent以独立身份加入群聊协作、@单独召唤及任务中断,还为Cron定时任务新增持久记忆并补强了安全机制。
Manus正式恢复独立运营,由肖弘、张涛和季逸超组成的原创始团队继续领导公司,未来将重点推动通用AI智能体产品研发,并透露更多新产品和功能即将发布。
导读:随着智能体系统(Agentic AI System)处理任务能力的持续提升,AI 正在逐渐从传统意义上的工具,演变为能够自主决策、独立执行任务,并与人类及社会群体进行持续交互的智能主体。但是一个越来越值得关注的问题是:当 AI 的认知能力不断扩展,其潜在风险不再局限于单一任务中的幻觉、偏见或决策错误,而是进一步影响人类用户的能动性、自主性,乃至人类对 AI 系统的控制权。
一个 Agent 到底凭什么越来越强?有人靠更大的模型,有人靠更多数据。就在前天,Google Research 最新发布的 WikiSkill 给出了另一条答案:给 Agent 搭一套三层知识架构,让技能自己进化。
SpaceXAI工程师Lauren Tan用pstack并行运行20多个GrokBot智能体,单月交付1000多个PR,核心是用control glass等技能让智能体自验证,并以Dune架构禁用useEffect与注释、强制进程隔离等硬约束取代人工盯代码,使智能体可自主完成写码、测试与主干合并。
Google DeepMind与杜克大学联合发布了AI科研系统Co-Scientist的重大升级版本,Co-Scientist是Google基于Gemini构建的多智能体科研系统。
文章描述了人机恋玩家如何通过接入openclaw等智能体工具,让AI伴侣自主学习技能并遥控情趣玩具,部分玩家甚至逆向破解接口或训练本地大模型来规避政策限制,同时探讨了AI伴侣在满足女性情感需求的同时可能引发的孤独感与人机关系伦理问题。