Agent长时工作如何不跑偏?WorkSwarm用「永续会话」给出解法
Agent长时工作如何不跑偏?WorkSwarm用「永续会话」给出解法让 Agent 完成一个任务并不难。它会整理材料、修改文件、检查结果,再交付答案。
搜索
让 Agent 完成一个任务并不难。它会整理材料、修改文件、检查结果,再交付答案。
一句话概括:文本世界模型都在比 "生成文本像不像真实环境",但我们发现文本更接近真实环境的预测反而可能让智能体错得更离谱。把训练目标从 "状态一致" 换成 "行为一致" 后,16 组实验配置下世界模型的轨迹级一致性几乎全面提升,弱智能体离线评测的假阳性率从 42.5% 降到 9.5%。
美国人烦 AI,欧洲人压根不在乎。
过去几年,端侧大模型一直在不断突破能力边界。
科幻早就预演过这一天,而这两年 AI 的真实进展,正把它推成一个可讨论的命题:AI 或许不会停在「工具」上,而会成为与人类共生的存在 ——AGI Being。
最近,AI 视频生成领域有一个备受瞩目的变化:视频的生成速度,已经比你看视频的速度都要快了。
在大模型的发展中,提升能力的主要手段一直是 "做大"—— 更多参数、更多数据、更多算力。如今,另一条思路开始受到关注:与其不断堆叠新的层,不如让已有的层再跑一遍。这就是 Looped Transformer。普通 Transformer 的每一层只执行一次,而 Looped Transformer 会把其中一部分层重复执行,让模型在不增加参数的情况下获得更深的计算。
AI算力调度公司Gimlet Labs获3亿美元融资,估值达30亿美元,由Andreessen Horowitz领投,Arm Holdings、微软M12等参投,公司目前专注于将AI工作负载分配至不同类型芯片并帮助客户搭建数据中心。
一项双机器人协作测试中,研究人员故意让其中一台机器人晚了 3 秒。
OpenAI被曝正在内部测试GPT-6 Sol,单次速度约为GPT-6 Astra的6倍,同时公开内部数据称研究员每8小时工作日背后并行运行约3.1个Agent工作日、每日Agent推理资源花费超600美元,并宣布已实现"自动化AI研究实习生"目标;其首席科学家Jakub Pachocki同日发文警告AI对齐与监控难题,表示若必要OpenAI不排除单方面暂停扩大模型规模。