代码造世界,扩散绘现实:AgentGarten让智能体在实时试炼场中边玩边进化
代码造世界,扩散绘现实:AgentGarten让智能体在实时试炼场中边玩边进化推开一块挡板,通道就此封闭;搬来一段坡道,高墙便有了越过的可能。
搜索
推开一块挡板,通道就此封闭;搬来一段坡道,高墙便有了越过的可能。
过去十几年,苹果把越来越多设备放进了我们的口袋、背包和手腕,却始终没能在客厅里找到同样稳固的位置。
上周,OpenAI 宣布解雇三名员工,理由是内部调查发现三人违反了公司关于敏感信息访问与处理的规定,涉嫌在既定程序之外向第三方 AI 安全评估组织分享机密信息。
DeepSeek的神鬼二象性被字节Seed团队逮到了。
在语音助手、多用户共享的家庭助理等长期对话场景中,模型需要跨越多次会话记住用户的信息,但现有评测常遭遇两大难题:
0.2秒。
扩散智能(DiffuSpace)连续完成两轮数亿元人民币融资,创全球扩散语言模型最大规模融资纪录,经纬创投、顺为资本、君联资本联合领投,华为哈勃等跟投。
谷歌推出Gemini游戏创作平台Playground,支持用自然语言生成和修改2D、3D游戏,并公布与Unity合作推出Unity Spark的计划。
OpenAI发布GPT-6.1 Sol Ultraffast模式,速度最高提升至标准版8倍但价格为其6倍,因标准版速度过慢且订阅开放受限,被用户质疑为“变相涨价”。
9 月 22 日,以 FLUX 图像模型闻名的 Black Forest Labs 跨界发布了开源 7B 世界动作模型 FLUX 3 Action。据其官方博客,该模型在英伟达 RoboLab-120 榜单上超过了此前最强的开源模型 Cosmos 3 Nano,参数量却不到后者一半。一家做图像生成的公司跑来卷机器人控制,说明视频模型里积累的「物理直觉」正被越来越多的团队当作机器人大脑的底座。
10 月 6 日,OpenAI 公开了 AI 产出的 722 篇数学论文,包括准黎曼猜想的相关证明。前 Google 科学家、xAI 联合创始人 Christian Szegedy 表示,数学家穷尽一生攀登的险峰,机器可乘飞机直接抵达。但 Szegedy 认为,数学不是走向终结,而是探索方式的改变 —— 人们可以借助飞机,抵达更多未境之地,他自己对此兴奋不已。
好好好,谷歌也来加入办公智能体混战,而且强调多模型调用的它连竞争对手Claude都给安排上了!
TRAE 合并 TraeWork 与 TraeCode,在统一客户端中提供 Agent 工作台和 IDE 模式,支持跨项目管理、多个 Agent 并行任务及代码细改,并将办公产物纳入持续开发流程。
太震撼了! 谁也没想到,就在昨天,马斯克悄悄干了一件大事。
AI 视频生成正在进入新的竞争阶段。
莫言在 2012 年获得诺贝尔文学奖时,我花了整整一个晚上,才把《丰乳肥臀》《蛙》和《红高粱》的阅读顺序理清楚。
「不准虐待Claude,否则取消你的使用资格」!
Anthropic 发了一篇科学博客:约翰斯·霍普金斯大学的天体物理学家 Brice Ménard(同时也是 Anthropic 的研究员),用自家的科研工作台 Claude Science,做出了第一张完整的全天紫外地图
多模态模型的视觉原生Harness,来了!
OpenAI最近真是频频往数学界扔重磅炸弹。
好家伙,世界动作模型(WAM)赛道,中国团队直接冲到了全球第一?!
昔日Agent顶流Manus,又杀回北京招人了。
最近AI产品有种动物成精了参加秋招的感觉,这个要当秘书,那个要当管家,反正都想给自己找个身份。
2026年的巴黎,秋意微凉。
拿起一枚生鸡蛋,手指需要施加恰到好处的力:既要防止滑落,又不能捏碎。拧一条湿毛巾,指尖的力道也要随着水分挤出不断调整。对人类而言,这些操作几乎出于本能。但如果只依赖视觉,摄像头拍得下手部轨迹,却捕捉不到手指接触的位置与按压的力度。
从检索动作知识、寻找角色参考,到模拟运动和衔接镜头,一个经过强化学习的智能体,能给视频生成带来多大提升?
智能体正在走进企业,但从演示效果到生产应用,仍有不少难关: 复杂任务链路长,多个智能体难以高效配合;业务经验难以沉淀,每次执行都可能重复摸索;算力投入不断增加,运行效率却未必同步提升。
设想一下: 你用Claude Code手搓了一个小应用,顺便给它接了个AI客服。
彻底撕破脸了。
在与用户的实时对话中,AI能否及时感知情绪?模型给出的“高置信度”结论,又是否经得起推敲?