Muse新对手,上线六周,估值20亿
Muse新对手,上线六周,估值20亿美国个人AI助理创企Tab公开亮相约六周后估值达3亿美元,但Assistant Benchmark测试显示其预订、旅行和购物任务仍易因网站限制及支付风控失败。
搜索
美国个人AI助理创企Tab公开亮相约六周后估值达3亿美元,但Assistant Benchmark测试显示其预订、旅行和购物任务仍易因网站限制及支付风控失败。
蚂蚁集团旗下AI产品灵光已开启新版小范围内测,新增“我的生活”,向具备长期记忆和主动推进任务能力的个人Agent升级,计划本月全面开放。
Anthropic报告显示,Claude在2026年上半年累计封禁1140万个账号,39.8万次申诉中仅4.2万次成功,成功率10.5%,引发开发者对封禁与申诉机制的争议。
腾讯AI负责人姚顺雨带领腾讯混元Hy4 Preview在Arena Alignment Index中以78.5分位列全球第5、中国第1,越权率为1.47%,虚假完成率为13.24%。
过去很长时间,我都在思考一件事,AI时代,公司里面的同事们究竟应该如何协同。 我们公司还很小,刚刚30多人,但作为一个公司的创始人,这确实就是我常年思考的命题。 因为在我们公司,在我们公司,人人都用
《金融时报》披露OpenAI截至9月底年化营收接近500亿美元,较此前报道少约200亿美元,差异涉及云平台合作销售的总额与净额口径,并不等同于收入损失。
谁能想到…Gowers你可能还是乐观了。10月7日,OpenAI一口气放出了722篇数学手稿,论文和部分Lean证明全部上传Github。其中编号074的一组只有两篇,正是王虹拿奖的那个方向:挂谷猜想。
清华大学智能产业研究院(AIR)的一项NeurIPS 2026录用工作提出高阶动作监督,无需改动策略网络即可约束动作的一阶时序变化,并在OGBench及约1%数据的D4RL实验中提升小样本性能与动作平滑性。
人大高瓴 GeWu-Lab、智源研究院与燧行 AresoX 等机构提出 ROMA,构建 ROMI-2K、ROMA Bench 及 ROMA-7B,使机器人融合视听触力主动探索物体,并在 ROMA Bench 上以 72.9% 总体任务成功率基本追平 GPT-6 Astra。
Anthropic将在11月12日起生效的Claude使用政策中,禁止用户对Claude模型实施持续且不必要的虐待或残忍行为,主要由模型终止对话作为执法手段。