openJiuwen X-Router自演进模型路由技术首发,昇腾亲和,Agent越跑越省,实测减少50+%Token消耗
openJiuwen X-Router自演进模型路由技术首发,昇腾亲和,Agent越跑越省,实测减少50+%Token消耗不是所有任务都需要最强的模型。让每一次请求选对模型,让每一次反馈都成为下一次更优、更省的选择。不是所有任务都需要最强的模型。让每一次请求选对模型,让每一次反馈都成为下一次更优、更省的选择。
搜索
不是所有任务都需要最强的模型。让每一次请求选对模型,让每一次反馈都成为下一次更优、更省的选择。不是所有任务都需要最强的模型。让每一次请求选对模型,让每一次反馈都成为下一次更优、更省的选择。
AFK 推出 Personal Agent Comma,主打 24 小时持续在线与围绕目标主动推进,通过 Cloud for work, your device for identity 的物理隔离设计解决信任问题,重新定义个人 Agent 从「等你下一句」到「你离开后任务才开始」的交互范式。
openJiuwen WorkSwarm首发全双工多模态能力,实现用户在前台像聊天一样随时与Agent交互、插话和追问,复杂任务则交给后台Core Agent独立执行,且原生亲和昇腾算力,支持基于华为云ModelArts与vLLM-Omni框架在昇腾NPU上部署。
机器之心编辑部 刚刚,Google 宣布推出新一代前沿模型 Gemini 4 Argon。 Google 将 Argon 定位为面向复杂、长周期工作流的模型,重点覆盖软件工程、法律与金融等企业知识工作
AMD以82亿美元全股票收购世界模型公司World Labs,文章解析世界模型从生成内容迈向生成可交互数字世界的技术路径与产业影响,梳理李飞飞的空间智能路线、杨立昆的JEPA架构以及谷歌Genie 3、英伟达Cosmos等巨头的不同押注方向。
腾讯WorkBuddy上线微信小程序一键发布功能,将代码生成、预览调试、发布上线及云服务数据库调用全流程打通,使无开发经验的用户约3小时即可从想法完成小程序的制作与上线,进一步拓展了腾讯生态的Agent应用场景。
Instinct创始人Noah Shinn在首次长访谈中介绍其估值100亿美元的Personal Agent产品,强调无App设计、依托手机和邮件交互、以交易抽成为商业模式,并面临算力与安全挑战。
港科大团队在NeurIPS 2026上提出AccelEval基准,覆盖6个领域42项任务和43类CUDA优化策略,评测大模型能否从可信CPU程序生成端到端更快的GPU实现,其中Gemini 3.1 Pro在中规模通过正确性验证的任务上取得71.2倍几何平均加速比。
谷歌正式发布前沿AI模型Gemini 4 Argon,其在Text Arena排名第一、Vals RSI指数超越GPT-6 Astra达30%,单任务成本仅1.99美元,单次输出上限升至100万Token,并在谷歌内部以Rust安全语言重写了80万行系统内核代码。
DeepSeek开源面向华为昇腾算力平台的基础设施组件,涵盖TileLang编译工具及DeepGEMM、DeepEP、TileKernels、FlashMLA、DeepSelect等计算与通信库,华为亦在CANN社区开源双方围绕昇腾950及超节点的联合创新实践。