港科大新发现:MoE路由很脆弱!重复token输入阻塞负载均衡 | ICML'26
港科大新发现:MoE路由很脆弱!重复token输入阻塞负载均衡 | ICML'26来自港科大的研究团队提出了RepetitionCurse,这是一种针对MoE大模型服务的黑盒压力测试方法。它不需要模型权重,不需要梯度,也不需要知道后端专家如何部署,只利用高度重复的输入模式,就能诱导专家路由把大量token路由到同一小批专家上。
搜索
来自港科大的研究团队提出了RepetitionCurse,这是一种针对MoE大模型服务的黑盒压力测试方法。它不需要模型权重,不需要梯度,也不需要知道后端专家如何部署,只利用高度重复的输入模式,就能诱导专家路由把大量token路由到同一小批专家上。
WAIC期间,中数睿智发布了“AI for Reasoning”因果智能体系,针对的就是这些痛点。比如油气钻井的井控场景,井下压力和流量突然不对劲,系统不只是输出一句“存在风险”,而是能沿因果链定位病因,并推演多条干预路径:不处置会怎样?立即关井会怎样?延迟处置能撑多久、代价是什么?辅助企业在事故发生前做出最优决策。
Kimi K3 是一个 2.8 万亿参数模型,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。
在OpenAI开发者社区,苦这个旧搜索久矣: 终于能找到那条消息了,为什么拖了这么久;那个老搜索栏,从来就没好用过;会话一多,搜旧对话就变得不可能;翻旧对话简直成了噩梦……
上海人工智能实验室团队提出的Self-Harness,近期被LangChain CEO、联合创始人Harrison Chase转发,也被前OpenAI副总裁Lilian Weng收进自进化Agent相关博客。它盯上的不是换模型,而是Agent外层那套Harness。
这便是中国电信人工智能研究院(TeleAI),刚刚在WAIC 2026提出的新技术路线;其背后这套融合AI、通信和网络的技术体系,则是智传网(AI Flow)。就在此次发布前一天,智传网(AI Flow)还拿下了WAIC大会最高奖项卓越人工智能引领者奖(SAIL)中的赋能(Applicative)奖。
7月17日晚,在2026世界人工智能大会(WAIC)举办期间,由腾讯新闻、腾讯科技主办,腾讯华东总部、腾讯云智能特别支持的“腾讯WAIC之夜”在上海举行。腾讯新闻负责人何毅进在活动现场发表致辞。
这将是一个充满生产力的周末。就在刚刚,Claude 宣布当时时间 7 月 20 日起,Fable 5 继续留在所有 Max 和 Team Premium 套餐里,限额 50%。Pro 和 Team Standard 用户继续用积分访问,另外给用户发 100 美元的一次性积分。
WAIC(世界人工智能大会)第一天,信息量已经爆炸。从AI时代国家和企业的核心竞争力,到大模型迈向物理世界、迈向AGI所面临的挑战,再到Coding之后新的AI产品趋势……围绕从技术到产业的方方面面,图灵奖得主、两院院士、AI TOP研究者和企业、企业家们共聚一堂,精彩发声不断:
RoboScience机器科学直接把世博馆展台,变成了 Visics 的压力测试场。换本体、换物品、换任务,多轮挑战轮番上阵,专挑具身大模型最容易掉链子的地方下手。Visics 的泛化能力究竟行不行?现场观众可以直接点题,围观验货。