在线蒸馏灵活却太慢,离线缓存高效却不够灵活,LinkedIn 如何取舍?
在线蒸馏灵活却太慢,离线缓存高效却不够灵活,LinkedIn 如何取舍?LinkedIn 公开其 AI 职位搜索的多教师蒸馏训练基础设施,通过基于 SGLang 的定制框架结合在线与离线蒸馏方案,并叠加 LiGer、多节点训练、FSDP2 及 H200 集群等优化,实现约 8 倍训练加速,将 80 亿参数相关性模型和 17 亿参数互动模型的知识压缩至 6 亿参数排序模型,使职位搜索 NDCG@10 提升 24.48%。
搜索
LinkedIn 公开其 AI 职位搜索的多教师蒸馏训练基础设施,通过基于 SGLang 的定制框架结合在线与离线蒸馏方案,并叠加 LiGer、多节点训练、FSDP2 及 H200 集群等优化,实现约 8 倍训练加速,将 80 亿参数相关性模型和 17 亿参数互动模型的知识压缩至 6 亿参数排序模型,使职位搜索 NDCG@10 提升 24.48%。
BenchJack 之后,reward hacking 检测还缺什么? Agent 在 benchmark 上拿到高分,未必真正完成了任务。它也可能利用评测或奖励机制中的漏洞,绕开题目要求来提高得分。
腾讯秘密内测AI游戏陪伴产品"鹅次元",内置多位数字人AI角色,支持语音对话、实时画面识别和游戏陪伴等能力,内测期间全部功能免费,并已搭建星币兑换能量的付费框架,主打替代真人陪伴以满足玩家游戏中的情绪社交需求。
AIHOT开发者卡兹克正式开源月活百万的AI热点资讯网站AIHOT,并上线利用Claude Opus 5.5等模型重写的AIHOT 2.0版本,以便法律、金融、HR等各行业用户基于该开源框架构建属于自己的行业热点监控产品。
上海人工智能实验室开源的多模态决策SOTA模型Intern-Decision采用自回归式掩码语言任务框架,在推理速度上比Jev提升2至3倍,并在游戏画面决策、验证码识别和网页操作等任务中展现出将视觉理解与结构化决策结合的能力,目前已在Hugging Face、GitHub开源0.8B、2B和4B三个版本。
OpenAI发布的GPT-6 Astra可自主调用Blender、KiCad等软件的编程接口,将蒸汽机车图纸拆解为3295个可编辑零件,并依据一句话指令建模后导出为虚幻引擎5中可交互运行的房屋,同时OpenAI承认其网络安全能力已触及准备框架"关键"级。
Manus 团队在从 Meta 强制拆解中恢复独立身份后,正式推出全架构重构的 Manus 2.0 及自研 Cascade 框架,并发布主打个人化的全新独立应用 Cue,传新估值升至 40 亿美元,腾讯成为重要外部股东。
埃默里大学提出的Decompose–Look–Reason(DLR)框架被EMNLP 2026接收,该方法通过分解问题、按premise提取视觉latent再推理,在Qwen3-VL-8B-Thinking上于V*、MathVista等基准取得显著提升。
酉术量子全球首发UnitarySpark异构计算硬件底座及UnitaryLab 2.5公测版,基于上海交大原创"薛定谔化"算法框架,通过AI Agent实现自然语言驱动的量子科学计算,数据全程本地处理,并与国盾量子等达成战略合作。
GitHub火热开源项目Colibrì以纯C实现分层推理框架,通过AI内存多层化将SSD、RAM和VRAM组成动态调度系统,无需GPU即可让普通笔记本运行744B参数GLM-5.2等超大MoE模型,已揽获32k Star并支持9个模型家族。