推荐系统只会「猜你喜欢」,却未必「听你的」?我们用多智能体给黑盒推荐做了一次外部可控性体检
推荐系统只会「猜你喜欢」,却未必「听你的」?我们用多智能体给黑盒推荐做了一次外部可控性体检打开视听平台,系统决定你接下来看到什么;进入购物软件,系统预测你可能购买什么。过去几十年,推荐系统主要关注 “能否更准确地预测用户下一步喜欢什么”。但当用户希望探索小众内容、调整兴趣结构或摆脱热门推荐时,系统是否会响应?
搜索
打开视听平台,系统决定你接下来看到什么;进入购物软件,系统预测你可能购买什么。过去几十年,推荐系统主要关注 “能否更准确地预测用户下一步喜欢什么”。但当用户希望探索小众内容、调整兴趣结构或摆脱热门推荐时,系统是否会响应?
让 Agent 上网查资料,已经不算新鲜事。
多智能体系统(Multi-Agent Systems,MAS)展示了令人印象深刻的能力:一个模型负责提出方案,另一个模型进行批评,还有模型承担投票、规划或执行。通过角色分工和多轮协作,系统能够解决单个模型难以稳定完成的数学推理、代码生成和知识问答任务。
刚刚,钛动科技在 WAIC 上发布了 Navos 2.0,把多智能体产品从网页对话框升级为智能体工作流架构。本月初,钛动还与 OpenAI 正式达成了合作并签约。创始人兼 CEO 李述昊给公司取了两个词拼成的名字——Tec-Do(用技术做生意),后面挂着版本号 2.0,含义是「像做产品一样做公司」(Develop Company as Product)——Tec-Do 2.0。
GraphPlanner通过引入图记忆网络,将多智能体LLM的路由过程升级为动态工作流生成。不仅选择调用哪个模型,还决定每个模型应承担的角色,实现任务分解与协作规划。
本文发现图生视频(I2V)模型天然适合重构动态交互过程,并提出 SCPE(Self-Correcting Process Editing) 多智能体系统自纠错框架:利用视频生成过程暴露失败原因,再通过分析、反思和工具书更新迭代增强提示,使 I2V 模型在复杂 HOI 编辑中显著提升交互准确性与推理能力。
研究团队提出了 XG-Guard (eXplainable and fine-Grained safeGuarding framework), 一个基于 GAD 且兼具可解释性和细粒度检测能力的无监督安全防护框架。目前工作已被 ACL 2026 Main Conference 接收。
2026 年 1 月,他作为首席科学家创立了原力引擎(UniForce AI)公司,试图用生成式仿真、智能控制和多智能体系统解决多物理场仿真与强耦合控制问题,并率先从可控核聚变这一工程领域最困难的问题切入。
我现在核心做的项目叫QLab,一个AI出海加速器。用多智能体,搭了一张高效的协作网络,专门帮国内的中小创业者、一人公司和AI团队,把产品推到海外去。 1. AI Agent相关技术产品支持:帮助非技术背景OPC迅速搭建AI产品体系
来自南京大学 NLP 实验室的 ICML 2026 论文 Recognize Your Orchestrator: An Entropy Dynamics Perspective for LLM Multi-Agent Systems 指出:在当前主流的 Orchestrator-Executor 多智能体架构中,系统失败往往并不首先来自某个执行器不会干活,