DeepSeek新论文公开Agent训练!梁文锋署名
DeepSeek新论文公开Agent训练!梁文锋署名大模型训练拼的是算力,Agent训练拼的是环境。
来自主题: AI技术研报
8496 点击 2026-09-23 18:04
搜索
大模型训练拼的是算力,Agent训练拼的是环境。
「DeepSeek V4 来了!」这样的消息是不是已经听烦了?总结来说,这篇新论文介绍了一个名为「DualPath」的创新推理系统,专门针对智能体工作负载下的大语言模型(LLM)推理性能进行优化。具体来讲,通过引入「双路径 KV-Cache 加载」机制,解决了在预填充 - 解码(PD)分离架构下,KV-Cache 读取负载不平衡的问题。
深夜,梁文锋署名的DeepSeek新论文又来了。这一次,他们提出全新的Engram模块,解决了Transformer的记忆难题,让模型容量不再靠堆参数!
梁文锋亲自参与的DeepSeek最新论文,来了!
DeepSeek新论文来了!在清华研究者共同发布的研究中,他们发现了奖励模型推理时Scaling的全新方法。DeepSeek R2,果然近了。