深度|对话OpenAI推理教父:为什么说现有的Benchmark让我们严重低估了AI能力?
深度|对话OpenAI推理教父:为什么说现有的Benchmark让我们严重低估了AI能力?本期播客,No Priors 请来了一位在 AI 推理领域被业内称为「教父级」人物的研究者Noam Brown。他是 OpenAI 的研究科学家,也是推动「test-time compute scaling」成为行业主流方向的关键人物之一。从扑克 AI 到前沿大模型的评估方法论,Brown 的研究轨迹几乎与整个行业对「推理」认知的升级同步。