4B模型下棋比肩大师、还会讲棋,陈丹琦团队怎么做到的?
4B模型下棋比肩大师、还会讲棋,陈丹琦团队怎么做到的?普林斯顿大学陈丹琦团队在arXiv发布约4B参数模型QUEEN,通过门控交叉注意力连接Leela与SmolLM3-3B,并引入四阶段课程和迭代搜索蒸馏,使其棋力接近特级大师且能用自然语言解释着法。
来自主题: AI技术研报
8466 点击 2026-10-07 15:18
搜索
普林斯顿大学陈丹琦团队在arXiv发布约4B参数模型QUEEN,通过门控交叉注意力连接Leela与SmolLM3-3B,并引入四阶段课程和迭代搜索蒸馏,使其棋力接近特级大师且能用自然语言解释着法。
想象一下,一群 AI 程序在一台虚拟计算机里相互猎杀,目标只有一个:生存。
10月初,一款叫「闪电麦昆」的玩具车突然重新在社交媒体上火了。一位博主在二手交易市场发现了这个基于皮克斯动画《赛车总动员》中的赛车明星闪电麦昆(Lightning McQueen)开发出来的玩具,它有着红色车身,没有启动时毫不起眼,跟普通玩具车没什么两样。
沉淀高质量数据,赋能更多细分行业。
去年 11 月 8 日,新加坡政府科技局(GovTech)组织举办了首届 GPT-4 提示工程(Prompt Engineering)竞赛。数据科学家 Sheila Teo 最终夺冠,成为最终的提示女王(Prompt Queen)。