翁荔刚回OpenAI,Thinking Machines反手发布新模型Inkling-Small

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
翁荔刚回OpenAI,Thinking Machines反手发布新模型Inkling-Small
8297点击    2026-07-31 13:35


首个模型Inkling亮相之后,全新AI又刷屏了!


今天,Thinking Machines正式发布第二款重磅模型——Inkling-Small。


276B总参数、12B激活参数,原生多模态,100万token上下文


翁荔刚回OpenAI,Thinking Machines反手甩出新模型


半个月前,首个开源975B Inkling登场,曾在AI圈掀起了巨浪。


Inkling-Small仅用四分之一体量,直接实现了对「万亿大哥」的性能反超。


翁荔刚回OpenAI,Thinking Machines反手甩出新模型


翁荔刚回OpenAI,Thinking Machines反手甩出新模型


在ARC-AGI-2上,Inkling-Small刷新开源SOTA


回看Thinking Machines这几天,剧情堪称跌宕起伏。


联创翁荔官宣离职仅两天,OpenAI便证实了她的回归——带队攻坚「递归自我提升」(RSI)。


翁荔刚回OpenAI,Thinking Machines反手甩出新模型


结果就在第三天,这家刚少了一位核心大将的公司,直接把新模型的「全量权重」甩了出来。


全新Inkling-Small登场


276B击败万亿


官博介绍中,Inkling-Small是一个MoE架构的模型,总参数2760亿,单次推理激活120亿。


相较于初代Inkling,体量直接浓缩成四分之一。


正如Pytorch大神Horace He所言,「Inkling-Small根本不用举全村之力,直接沿用前代技术就成了」。


最硬核的是,体量虽缩小了,综合实力显著提升。


翁荔刚回OpenAI,Thinking Machines反手甩出新模型


在数学、推理、智能体编码、多模态基准中,Inkling-Small堪比,甚至超越了Inkling、DeepSeek V4 Flash。


翁荔刚回OpenAI,Thinking Machines反手甩出新模型


在HLE、Terminal-Bench、IFBench这三个核心指标上——Inkling-Small每一FLOP换来的性能都高于Inkling。


可以看到,Inkling-Small的曲线,全程压在Inkling上面。


翁荔刚回OpenAI,Thinking Machines反手甩出新模型


翁荔刚回OpenAI,Thinking Machines反手甩出新模型


多模态那边也几乎没掉队没,图表理解、视觉推理、语音理解、长音频推理,Inkling-Small在评测中「接近」原版,代价却低得多。


其他基准测试成绩如下:


翁荔刚回OpenAI,Thinking Machines反手甩出新模型


一个体积只有四分之一的模型,在推理和智能体任务上把它的老大哥按在了地上。


后训练细节,全公开了


至于如何做到,官方把方法写得很细,关键是两步。


翁荔刚回OpenAI,Thinking Machines反手甩出新模型


Inkling-Small 的训练开始时间晚于 Inkling,于是把前一轮踩过的坑全部吃进去了——


预训练数据配比改了,机器学习配方重新精炼过。


更关键的,是两步操作。


第一步,用 Inkling 当老师做 on-policy 蒸馏,先出一个 preview 检查点。


第二步,从这个检查点接着跑了整整两周的智能体编码强化学习。于是就有了「学生超过老师」的结果。


仅用两周的时间,就把差距拉了回来,还反超了。


这意味着,Thinking Machines直接跑通了一条能反复出模型的产线。第一个模型是作品,第二个模型是产能证明。


120亿激活,才是真正的分水岭


对绝大多开发者来说,真正关心的是,自己能不能用起来?


原版Inkling门槛非常高,BF16检查点最低要求是2TB聚合显存——


示例配置是,8张B300或16张H200;就算换成NVFP4量化版,也还要600GB起步。


翁荔刚回OpenAI,Thinking Machines反手甩出新模型


Inkling-Small把这道门槛,整个往下拽了一大截。


LMSYS的说法很直接:276B总参数配12B激活,是强化学习的甜点位,LoRA和全参数训练都变得「够得着」。


以前只有大厂能玩的模型定制,现在一个中等规模的团队,也有机会真的把它训成自己的东西。


实测显示,8张B200、TP8、NVFP4、batch size 1的同一套环境下,用SGLang跑Inkling-Small,开DSpark能到648 tok/s解码,不开也有288 tok/s。


翁荔刚回OpenAI,Thinking Machines反手甩出新模型


六个联创走了四个


模型越发越快


去年2月,Thinking Machines带着一份「OpenAI梦之队」的六人名单惊艳开局:


Mira Murati、John Schulman、Barret Zoph、翁荔、Andrew Tulloch、Luke Metz。


当时,他们拿的是20亿美元种子轮、120亿美元估值的逆天剧本。


谁能想到,今年1月那轮500亿美元估值的融资最终流产,成为了转折的开始。


如今,六人团只剩下了Murati和Schulman。


更有意思的是,离开的四个人里,Zoph和Metz先后回了OpenAI,如今翁荔成为了第三个。


一家由OpenAI「叛逆者」组建的公司,核心骨干最终还是没能逃脱OpenAI的引力场。


翁荔刚回OpenAI,Thinking Machines反手甩出新模型


但真正充满戏剧性的,是团队在面临动荡时的反应。


7月15日,沉默了整整17个月的Thinking Machines终于交出了首个大模型Inkling。


不到两周,翁荔宣布离职;仅仅三天后,第二个带着全量权重的开源模型又紧跟着上线。


人才在加速流失,模型在加速狂飙。


这两条背道而驰的曲线,成了AI行业中最具代表性的一幕。


也许这就是通向ASI的必经之路:不管留下的人有多么少,机器向前的车轮,只会越转越快。


参考资料:


https://thinkingmachines.ai/news/inkling-small/


文章来自于微信公众号 “新智元”,作者 “新智元”

AI转型,免费服务,就找AITNT
AITNT资源拓展
根据文章内容,系统为您匹配了更有价值的资源信息。内容由AI生成,仅供参考
1
AI代理

【开源免费】Browser-use 是一个用户AI代理直接可以控制浏览器的工具。它能够让AI 自动执行浏览器中的各种任务,如比较价格、添加购物车、回复各种社交媒体等。

项目地址:https://github.com/browser-use/browser-use


2
智能体

【开源免费】AutoGPT是一个允许用户创建和运行智能体的(AI Agents)项目。用户创建的智能体能够自动执行各种任务,从而让AI有步骤的去解决实际问题。

项目地址:https://github.com/Significant-Gravitas/AutoGPT


【开源免费】MetaGPT是一个“软件开发公司”的智能体项目,只需要输入一句话的老板需求,MetaGPT即可输出用户故事 / 竞品分析 / 需求 / 数据结构 / APIs / 文件等软件开发的相关内容。MetaGPT内置了各种AI角色,包括产品经理 / 架构师 / 项目经理 / 工程师,MetaGPT提供了一个精心调配的软件公司研发全过程的SOP。

项目地址:https://github.com/geekan/MetaGPT/blob/main/docs/README_CN.md