深度|大模型厮杀背后:谁在成为AI时代的隐形 “卖铲人”?
深度|大模型厮杀背后:谁在成为AI时代的隐形 “卖铲人”?AI行业正上演一场冰火两重天。一边是大模型公司将烧钱推向极致,万亿美元级别的开支砸向算力与研发;另一边,不练模型、不抢GPU,帮AI企业“管钱”的金融基础设施公司营收飙升。当所有人都在追问哪个模型会赢时,真正的赢家或许是这些提供AI基建的公司。
搜索
AI行业正上演一场冰火两重天。一边是大模型公司将烧钱推向极致,万亿美元级别的开支砸向算力与研发;另一边,不练模型、不抢GPU,帮AI企业“管钱”的金融基础设施公司营收飙升。当所有人都在追问哪个模型会赢时,真正的赢家或许是这些提供AI基建的公司。
这几天社媒上一张AI漫画图非常火,图中人物虽是梁文锋,却进行了漫画化的处理,外观形象上尤其像超人等漫画人物,这被网友们评为,海外开发者眼中的梁文锋。
2026年已过去七个月,中国AI创业市场出现了一个值得关注的现象:在世界模型赛道,新成立的公司数量持续攀升,截至8月初已达到23家。这个数字意味着什么?作为对比,2025年全年新成立的世界模型公司是20家,2024年只有10家。2026年用7个月就超过去年全年总量。
今天,OpenAI重磅放出一份长达62页的「核心手稿」,详细展示了GPT的完整推演。传送门:https://cdn.openai.com/pdf/reasoning-walkthroughs.pdf。它的「摘要」只有一小段,但信息量却大得惊人——这份笔记由AI模型独立撰写,OpenAI团队完全没有插手。
这个周末,很多数学家都被 OpenAI 的新模型整破防了。
过去,LlamaFactory 让每个人都能微调大模型;现在,PenguinHarness 希望让每个人都能构建自进化 Agent。
视觉问答模型的准确率不断提高,但高分未必来自视觉理解 —— 当基准图像与答案已进入训练语料,模型可能只是复现了记忆。浙江大学等团队提出 ReKey:保留原始真实场景,只更新决定答案的那一小块视觉线索,使每轮评测都面向未见过的内容。
斯坦福最近公开了一门课的录像,叫 CS329A,主题是 Self-Improving AI Agents(自我改进的 AI agent)。两位主讲教授,Aakanksha Chowdhery 和 Azalia Mirhoseini,都有极深的工业背景。Aakanksha 曾是 Google 540B 参数 PaLM 模型的技术负责人,也参与了 Gemini 的研发
刚刚,杭州大模型公司西湖心辰宣布,公司近日完成数亿元人民币B+轮融资。该公司创始人蓝振忠,是卡耐基梅隆大学AI博士、自然语言处理预训练语言模型“ALBERT”第一作者,曾任谷歌人工智能研究院科学家,研究成果已被应用于Google News、Google Assistant 等数亿级用户产品中。他于2020年6月受聘于西湖大学,创办深度学习实验室并担任博士生导师。
未来几年,医疗大模型的行业竞争将不再局限于基础模型技术的单点对抗,而是演变为模型能力、医疗数据、临床场景、医院生态四位一体的综合实力竞争。下文筛选海内外各10家代表性企业,集中展现了全球医疗大模型产业链核心力量与资本流向(本文内容仅作行业研究参考,不构成任何投资建议、投资引导及相关承诺)。