曝苹果已与阿里合作训练大模型
曝苹果已与阿里合作训练大模型据路透社援引三位知情人士爆料,苹果已和阿里巴巴展开合作,联合训练一款专门面向中国市场的大语言模型。就在8月8日,苹果悄然更新Mac使用手册,新增《在Mac上配合Apple智能使用千问》相关章节,这也是苹果首次对外官方披露国行Apple智能的合作细节,不过该章节后续已被删除。
搜索
据路透社援引三位知情人士爆料,苹果已和阿里巴巴展开合作,联合训练一款专门面向中国市场的大语言模型。就在8月8日,苹果悄然更新Mac使用手册,新增《在Mac上配合Apple智能使用千问》相关章节,这也是苹果首次对外官方披露国行Apple智能的合作细节,不过该章节后续已被删除。
《智能涌现》从相关人士处获悉,混元资深研究员徐灿在近期加入腾讯WeLM团队,从事大模型研发相关工作。多名知情人士透露,在姚顺雨接手腾讯大语言模型研发前,徐灿在混元LLM体系中担任后训练一个方向上的负责人。值得一提的是,这次转岗发生在微信持续强化自研大模型和Agent能力的阶段。
近日,Oh My Pi 作者 can1357 在 X 上发文,展示了利用模型 API 漏洞,直接提取 GPT-5.6、Claude Fable 5 等顶级模型完整内部推理记录的方法。他发现,做到这些并不用破解加密,只需要关闭模型的隐藏思考,再给它一个思考工具,就能让模型主动输出内部推理格式。
今日,Meta超级智能实验室大牛、AI研究科学家余家辉宣布将离职创业。余家辉在帖子上提到离职原因是,随着时间推移,他意识到有一个对人类未来至关重要、却鲜少有人探索的事,他要将全部精力投入到这件事上。不过,他并未透露具体的创业方向。
上个月,小红书自研大模型「dots-note-3.0」创下了一个历史记录:AI 首次在国际奥数竞赛中斩获官方认证的满分42 分。此后,社区最关心的问题,就是模型什么时候开源。就在今天,小红书 dots 模型实验室(以下简称 dots 实验室)宣布开源 dots3-note preview!
就在刚刚,智谱发布了其最新一代旗舰模型GLM-5.3,并宣布模型将在两周内开源。这是一个拥有7430亿个参数的模型,和此前的GLM模型一样主打编程。在多项主流基准测试中,GLM-5.3位居所有已开源或即将开源模型中的第一;其在编程与智能体任务上的能力,已逼近Claude Fable 5、GPT-5.6 Sol等海外顶尖模型。
OpenAI 官方公告,包括 OpenAI、Anthropic、Google、Meta、Microsoft 在内的一大批公司,签署了欧盟《AI 生成内容透明度行为准则》,承诺推进 AI 生成内容的标记与检测。看起来 AI 内容马上也要有「署名」了。
据路透社最新消息,在8月6日举行的Google DeepMind全员会上,管理层宣布:数个非技术团队将被移出DeepMind,转入谷歌的公司汇报体系。会上,哈萨比斯和接班人Koray Kavukcuoglu还在安抚员工,称实验室的日常工作不会发生变化。
在昨天正式发布DeepSeek V4 Pro正式版之后。 预告了很久的,DeepSeek家自己的Agent产品终于也发出来了。 名字叫,DeepSeek Harness。 理念也很清晰,一切皆插件。 可能是有史以来最快的速度,截止到我写完文,它在Github上到了3万7的Star。
这次百花奖时间紧、任务重,好在豆包帮了金启棣大忙。在豆包工作任务模式下,他把舞台数据、观众规模、视觉需求等一并交给豆包。豆包很快就生成了舞美概念和效果图,让原本模糊的创意迅速落地。在此基础上,舞美设计团队继续精修,省下了大量做基础工作的时间。
过去一年,编程 Agent 的能力大幅提升,软件工程师对它们的要求也比以往任何时候都高,但上下文窗口的大小却基本停滞不前——一年前,一百万个 token 大致就是最先进的水平,如今依然如此。随着我们逐渐进入 Agent 日常处理 Monorepo(单体仓库)级任务的世界,将越来越多的信息塞进模型那固定的上下文限制中,这种需求已经变成了一项实实在在的全职工程任务。
今天,我们特别邀请到了百度搭子的负责人李景秋。在这场对话中,他带放下了官方客套,抛出了许多极其犀利且颠覆认知的一线洞察:关于工具终局:为什么他认为 AI 不是在“辅助”Excel,而是正在让用户“彻底忘掉 Excel 公式”?
京东健康医疗 AI 产品总监刘慧至今记得这个故事。此前在广州的一次合作洽谈中,对方主动向她讲起了这段经历。她和我一样,也是一位母亲,刘慧说。那天孩子发烧后,这位母亲没有像往常那样立刻请假、打车,带着孩子去医院,而是决定先问问「大为」。
前不久用Fable 5推翻雅可比猜想的Anthropic研究员,又吭哧吭哧和两个人类伙伴带着Claude,做出了668阶哈达玛矩阵!(好数学家不挑AI模型,doge)不过这人每次有成果都不明说,发一堆只有内行才看得懂的东西。
视频模型这个月很热闹。7 月 31 日,MiniMax H3 和字节跳动 Seedance 2.5 同日发布。3 天后,MiniMax H3 正式开源;8 月 7 日,Seedance 2.5 开放 api。模型越来越好了,但产品能把它用好吗?
8 月 14 日凌晨,OpenAI 联合 AI 芯片厂商 Cerebras 正式预览了其旗舰模型 GPT-5.6 Sol 的全新服务层级「超高速模式」(Ultrafast Mode)。在该模式下,GPT-5.6 Sol 的输出速度最高可达 750 tokens/s,相比目前 Standard(标准)模式约 53 tokens/s 的推理基线,速度提升最高达 14 倍,同时不降低任何质量。
距离 3.6 Flash 发布才过去 3 周,Google 又端上了 Gemini 3.7 Flash。刚刚接掌 Google DeepMind 的 Koray Kavukcuoglu 发文介绍,这是新一代面向 Coding 和 Agent 工作流的主力模型,首发价格只有 Gemini 3.6 Flash 原始价格的一半。
其实最近一个让我觉得很摸不到头脑的小热门议题就是,WorkBuddy到底有多少日活,有多少月活。众说纷纭啊,有说几千万也有说几百万的。反正咱不猜,也不写。有人说是写了就会被投诉删稿,我觉得是谣言(确信
刚刚,阿里千问大模型团队开放Qwen3.8-2.4T-A95B模型权重! Qwen3.8-Max是基于Qwen3.8-2.4T-A95B的官方版本,于8月3日发布,拥有更多功能,例如视觉输入功能、无需思考即可使用、默认支持1百万上下文长度处理、内置官方工具等。
今天凌晨,DeepSeek V4 Pro 正式版发布,引发热潮。现在,半天过去,DeepSeek Harness (开发者预览版)也来了!当然,这并不意外,毕竟该项目之前已经铺垫了很久了,比如 DeepSeek Harness 团队的崔添翼就一直在社交网络上发预热贴以及为该团队招募人才。
昨晚 AI 圈又炸了。阿里开源Qwen3.8-2.4T-A95B,DeepSeek V4 Pro正式版发布,马斯克推出最新一代旗舰模型Grok 4.6。7 月 16 日,Grok 4.5 才刚发布。短短 27 天,Grok 4.6 就来了。
就在刚刚,X上网友「三只草莓」爆料,SSI正在探索一种基于TTT(Test-Time Training,测试时训练)的小型推理引擎。 据其描述,这个模型会用专门整理的数据学习「如何学习」,再在解决问题的过程中更新部分权重。
8 月 3 日,Genspark 创始人&CEO 景鲲在 AGI Playground 2026 大会上发布了 GenOffice。这是一款 AI 深度集成的本地 Office 客户端,其亮点在于打通了从 AI 生成到工作交付间的链路:通过 GenOffice 打造的软件工程框架,模型得以直接操作 Office 文件最复杂的底层格式,将生成内容转化为可编辑、可交付的 Word 和 PPT 成品。
虽然现在的AI助手已经可以聊天、搜索资料、写内容,也可以调用浏览器和电脑执行任务。大部分时候,用户依然需要主动找到AI,再把背景、资料和需求重新告诉它。这正是Today AI设计的出发点。在获得用户授权后,它可以接入本机和外部服务,再持续整理这些信息,逐渐建立一份关于用户的长期理解。
瓴羊CEO朋新宇。他是阿里数据中台方法论的创立者,他的团队做这件事已经5年,比“FDE”这个词流行起来还要早。在AI浪潮到来之后,他们发布企业级Agent平台:AgentOne。
就在刚刚,X上被这个消息震惊了。OpenAI的元老级高管、奥特曼秘密武器Brad Lightcap,官宣出走!现在,OpenAI估值已经飙升到8520亿美元,眼看就要成为史诗级IPO,他居然在此刻选择离开?
今日,中国最大端侧大模型独角兽面壁智能首次向北京证监局提交了上市辅导备案报告,正式启动A股上市辅导,中信证券为其辅导机构。从备案信息来看,面壁智能注册资本为154.5833万元。其目前无控股股东,第一大股东为北京清语启航科技中心(有限合伙),持股比例为16.45%。
8 月 11 日,xAI 联合创始人伊戈尔·巴布什金(Igor Babuschkin)创办的 River AI 宣布完成 11 亿美元融资。这笔资金横跨种子轮和 A 轮,由 General Catalyst 和 AMP PBC 领投,英伟达、AMD Ventures 战略投资,Y Combinator 和淡马锡等参与。
Discovered Materials便是这一趋势下的最新代表,该公司计划利用大量AI Agent集群,寻找可用于制造更高效集成电路的新材料。这家初创公司表示,公司近期从Y Combinator毕业后,已完成一轮900万美元种子轮融资,由Lightspeed India Partners领投
MiniMax 过去一年的 agent 实践,从一个内部飞书 bot 开始,演化成了桌面应用 MiniMax Code,最终形成了一个训练-服务的闭环:模型在自己的 harness 里训练,通过 harness 服务用户,用户行为变成训练信号反哺下一个模型。这个闭环是模型公司设计 Agent 的核心逻辑。