Mistral Large 4 发布:1T 参数、49B 激活,aka「大胖猫」
Mistral Large 4 发布:1T 参数、49B 激活,aka「大胖猫」Mistral 发布 Mistral Large 4,采用细粒度混合专家结构,总参数1.05T、每次激活49B,支持图文输入和100万上下文,API现已开放,权重计划于10月27日发布。
搜索
Mistral 发布 Mistral Large 4,采用细粒度混合专家结构,总参数1.05T、每次激活49B,支持图文输入和100万上下文,API现已开放,权重计划于10月27日发布。
据彭博社报道,DeepSeek即将敲定至少800亿元人民币的新一轮融资,腾讯和宁德时代承诺出资金额居前,该轮融资拟为2027年初IPO铺路,但最终条款仍未确定。
开源项目mu(μ)在进化酒馆黑客松深圳收官战中夺冠,其将Jev深度融合进Harness,通过35个判定点优化上下文管理与多Agent通信。
英伟达投资的Reflection发布开源模型Beam,采用MoE架构,专注代码、推理和Agent任务,官方称其以GLM-5.2三分之一至四分之一的推理算力取得相当成绩,但原始能力仍落后部分前沿开源模型,计划月底以Apache 2.0放出权重。
A16Z第七版Top 100 消费级 AI 应用与9月底更新的市场状况 II显示,美国消费者虽已广泛尝试AI,但日常使用和付费渗透仍浅,智能降价正放大Agent的Token需求,重度用户与大众之间的AI使用鸿沟扩大,资本也重新流向芯片、能源和数据中心等实体基础设施。
Anthropic部分早期员工因担忧AI失控开始考虑在美国偏远地区买地避难,这群源自湾区AI安全圈的研究者也因风险判断不同而选择留下或离开。
OpenAI开启Codex“疯狂28天”计划,首日宣称将GPT-6 Astra和GPT-6.1 Sol默认推理速度提升约50%至50TPS,但用户实测低于预期,叠加ChatGPT测试广告、欧盟文本隐形水印及订阅调整引发质疑。
清华团队开源以Qwen 3.8-27B为基础模型的VeriLoop E2,通过VGR外部证据门控实现可验证状态提交,并取得黎曼猜想临界线零点比例下界67.350003708785593%的严格有限维证书,但上游形式化桥接尚未完成。
xAI联合创始人Christian Szegedy在《数学何去何从?》中称,AI正解决多个数学猜想和长期悬而未决问题,数学将由少数天才的手艺转向科技行业基础设施,但Wolfram等人认为纯数学不会被AI做完。
Hinton等22位作者在首篇RSI论文中指出,AI全面参与下一代AI研发可能形成递归自我改进并引发智能爆炸,但现阶段证据不足以证明智能爆炸已经发生。
Utopai Studios打造的Utopai X在Artificial Analysis Video Arena盲评中以1150 Elo位列全球第二,其核心竞争力是将模型深度集成PAI制作系统,并通过真实影视项目、专家反馈与系统迭代形成持续进化的数据飞轮。
StartLux发布完全开源的StartLux-Decision,其27B版本在Decision Index 0.2.1的38项基准中有31项超过Jev 1.13,并以63.88分升至公开榜首。
AI虚拟细胞(AIVC)正围绕基础模型、扰动数据、算力和评测标准展开竞赛,百图生科等机构加速布局,但纯AI尚不能稳定战胜统计基线,高质量扰动数据仍是瓶颈。
文章指出,AI时代的FDE已从软件部署延伸至梳理企业Ontology、验证方案、推动系统接入与员工采用,并通过沉淀可复用能力服务产品迭代,其核心难点正由技术转向沟通和组织变革。
开源项目agent-wow接入GPT-6 Astra,使其不读取游戏画面、仅依据服务器网络数据包自主感知和规划,40分钟内零死亡完成《魔兽世界》兽人新手村全部任务。
Rabbit创始人吕骋表示,人不该为Agent改变思考方式,OS3以持续对话、最多连接五台电脑并支持自带模型密钥和本地执行来降低门槛,但个人Agent的长期需求仍待验证。
Karpathy建议让LLM采用约80%的ASD-STE100规范,并生成图示、HTML交互页面或定制讲解视频,将输出转化为更清晰易懂的软件产物。
Tavus发布全双工视频到视频交互模型Griffin,可实时生成720p数字人并理解停顿、表情与动作,在一分钟测试中让54名参与者近48%误以为在与人交谈,但该结果未独立验证且模型尚未公开。
在Anthropic冲刺IPO之际,Meta将Claude Code活跃用户从6万降至3万并转向Muse Code,微软也将内部Claude支出削减逾33%,单员工月度Token预算从10万美元降至1万美元。
《The Verge》报道,Mercor、Scale AI 和 Surge AI 招募律师、编剧、教师等专业人士生产 AI 训练数据,使劳动者在教 AI 取代原有工作的同时,面临项目骤停、严密监控、降薪和技能被模型掌握后需求消失的困境。
Google等提出RRSI,通过正则化Agent Harness自我改进中的Proposal与Selection,减少过拟合与复杂度累积,并提升未见基准上的迁移表现、降低Token成本。
Opus 5.5通过MV、3D游戏和机械沙虫等案例展示出编排完整创作流程的能力,文章指出爆款Demo正成为观察模型的新benchmark,但应结合时间、成本、工具与修改过程判断其成熟度。
Anthropic 为 Claude Code 默认开放可深度改装的 Mods,并推出拥有超 2000 个插件和连接器的 Claude Marketplace,但高权限与暂缺收益分成也带来安全和持续运营疑问。
一位北大数学系校友认为,OpenAI和Anthropic借AI高调宣传数学突破,可能误导公众并打击青年学习数学的热情,学界仍应支持人类数学研究与公平成果归属。
OpenAI员工David Robinson在离职信中称,持续冲刺和“迭代部署”文化已无法保持必要谨慎,并警告随着AI能力增强,失败的代价将扩大,人类可能失去决定自身生活方式的权利。
OpenAI将订阅用户使用GPT-6 Astra和GPT-6.1 Sol的速度提升约50%,但SemiAnalysis实测称Anthropic订阅的API等价价值约为OpenAI的5倍,OpenAI 200美元套餐额度也已减半。
Ateve 团队发布 AI 决策模型 Ateve Jev,首个版本 ateve-jev-v1 支持候选选择、是非判断和等级评分,并上线 TokenDance 平台。
今天,外网被这个视频刷屏了。有人用Fable 5.5一键生成了一部「人类数万年进化史」,把整个人类历史压缩进了3分钟。整个过程,都是用纯代码写出,零视频素材,零版权音乐,没有使用任何视频生成模型。
马斯克确认正与台积电讨论Terafab芯片制造合作,而英特尔仍是目前唯一被正式点名的合作伙伴,计划提供14A工艺。
Caltech的Anima Anandkumar团队利用物理信息神经网络(PINN)和自研优化器,在三维无强迫欧拉方程自由空间中求得奇点候选解,缩放指数收敛至约0.5,但最终证明仍待完成。