谷歌把AI搜索塞进手机!不到600MB,照片、视频、录音断网照样搜
谷歌把AI搜索塞进手机!不到600MB,照片、视频、录音断网照样搜10月6日,谷歌开源EmbeddingGemma 2,把一个能搜图、看视频、听声音的搜索引擎,塞进了一个内存不到600MB的小模型!
搜索
10月6日,谷歌开源EmbeddingGemma 2,把一个能搜图、看视频、听声音的搜索引擎,塞进了一个内存不到600MB的小模型!
最高20核CPU、6144核GPU、128GB统一内存、1PFLOPS本地AI算力。
Claude Haiku 5.5发布,小模型大逆袭!
AI生成内容越来越快,你要收尾的活儿却越攒越多。
2026年AI赛道最大的风口,或许早已不是传统的AI生成图文、视频,而是可落地、可参与、可二次创作的AI互动产品。
昨天早上,可能会是人类时代的一个分水岭。
在这个被大模型和 AI 融资神话包裹的 2026 年,如果有人问:谁是国内大厂 AI 产品经理最危险的竞争对手?
同志们家人们,国庆假期终于结束,此时此刻我在德黑兰等飞机,看到大伙又开始发表自己对于Personal agent的重要见解,无脑吹捧邪恶的扎克伯格的拉盘行动。
厘清智能近日完成天使轮及天使+轮数亿元融资,蚂蚁集团连续两轮加码并领投天使+轮,资金将投入物理世界数据管线、模型研发、物理仿真、能力评测、跨本体适配与部署系统建设。
就在刚刚,OpenAI 宣布向 ChatGPT 全体用户推送 GPT-6,同时上线 Intelligent UI(智能界面)。
太炸裂了!
Anthropic发布Claude Haiku 5.5,单价为Haiku 4.5的十分之一,多项跑分显著提升,定位为处理摘要、上下文压缩、数据库查询和分类等任务的高速低成本模型。
谷歌推出Nano Banana 2.1,出图价为Nano Banana 2的一半,支持蒙版局部编辑、最高4K直出和最多14张参考图,并在Arena多图编辑榜排名第4,陆续登陆Gemini App、搜索AI模式、AI Studio等平台。
OpenAI公开了未发布的内部前沿模型产出的722篇数学手稿,归为372个成果族,涉及准黎曼猜想和四维挂谷猜想等,其中235族附有Lean形式化说明,仍待专家审读验证。
作者将手绘视频制作流程整理为handdrawn-explainer Skill并上传至SkillHub,使agent能按主题生成脚本和可视分镜,产出配音与绘画时序对齐的视频,并支持审阅后修改。
OpenAI推出四项更新:Auto-review全面免费,API付费等级由五档简化为三档且Grow门槛由1000美元降至500美元,Meetings插件进入macOS版ChatGPT Beta,Decisions API面向开发者开放公测。
OpenAI启用文本水印,未来几周将为欧盟符合条件的ChatGPT与Codex文本输出加入不可见水印,其textGrain方案由2026年考普斯奖得主苏炜杰等九人合作设计。
Anthropic内部尚未发布的超前代Claude自动生成完整证明代码,并经Lean严格验证,攻克了渗流理论3至10维连续相变猜想这一困扰数学界近70年的概率论“圣杯”难题。
DeepSeek Harness v0.2.1-alpha.1 加入实验性 Claude Code Mods 兼容层,用于验证其扩展能力与“一切皆插件”架构的关系,但目前尚不能保证所有 Mods 无缝运行。
Utopai Studios正以Utopai X和PAI将模型生成、素材管理及专业协作纳入同一电影制作流程,并规划三部2027年院线片,同时拓展DeNA合作与体育IP开发。
陶哲轩在SAIR最新演讲中呼吁AI公司放慢数学解题速度,称AI量产证明却缺乏理解、阐释和传播,将引发“Proof Indigestion”与数据污染风险。
Anthropic强化学习技术负责人Sholto Douglas预测,能力等于甚至超过所有人类的AGI可能在未来几年内出现,2028年AI年度资本开支或达4万亿美元,而研究员Nick Marwell对AI无需人类搭档后的后果表示紧张。
OpenAI在GitHub的openai/math仓库公开722份数学手稿,涉及372个问题家族及Lean形式化证明,并表示多数结果来自未发布的内部模型,部分未形式化结果可能存在问题。
Claude网页端和桌面端新增简体中文、繁体中文界面,但中国大陆及港澳仍不在Anthropic官方支持地区范围内。
Mistral 发布 Mistral Large 4,采用细粒度混合专家结构,总参数1.05T、每次激活49B,支持图文输入和100万上下文,API现已开放,权重计划于10月27日发布。
据彭博社报道,DeepSeek即将敲定至少800亿元人民币的新一轮融资,腾讯和宁德时代承诺出资金额居前,该轮融资拟为2027年初IPO铺路,但最终条款仍未确定。
开源项目mu(μ)在进化酒馆黑客松深圳收官战中夺冠,其将Jev深度融合进Harness,通过35个判定点优化上下文管理与多Agent通信。
英伟达投资的Reflection发布开源模型Beam,采用MoE架构,专注代码、推理和Agent任务,官方称其以GLM-5.2三分之一至四分之一的推理算力取得相当成绩,但原始能力仍落后部分前沿开源模型,计划月底以Apache 2.0放出权重。
A16Z第七版Top 100 消费级 AI 应用与9月底更新的市场状况 II显示,美国消费者虽已广泛尝试AI,但日常使用和付费渗透仍浅,智能降价正放大Agent的Token需求,重度用户与大众之间的AI使用鸿沟扩大,资本也重新流向芯片、能源和数据中心等实体基础设施。
Anthropic部分早期员工因担忧AI失控开始考虑在美国偏远地区买地避难,这群源自湾区AI安全圈的研究者也因风险判断不同而选择留下或离开。