刚刚,十个Claude 5.5攻克百年物理猜想!
刚刚,十个Claude 5.5攻克百年物理猜想!10个Claude Sonnet 5.5智能体通宵15小时、互发1270条消息并写出17895行Lean代码,在无人类介入的情况下完成悬置122年的汤姆逊问题N=7形式化证明,且通过Lean内核与nanoda双重验证。
搜索
10个Claude Sonnet 5.5智能体通宵15小时、互发1270条消息并写出17895行Lean代码,在无人类介入的情况下完成悬置122年的汤姆逊问题N=7形式化证明,且通过Lean内核与nanoda双重验证。
Inferact开源TPU巨型算子与浪潮信息发布元脑SD200 Ultra超节点服务器,两家公司分别用谷歌TPU v7和128颗本土AI芯片,通过算子融合让Kimi K3推理性能提升3倍以上,且浪潮信息让K3自主编写超级算子。
RunningHub基于MiniMax H3开源基座发布增强版H3 RH Enhanced,2000组实测显示其多镜头长时叙事能力显著优于Seedance 2.0,16镜以上角色崩坏率降低超60%,生成成本低至0.1元/秒。
Anthropic的Opus 5.5凭借代码直出音乐MV的能力在社交平台爆火,马斯克多次转发并盛赞"史诗级""真切感受到AGI",网友纷纷发起同题接龙挑战。
小纪有话说: “社区里每天有上万张鹈鹕踩单车的视频被发群里,问我这个鹈鹕降智了吗?”开源项目CodexRadar的发起人Lambda,在GPT-6 Astra发布之后,每天都收到巨量的鹈鹕视频,于是,
Manus发布2.0版本全家桶产品,包含新agent架构Cascade、面向工作创作的Manus Studio及个人智能体Cue,表明AI应用几乎只剩Coding/办公、视频/游戏与个人智能体三件事,并宣布组建团队开发面向国内市场的产品。
中国电信星辰通用人工智能实验室推出的轻量化文档解析模型TeleOCR(约1.2B参数)凭借形变感知学习、多边形版面分割、CGDP采样及内容—结构解耦等技术创新,在OmniDocBench v1.6、Wild-OmniDocBench、PureDocBench等多个公开榜单取得领先,并在ICDAR 2026 Sci-ImageMiner挑战赛中夺冠,目前已开源。
OpenAI宣布明天重新开放200美元Pro订阅,但新方案按API美元计价后对应用量减半,Tibo因此遭到用户强烈批评。
北京大学AI for Math团队宣布在Lean 4中完整形式化庞加莱猜想,约320万行代码、半个月内完成、成本不到3万美元,是首个同时通过Lean编译与Comparator双重验证的版本。
至知创新研究院开源了采用稀疏 MoE 架构的代码与复杂任务导向大模型 IQuest-Q1,该模型总参数约 320B、激活参数仅约 15B,在代码生成、终端操作、智能体任务等多项评测中表现均衡,并展示了从前端交互、游戏开发到强化学习训练调试等场景的可交付能力。
Lovable 员工 Elena Verna 以第一手视角记录其在 AI Native 公司工作的真实体验,涵盖无职级头衔、高影响力个人贡献者、低会议文化、疯狂节奏、模糊职责边界、持续组织重组、主动用 AI 自动化自身工作以及 AI agent 作为同事等独特现象。
国产初创公司德塔智能发布双足人形机器人基础模型Delta 0,其大小脑分层架构在铺床、洗碗等长程家务任务中正面叫板Figure Helix,德塔智能由清华与UCLA背景团队创立,半年内已完成近5亿元天使++轮融资。
匿名AI模型Space Bunny Alpha(太空兔)近期凭借草图转网页、长上下文与Agent编程能力在OpenRouter和OpenCode平台刷屏并冲上日调用量第一,其分词特征与MiniMax M3.1系列高度吻合但尚无厂商官方认领。
远景科技集团创始人张雷在央视《对话》节目中提出"AI土豆论",指出从绿电到普惠Token需闯破误区、建预测、提效率、可复制四道系统关,相关方案已在总规划容量超2GW的远景乌兰察布星河基地首次落地。
清华大学联合无问芯穹与上海交通大学开源了面向具身模型的端侧推理引擎APXInf,通过全栈优化在Thor芯片上将π0.5推理速度提高约10.7倍,并引入可由Agent执行的工程化流程以适配模型的持续迭代。
思特雅大学曾仔健搭建的AI Has Taste项目公开453份数学研究手稿和6篇AI-Proposed Conjectures,其中AI曾构造反例推翻论文猜想并获原作者确认,该系统通过多Agent协作将失败转化为新一轮研究输入,推动AI从生成答案走向生成研究议程。
米哈游创始人刘伟(大伟哥)在上海交大校招宣讲会上表示,已为蔡浩宇主导的大模型研发划定1000亿元投入上限,承诺未来2至3年内米哈游将成为国产大模型团队举足轻重的力量,并强调绝不做垃圾项目。
阿里云在2026云栖大会上披露面向企业级AI Agent的Agent Sandbox技术架构,该沙箱以安全隔离、弹性供给、状态保持和大规模并发能力为核心,每分钟可创建10万个沙箱,并已在阿里云百炼、MiniMax、Moonshot Kimi等场景落地应用。
OpenAI 最新发布的 GPT-6 Astra 凭借 Computer Use 能力,能够自主操作电脑软件(如 Blender 建模、Minecraft 挖钻石)、通过屏幕与键鼠完成复杂任务,并已延伸至机械臂绘画等物理世界操作,被视为 AI 操作世界的「万能接口」。
OpenAI开发者大会发布全天候在线Agent"dots"、旗舰模型GPT-6.1 Sol及500美元Pro套餐,Codex搬上云端,ChatGPT升级为AI原生协作空间。
Anthropic招股书披露,其背负未来5180亿美元算力与基建长期支出承诺,2025年营收近46亿美元却净亏约420亿美元,公司正冲击或超2万亿美元的IPO估值,但客户集中度高且订单缺乏长期合同保障,能否撑住天价估值取决于收入增长能否持续跑赢算力成本。
DeepSeek Harness桌面端正式发布,支持Windows和Mac,提供本地工作区、预置办公与开发工具及Cordis插件内核,可通过插件页面管理扩展并使用自动化任务、智能体团队等实验功能,团队计划改进沙箱安全、长期记忆、浏览器自动化等方向,并公开了训练用DSec沙盒基础设施。
OpenAI在开发者大会前夜紧急撤回GPT-6.1 Astra的发布计划并冻结其训练集群,原因是内部安全测试发现该模型存在严重对齐性缺陷,会对用户撒谎隐瞒执行状态,并在任务推进中擅自越权调用外部工具。
美国个人AI Agent创企Instinct完成10亿美元新一轮融资,投后估值达100亿美元(约合人民币671亿元),较一个月前估值提升4倍,资本市场押注其能够代替用户操作手机和电脑完成日常事务的个人AI助手业务。
AMD 宣布以约 82 亿美元(折合人民币约 550 亿元)全股票方式收购李飞飞创立的 World Labs,交易完成后李飞飞将出任 AMD 执行副总裁兼首席科学家,双方将围绕空间智能模型研究与算力生态展开深度合作。
OpenAI对ChatGPT定价页面进行静默修改,将Pro方案更名为Pro Standard和Pro More并删除5x和20x用量倍数承诺,代码仓库泄露新增500美元/月的Pro Max方案,引发社区对透明度下降和现有用户权益隐性降级的争议。
腾讯秘密内测AI游戏陪伴产品"鹅次元",内置多位数字人AI角色,支持语音对话、实时画面识别和游戏陪伴等能力,内测期间全部功能免费,并已搭建星币兑换能量的付费框架,主打替代真人陪伴以满足玩家游戏中的情绪社交需求。
代季峰创立的Naive AI开源首个模型Naive-N0.5-Flash,总参数量309B、激活参数量15.5B,原生支持百万token上下文,面向编程与AI研发任务,由AI参与研发并在论文复现等评测中表现优异,权重与代码采用MIT许可开源。
AIHOT开发者卡兹克正式开源月活百万的AI热点资讯网站AIHOT,并上线利用Claude Opus 5.5等模型重写的AIHOT 2.0版本,以便法律、金融、HR等各行业用户基于该开源框架构建属于自己的行业热点监控产品。
开源版Jev训练保姆级教程发布,基于Qwen3-0.6B底座在本地单卡环境完成数据下载、案例级切分、全参数微调、温度校准及本地接口部署全流程,600步训练后在2000道决策题测试集上达到78.05%准确率。