只读文本的AI,科学推理能力只有“看图”AI的1/3丨中科大
只读文本的AI,科学推理能力只有“看图”AI的1/3丨中科大目前,这项技术已成功应用于上海人工智能实验室Intern-S2-Preview 35B/397B系列多模态大模型的预训练中,有效提升了模型的科学推理与多模态理解能力。值得一提的是,相关研发均基于国产昇腾算力平台完成,并成功实现了面向大规模预训练的深度适配与优化。
搜索
目前,这项技术已成功应用于上海人工智能实验室Intern-S2-Preview 35B/397B系列多模态大模型的预训练中,有效提升了模型的科学推理与多模态理解能力。值得一提的是,相关研发均基于国产昇腾算力平台完成,并成功实现了面向大规模预训练的深度适配与优化。
DeepSeek-V4-Flash风评冲爆了,原生支持接入Codex,而且还强化了Agent能力。我第一时间把它接进了Codex,用cc swich非常方便。一个小时,跑了一亿多token。跟大家说说体感。
7月31日,DeepSeek正式向公众开放V4-Flash正式版API公测。这一次,最亮眼的关键词是——Agent能力大幅跃升。9项基准测试成绩全面披露,多项指标远超此前发布的V4-Pro-Preview预览版,直接将“代码智能体”的天花板又顶高了一截。
今天,Thinking Machines正式发布第二款重磅模型——Inkling-Small。276B总参数、12B激活参数,原生多模态,100万token上下文。半个月前,首个开源975B Inkling登场,曾在AI圈掀起了巨浪。
起底 K3 背后核心极客天团,人均扛起 7 亿估值!
2026年7月16日,东京。 英伟达CEO黄仁勋拍了一个大大的马屁:"日本发明了现代制造业。现在,它正在建设将驱动下一次工业革命的AI工厂。"不过效果很明显,日本被彻底忽悠瘸了,在同一天,市场估算投资额接近3.4万亿日元的项目落地(约1408亿元人民币)。
旧金山市中心有一条很窄的小巷,名字叫 Claude Lane,巷子里开着一家全年无休的咖啡馆。凌晨两点,顾客仍然可以进来买咖啡、连无线网络、打开电脑工作。到了工作日下午,店里的桌子经常全部坐满,有人只能把电脑放在膝盖上。
近日,米哈游创始人蔡浩宇久违地更新了自己的个人领英,新增了一条独立大模型+智能体开发者(Independent LLM+Agent Developer)的职业经历,时间从2026年7月开始,在新加坡混合办公。
7 月 19 日至 23 日,美国洛杉矶,SIGGRAPH 2026 如期而至。这场汇聚全球计算机图形学与视觉计算领域顶尖学者、艺术家与工程师的年度盛会,吸引了来自 69 个国家的近万名参会者。渲染、几何建模、动画仿真、与生成式 AI,几乎所有关于如何用计算机创造视觉世界的最前沿探索,都在这五天里集中呈现。
7月几天之内,中国大模型行业接连出现了两个超过2万亿参数的模型。