只读文本的AI,科学推理能力只有“看图”AI的1/3丨中科大
只读文本的AI,科学推理能力只有“看图”AI的1/3丨中科大目前,这项技术已成功应用于上海人工智能实验室Intern-S2-Preview 35B/397B系列多模态大模型的预训练中,有效提升了模型的科学推理与多模态理解能力。值得一提的是,相关研发均基于国产昇腾算力平台完成,并成功实现了面向大规模预训练的深度适配与优化。
搜索
目前,这项技术已成功应用于上海人工智能实验室Intern-S2-Preview 35B/397B系列多模态大模型的预训练中,有效提升了模型的科学推理与多模态理解能力。值得一提的是,相关研发均基于国产昇腾算力平台完成,并成功实现了面向大规模预训练的深度适配与优化。
7月31日,DeepSeek正式向公众开放V4-Flash正式版API公测。这一次,最亮眼的关键词是——Agent能力大幅跃升。9项基准测试成绩全面披露,多项指标远超此前发布的V4-Pro-Preview预览版,直接将“代码智能体”的天花板又顶高了一截。
三智一体不断演进,开启具身智能新未来。
Claude,开始对密码算法下手了。
Z Potentials 独家获悉,新加坡国立大学博士,牛津大学博士后研究员林庆泓(Kevin)近期以首席研究员(Principal Researcher)身份加入世界模型公司 Video Rebirth,负责多模态智能体与世界模型相关研究。
当我们从业内人士处听到,一款专注欧美市场的 AI 视频 Agent 产品「DeeVid AI」,上线才一年半,注册用户达 3000 万,ARR 也做到数千万美元量级,多少有些意外。这家公司此前并不起眼,没有大额融资的高光时刻,也很少出现在赛道的公开讨论里。
咱发现,邓文迪和默多克的二女儿Chloe Di Murdoch(以下简称Chloe),今年刚提前一年从斯坦福硕士毕业,就兴致勃勃加入了一家AI创业公司。就是AI 2.0时代程序员古早外挂、Vibe Coding老祖——Devin背后的公司。
近日,北京航空航天大学史振威教授和邹征夏教授团队发布了一个面向通用遥感目标检测的大规模数据集与基础模型框架 ——LEVIRDet。该研究构建了目前最大规模、最全面的遥感目标检测数据集 LEVIRDet-159,并在此基础上提出了面向通用遥感检测的基础模型 LEVIRDetNet。
就在前几天,一家名为 Oasis Devices 的迈阿密初创公司,发布了一款专门适用于不方便打字也不方便大声说话的新 AI 录音听写硬件,OASIS 1 智能戒指。这枚售价 289 美元的钛合金戒指,最大的卖点,就是把 Wispr Flow 的 AI 听写技术,从一个放在手机上的 App 里,转到了一个离我们嘴巴更近的载体里。
观点跃迁研发了全球首个Text to Device AI电子设备生成平台STACK ANYWAY,旨在打通从“任意想法”到“现实硬件”的端到端链路。据观点跃迁估算,在海量的硬件SKU中,至少70%-80%属于硬件原型阶段,而这些原型实际上撬动了规模更大的量产硬件市场。整个硬件原型开发相关市场规模粗略估算已达上百亿美元。