AI技术研报-这里有最前沿的人工智能技术解读

华为创造AI算力新纪录：万卡集群训练98%可用度，秒级恢复、分钟诊断

大模型的落地能力，核心在于性能的稳定输出，而性能稳定的底层支撑，是强大的算力集群。其中，构建万卡级算力集群，已成为全球公认的顶尖技术挑战。

来自主题: AI技术研报

7571 点击 2025-06-10 17:05

一块4090搞定实时视频生成！Adobe黑科技来了

游戏直播等实时渲染门槛要被击穿了？Adobe 的一项新研究带来新的可能。

来自主题: AI技术研报

5680 点击 2025-06-10 16:52

让AI自己设计芯片！中国科学院发布「启蒙」，芯片全流程自动设计

近日，中国科学院计算技术研究所联合软件研究所推出「启蒙」系统，基于AI技术，实现处理器芯片软硬件各个步骤的全自动设计，达到或部分超越人类专家手工设计水平。

来自主题: AI技术研报

7296 点击 2025-06-10 16:43

北大伯克利联手“拷问”大模型：最强Agent也才40分！新基准专治“不听话”的AI分析师

给大模型当老师，让它一步步按你的想法做数据分析，有多难？

来自主题: AI技术研报

6267 点击 2025-06-10 16:25

视频生成1.3B碾压14B、图像生成直逼GPT-4o！港科&快手开源测试时扩展新范式

测试时扩展（Test-Time Scaling）极大提升了大语言模型的性能，涌现出了如 OpenAI o 系列模型和 DeepSeek R1 等众多爆款。那么，什么是视觉领域的 test-time scaling？又该如何定义？

来自主题: AI技术研报

6408 点击 2025-06-10 16:18

1.93bit版DeepSeek-R1编程超过Claude 4 Sonnet，不用GPU也能运行

1.93bit量化之后的 DeepSeek-R1（0528），编程能力依然能超过Claude 4 Sonnet？

来自主题: AI技术研报

6123 点击 2025-06-10 15:28

SOTA级视频编辑新方法：无需训练一句话编辑视频，背景保持100%

传统的视频编辑工作流，正在被AI彻底重塑。

来自主题: AI技术研报

6445 点击 2025-06-10 15:23

比自回归更灵活、比离散扩散更通用，首个纯Discrete Flow Matching多模态巨兽降临

王劲，香港大学计算机系二年级博士生，导师为罗平老师。研究兴趣包括多模态大模型训练与评测、伪造检测等，有多项工作发表于 ICML、CVPR、ICCV、ECCV 等国际学术会议。

来自主题: AI技术研报

7237 点击 2025-06-10 15:02

首创像素空间推理，7B模型领先GPT-4o，让VLM能像人类一样「眼脑并用」

视觉语言模型（VLM）正经历从「感知」到「认知」的关键跃迁。当OpenAI的o3系列通过「图像思维」（Thinking with Images）让模型学会缩放、标记视觉区域时，我们看到了多模态交互的全新可能。

来自主题: AI技术研报

6220 点击 2025-06-10 14:45

大模型能够自发形成“人类思维地图”！Nature子刊重磅研究揭示多模态大模型类脑机制

大模型≠随机鹦鹉！Nature子刊最新研究证明：大模型内部存在着类似人类对现实世界概念的理解。

来自主题: AI技术研报

6228 点击 2025-06-10 11:54

沃顿商学院重磅Prompt报告：别再对AI"循循善诱"了！我们在错误地使用它！

宾夕法尼亚大学沃顿商学院生成式AI实验室刚刚发布了两份重磅研究报告，通过严格的科学实验揭示了一个令人震惊的事实：我们可能一直在用错误的方式与AI对话。这不是胡说八道，而是基于近4万次实验得出的硬核数据推理的结论。

来自主题: AI技术研报

5026 点击 2025-06-10 11:33

60%情况下，主流大模型没理解风险只是装懂！别被模型的“安全答案”骗了

让推理模型针对风险指令生成了安全输出，表象下藏着认知危机：即使生成合规答案，超60%的案例中模型并未真正理解风险。

来自主题: AI技术研报

4918 点击 2025-06-10 11:00

最高220倍加速！面壁小钢炮4.0，稀疏创新黑科技大爆发

有史以来最具想象力的小钢炮系列，MiniCPM 4.0 来了！

来自主题: AI技术研报

6783 点击 2025-06-09 17:50

影视级3D生成新王：Direct3D-S2全面开源！8块GPU超越闭源登顶HF

3D生成模型高光时刻来临！DreamTech联手南大、复旦、牛津发布的Direct3D-S2登顶HuggingFace热榜。仅用8块GPU训练，效果超闭源模型，直指影视级精细度。

来自主题: AI技术研报

7561 点击 2025-06-09 16:52

出海赚美金：用n8n搭建「Reddit商机搜索与洞察」 AI Agent自动化寻找蓝海市场，发现真实痛点

前天，生财有术的老板亦仁发布了一条「超级标」（至少价值千万以上的现象级行业机会）：随着GPT-4o图像革命而来的，是无数的创业机会。

来自主题: AI技术研报

6582 点击 2025-06-09 16:41

3B超越DeepSeek，大模型终于理解时间了！Time-R1一统过去/未来/生成

Time-R1通过三阶段强化学习提升模型的时间推理能力，其核心是动态奖励机制，根据任务难度和训练进程调整奖励，引导模型逐步提升性能，最终使3B小模型实现全面时间推理能力，超越671B模型。

来自主题: AI技术研报

6094 点击 2025-06-09 15:54

给大模型装上「思维分段引擎」：浙大InftyThink解锁无限深度推理

学会“适当暂停与总结”，大模型终于实现无限推理。

来自主题: AI技术研报

8461 点击 2025-06-09 15:20

破解自驾数据难题！毫米波雷达可控仿真技术新框架来了

以神经网络为核心引擎，让AI承担雷达仿真数据生成任务，还实现对雷达物理特性的建模与控制——

来自主题: AI技术研报

7186 点击 2025-06-09 14:58

华为昇腾万卡集群揭秘：如何驯服AI算力「巨兽」？

你是否注意到，现在的 AI 越来越 "聪明" 了？能写小说、做翻译、甚至帮医生看 CT 片，这些能力背后离不开一个默默工作的 "超级大脑工厂"——AI 算力集群。

来自主题: AI技术研报

6055 点击 2025-06-09 14:56

CVPR 2025 Highlight｜AdaCM2：首个面向超长视频理解的跨模态自适应记忆压缩框架

本文第一作者为前阿里巴巴达摩院高级技术专家，现一年级博士研究生满远斌，研究方向为高效多模态大模型推理和生成系统。通信作者为第一作者的导师，UTA 计算机系助理教授尹淼。尹淼博士目前带领 7 人的研究团队，主要研究方向为多模态空间智能系统，致力于通过软件和系统的联合优化设计实现空间人工智能的落地。

来自主题: AI技术研报

8108 点击 2025-06-09 14:51

AI集体“听不懂”！MMAR基准测试揭示音频大模型巨大短板

用AI来整理会议内容，已经是人类的常规操作。不过，你猜怎么着？面对1000道多步骤音频推理题时，30款AI模型竟然几乎全军覆没，很多开源模型表现甚至接近瞎猜。

来自主题: AI技术研报

8082 点击 2025-06-09 14:43

区区一款 AI 会议记录软件凭什么值 2.5 亿美元？| 深度拆解 Granola 的产品哲学

「十字路口」的每一次选题、每一场活动，都像投早期项目 ——我们不只是做内容，而是希望成为「创业者声量放大器 + 早期项目雷达」。

来自主题: AI技术研报

6542 点击 2025-06-09 11:54

硅基流动 SiliconCloud × translate.js：两行代码，让网页秒切 100+ 语言

translate.js（https://github.com/xnx3/translate）是面向开发者打造的一个简单而强大的前端国际化工具，专注于提供极简高效的多语言切换能力。项目完全开源并允许商业使用。

来自主题: AI技术研报

6124 点击 2025-06-09 11:44

LLM已进入「组装」时代，CAIS复合人工智能系统来了

2024年，伯克利人工智能研究中心（BAIR）率先提出了一个新概念——复合人工智能系统（Compound AI Systems，简称CAIS）。这个看似简单的术语背后，蕴含着AI系统架构的根本性改变：不再依赖单一LLM的"超级大脑"，而是构建多组件协同的"智能生态系统"。

来自主题: AI技术研报

6799 点击 2025-06-09 11:32

大模型强化学习新突破——SPO新范式助力大模型推理能力提升！

当前，强化学习（RL）在提升大语言模型（LLM）推理能力方面展现出巨大潜力。DeepSeek R1、Kimi K1.5 和 Qwen 3 等模型充分证明了 RL 在增强 LLM 复杂推理能力方面的有效性。

来自主题: AI技术研报

6406 点击 2025-06-09 11:02

苹果炮轰推理模型全是假思考！4个游戏戳破神话，o3/DeepSeek高难度全崩溃

苹果最新大模型论文，在AI圈炸开了锅。有人总结到：苹果刚刚当了一回马库斯，否定了所有大模型的推理能力。

来自主题: AI技术研报

6582 点击 2025-06-09 10:38

扩展强化学习：环境、奖励黑客、智能体、数据扩展

Test time scaling范式蓬勃发展。推理模型持续快速改进，变得更为高效且价格更为亲民。在评估现实世界软件工程任务（如 SWE-Bench）时，模型以更低的成本取得了更高的分数。以下是显示模型变得更便宜且更优秀的图表。

来自主题: AI技术研报

5478 点击 2025-06-09 10:25

算力终结者来了！华人天团「降维打击」注意力瓶颈，AI狂飙进对数时代

注意力机制的「平方枷锁」，再次被撬开！一招Fenwick树分段，用掩码矩阵，让注意力焕发对数级效率。更厉害的是，它无缝对接线性注意力家族，Mamba-2、DeltaNet 全员提速，跑分全面开花。长序列处理迈入log时代！

来自主题: AI技术研报

7041 点击 2025-06-08 15:27

8个数据集全面胜出！思维链推理刷新图学习表现上限

图神经网络还能更聪明？思维链提示学习来了！

来自主题: AI技术研报

5863 点击 2025-06-08 15:17

告别「失忆」AI！首个大模型记忆操作系统开源框架来了！

该项目来自百家 AI，是北京邮电大学白婷副教授所指导的研究小组，团队致力于为硅基人类倾力打造情感饱满、记忆超凡的智慧大脑。

来自主题: AI技术研报

7233 点击 2025-06-08 15:07