AI技术研报-这里有最前沿的人工智能技术解读

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
几千人催我蒸馏的X冷启动Skill,开源了!

几千人催我蒸馏的X冷启动Skill,开源了!

几千人催我蒸馏的X冷启动Skill,开源了!

大家好,我是袋鼠帝 几天前我尝试做了一个相对粗糙的视频,是关于我开源的仓颉Skill的 没想到居然爆火了!(全网将近50万播放)。

来自主题: AI技术研报
6354 点击    2026-07-16 10:11
大模型RL训练为何会「越训越窄」?ACL Outstanding Paper从token-level熵变揭示RLVR训练机制

大模型RL训练为何会「越训越窄」?ACL Outstanding Paper从token-level熵变揭示RLVR训练机制

大模型RL训练为何会「越训越窄」?ACL Outstanding Paper从token-level熵变揭示RLVR训练机制

基于可验证奖励的强化学习(Reinforcement Learning with Verifiable Rewards,RLVR)正在成为大模型后训练的关键技术。数学题能判对错,代码能跑测试,可验证奖励让大模型可以通过强化学习持续提升推理能力。

来自主题: AI技术研报
9905 点击    2026-07-16 10:10
世界模型迎来「真考场」:WorldArena 2.0 Challenge正式启动

世界模型迎来「真考场」:WorldArena 2.0 Challenge正式启动

世界模型迎来「真考场」:WorldArena 2.0 Challenge正式启动

WorldArena 1.0 的核心意义,在于将世界模型评测从 “好不好看” 推进到 “是否真的有用”。它不再只关注视频观感,而是把物理一致性、可控性、3D 准确性和具身任务功能性纳入统一评测框架,使许多看似流畅的生成结果第一次在机器人具身任务中接受检验。

来自主题: AI技术研报
8843 点击    2026-07-16 10:10
ISSTA 2026|LAVE:面向扩散语言模型的约束解码

ISSTA 2026|LAVE:面向扩散语言模型的约束解码

ISSTA 2026|LAVE:面向扩散语言模型的约束解码

推理大模型 (如 DeepSeek-R1、o1) 靠长思维链拿高分,却普遍「想太多」: 研究统计了五个代表性模型里,发现有 41–52% 的 token 是在模型给出它的最终答案之后生成的。

来自主题: AI技术研报
8668 点击    2026-07-16 10:09
用推理步骤的「语义冗余」给LRM过度思考踩刹车

用推理步骤的「语义冗余」给LRM过度思考踩刹车

用推理步骤的「语义冗余」给LRM过度思考踩刹车

推理大模型 (如 DeepSeek-R1、o1) 靠长思维链拿高分,却普遍「想太多」: 研究统计了五个代表性模型里,发现有 41–52% 的 token 是在模型给出它的最终答案之后生成的。

来自主题: AI技术研报
5560 点击    2026-07-16 10:08
首次,统一建模视角下的扩散语言模型后门威胁

首次,统一建模视角下的扩散语言模型后门威胁

首次,统一建模视角下的扩散语言模型后门威胁

扩散语言模型(DLM)正逐渐成为自回归(Autoregressive, AR)语言模型之外一种新兴的建模范式。

来自主题: AI技术研报
8346 点击    2026-07-15 14:35
超越OpenAI,中国00后团队攻破「记忆」难题!打造下一个AI互联网时刻

超越OpenAI,中国00后团队攻破「记忆」难题!打造下一个AI互联网时刻

超越OpenAI,中国00后团队攻破「记忆」难题!打造下一个AI互联网时刻

80年前,阿根廷作家博尔赫斯写过一个寓言,叫《博闻强记的富内斯》。博尔赫斯笔下的富内斯,拥有过目不忘、堪称完美的记忆,却无法思考,因为思考依赖于遗忘和抽象。

来自主题: AI技术研报
9070 点击    2026-07-15 14:34
提示词工程论文登上ICML 2026,网友吵翻了天

提示词工程论文登上ICML 2026,网友吵翻了天

提示词工程论文登上ICML 2026,网友吵翻了天

这年头,提示词工程也能发ICML了???

来自主题: AI技术研报
7006 点击    2026-07-15 11:11
离谱,Claude Fable 5 手搓魔兽世界后,开始和人类组队开黑了!

离谱,Claude Fable 5 手搓魔兽世界后,开始和人类组队开黑了!

离谱,Claude Fable 5 手搓魔兽世界后,开始和人类组队开黑了!

这两天网上冲浪的时候,发现有人用 Claude 复刻了一个类似《魔兽世界》的在线多人游戏。

来自主题: AI技术研报
8003 点击    2026-07-15 10:28
AI越会回答,人为什么越需要深度思考?复旦发布2026人文社科智能发展蓝皮书

AI越会回答,人为什么越需要深度思考?复旦发布2026人文社科智能发展蓝皮书

AI越会回答,人为什么越需要深度思考?复旦发布2026人文社科智能发展蓝皮书

曾经我们对 AI 的期待还比较朴素,写邮件、翻译论文、聊天搭子……那时候,AI 像一个初出茅庐的实习生,你指哪它打哪,但也经常一本正经地胡说八道。

来自主题: AI技术研报
8007 点击    2026-07-14 15:28
Yann LeCun连续转发并高度认可的VISReg,到底强在哪?

Yann LeCun连续转发并高度认可的VISReg,到底强在哪?

Yann LeCun连续转发并高度认可的VISReg,到底强在哪?

近日,自监督学习新工作 VISReg(Variance-Invariance-Sketching Regularization)获图灵奖得主 Yann LeCun 连续转发并给予高度认可 —— 他在转发时评价道「VICReg begat SIGReg which begat VISReg」(VICReg 孕育了 SIGReg,SIGReg 又孕育了 VISReg),

来自主题: AI技术研报
9269 点击    2026-07-14 15:28
Science | 北大研制全球首款基于可控存内计算的忆阻器神经动力学芯片

Science | 北大研制全球首款基于可控存内计算的忆阻器神经动力学芯片

Science | 北大研制全球首款基于可控存内计算的忆阻器神经动力学芯片

近日,新基石研究员、北京大学集成电路学院教授、深圳研究生院信息工程学院院长杨玉超团队,联合中国科学院上海微系统与信息技术研究所宋志棠研究员团队等,在国际顶级学术期刊《科学》发表最新成果,在新型神经动力学计算芯片领域取得重大突破。

来自主题: AI技术研报
5719 点击    2026-07-14 11:08
无需视觉 tokenizer,北大PRA解锁自回归图像生成潜力,135M模型性能反超1.9B基线

无需视觉 tokenizer,北大PRA解锁自回归图像生成潜力,135M模型性能反超1.9B基线

无需视觉 tokenizer,北大PRA解锁自回归图像生成潜力,135M模型性能反超1.9B基线

过去几年,扩散模型几乎定义了高质量图像生成:从随机噪声出发,经过多轮迭代,逐步 “雕刻” 出一张图像。但随着大语言模型席卷人工智能领域,另一条路线正迅速走到舞台中央 —— 图像,能否也像语言一样,通过自回归方式逐步生成?

来自主题: AI技术研报
7193 点击    2026-07-14 11:07
md2wechat 3.0重磅发布,10种图片场景一次讲透

md2wechat 3.0重磅发布,10种图片场景一次讲透

md2wechat 3.0重磅发布,10种图片场景一次讲透

大家好,我是极客杰尼。 今天,md2wechat 正式发布 3.0.0 大版本,这次最重要的变化,是普通创作者也能让 Agent 帮自己完成多图和 SVG 排版。

来自主题: AI技术研报
9206 点击    2026-07-14 11:07
OpenAI骑脸输出!仅5分钟,把GPT-5.6塞进Claude老家

OpenAI骑脸输出!仅5分钟,把GPT-5.6塞进Claude老家

OpenAI骑脸输出!仅5分钟,把GPT-5.6塞进Claude老家

OpenAI高管亲自下场,教开发者5分钟极速「策反」Claude Code,这波贴脸开大太狠了。

来自主题: AI技术研报
6785 点击    2026-07-13 16:02
Codex + ChatCut,Agent 剪视频成了!

Codex + ChatCut,Agent 剪视频成了!

Codex + ChatCut,Agent 剪视频成了!

最近刷小红书,总能刷到 ChatCut。

来自主题: AI技术研报
6103 点击    2026-07-13 16:01
全球首创!AI看一眼视频就能「读出」双手,三个世界第一

全球首创!AI看一眼视频就能「读出」双手,三个世界第一

全球首创!AI看一眼视频就能「读出」双手,三个世界第一

不教AI认手,而是从视频世界模型里直接「读」出双手:三大基准SOTA,让百万小时野生视频第一次能变成机器人的操作教材。

来自主题: AI技术研报
7240 点击    2026-07-13 15:27
5秒挖出15年Linux漏洞,AI却让无辜记者成了偷车嫌犯

5秒挖出15年Linux漏洞,AI却让无辜记者成了偷车嫌犯

5秒挖出15年Linux漏洞,AI却让无辜记者成了偷车嫌犯

一个AI工具挖出了藏在Linux里15年的致命漏洞,另一个AI却因为一个被录错的数字,让四辆警车把无辜记者当成盗车贼围了起来。

来自主题: AI技术研报
7626 点击    2026-07-13 15:17
ICML 2026|让奖励模型更准更高效,TikTok、NUS提出置信度门控

ICML 2026|让奖励模型更准更高效,TikTok、NUS提出置信度门控

ICML 2026|让奖励模型更准更高效,TikTok、NUS提出置信度门控

奖励模型(Reward Model, RM)是大语言模型对齐的核心组件,负责为模型输出提供符合人类偏好的评价信号。现有方法各有短板:标量判别式 RM 高效稳定但可解释性有限;生成式 judge 能给出判断理由,却需为每个样本生成长 reasoning,token 与延迟开销显著。

来自主题: AI技术研报
7147 点击    2026-07-13 14:44
世界模型应如何评估?南京大学团队发布「世界模型」评估立场论文

世界模型应如何评估?南京大学团队发布「世界模型」评估立场论文

世界模型应如何评估?南京大学团队发布「世界模型」评估立场论文

近期,围绕「世界模型」的讨论持续升温。机器人、自动驾驶、视频生成、具身智能等多个方向都在频繁使用这一概念,相关系统不断出现,演示形式日益丰富,评价指标也越来越多。伴随这一趋势,一个基础问题变得格外重要:当一个模型被称为「世界模型」时,人们究竟在评价什么?

来自主题: AI技术研报
8222 点击    2026-07-13 14:44
Agentic时代推荐系统范式认知或被颠覆?个性化推荐或将从平台中心转向用户主导

Agentic时代推荐系统范式认知或被颠覆?个性化推荐或将从平台中心转向用户主导

Agentic时代推荐系统范式认知或被颠覆?个性化推荐或将从平台中心转向用户主导

在过去二三十年的互联网发展中,个性化推荐几乎一直是平台的核心能力之一。打开视频 app,平台决定你接下来会刷到什么视频;打开购物软件,平台预测你可能会购买什么商品;打开短视频 app,平台根据你的浏览、点赞、停留和互动,不断优化信息流。某种意义上,现代互联网的用户体验本身就是由推荐系统塑造的。

来自主题: AI技术研报
9428 点击    2026-07-13 14:43