AI技术研报-这里有最前沿的人工智能技术解读

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
中国AI突破「造芯方法论」!Agent军团接管芯片设计全流程

中国AI突破「造芯方法论」!Agent军团接管芯片设计全流程

中国AI突破「造芯方法论」!Agent军团接管芯片设计全流程

RSI(Recursive Self-Improvement,递归自我改进)正在成为人工智能领域最受瞩目的前沿方向。

来自主题: AI技术研报
5452 点击    2026-08-26 15:03
把PLC仿真搬进浏览器,小参数模型也能实现高工程通过率

把PLC仿真搬进浏览器,小参数模型也能实现高工程通过率

把PLC仿真搬进浏览器,小参数模型也能实现高工程通过率

AI正在改变软件开发方式。过去需要从零编写的程序,现在可以用自然语言描述需求,再由AI生成代码初稿。

来自主题: AI技术研报
8850 点击    2026-08-26 14:47
Anthropic 重磅发布:AI Native 软件开发方法论

Anthropic 重磅发布:AI Native 软件开发方法论

Anthropic 重磅发布:AI Native 软件开发方法论

Anthropic 最近发布了一篇博客文章《The AI Native SDLC playbook》,讨论AI进入软件开发之后,整个软件开发生命周期(Software Development Life Cycle,简称 SDLC)应该怎么重做。

来自主题: AI技术研报
6854 点击    2026-08-26 12:27
我们给DeepSeek Harness接入了MemSearch ,自动把Memory提炼成Skill

我们给DeepSeek Harness接入了MemSearch ,自动把Memory提炼成Skill

我们给DeepSeek Harness接入了MemSearch ,自动把Memory提炼成Skill

DeepSeek Harness(DSH) 的口号,大家应该都有所了解,模型、工具、Skills、会话、沙箱、存储、Agent Loop、调度,甚至 UI,一切皆插件。

来自主题: AI技术研报
6421 点击    2026-08-26 11:40
AI能否独立开展科研?ASI-Bench为科学自主性建立评测标尺

AI能否独立开展科研?ASI-Bench为科学自主性建立评测标尺

AI能否独立开展科研?ASI-Bench为科学自主性建立评测标尺

如果超级智能有黎明, 我们现在大概在黎明破晓前。 天还没亮,但地平线上已经有光了。

来自主题: AI技术研报
5969 点击    2026-08-26 11:22
V-RAE:把「看懂视频」的能力带入生成,重新思考视频模型的潜空间

V-RAE:把「看懂视频」的能力带入生成,重新思考视频模型的潜空间

V-RAE:把「看懂视频」的能力带入生成,重新思考视频模型的潜空间

近日,新加坡国立大学 Minghui Guo 与牛津大学 Shengqiong Wu、Hao Fei 在论文《V-RAE: Rethinking Video Latent Spaces for Generation》中提出视频表征自编码器 V-RAE。该方法以冻结的视觉基础模型为编码器,通过轻量级时间池化压缩视频特征,并将具有丰富语义和时间连续性的表征直接用于视频重建、生成与未来预测。

来自主题: AI技术研报
8659 点击    2026-08-26 10:19
我的 AI 原生开发流程:一个真实案例的完整复盘

我的 AI 原生开发流程:一个真实案例的完整复盘

我的 AI 原生开发流程:一个真实案例的完整复盘

很多人对 AI 开发的理解停留在"让 AI 帮我写代码"。

来自主题: AI技术研报
10148 点击    2026-08-25 14:59
华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

由华东师大智金院团队孵化的金融原生 Agentic Foundation Model 家族 Mint-Agent 正式发布。在 FinanceAgentBench v2 上,27B 的 Mint-Ag 达到 60.49%,超过 GPT-5.6-Sol 与 Claude Opus 4.8;单题推理成本分别仅为两者的约 22% 和 10%。

来自主题: AI技术研报
7934 点击    2026-08-25 14:56
VC开始靠AI预测未来了

VC开始靠AI预测未来了

VC开始靠AI预测未来了

七月,DigClaw的预测框架Rhizome v1,在FutureX评测平台上取得了#1、#3、#7三个席位。

来自主题: AI技术研报
9465 点击    2026-08-25 11:04
斯坦福实验实锤: 魔改后的DS V4 Flash干翻Fable 5

斯坦福实验实锤: 魔改后的DS V4 Flash干翻Fable 5

斯坦福实验实锤: 魔改后的DS V4 Flash干翻Fable 5

同样的模型,同样的任务,让它执行五遍,再让他自己挑一遍最稳的,效果能有多大提升?斯坦福把这套玩法用在了AI身上,DeepSeek V4 Flash在Terminal-Bench 2.1的成绩从79%一路涨到88%,反超了尖子生Fable 5。而且连做五遍加挑选这一通折腾,价格依然比Fable 5便宜了4-11倍。

来自主题: AI技术研报
9096 点击    2026-08-25 10:41
法国团队:死后人脑通过无监督学习操控机械手弹钢琴!完了,以后算力中心全是脑花了!

法国团队:死后人脑通过无监督学习操控机械手弹钢琴!完了,以后算力中心全是脑花了!

法国团队:死后人脑通过无监督学习操控机械手弹钢琴!完了,以后算力中心全是脑花了!

最近,一支法国科研团队干了一件听起来像赛博朋克小说开场的事:把来自死后供体的成人脑切片泡在培养皿里,接上一只机械手和一个麦克风。相关论文的标题是:《人类大脑离体培养物的无监督感觉-运动关联学习,使机器人实现动作模仿》。

来自主题: AI技术研报
9207 点击    2026-08-24 17:03
一行命令,我把 Claude Code 和 Codex 打通了

一行命令,我把 Claude Code 和 Codex 打通了

一行命令,我把 Claude Code 和 Codex 打通了

关于无缝衔接 Claude Code 和 Codex 这件事。

来自主题: AI技术研报
8821 点击    2026-08-24 16:48
300多组控制实验、70万余TPU小时,普林斯顿团队给出全开放文生图配方i1

300多组控制实验、70万余TPU小时,普林斯顿团队给出全开放文生图配方i1

300多组控制实验、70万余TPU小时,普林斯顿团队给出全开放文生图配方i1

近来文生图模型发展迅速,但每篇工作多是独立地引入一整套模型、数据和训练设计,然后用私有的数据训出来了一个亮眼的模型。

来自主题: AI技术研报
6558 点击    2026-08-24 15:41
Anthropic:AI没有导致失业率的增加

Anthropic:AI没有导致失业率的增加

Anthropic:AI没有导致失业率的增加

AI 没有抢走任何人的工作。至少到目前为止没有。

来自主题: AI技术研报
7112 点击    2026-08-24 09:28
全球虚拟细胞全景路线图发布!

全球虚拟细胞全景路线图发布!

全球虚拟细胞全景路线图发布!

8月18日,一篇系统梳理单细胞基础模型的综述预印本挂上 Preprints.org(doi:10.20944/preprints202608.1166.v1),标题是《The Landscape of Single-Cell Foundation Models: Design Principles, Applications, and Open Challenges》,尚未经过同行评审。

来自主题: AI技术研报
8981 点击    2026-08-24 09:26
视频世界模型困在像素网格里:腾讯开源SCoPE,用射线空间重写位置关系

视频世界模型困在像素网格里:腾讯开源SCoPE,用射线空间重写位置关系

视频世界模型困在像素网格里:腾讯开源SCoPE,用射线空间重写位置关系

香港大学、香港科技大学与腾讯 ARC Lab 联合提出 SCoPE(Sightline-Coordinate Positional Encoding),一套面向视频 DiT 的射线空间位置编码:让视频模型处理位置关系的基底从张量网格转向射线空间。

来自主题: AI技术研报
8041 点击    2026-08-24 08:49
清华沃顿师徒破解40年悬案!核心数学全是GPT写的,你上你也行

清华沃顿师徒破解40年悬案!核心数学全是GPT写的,你上你也行

清华沃顿师徒破解40年悬案!核心数学全是GPT写的,你上你也行

训练一切AI的算法,被AI自己判了「死刑」?就在最近,清华大学和宾大沃顿商学院的两位研究者挂出一篇新论文,给了一个优化理论界等了40年的结论——梯度下降想跑到最快,光调步长没用。

来自主题: AI技术研报
9091 点击    2026-08-23 14:14
给 Agent 做“CT”:大规模 Agent 的可观测与质量保障体系

给 Agent 做“CT”:大规模 Agent 的可观测与质量保障体系

给 Agent 做“CT”:大规模 Agent 的可观测与质量保障体系

随着大语言模型能力边界的持续拓展,AI Agent 已从概念验证阶段迈入大规模工程落地。然而,Agent 内部复杂的任务规划、工具调用与记忆检索机制,使得传统的应用观测手段在面临这类非确定性系统时显得力不从心。

来自主题: AI技术研报
5687 点击    2026-08-21 09:39
Claude Code 被轻易攻破,仅需一个假工具

Claude Code 被轻易攻破,仅需一个假工具

Claude Code 被轻易攻破,仅需一个假工具

用户让 AI 编程助手写个贪吃蛇小游戏,智能体照办了,但同时多跑了一条 curl | bash 命令,把攻击者的脚本下载到本地并执行。

来自主题: AI技术研报
9500 点击    2026-08-21 09:20
北大与微软亚研提出 BCP,让模型自己决定何时重规划

北大与微软亚研提出 BCP,让模型自己决定何时重规划

北大与微软亚研提出 BCP,让模型自己决定何时重规划

在 action chunking 已成为 VLA 标配的今天,「一次执行多少步」几乎被所有工作当作一个固定的超参数。

来自主题: AI技术研报
5922 点击    2026-08-20 14:22
世界模型驶入F1赛道:探索极限工况下具身智能体的认知物理边界

世界模型驶入F1赛道:探索极限工况下具身智能体的认知物理边界

世界模型驶入F1赛道:探索极限工况下具身智能体的认知物理边界

当自动驾驶赛车以近 300 km/h 的时速在 F1 赛道上与周车进攻防守、交互博弈,它面对的问题早已不只是提升圈速。

来自主题: AI技术研报
7432 点击    2026-08-20 14:19