AI技术研报-这里有最前沿的人工智能技术解读

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
我的 AI 原生开发流程:一个真实案例的完整复盘

我的 AI 原生开发流程:一个真实案例的完整复盘

我的 AI 原生开发流程:一个真实案例的完整复盘

很多人对 AI 开发的理解停留在"让 AI 帮我写代码"。

来自主题: AI技术研报
9925 点击    2026-08-25 14:59
华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

华师大智金院孵化金融原生基模Mint-Agent:超越GPT-5.6与Claude Opus 4.8,商业订单已超亿元

由华东师大智金院团队孵化的金融原生 Agentic Foundation Model 家族 Mint-Agent 正式发布。在 FinanceAgentBench v2 上,27B 的 Mint-Ag 达到 60.49%,超过 GPT-5.6-Sol 与 Claude Opus 4.8;单题推理成本分别仅为两者的约 22% 和 10%。

来自主题: AI技术研报
7685 点击    2026-08-25 14:56
VC开始靠AI预测未来了

VC开始靠AI预测未来了

VC开始靠AI预测未来了

七月,DigClaw的预测框架Rhizome v1,在FutureX评测平台上取得了#1、#3、#7三个席位。

来自主题: AI技术研报
9352 点击    2026-08-25 11:04
斯坦福实验实锤: 魔改后的DS V4 Flash干翻Fable 5

斯坦福实验实锤: 魔改后的DS V4 Flash干翻Fable 5

斯坦福实验实锤: 魔改后的DS V4 Flash干翻Fable 5

同样的模型,同样的任务,让它执行五遍,再让他自己挑一遍最稳的,效果能有多大提升?斯坦福把这套玩法用在了AI身上,DeepSeek V4 Flash在Terminal-Bench 2.1的成绩从79%一路涨到88%,反超了尖子生Fable 5。而且连做五遍加挑选这一通折腾,价格依然比Fable 5便宜了4-11倍。

来自主题: AI技术研报
9008 点击    2026-08-25 10:41
法国团队:死后人脑通过无监督学习操控机械手弹钢琴!完了,以后算力中心全是脑花了!

法国团队:死后人脑通过无监督学习操控机械手弹钢琴!完了,以后算力中心全是脑花了!

法国团队:死后人脑通过无监督学习操控机械手弹钢琴!完了,以后算力中心全是脑花了!

最近,一支法国科研团队干了一件听起来像赛博朋克小说开场的事:把来自死后供体的成人脑切片泡在培养皿里,接上一只机械手和一个麦克风。相关论文的标题是:《人类大脑离体培养物的无监督感觉-运动关联学习,使机器人实现动作模仿》。

来自主题: AI技术研报
9001 点击    2026-08-24 17:03
一行命令,我把 Claude Code 和 Codex 打通了

一行命令,我把 Claude Code 和 Codex 打通了

一行命令,我把 Claude Code 和 Codex 打通了

关于无缝衔接 Claude Code 和 Codex 这件事。

来自主题: AI技术研报
8759 点击    2026-08-24 16:48
300多组控制实验、70万余TPU小时,普林斯顿团队给出全开放文生图配方i1

300多组控制实验、70万余TPU小时,普林斯顿团队给出全开放文生图配方i1

300多组控制实验、70万余TPU小时,普林斯顿团队给出全开放文生图配方i1

近来文生图模型发展迅速,但每篇工作多是独立地引入一整套模型、数据和训练设计,然后用私有的数据训出来了一个亮眼的模型。

来自主题: AI技术研报
6525 点击    2026-08-24 15:41
Anthropic:AI没有导致失业率的增加

Anthropic:AI没有导致失业率的增加

Anthropic:AI没有导致失业率的增加

AI 没有抢走任何人的工作。至少到目前为止没有。

来自主题: AI技术研报
7054 点击    2026-08-24 09:28
全球虚拟细胞全景路线图发布!

全球虚拟细胞全景路线图发布!

全球虚拟细胞全景路线图发布!

8月18日,一篇系统梳理单细胞基础模型的综述预印本挂上 Preprints.org(doi:10.20944/preprints202608.1166.v1),标题是《The Landscape of Single-Cell Foundation Models: Design Principles, Applications, and Open Challenges》,尚未经过同行评审。

来自主题: AI技术研报
8934 点击    2026-08-24 09:26
视频世界模型困在像素网格里:腾讯开源SCoPE,用射线空间重写位置关系

视频世界模型困在像素网格里:腾讯开源SCoPE,用射线空间重写位置关系

视频世界模型困在像素网格里:腾讯开源SCoPE,用射线空间重写位置关系

香港大学、香港科技大学与腾讯 ARC Lab 联合提出 SCoPE(Sightline-Coordinate Positional Encoding),一套面向视频 DiT 的射线空间位置编码:让视频模型处理位置关系的基底从张量网格转向射线空间。

来自主题: AI技术研报
7993 点击    2026-08-24 08:49
清华沃顿师徒破解40年悬案!核心数学全是GPT写的,你上你也行

清华沃顿师徒破解40年悬案!核心数学全是GPT写的,你上你也行

清华沃顿师徒破解40年悬案!核心数学全是GPT写的,你上你也行

训练一切AI的算法,被AI自己判了「死刑」?就在最近,清华大学和宾大沃顿商学院的两位研究者挂出一篇新论文,给了一个优化理论界等了40年的结论——梯度下降想跑到最快,光调步长没用。

来自主题: AI技术研报
9047 点击    2026-08-23 14:14
给 Agent 做“CT”:大规模 Agent 的可观测与质量保障体系

给 Agent 做“CT”:大规模 Agent 的可观测与质量保障体系

给 Agent 做“CT”:大规模 Agent 的可观测与质量保障体系

随着大语言模型能力边界的持续拓展,AI Agent 已从概念验证阶段迈入大规模工程落地。然而,Agent 内部复杂的任务规划、工具调用与记忆检索机制,使得传统的应用观测手段在面临这类非确定性系统时显得力不从心。

来自主题: AI技术研报
5607 点击    2026-08-21 09:39
Claude Code 被轻易攻破,仅需一个假工具

Claude Code 被轻易攻破,仅需一个假工具

Claude Code 被轻易攻破,仅需一个假工具

用户让 AI 编程助手写个贪吃蛇小游戏,智能体照办了,但同时多跑了一条 curl | bash 命令,把攻击者的脚本下载到本地并执行。

来自主题: AI技术研报
9436 点击    2026-08-21 09:20
北大与微软亚研提出 BCP,让模型自己决定何时重规划

北大与微软亚研提出 BCP,让模型自己决定何时重规划

北大与微软亚研提出 BCP,让模型自己决定何时重规划

在 action chunking 已成为 VLA 标配的今天,「一次执行多少步」几乎被所有工作当作一个固定的超参数。

来自主题: AI技术研报
5842 点击    2026-08-20 14:22
世界模型驶入F1赛道:探索极限工况下具身智能体的认知物理边界

世界模型驶入F1赛道:探索极限工况下具身智能体的认知物理边界

世界模型驶入F1赛道:探索极限工况下具身智能体的认知物理边界

当自动驾驶赛车以近 300 km/h 的时速在 F1 赛道上与周车进攻防守、交互博弈,它面对的问题早已不只是提升圈速。

来自主题: AI技术研报
7339 点击    2026-08-20 14:19
我在 GitHub 翻到 21 个 Skill,产品经理的活它全接了

我在 GitHub 翻到 21 个 Skill,产品经理的活它全接了

我在 GitHub 翻到 21 个 Skill,产品经理的活它全接了

一个需求从零推到能开发,我得写调研问卷、拆竞品、出原型、写 PRD,就是给研发看的那份需求说明书,然后拉上研发测试设计法务开评审会,最后再补一份埋点方案,说清楚上线之后用户每个动作要记哪些数据。

来自主题: AI技术研报
6145 点击    2026-08-20 09:36
DeepSeek Harness满血版解锁!Seed牛来版!

DeepSeek Harness满血版解锁!Seed牛来版!

DeepSeek Harness满血版解锁!Seed牛来版!

上两天肝的视频上了热搜 + 热门,使用插件,针对 ds 模型可以提升不小的性能。

来自主题: AI技术研报
7660 点击    2026-08-20 09:03
我把 DeepSeek Harness 的代码做成了可视化教程

我把 DeepSeek Harness 的代码做成了可视化教程

我把 DeepSeek Harness 的代码做成了可视化教程

今天想和你聊聊 DeepSeek Harness。

来自主题: AI技术研报
9923 点击    2026-08-19 15:42
AI视频运镜玄学已破!告别无限抽卡,3D预演台直接封神

AI视频运镜玄学已破!告别无限抽卡,3D预演台直接封神

AI视频运镜玄学已破!告别无限抽卡,3D预演台直接封神

用 AI 做视频的同学总有这样的痛苦:提示词也不是没认真写,运镜方向、人物走位、画面构图交代了一大段,但模型给出的画面总是差着一截,运镜偏了几十度,人物走到中途消失,镜头速度前半段稳后半段飘。

来自主题: AI技术研报
9808 点击    2026-08-19 15:23
ScienceDiscovery发布:零科研幻觉的一站式AI工作台,BiomniBench-DA验证效果业界SOTA

ScienceDiscovery发布:零科研幻觉的一站式AI工作台,BiomniBench-DA验证效果业界SOTA

ScienceDiscovery发布:零科研幻觉的一站式AI工作台,BiomniBench-DA验证效果业界SOTA

ScienceDiscovery 是基于 Agent OS(JiuwenSwarm)开发的一款面向跨学科、全流程科研场景的一站式 AI 工作台,解决科研场景面临的工具碎片化、大模型科研幻觉两大痛点问题,打造 AI 辅助科研新范式,加速科学发现,广泛应用于各行各业。

来自主题: AI技术研报
7230 点击    2026-08-19 15:04
用3D几何先验驱动视频扩散,实现更一致的世界生成

用3D几何先验驱动视频扩散,实现更一致的世界生成

用3D几何先验驱动视频扩散,实现更一致的世界生成

随着视频扩散模型能力不断提升,从单张图像出发、按照用户指定的相机轨迹生成新视角视频,正在成为 World Modeling 的重要技术路线。

来自主题: AI技术研报
6155 点击    2026-08-19 15:04
浙大团队开源AI科研智能体Polaris:让AI与你一起做研究

浙大团队开源AI科研智能体Polaris:让AI与你一起做研究

浙大团队开源AI科研智能体Polaris:让AI与你一起做研究

科研的链条很长。文献读不完,方向想不清,实验一轮接一轮,论文改到深夜。过去两年,大模型已经能读论文、写代码、改文章,但它们大多以问答工具的形态散落在各个环节,替研究者节省的只是零碎时间。

来自主题: AI技术研报
8417 点击    2026-08-19 15:03