AI技术研报-这里有最前沿的人工智能技术解读

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
李飞飞的世界模型,终于开始训练机器人了

李飞飞的世界模型,终于开始训练机器人了

李飞飞的世界模型,终于开始训练机器人了

李飞飞老师的World Labs,补了块关键拼图。

来自主题: AI技术研报
7637 点击    2026-07-29 14:22
少即是多,这次轮到大模型来证明

少即是多,这次轮到大模型来证明

少即是多,这次轮到大模型来证明

每逢重要的新模型发布,我们编辑部通常比新闻本身更早进入工作状态:提前打开官网、直播和社交媒体,等结果陆续出来,大家一边热火朝天地开始写文章,一边梳理参数、榜单和演示案例,判断这一次技术究竟向前走了多远。

来自主题: AI技术研报
9611 点击    2026-07-29 14:03
大模型、机器人之外,社会智能补上AGI第三极

大模型、机器人之外,社会智能补上AGI第三极

大模型、机器人之外,社会智能补上AGI第三极

是时候讨论一下 AI 的 “第三极”—— 社会智能了。

来自主题: AI技术研报
6779 点击    2026-07-29 14:01
目前最强的编程 Agent,不是 Fable 5,而是「用Codex指挥ChatGPT Pro」

目前最强的编程 Agent,不是 Fable 5,而是「用Codex指挥ChatGPT Pro」

目前最强的编程 Agent,不是 Fable 5,而是「用Codex指挥ChatGPT Pro」

哈喽,大家好,我是刘小排。 刚才,有关注我 Token 消耗的小伙伴已经发现:我今天的 Codex 消耗突然很低。

来自主题: AI技术研报
9598 点击    2026-07-29 10:10
Agent该不该单独配一个记忆模型?怎么搭建?Meta最新研究给出了答案

Agent该不该单独配一个记忆模型?怎么搭建?Meta最新研究给出了答案

Agent该不该单独配一个记忆模型?怎么搭建?Meta最新研究给出了答案

一个Agent可以完整读过任务要求,亲手执行过失败命令,也能在十分钟前准确定位错误根因,但到了下一轮决策,它仍可能像第一次遇到问题一样重走旧路:再次写入已经确认不可写的目录,重新尝试已经被证伪的参数,或者修好局部测试后忘掉最初的验收条件。

来自主题: AI技术研报
7176 点击    2026-07-29 09:50
全球⾸个⼤规模 Agentic 扩散模型来了!

全球⾸个⼤规模 Agentic 扩散模型来了!

全球⾸个⼤规模 Agentic 扩散模型来了!

还记得「苦涩的教训」(The Bitter Lesson)吗?

来自主题: AI技术研报
7856 点击    2026-07-28 12:20
如何让你的 Agent 搜索,搜得更快更聪明?

如何让你的 Agent 搜索,搜得更快更聪明?

如何让你的 Agent 搜索,搜得更快更聪明?

即使到了人手 N 个 Agent 产品的时代,大部分人还在用 Agent 产品的默认搜索与策略。

来自主题: AI技术研报
5954 点击    2026-07-28 12:19
世界模型迎来因果升级:CD-LAM仅用几千步微调即可显著增强动作控制

世界模型迎来因果升级:CD-LAM仅用几千步微调即可显著增强动作控制

世界模型迎来因果升级:CD-LAM仅用几千步微调即可显著增强动作控制

人类可以轻松想象一个还没做出的动作会带来什么:手一松,杯子会掉;往前一推,抽屉会合上。动作尚未发生,大脑已经预演了可能的结果。对机器人来说,具身世界模型(Embodied World Model)会根据当前观察和未来的动作,预测动作执行后的未来画面。

来自主题: AI技术研报
5847 点击    2026-07-28 10:33
我们实测TRAE Work的这份攻略,被官方收进知识库了

我们实测TRAE Work的这份攻略,被官方收进知识库了

我们实测TRAE Work的这份攻略,被官方收进知识库了

上周我们发了一篇Agent大横评的文章三家评测,结果评论区出现了一个高频问题: “字节的TRAE Work建议测一下。”

来自主题: AI技术研报
9412 点击    2026-07-27 16:07
AI最尴尬的短板,中国科学院出手了

AI最尴尬的短板,中国科学院出手了

AI最尴尬的短板,中国科学院出手了

GPT-5.5能写专业论文,DeepSeek-V4-Pro能生成复杂代码,具身机器人能完成基础物理操作,语言智能和工具智能都已经跑出了自己的赛道。

来自主题: AI技术研报
7539 点击    2026-07-27 15:50
Claude Opus 5,第一次杀死 Harness?

Claude Opus 5,第一次杀死 Harness?

Claude Opus 5,第一次杀死 Harness?

7 月 24 日,Claude Opus 5 上线。几个小时之内,我看到各家媒体把这个模型的评测成绩转载了一轮,而更值得留意的是 Anthropic 内部人员当天发出的一条推文。

来自主题: AI技术研报
7576 点击    2026-07-27 11:31
浪费20亿Token之后,我做了一个帮自己定义目标的Skill。

浪费20亿Token之后,我做了一个帮自己定义目标的Skill。

浪费20亿Token之后,我做了一个帮自己定义目标的Skill。

今天给大家开源一个我自己周末做完然后用的很爽的Skill。 我把它称为, Leader.skill。

来自主题: AI技术研报
7864 点击    2026-07-27 11:10
我给 codex 装的最有用的 skill,是反过来盘我的

我给 codex 装的最有用的 skill,是反过来盘我的

我给 codex 装的最有用的 skill,是反过来盘我的

装完 codex,很多人在输入框里敲的第一句话是这样的:帮我做个 XX 网站。

来自主题: AI技术研报
8596 点击    2026-07-27 11:10
试完Codex这4个神仙用法,彻底回不去了...【建议收藏】

试完Codex这4个神仙用法,彻底回不去了...【建议收藏】

试完Codex这4个神仙用法,彻底回不去了...【建议收藏】

大家好,我是连续充值Codex Pro会员4个月的袋鼠帝。 不得不说,Codex是真香,一开始我还是100刀的Pro 自从GPT-5.6出来之后,已经改成200$的会员了。

来自主题: AI技术研报
6218 点击    2026-07-27 11:09