AI资讯新闻榜单内容搜索-o

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: o
谷歌大佬盛赞Fable 5!23年前PC神作,40分钟塞进iPhone

谷歌大佬盛赞Fable 5!23年前PC神作,40分钟塞进iPhone

谷歌大佬盛赞Fable 5!23年前PC神作,40分钟塞进iPhone

谷歌DeepMind的一个高管,用死对头Anthropic的AI,把一个2003年的游戏硬塞进了iPhone。这个人叫Ammaar Reshi,是AI Studio的产品与设计负责人。跑的是真实引擎,ARM64原生编译,不是模拟器。

来自主题: AI资讯
10493 点击    2026-07-06 15:56
AMD跑GLM 5.2,成本只要英伟达一半

AMD跑GLM 5.2,成本只要英伟达一半

AMD跑GLM 5.2,成本只要英伟达一半

GLM 5.2,用AMD芯片也能跑出来了,而且成本只要英伟达的一半。这是推理优化公司Wafer这周公布的一组数据。Wafer用AMD的MI355X芯片跑最新开源模型GLM 5.2,单节点吞吐做到2626 tok/s,单流吞吐也跑到了213 tok/s。

来自主题: AI资讯
8725 点击    2026-07-06 15:55
1600代码造出水下曼哈顿, Fable 5让Karpathy看呆了

1600代码造出水下曼哈顿, Fable 5让Karpathy看呆了

1600代码造出水下曼哈顿, Fable 5让Karpathy看呆了

Fable 5重新上线,Arena.ai的Gostev在一段视频中甩出63个3D世界,几乎都是一次成型。看了视频,就连刚加盟Anthropic预训练团队的Karpathy,也直呼没想到。

来自主题: AI资讯
9169 点击    2026-07-06 15:52
Claude、GLM、GPT谁才是真正的AI软件工程师?首个持续更新Visual Spec-to-App Benchmark发布

Claude、GLM、GPT谁才是真正的AI软件工程师?首个持续更新Visual Spec-to-App Benchmark发布

Claude、GLM、GPT谁才是真正的AI软件工程师?首个持续更新Visual Spec-to-App Benchmark发布

为了解决这一问题,来自 University of Arizona、Zoom 与 Stony Brook University 的研究团队推出了 VISTA(VIsual Spec-To-App Benchmark), 首个面向 Visual Spec-to-Web-App Coding Agents 的端到端 Benchmark。

来自主题: AI技术研报
8694 点击    2026-07-06 15:49
Vibe Coding误烧55万元token,他靠嘲笑声反手赚了7个亿

Vibe Coding误烧55万元token,他靠嘲笑声反手赚了7个亿

Vibe Coding误烧55万元token,他靠嘲笑声反手赚了7个亿

一名员工响应公司号召,一头扎进Vibe Coding的世界里,勤勤恳恳搓出了一个像素风脑腐FPS游戏。没等他心里美完,不经意瞥了一眼。我去,这玩意儿花了我81267美元的token(折合人民币55万元)???

来自主题: AI资讯
8658 点击    2026-07-06 15:48
ICML 2026|如何对Multi-Agent系统进行过程评估?重新认识多智能体系统中的Orchestrator

ICML 2026|如何对Multi-Agent系统进行过程评估?重新认识多智能体系统中的Orchestrator

ICML 2026|如何对Multi-Agent系统进行过程评估?重新认识多智能体系统中的Orchestrator

来自南京大学 NLP 实验室的 ICML 2026 论文 Recognize Your Orchestrator: An Entropy Dynamics Perspective for LLM Multi-Agent Systems 指出:在当前主流的 Orchestrator-Executor 多智能体架构中,系统失败往往并不首先来自某个执行器不会干活,

来自主题: AI技术研报
9070 点击    2026-07-06 15:48
Claude Code用不了?DeepSeek上新:Deep Code来了

Claude Code用不了?DeepSeek上新:Deep Code来了

Claude Code用不了?DeepSeek上新:Deep Code来了

据DeepSeek官方API文档及GitHub仓库信息,一款名为Deep Code的第三方开源AI编程助手近日被收录进DeepSeek Agent工具。该工具面向DeepSeek-V4系列模型做了适配,支持深度思考、推理强度控制、Agent Skills以及MCP集成。截至发稿,Deep Code GitHub仓库显示,该工具收获超1500星、127 fork。

来自主题: AI资讯
9271 点击    2026-07-06 14:40
Fable 5被网友薅出省钱神招!pxpipe最高让token减70%!

Fable 5被网友薅出省钱神招!pxpipe最高让token减70%!

Fable 5被网友薅出省钱神招!pxpipe最高让token减70%!

这两天,有位机智的老哥发现,只要把Fable 5的上下文转换成一张张密密麻麻写满文字的图片,再让模型通过OCR读回来,token输入成本最多能省下70%。更离谱的是,不只是普通对话,系统提示、工具文档、历史记录,全都能一股脑塞进图里。

来自主题: AI资讯
9526 点击    2026-07-06 12:25
李飞飞LeCun疯狂加注!中国黑马零犀科技,已在因果AI暗战6年

李飞飞LeCun疯狂加注!中国黑马零犀科技,已在因果AI暗战6年

李飞飞LeCun疯狂加注!中国黑马零犀科技,已在因果AI暗战6年

从李飞飞World Labs的50亿估值,到LeCun出走创立AMI Labs的十亿种子轮,再到谷歌Genie 3让文本生成的世界第一次具备实时可交互、可导航的形态,世界模型正在成为AI下一阶段的核心战场。

来自主题: AI资讯
9230 点击    2026-07-06 12:25
世界模型评测的最大盲区,被新基准MemoBench捅破了

世界模型评测的最大盲区,被新基准MemoBench捅破了

世界模型评测的最大盲区,被新基准MemoBench捅破了

来自哈佛大学、MIT、IBM、波士顿大学、谷歌、JHU、CMU 和 Kempner Institute 的研究者提出了一个新的诊断性基准:MemoBench。这是首个面向动态环境的「消失-重现」世界建模评测基准,并已被计算机视觉顶会 ECCV 2026 接收。其一作 Haoyu Chen 为哈佛大学计算科学与工程专业一年级硕士生,师从哈佛大学计算机科学助理教授 Yilun Du。

来自主题: AI技术研报
8455 点击    2026-07-06 12:24