AI资讯新闻榜单内容搜索-Ark

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Ark
OpenAI把AI推向物理世界,这家公司已造好引擎,下一站1000万小时人类经验

OpenAI把AI推向物理世界,这家公司已造好引擎,下一站1000万小时人类经验

OpenAI把AI推向物理世界,这家公司已造好引擎,下一站1000万小时人类经验

9 月 3 日,OpenAI 正式发布 GPT-6 Astra。在 ARC-AGI-3(一个考验 AI 能否在陌生环境中自主探索、理解规则并规划行动的 Benchmark),Astra 拿下 99.9%,并在 96% 的关卡中达到或超过人类的行动效率基准。

来自主题: AI技术研报
8991 点击    2026-09-17 15:22
是时候重新评估 MiniMax 了。

是时候重新评估 MiniMax 了。

是时候重新评估 MiniMax 了。

前几天,著名外宾AI应用 Genspark 干了一件以前不太像它会干的事。

来自主题: AI资讯
7655 点击    2026-09-14 10:23
2000+真实场景搬进仿真!一个导航模型零样本“通吃”四种机器人本体

2000+真实场景搬进仿真!一个导航模型零样本“通吃”四种机器人本体

2000+真实场景搬进仿真!一个导航模型零样本“通吃”四种机器人本体

过去一年,具身智能的技术迭代明显加快。VLA、世界模型持续演进,强化学习重新成为机器人学习的重要技术路径,Sim2Real加速从仿真走向真机,全身控制能力也在快速突破。

来自主题: AI技术研报
8413 点击    2026-09-14 09:22
AI Costco,开始卖自有品牌了

AI Costco,开始卖自有品牌了

AI Costco,开始卖自有品牌了

Genspark 发布基于 MiniMax M3 后训练的自有品牌 PPT 模型 Gen-1 Slides,标志着这家曾被比作"AI Costco"的应用公司开始从组合外部模型转向在开源基座上训练专用模型。

来自主题: AI资讯
8123 点击    2026-09-13 13:05
谷歌Meta被锤刷榜!Gemini暴跌70分,Top 2秒变倒数第三

谷歌Meta被锤刷榜!Gemini暴跌70分,Top 2秒变倒数第三

谷歌Meta被锤刷榜!Gemini暴跌70分,Top 2秒变倒数第三

分析机构SemiAnalysis点名谷歌Gemini 3.8 Flash和Meta Muse Spark 1.3在Terminal-Bench 2.1刷榜,换用新版Terminal-Bench 4.0后Gemini分数从89.4暴跌至19.1,揭露大厂通过购买"模拟卷"训练数据刷榜的AI造假黑幕。

来自主题: AI资讯
8876 点击    2026-09-13 13:04
突发!OpenAI关停史上最快模型

突发!OpenAI关停史上最快模型

突发!OpenAI关停史上最快模型

OpenAI宣布旗下史上最快模型GPT-5.3-Codex-Spark仅存活7个月后将于下周退役,因其"以智能换速度"的设计在Cerebras晶圆上跑通旗舰模型GPT-5.6 Sol的Ultrafast模式后已失去存在意义。

来自主题: AI资讯
8564 点击    2026-09-12 19:26
GPT-6登顶第一!AlphaFold之后最大震撼,成抗体预测最强AI

GPT-6登顶第一!AlphaFold之后最大震撼,成抗体预测最强AI

GPT-6登顶第一!AlphaFold之后最大震撼,成抗体预测最强AI

OpenAI发布的GPT-6 Astra在Insilico Medicine构建的DDD Benchmark抗体可开发性预测测试中以37.98分登顶第一,在不依赖外部专用工具的情况下击败所有前沿模型,标志着通用大模型正在突破抗体成药性预测这一生物医药研发的"死亡之谷",成为AlphaFold之后最具震撼性的科学范式转移。

来自主题: AI资讯
8929 点击    2026-09-11 16:06
OpenAI这是拿千禧年难题当Benchmark刷啊。。。

OpenAI这是拿千禧年难题当Benchmark刷啊。。。

OpenAI这是拿千禧年难题当Benchmark刷啊。。。

《纽约时报》最新追访,补出了这场冲突中此前没有披露的细节。

来自主题: AI资讯
8300 点击    2026-09-11 10:14
Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

Eval丨 我们做了个“你画我猜 Benchmark” :1350 张图后,GPT-6 险胜

我们自建的"你画我猜 Benchmark"第一期用150个词、1350张SVG画作对8款模型进行互画互猜测试,最终GPT-6 Astra以75.5分险胜Gemini 3.8 Flash与Claude Fable 5.1,结果显示思考更多或花费更多的模型并未稳定取得更高分,且部分模型连自己的画都认不出。

来自主题: AI技术研报
9422 点击    2026-09-06 11:05