AI资讯新闻榜单内容搜索-scaling

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: scaling
深度|对话OpenAI推理教父:为什么说现有的Benchmark让我们严重低估了AI能力?

深度|对话OpenAI推理教父:为什么说现有的Benchmark让我们严重低估了AI能力?

深度|对话OpenAI推理教父:为什么说现有的Benchmark让我们严重低估了AI能力?

本期播客,No Priors 请来了一位在 AI 推理领域被业内称为「教父级」人物的研究者Noam Brown。他是 OpenAI 的研究科学家,也是推动「test-time compute scaling」成为行业主流方向的关键人物之一。从扑克 AI 到前沿大模型的评估方法论,Brown 的研究轨迹几乎与整个行业对「推理」认知的升级同步。

来自主题: AI资讯
5387 点击    2026-08-05 11:04
斯坦福新开了一门课,专门讲 AI 怎么自我进化

斯坦福新开了一门课,专门讲 AI 怎么自我进化

斯坦福新开了一门课,专门讲 AI 怎么自我进化

斯坦福最近公开了一门课的录像,叫 CS329A,主题是 Self-Improving AI Agents(自我改进的 AI agent)。两位主讲教授,Aakanksha Chowdhery 和 Azalia Mirhoseini,都有极深的工业背景。Aakanksha 曾是 Google 540B 参数 PaLM 模型的技术负责人,也参与了 Gemini 的研发

来自主题: AI资讯
8999 点击    2026-08-04 10:29
把思考折叠进序列:WeLM 617B MoE的隐式Scaling路径

把思考折叠进序列:WeLM 617B MoE的隐式Scaling路径

把思考折叠进序列:WeLM 617B MoE的隐式Scaling路径

新智元报道 大模型变强,过去靠两条路。 做大——Scaling Law出现后,参数从百亿推向千亿,算力支出一路飙升。 想久——o1带火思考模型,用更长的思维链、更多推理时间换结果。 问题是,除了Sca

来自主题: AI技术研报
8552 点击    2026-07-24 15:54
六位顶尖学者、三大挑战赛道——IROS 2026 Physical World Models Workshop征稿

六位顶尖学者、三大挑战赛道——IROS 2026 Physical World Models Workshop征稿

六位顶尖学者、三大挑战赛道——IROS 2026 Physical World Models Workshop征稿

2026年10月1日,IROS 2026 Workshop——Physical World Models for Scaling Embodied AI将在美国匹兹堡举行。论文征集现已开放,8月10日截止;WorldArena 2.0 Challenge三大赛道已于7月10日开赛,总奖金$7500。

来自主题: AI资讯
7228 点击    2026-07-22 10:09
WAIC五位首席科学家交锋:多模态是LLM的“外挂”,还是下一代智能的“灵魂”?

WAIC五位首席科学家交锋:多模态是LLM的“外挂”,还是下一代智能的“灵魂”?

WAIC五位首席科学家交锋:多模态是LLM的“外挂”,还是下一代智能的“灵魂”?

作为WAIC 2026最受关注的论坛,由商汤科技承办的“基座大模型架构创新与生态合作论坛”吸引了无数AI研究者、产业专家和投资机构的目光。因它直面了当前大模型行业最核心的焦虑:当Scaling Law在逼近物理极限,多模态究竟是破局的“解药”,还是新瓶装旧酒的延伸?

来自主题: AI资讯
9258 点击    2026-07-19 10:11
小米发布Xiaomi-Robotics-1具身基座模型:100000h真实数据,首次系统验证机器人Scaling Law

小米发布Xiaomi-Robotics-1具身基座模型:100000h真实数据,首次系统验证机器人Scaling Law

小米发布Xiaomi-Robotics-1具身基座模型:100000h真实数据,首次系统验证机器人Scaling Law

今天,小米刚刚扔出一颗“深水炸弹”——Xiaomi-Robotics-1具身基座模型,试图改变这一局面。Xiaomi-Robotics-1基于10万小时真实世界操作轨迹进行预训练,再用约1.1万小时跨本体数据完成后训练。据悉,这是国内首次在机器人策略模型中,对Scaling Law进行较为完整的系统验证。

来自主题: AI资讯
8742 点击    2026-07-16 16:24
3.8万小时、狂烧天价token:字节发现Agent的 Scaling Law

3.8万小时、狂烧天价token:字节发现Agent的 Scaling Law

3.8万小时、狂烧天价token:字节发现Agent的 Scaling Law

7月2日,字节 Seed 发布了一个 Agent评测项目 EdgeBench。看起来又是一个 benchmark,但它问了一个其他榜单不问的问题。EdgeBench 的切口就是把盲区里的东西放进评测,解答一个问题:把Agent扔进一个陌生环境,12小时后,你能变强多少?

来自主题: AI技术研报
9004 点击    2026-07-08 15:53