AI资讯新闻榜单内容搜索-模型

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 模型
GPT-5难产,外媒爆料:性能提升不大,OpenAI高管Slack上当众破防

GPT-5难产,外媒爆料:性能提升不大,OpenAI高管Slack上当众破防

GPT-5难产,外媒爆料:性能提升不大,OpenAI高管Slack上当众破防

赢了的才是「GPT-5」。 GPT-5 迟迟未现身,网友们开始制作各种梗图「吐槽」其实,这几天关于 GPT-5 的传言就没消停。先是有网友在 macOS ChatGPT 应用中发现了 GPT-5-Auto 和 GPT-5-Reasoning 模型的踪迹:

来自主题: AI资讯
7731 点击    2025-08-02 14:28
刚刚,谷歌「IMO金牌」模型上线Gemini,数学家第一时间证明猜想

刚刚,谷歌「IMO金牌」模型上线Gemini,数学家第一时间证明猜想

刚刚,谷歌「IMO金牌」模型上线Gemini,数学家第一时间证明猜想

网友:Deep Think 简直太疯狂了。本周五,谷歌宣布向 Google AI Ultra 订阅用户推出 Deep Think 功能,并将全版本的 Gemini 2.5 Deep Think 模型(用于 IMO 竞赛)提供给部分数学家使用。

来自主题: AI资讯
7935 点击    2025-08-02 14:20
Z Tech|独家解读Meta朱泽园开源新基线,用10%算力跑赢Llama3-8B,科学方法引领新范式,语言模型物理学迈入新时代

Z Tech|独家解读Meta朱泽园开源新基线,用10%算力跑赢Llama3-8B,科学方法引领新范式,语言模型物理学迈入新时代

Z Tech|独家解读Meta朱泽园开源新基线,用10%算力跑赢Llama3-8B,科学方法引领新范式,语言模型物理学迈入新时代

《Physics of Language Models(语言模型物理学)》,正是将AI研究带入“物理学范式”的项目,由Meta FAIR研究院的朱泽园概念化发起,并统筹设计。

来自主题: AI资讯
7670 点击    2025-08-02 14:04
PPIO这家AI Infra公司为什么做了一个“中国版的E2B”?

PPIO这家AI Infra公司为什么做了一个“中国版的E2B”?

PPIO这家AI Infra公司为什么做了一个“中国版的E2B”?

中国首个推出兼容E2B接口Agent沙箱的公司。7月26日,2025世界人工智能大会(WAIC)现场人头攒动。在科技要素拉满的会场内,几乎每个展台都在讨论大模型和AI Agent。

来自主题: AI资讯
8018 点击    2025-08-02 13:52
抖音全新推荐大模型RankMixer,参数翻70倍,推理成本不涨

抖音全新推荐大模型RankMixer,参数翻70倍,推理成本不涨

抖音全新推荐大模型RankMixer,参数翻70倍,推理成本不涨

你刷的每一条短视频,背后都隐藏着推荐算法的迭代与革新。 作为最新成果,字节跳动的算法团队提出的全新推荐排序模型架构RankMixer,在兼顾算力利用率的同时,实现了模型效果的可扩展性。

来自主题: AI资讯
9130 点击    2025-08-02 13:45
一个模型超了DeepSeek R1、V3,参数671B,成本不到350万美元

一个模型超了DeepSeek R1、V3,参数671B,成本不到350万美元

一个模型超了DeepSeek R1、V3,参数671B,成本不到350万美元

Deep Cogito,一家鲜为人知的 AI 初创公司,总部位于旧金山,由前谷歌员工创立,如今开源的四款混合推理模型,受到大家广泛关注。

来自主题: AI资讯
7814 点击    2025-08-02 13:38
AI答IMO难题坦承“不会”,OpenAI:这就是自我意识

AI答IMO难题坦承“不会”,OpenAI:这就是自我意识

AI答IMO难题坦承“不会”,OpenAI:这就是自我意识

这一次,“不会”竟成了大模型的高光时刻。 虽然在IMO第6题上得了零分,OpenAI的金牌模型却展现了“高智商的诚实”。

来自主题: AI资讯
6680 点击    2025-08-02 13:32
机器人不只会抓和放!北京大学X银河通用「世界-动作模型」赋能全面泛化的非抓握技能

机器人不只会抓和放!北京大学X银河通用「世界-动作模型」赋能全面泛化的非抓握技能

机器人不只会抓和放!北京大学X银河通用「世界-动作模型」赋能全面泛化的非抓握技能

尽管当前的机器人视觉语言操作模型(VLA)展现出一定的泛化能力,但其操作模式仍以准静态的抓取与放置(pick-and-place)为主。相比之下,人类在操作物体时常常采用推动、翻转等更加灵活的方式。若机器人仅掌握抓取,将难以应对现实环境中的复杂任务。

来自主题: AI技术研报
7936 点击    2025-08-02 13:19
港科大发布「大模型越狱攻击」评估基准,覆盖37种、6大类别方法

港科大发布「大模型越狱攻击」评估基准,覆盖37种、6大类别方法

港科大发布「大模型越狱攻击」评估基准,覆盖37种、6大类别方法

现有的方法对大语言模型(LLM)「越狱」攻击评估存在误判和不一致问题。港科大团队提出了GuidedBench评估框架,通过为每个有害问题制定详细评分指南,显著降低了误判率,揭示了越狱攻击的真实成功率远低于此前估计,并为未来研究提供了更可靠的评估标准。

来自主题: AI技术研报
7726 点击    2025-08-02 13:15
谷歌深夜放出 IMO 金牌模型,多项测试力压 Grok 4、OpenAI o3!网友评论两极分化

谷歌深夜放出 IMO 金牌模型,多项测试力压 Grok 4、OpenAI o3!网友评论两极分化

谷歌深夜放出 IMO 金牌模型,多项测试力压 Grok 4、OpenAI o3!网友评论两极分化

昨夜,谷歌宣布向 Google AI Ultra 订阅用户推出 Deep Think 功能,Gemini 2.5 Deep Think 模型在今年的国际数学奥林匹克竞赛 (IMO) 上夺得金牌。

来自主题: AI资讯
7642 点击    2025-08-02 13:09