AI资讯新闻榜单内容搜索-Deep

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: Deep
字节Seed团队PHD-Transformer突破预训练长度扩展!破解KV缓存膨胀难题

字节Seed团队PHD-Transformer突破预训练长度扩展!破解KV缓存膨胀难题

字节Seed团队PHD-Transformer突破预训练长度扩展!破解KV缓存膨胀难题

最近,DeepSeek-R1 和 OpenAI o1/03 等推理大模型在后训练阶段探索了长度扩展(length scaling),通过强化学习(比如 PPO、GPRO)训练模型生成很长的推理链(CoT),并在奥数等高难度推理任务上取得了显著的效果提升。

来自主题: AI技术研报
5499 点击    2025-04-28 14:09
大模型不懂命理,但她们还是问了

大模型不懂命理,但她们还是问了

大模型不懂命理,但她们还是问了

年初,DeepSeek 上线,18 天内即获得了 1600 万次下载,登顶 140 国下载榜单。让人意料之外而又情理之中的是,AI最火的功能不是翻译、写作,而是算命。有数据显示,#DeepSeek 算命等话题在小红书上吸引了超过 6600 万次浏览。

来自主题: AI资讯
7853 点击    2025-04-27 20:38
实测免费DeepResearch!轻量版深夜上线,基于o4-mini,速度更快/重视脉络梳理

实测免费DeepResearch!轻量版深夜上线,基于o4-mini,速度更快/重视脉络梳理

实测免费DeepResearch!轻量版深夜上线,基于o4-mini,速度更快/重视脉络梳理

终于,免费用户也能用上OpenAI的DeepResearch了,量子位也进行了新鲜实测!OpenAI深夜官宣,基于o4-mini某个版本的轻量版DeepResearch正式上线。按照官方说法,轻量版的回答会更短,但智能水平将几乎无异于满血版本。

来自主题: AI资讯
7804 点击    2025-04-27 10:20
炸裂!DeepMind 发布 Lyria 2 音乐生成模型!

炸裂!DeepMind 发布 Lyria 2 音乐生成模型!

炸裂!DeepMind 发布 Lyria 2 音乐生成模型!

Google DeepMind正式发布其最新的音乐生成模型Lyria2,标志着音乐创作领域人工智能又一重大突破。该新模型具备高保真音频生成和专业音质,为音乐家、制作人和创作者提供了更强大的工具。

来自主题: AI资讯
7835 点击    2025-04-27 09:16
Deep Research类产品深度测评:下一个大模型产品跃迁点到来了吗?

Deep Research类产品深度测评:下一个大模型产品跃迁点到来了吗?

Deep Research类产品深度测评:下一个大模型产品跃迁点到来了吗?

Deep Research 产品可被理解为一个以大模型能力为基础、集合了检索与报告生成的端到端系统,对信息进行迭代搜索和分析,并生成详细报告作为输出。

来自主题: AI技术研报
5787 点击    2025-04-26 20:28
美国政府「AI行动计划」万言书发布! OpenAI与Anthropic呼吁联手封锁中国AI

美国政府「AI行动计划」万言书发布! OpenAI与Anthropic呼吁联手封锁中国AI

美国政府「AI行动计划」万言书发布! OpenAI与Anthropic呼吁联手封锁中国AI

就在刚刚,美国政府曝光了各界对「AI行动计划」的全部政策建议。OpenAI措辞激烈地表示,DeepSeek让我们看到,必须马上锁死中国AI,必须限制高端GPU芯片和模型权重流向中国!Anthropic同样呼吁:必须立马补上H20这一关键漏洞,并且严控H100的门槛。

来自主题: AI资讯
5815 点击    2025-04-26 19:49
英伟达AI奥赛夺冠,1.5B数学碾压DeepSeek-R1!代码全系开源,陶哲轩点赞

英伟达AI奥赛夺冠,1.5B数学碾压DeepSeek-R1!代码全系开源,陶哲轩点赞

英伟达AI奥赛夺冠,1.5B数学碾压DeepSeek-R1!代码全系开源,陶哲轩点赞

AIMO2冠军「答卷」公布了!英伟达团队NemoSkills拔得头筹,开源了OpenMath-Nemotron系列AI模型,1.5B小模型击败14B-DeepSeek「推理大模型」!

来自主题: AI技术研报
5832 点击    2025-04-26 17:17
最新实测!文心4.5T/X1T双卷王登场效果惊人,骨折价卷到DeepSeek

最新实测!文心4.5T/X1T双卷王登场效果惊人,骨折价卷到DeepSeek

最新实测!文心4.5T/X1T双卷王登场效果惊人,骨折价卷到DeepSeek

百度文心大模型X1 Turbo正式发布了。这个基于4.5 Turbo的深度思考模型,效果领先DeepSeek-R1、V3,且价格仅为R1的25%!而文心4.5 Turbo在低价的同时,多模态能力更是让人出乎意料。

来自主题: AI资讯
5828 点击    2025-04-26 16:16
具身交互推理: 图像-思考-行动交织思维链让机器人会思考、会交互

具身交互推理: 图像-思考-行动交织思维链让机器人会思考、会交互

具身交互推理: 图像-思考-行动交织思维链让机器人会思考、会交互

OpenAI 的 o1 系列模型、Deepseek-R1 带起了推理模型的研究热潮,但这些推理模型大多关注数学、代码等专业领域。

来自主题: AI技术研报
5780 点击    2025-04-26 15:31