AI资讯新闻榜单内容搜索-DeepSeeK

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: DeepSeeK
4小时、118个回答,梁文锋内部交流回应一切

4小时、118个回答,梁文锋内部交流回应一切

4小时、118个回答,梁文锋内部交流回应一切

在此之前,梁文锋曾提出“不融资、不上市、不商业化”的原则。此次大规模融资标志着DeepSeek正式走向资本市场,也引发了业界对其商业化路径与技术愿景的广泛关注。在近期的一场投资者交流会上,梁文锋详细阐述了DeepSeek的组织文化、开源逻辑、技术路线图以及对行业竞争格局的看法。

来自主题: AI资讯
10845 点击    2026-07-23 15:56
梁文锋四小时投资人会议实录

梁文锋四小时投资人会议实录

梁文锋四小时投资人会议实录

@elsewhere 上个月,「elsewhere」报道了 DeepSeek 的融资故事。其中最多人讨论的,莫过于那个传说中的4小时投资人会议。 此去一个月间,梁文锋的各种语录在江湖流传,我们也多方收集到了一些其中内容。

来自主题: AI资讯
9719 点击    2026-07-23 09:22
WAIC现场,建起一座AI版「超级电网」!跑DeepSeek成本暴降75%

WAIC现场,建起一座AI版「超级电网」!跑DeepSeek成本暴降75%

WAIC现场,建起一座AI版「超级电网」!跑DeepSeek成本暴降75%

2026年WAIC的展厅里,人潮涌动。大模型厂商在秀参数,算力厂商在秀集群规模。

来自主题: AI资讯
6644 点击    2026-07-22 10:33
DeepSeek V4「满血版」曝光了!最快明天发布

DeepSeek V4「满血版」曝光了!最快明天发布

DeepSeek V4「满血版」曝光了!最快明天发布

全网等了快三个月!DeepSeek V4正式版,可能最早明日发布,最迟不过这几天。目前,一部分人已提前拿到了DeepSeek V4(GA)灰度测试的权限。一共有两个版本:DeepSeek V4 Flash,DeepSeek V4 Pro。

来自主题: AI资讯
9739 点击    2026-07-19 10:55
DeepSeek估值,被一家安徽箱包公司给全部暴露了

DeepSeek估值,被一家安徽箱包公司给全部暴露了

DeepSeek估值,被一家安徽箱包公司给全部暴露了

谁曾想呢,DeepSeek一直没有公开讲清楚的融资估值,被一家卖行李箱的公司给全部暴露了。7月16日晚间,安徽开润股份发布了一份投资进展公告。公告显示,开润股份参与投资的一只基金,已经将29亿元实缴资金全部间接投向DeepSeek,获得后者0.8265%的股权。

来自主题: AI资讯
9028 点击    2026-07-19 10:10
让动态投机解码不再局限于DSpark:LightSpec首个开源动态MTP系统实现

让动态投机解码不再局限于DSpark:LightSpec首个开源动态MTP系统实现

让动态投机解码不再局限于DSpark:LightSpec首个开源动态MTP系统实现

随着 DeepSeek 发布 DSpark,动态 MTP(多 Token 预测)成为了对抗高并发、提升 GPU 利用率的绝对焦点。然而,DSpark 高度绑定特定模型且需要额外训练。

来自主题: AI技术研报
9300 点击    2026-07-17 10:08
突发:kimi k3悄悄上线,模型参数高达2.8T,超越Deepseek登顶开源模型全球第一

突发:kimi k3悄悄上线,模型参数高达2.8T,超越Deepseek登顶开源模型全球第一

突发:kimi k3悄悄上线,模型参数高达2.8T,超越Deepseek登顶开源模型全球第一

7 月 16 日,月之暗面正式发布 Kimi K3:总参数量 2.8 万亿(2.8T),原生视觉理解,100 万 token 上下文,并且——开源权重。这是历史上第一个摸到 2.8 万亿参数量级的开源模型。前任"开源最大模型"的纪录保持者?也是它自己。

来自主题: AI资讯
10073 点击    2026-07-17 01:06
ISSTA 2026|LAVE:面向扩散语言模型的约束解码

ISSTA 2026|LAVE:面向扩散语言模型的约束解码

ISSTA 2026|LAVE:面向扩散语言模型的约束解码

推理大模型 (如 DeepSeek-R1、o1) 靠长思维链拿高分,却普遍「想太多」: 研究统计了五个代表性模型里,发现有 41–52% 的 token 是在模型给出它的最终答案之后生成的。

来自主题: AI技术研报
9088 点击    2026-07-16 10:09
用推理步骤的「语义冗余」给LRM过度思考踩刹车

用推理步骤的「语义冗余」给LRM过度思考踩刹车

用推理步骤的「语义冗余」给LRM过度思考踩刹车

推理大模型 (如 DeepSeek-R1、o1) 靠长思维链拿高分,却普遍「想太多」: 研究统计了五个代表性模型里,发现有 41–52% 的 token 是在模型给出它的最终答案之后生成的。

来自主题: AI技术研报
5901 点击    2026-07-16 10:08