4小时、118个回答,梁文锋内部交流回应一切
4小时、118个回答,梁文锋内部交流回应一切在此之前,梁文锋曾提出“不融资、不上市、不商业化”的原则。此次大规模融资标志着DeepSeek正式走向资本市场,也引发了业界对其商业化路径与技术愿景的广泛关注。在近期的一场投资者交流会上,梁文锋详细阐述了DeepSeek的组织文化、开源逻辑、技术路线图以及对行业竞争格局的看法。
搜索
在此之前,梁文锋曾提出“不融资、不上市、不商业化”的原则。此次大规模融资标志着DeepSeek正式走向资本市场,也引发了业界对其商业化路径与技术愿景的广泛关注。在近期的一场投资者交流会上,梁文锋详细阐述了DeepSeek的组织文化、开源逻辑、技术路线图以及对行业竞争格局的看法。
一夜之间,Tokenmaxxing成为硅谷热议话题!
@elsewhere 上个月,「elsewhere」报道了 DeepSeek 的融资故事。其中最多人讨论的,莫过于那个传说中的4小时投资人会议。 此去一个月间,梁文锋的各种语录在江湖流传,我们也多方收集到了一些其中内容。
2026年WAIC的展厅里,人潮涌动。大模型厂商在秀参数,算力厂商在秀集群规模。
全网等了快三个月!DeepSeek V4正式版,可能最早明日发布,最迟不过这几天。目前,一部分人已提前拿到了DeepSeek V4(GA)灰度测试的权限。一共有两个版本:DeepSeek V4 Flash,DeepSeek V4 Pro。
谁曾想呢,DeepSeek一直没有公开讲清楚的融资估值,被一家卖行李箱的公司给全部暴露了。7月16日晚间,安徽开润股份发布了一份投资进展公告。公告显示,开润股份参与投资的一只基金,已经将29亿元实缴资金全部间接投向DeepSeek,获得后者0.8265%的股权。
随着 DeepSeek 发布 DSpark,动态 MTP(多 Token 预测)成为了对抗高并发、提升 GPU 利用率的绝对焦点。然而,DSpark 高度绑定特定模型且需要额外训练。
7 月 16 日,月之暗面正式发布 Kimi K3:总参数量 2.8 万亿(2.8T),原生视觉理解,100 万 token 上下文,并且——开源权重。这是历史上第一个摸到 2.8 万亿参数量级的开源模型。前任"开源最大模型"的纪录保持者?也是它自己。
推理大模型 (如 DeepSeek-R1、o1) 靠长思维链拿高分,却普遍「想太多」: 研究统计了五个代表性模型里,发现有 41–52% 的 token 是在模型给出它的最终答案之后生成的。
推理大模型 (如 DeepSeek-R1、o1) 靠长思维链拿高分,却普遍「想太多」: 研究统计了五个代表性模型里,发现有 41–52% 的 token 是在模型给出它的最终答案之后生成的。