突发 | DeepSeek V4 Pro 上线,逼近 Fable 5

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
突发 | DeepSeek V4 Pro 上线,逼近 Fable 5
8969点击    2026-08-13 00:03

就在刚刚,DeepSeek V4 Pro 正式版来了。


最新的模型与价格页面显示,deepseek-v4-pro 对应模型版本已经更新为 DeepSeek-V4-Pro-0813。


从目前公布的信息来看,deepseek-v4-pro 支持 1M 上下文长度,最大输出长度达到 384K Token,同时支持非思考模式和思考模式,其中思考模式默认开启。


对于长代码库、大规模文档处理以及需要连续执行大量步骤的 Agent 任务来说,1M 上下文和 384K 最大输出,意味着一次调用能够容纳和生成的内容规模都相当可观。


突发 | DeepSeek V4 Pro 上线,逼近 Fable 5


配套能力也基本覆盖了目前主流的 Agent 开发需求。


deepseek-v4-pro 支持 JSON Output、Tool Calls、Responses API、Anthropic API,同时支持 Beta 阶段的对话前缀续写与 FIM 补全,其中 FIM 补全仅限非思考模式使用。


API 接入方式则同时兼容 OpenAI 和 Anthropic 两套格式。


更值得关注的还是价格。DeepSeek 此前发布公告,宣布计划近期整体上调 API 服务定价,现在靴子落定。


deepseek-v4-pro 当前每百万 Token 的价格分别为:缓存命中输入 0.025 元,缓存未命中输入 3 元,输出 6 元。


相比之下,deepseek-v4-flash 分别为 0.02 元、1 元和 2 元。也就是说,在缓存未命中输入和输出两个主要计费项目上,Pro 的价格都是 Flash 的 3 倍。


两者的并发限制也有所区别。deepseek-v4-flash 的并发限制为 2500,deepseek-v4-pro 则为 500。


跑分图如下:


突发 | DeepSeek V4 Pro 上线,逼近 Fable 5


此外,从价格和并发配置来看,Flash 更明显地面向高频、大规模调用场景,而 Pro 则把资源进一步集中到规格更高的任务上。即便如此,V4 Pro 目前的绝对调用成本依旧不算太高。


随着 DeepSeek-V4-Pro-0813 出现,V4 系列的产品结构也进一步清晰起来:


Flash 主打更低成本和更高并发,Pro 则提供更高规格的模型服务,并围绕 Tool Calls、Responses API、Anthropic API 等能力继续向 Agent 和 Coding 场景延伸。


今晚又是一个不眠夜。


官方博客地址:


https://api-docs.deepseek.com/zh-cn/quick\_start/pricing


文章来自于微信公众号 “APPSO”,作者 “APPSO”

AI转型,免费服务,就找AITNT
AITNT资源拓展
根据文章内容,系统为您匹配了更有价值的资源信息。内容由AI生成,仅供参考
1
智能体

【开源免费】AutoGPT是一个允许用户创建和运行智能体的(AI Agents)项目。用户创建的智能体能够自动执行各种任务,从而让AI有步骤的去解决实际问题。

项目地址:https://github.com/Significant-Gravitas/AutoGPT


【开源免费】MetaGPT是一个“软件开发公司”的智能体项目,只需要输入一句话的老板需求,MetaGPT即可输出用户故事 / 竞品分析 / 需求 / 数据结构 / APIs / 文件等软件开发的相关内容。MetaGPT内置了各种AI角色,包括产品经理 / 架构师 / 项目经理 / 工程师,MetaGPT提供了一个精心调配的软件公司研发全过程的SOP。

项目地址:https://github.com/geekan/MetaGPT/blob/main/docs/README_CN.md