DeepSeek V4 Pro正式版上线,API输入输出价格为Flash的三倍

https://assets.wanlianyida.com/industry-uniapp/web/static/image-default.BtYt8t8Z.png
产联社CLS
·阅读量:1.7w
DeepSeek V4 Pro正式版已开放调用,支持1M上下文和最大384K输出,缓存未命中输入价格为3元/百万Token,输出价格为6元/百万Token,均为V4 Flash的三倍。

摘要:DeepSeek V4 Pro正式版已开放调用,支持1M上下文和最大384K输出,缓存未命中输入价格为3元/百万Token,输出价格为6元/百万Token,均为V4 Flash的三倍。

产联社编辑 | 黄钰慧

image.png

【产联社】DeepSeek V4 Pro正式版上线。8月13日,DeepSeek官网“模型与价格”页面列出的Pro模型版本更新为DeepSeek-V4-Pro-0813。该模型支持1M上下文和最大384K输出,每百万Token缓存未命中输入价格为3元,输出价格为6元。

DeepSeek V4 Pro正式版已开放调用,支持1M上下文和最大384K输出,缓存未命中输入价格为3元/百万Token,输出价格为6元/百万Token,均为V4 Flash的三倍。

V4 Pro正式版支持1M上下文

DeepSeek官网显示,开发者可通过模型名deepseek-v4-pro调用V4 Pro。该模型同时支持思考模式和非思考模式,其中思考模式默认开启。

功能方面,DeepSeek-V4-Pro-0813支持JSON Output、工具调用、Responses API和Anthropic API;对话前缀续写和FIM补全仍标注为Beta功能,其中FIM补全仅支持非思考模式。

DeepSeek于4月24日发布V4预览版,并同步开放V4 Pro和V4 Flash的API调用。两款模型均支持1M上下文,用户可通过修改模型名称进行调用。

7月31日,V4 Flash正式版率先上线公测。DeepSeek当时表示,V4 Pro正式版将“尽快发布”。此次官网将Pro模型版本更新为0813,意味着此前预告的正式版本已经落地。

价格高于Flash,并发限制更低

DeepSeek按每百万Token计费。V4 Pro缓存命中输入价格为0.025元,缓存未命中输入价格为3元,输出价格为6元;V4 Flash相应价格分别为0.02元、1元和2元。

由此计算,V4 Pro缓存未命中输入和输出价格均为Flash的三倍,缓存命中输入价格则比Flash高25%。

此外,V4 Pro正式版上线之际,DeepSeek还在价格页面提示,计划近期整体上调API服务定价,“预计涨幅较大”,具体方案以正式通知为准。该页面尚未公布调价幅度和生效日期。

因此,V4 Pro当前每百万Token缓存未命中输入3元、输出6元的价格仍可能发生变化。DeepSeek同时说明,产品价格可能调整,并建议用户根据实际用量充值,定期查看价格页面。

两款模型的账号级并发限制也存在差异。V4 Pro的默认并发限制为500,V4 Flash为2500。DeepSeek解释,一个请求从发出到模型响应完成记为一个并发;超过限制时,API将返回HTTP 429错误。用户如有更高并发需求,可以提交账号扩容申请。

价格和并发设置对应了两款模型的不同定位。DeepSeek在V4预览版发布说明中将Flash称为“更快捷高效的经济之选”,并称Flash在简单Agent任务上与Pro表现接近,但在高难度任务上仍有差距。

上述能力比较来自DeepSeek官方,尚不能替代第三方机构在相同条件下进行的独立测试。

瞄准Agentic Coding

DeepSeek在4月发布V4预览版时称,V4 Pro重点提升了Agent、世界知识和推理能力,并已针对Claude Code、OpenClaw、OpenCode和CodeBuddy等Agent产品进行适配和优化。

在Agentic Coding方面,DeepSeek称,V4 Pro在相关评测中达到当时开源模型较高水平;公司内部使用反馈显示,其使用体验优于Claude Sonnet 4.5,交付质量接近Claude Opus 4.6非思考模式,但与Claude Opus 4.6思考模式仍有差距。

世界知识方面,DeepSeek称,V4 Pro的评测结果大幅领先其他开源模型,仅稍逊于Gemini 3.1 Pro;在数学、STEM和竞赛型代码评测中,V4 Pro的表现超过当时已公开评测的开源模型。上述成绩均为DeepSeek在预览版发布时披露的官方评测口径,并非V4-Pro-0813正式版的第三方测试结果。

DeepSeek还建议,在复杂Agent场景中启用思考模式,并将思考强度设置为max。具体模型调用和参数调整方法可参考其思考模式说明。

在Agent工具接入文档中,DeepSeek列出了Claude Code、OpenCode和OpenClaw等工具的配置方法。以Claude Code为例,开发者可将Anthropic接口地址设置为DeepSeek提供的兼容地址,并将模型指定为deepseek-v4-pro[1m]。

1M上下文、最大384K输出、工具调用和Responses API等配置,为处理长代码库和多步骤Agent任务提供了接口基础。不过,模型在实际任务中的完成率、Token消耗和运行效率,仍需结合具体Agent框架与任务类型判断。

正式版专项跑分尚未公布

截至8月13日,DeepSeek尚未在更新日志中公布V4-Pro-0813正式版的专项评测成绩。因此,正式版相对于V4 Pro预览版、V4 Flash及其他具名模型的能力变化,目前无法依据官方公开数据作出量化判断。

需要注意的是,DeepSeek在7月31日更新日志中公布的Terminal Bench 2.1、NL2Repo、Cybergym和DeepSWE等评测成绩,测试对象均为V4 Flash正式版,而非此次上线的V4-Pro-0813。这组成绩不能用于证明V4 Pro正式版的性能变化。

同一份更新日志还提到,V4 Flash在部分公开Code Agent基准测试中采用“DeepSeek Harness极简模式”作为运行框架,并将其状态标注为“即将发布”。

Agent框架会影响模型读取文件、调用工具、管理上下文和执行长任务的方式,也可能影响同一模型在不同测试环境中的表现。截至8月13日,DeepSeek更新日志尚未列出该框架的独立发布记录,其功能、开放时间和使用方式仍待官方进一步披露。

商务合作/报料,请联系微信号:18801065284

特别声明:本文仅供参考,不构成任何投资建议,未经允许不得转载。

129
67
分享