
【CNMO科技消息】DeepSeek旗下deepseek-v4-pro对应的模型版本已更新为DeepSeek-V4-Pro-0813。从目前公布的信息来看,这次更新并没有伴随价格调整,尽管DeepSeek此前曾发布公告表示计划近期整体上调API服务定价,但当前各档位价格仍与此前保持一致。

DeepSeek
在核心规格方面,deepseek-v4-pro支持1M上下文长度,最大输出长度达到384K Token,同时支持非思考模式和思考模式,其中思考模式默认开启。对于长代码库处理、大规模文档分析以及需要连续执行大量步骤的Agent任务来说,1M上下文窗口和384K最大输出意味着单次调用能够容纳和生成的内容规模相当可观,减少了多轮拆分和拼接的开销。
配套能力方面,deepseek-v4-pro基本覆盖了目前主流的Agent开发需求。该模型支持JSON Output、Tool Calls、Responses API和Anthropic API,同时支持处于Beta阶段的对话前缀续写与FIM补全功能,其中FIM补全仅限在非思考模式下使用。API接入方式上,deepseek-v4-pro同时兼容OpenAI和Anthropic两套格式,开发者可以根据自身技术栈灵活选择接入路径。
价格方面,deepseek-v4-pro当前每百万Token的计费标准分别为:缓存命中输入0.025元,缓存未命中输入3元,输出6元。作为对比,同系列的deepseek-v4-flash每百万Token价格分别为缓存命中输入0.02元、缓存未命中输入1元、输出2元。也就是说,在缓存未命中输入和输出这两个主要计费项目上,Pro版本的价格均为Flash版本的3倍。虽然Pro绝对价格高于Flash,但考虑到其更大的上下文窗口和输出能力,单位Token的性价比依然具备竞争力。
两个版本在并发限制上也有所区分。deepseek-v4-flash的并发限制为2500,deepseek-v4-pro则为500。从这一配置差异来看在配资炒股,Flash更明显地面向高频、大规模的调用场景,适合需要快速响应和大量并行请求的应用;而Pro则将资源进一步集中到规格更高的任务上,优先保障单次调用的深度和复杂度。
富华优配提示:文章来自网络,不代表本站观点。