DeepSeek重磅更新 V4Pro正式版上线

8月13日,DeepSeek把V4 Pro从预览版正式扶正,定价页版本号切到DeepSeek-V4-Pro-0813。这不是临时起意,早在4月底V4-Pro和V4-Flash进API时,官方更新日志就留过一句正式版随后跟上,如今靴子落地。
 
最核心的硬件参数摆在明面:100万Token上下文、单次最大输出38.4万Token,思考模式默认开启,也留了非思考模式给低延迟场景。配套能力基本把主流Agent开发包圆了,JSON输出、Tool Calls、Responses API、Anthropic API格式兼容全给齐,Beta阶段的对话前缀续写和FIM补全也在,后者仅限非思考模式。1M上下文在国产模型里是第一梯队,配上384K输出,整库代码、几百页合同、多步骤Agent循环一次调用吞下去再吐半本书出来,不用再切段拼装。
 
价格上Pro是Flash的三倍,但结构很清楚。每百万Token计费:Pro缓存命中输入0.025元、未命中3元、输出6元;Flash对应0.02元、1元、2元。未命中输入和输出两项正好3倍,缓存命中档差得不多。并发更分明,Flash给2500,Pro只给500,明显是把高并发流量让给Flash,Pro留着算力啃硬骨头。
 
真正值得开发者盯着的,是定价页底部那行小字:计划近期整体上调DeepSeek API服务定价,预计涨幅较大,具体以正式通知为准。也就是说眼前这组0.025/3/6只是过渡快照,不是长期锚点。重度调用方该趁现在跑完成本测算,把涨价当确定变量写进预算,而不是默认现价永久有效;有闲钱囤额度的也可以先锁一批。
 
接入层完全不用慌。base_url不变,模型名继续写deepseek-v4-pro,后端自动指向0813;OpenAI兼容接口和api.deepseek.com/anthropic那条Anthropic格式通道都能用。旧名deepseek-chat和deepseek-reasoner已在7月24日停用,现在分别映射到V4-Flash的非思考与思考模式,老用户别再写死旧名。
 
选型逻辑很简单:聊天、轻量抽取、日常问答、高频分类用Flash,性价比拉满;只有长代码库分析、超长文档综述、连续几十步的工具调用Agent、对推理深度有硬要求时,才值得为Pro的三倍单价和500并发买单。官方此前放的Terminal Bench、Cybergym等Agent数据标的是V4-Flash-0731相对V4-Pro-Preview的提升,不是0813正式版成绩,别拿错参照系。
 
V4系列到此分工彻底清晰:Flash走量、Pro走质,前者用低单价和高并发覆盖流量,后者用1M上下文、384K输出和Agent工具链卡位复杂任务。对国内Coding Agent和Claude迁移党来说,双格式兼容比单点跑分更实用,原来基于Anthropic写的代码改个模型名就能跑。接下来唯一的不确定性不是模型能力,而是那波预告中的整体涨价什么时候落、落多少。

快递今日最新新闻【今天最新新闻】:转载请保留快递新闻网链接。