ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

DeepSeek V4 Pro正式版转正

DeepSeek V4 Pro正式版转正 API价格上调前夜DeepSeek V4 Pro正式版接入指北500并发、384K输出、零成本从Flash迁移摘要8月12日深夜DeepSeek低调上线V4 Pro正式版0813版本Agent能力较预览版实现跨越式提升DeepSWE得分从12.8飙升至62.7Cybergym、Terminal Bench等多项测试逼近甚至反超Claude Fable 5。本文结合官方数据从性能、定价、架构、视觉能力等维度做一次全面客观的梳理。2026年8月13日凌晨DeepSeek官方将V4 Pro从预览版正式转正版本号DeepSeek-V4-Pro-0813。本次更新没有举行发布会而是直接在API文档中悄然完成替换。核心亮点在于Agent能力的显著提升同时价格、并发策略及配套功能均有明确调整。下面结合公开数据做一次客观梳理。一、正式版相较预览版进步有多大正式版最突出的提升集中在多步骤智能体任务上例如自主规划、调用工具、调试代码等。官方公布的基准测试数据直观反映了这种变化基准测试预览版正式版Pro提升幅度DeepSWE软件工程12.862.7约4.9倍DSBench-Hard推理31.167.2翻倍Terminal Bench 2.1终端操作72.187.915.8Cybergym安全攻防52.783.330.6DSBench-FullStack全栈开发41.871.129.3DeepSWE从12.8跃升至62.7说明模型在复杂代码仓库任务中从几乎不会变为能胜任大部分步骤。Terminal Bench 87.9分已非常接近Fable 5的88.0分Cybergym 83.3分甚至略超Fable 5的83.1分表明在特定领域Pro已达到第一梯队水平。此外正式版延续了100万token上下文最大输出长度维持384K tokenV4系列自4月预览版发布起即支持该规格对长文档生成、完整项目代码产出非常友好。同时支持思考模式默认开启与非思考模式切换便于根据需求平衡质量与速度。二、定价策略与并发限制Pro正式版定价明确与同系列V4-Flash对比如下按每1M token计计费项V4-FlashV4-Pro输入缓存命中0.02元0.025元输入缓存未命中1元3元输出2元6元并发限制2500500Pro的输出价格是Flash的3倍输入未命中也是Flash的3倍。并发限制Pro为500Flash为2500。这表明Pro定位为高质量、低并发的企业级/复杂任务场景而Flash更适合高频、低成本调用。峰谷定价机制值得注意的是DeepSeek API已公告将实施峰谷定价策略高峰时段北京时间工作日9:00–12:00、14:00–18:00所有计费项价格翻倍。以V4-Pro为例高峰时段输出价格将从6元升至12元/百万token。具体执行时间以官方正式通知为准。⚠️特别注意官方在定价页面明确注明计划近期整体上调DeepSeek API服务定价预计涨幅较大。长期使用者需密切关注后续公告合理安排调用预算。三、模型架构与关键技术参数配置项V4-ProV4-Flash架构MoE混合专家MoE总参数量1.6万亿2840亿激活参数量每次前向约490亿约130亿上下文窗口100万token100万token最大输出384K token384K token支持思考模式✅默认开启✅API格式兼容OpenAI AnthropicOpenAI Anthropic对话前缀续写/FIM补全✅Beta仅限非思考模式✅Beta仅限非思考模式补充说明V4 Pro总参数量是Flash的5.6倍激活参数量约为Flash的3.8倍。FIM补全功能目前处于Beta阶段且仅限非思考模式使用。V4-Flash和V4-Pro均支持该功能。旧模型名deepseek-chat和deepseek-reasoner已于2026年7月24日正式停用调用时需将model参数改为deepseek-v4-pro或deepseek-v4-flash。关于Responses API截至2026年8月12日的官方API文档页面显示Responses API已支持V4-FlashV4-Pro的Responses API支持状态请以官方最新文档为准。四、视觉能力纯文本模型与识图模式的关系DeepSeek V4 Pro本身是纯文本大语言模型API接口不具备原生的多模态视觉理解能力如通过API直接传入图像进行物体识别、场景理解等。不过DeepSeek于2026年4月底灰度、5月正式开放了网页端和App端的识图模式。关于该模式的能力边界存在两个阶段的信息2026年4-5月上线初期官方及第三方评测报告了超出纯OCR的能力包括场景描述、物体识别、梗图理解、文物年代推断等采用了视觉原语思考Thinking with Visual Primitives技术框架。2026年6月官方澄清DeepSeek官方解释称其识图功能的底层是OCR模型擅长从图像中读取文本但不是多模态视觉语言模型VLM无法以像素级别看到物体、人脸或场景。该解释发布于识图功能出现多次识别错误如将梁文锋认成张一鸣之后。综合来看识图模式的能力介于纯OCR和完整多模态理解之间且截至2026年6月仍存在稳定性问题。对于需要可靠图像理解的生产级场景仍建议使用专用多模态模型。社区也存在一些桥接方案原理是先用其他视觉模型生成图片描述再将描述文本喂给DeepSeek处理。但这不是模型原生功能使用过程中需注意避免重复计费。五、那些容易被忽略的信号发布时间与竞争背景V4 Pro正式版于北京时间8月12日深夜在官网API文档中悄然更新并未提前大规模预告也未同步发布官方更新日志更新日志页面最新一条仍为7月31日的V4-Flash正式版公告。巧合的是几乎同一时间马斯克旗下SpaceXAI发布了Grok 4.6两大模型正面撞车。有观点认为大模型竞争已进入智能体Agent决赛圈。V4-Flash已足够应对日常任务对大多数日常场景聊天、轻量编程、问答V4-Flash性价比明显更高。需要注意的是官方评测表中V4-Flash 0731的Agent得分如Terminal Bench 82.7、Cybergym 76.7是Flash自身的成绩这些分数已经超过了V4-Pro预览版分别为72.1和52.7但并非V4-Pro正式版的数据。阅读评测时需留意区分。开发者迁移指南调用方式没有变化base_url不变只需把model参数改成deepseek-v4-pro即可。无论是走OpenAI兼容接口https://api.deepseek.com还是Anthropic接口https://api.deepseek.com/anthropic均可无缝升级。六、总结与适用建议Agent能力是本次最大亮点DeepSWE、Terminal Bench等数据充分说明Pro在多步任务、编程代理方面的实质性突破适合需要高精度自动化处理的项目。价格与并发策略明确Pro比Flash贵3倍并发更低且即将引入峰谷定价机制选择时可根据任务复杂度与预算权衡。视觉方面不要抱过高期待V4 Pro API为纯文本接口网页端识图模式能力介于OCR和完整多模态之间且存在稳定性问题真正的图像理解仍需专用多模态模型。注意价格上调预告2026年8月6日DeepSeek在开放平台发布正式公告宣布“计划近期整体上调DeepSeek API服务的定价”官方已提示近期将整体涨价且涨幅较大建议长期使用者提前规划预算。整体来看DeepSeek V4 Pro的正式版为开发者提供了一个在Agent和代码任务上具备全球竞争力的选项。对于日常轻量使用V4-Flash仍是性价比更高的选择若涉及复杂智能体开发或高精度任务Pro值得一试。
返回列表