
摘要DeepSeek Flash系列于2026年9月10日12:00起执行新定价三档价格全线下调空闲时段输入缓存命中降至每百万Token 0.02元降幅60%输入缓存未命中降至1元输出降至4元高峰时段对应翻倍。本文梳理了缓存命中、未命中与输出三档价格的具体变化分析了峰谷计价规则对批处理与实时任务的适用场景并给出缓存分层、可控变量控制未命中输入、任务编排等成本优化建议帮助开发者在降价窗口期真正吃到红利。一盆冷水还没凉透DeepSeek突然把价格表往回拉了一格。就在不少团队还在复盘8月那波涨价带来的成本焦虑时DeepSeek开放平台抛出公告北京时间2026年9月10日12:00起Flash系列模型执行新定价空闲时段输入缓存命中每百万Token只要0.02元输入缓存未命中1元输出4元高峰时段对应翻倍。最贵的不是算力是踩错时段这句话在Agent批量调用、长文本解析和代码补全场景里会越来越像一句实话。这次动刀最狠的地方是缓存命中。旧价里空闲时段deepseek-v4-flash与deepseek-v4-flash-vision-exp的输入缓存命中是每百万Token 0.05元高峰0.10元新价直接压到空闲0.02元、高峰0.04元降幅60%。对大量重复Prompt、固定系统提示词、RAG里反复复用的知识块来说缓存命中率就是隐形的毛利。谁把上下文设计得更稳谁就把DeepSeek API成本往下拧。输入缓存未命中的变化同样扎眼。空闲时段从1.5元降到1元高峰从3元降到2元降幅33.33%。这个数字放在单次调用里未必惊人可放到一天几十万次请求的业务里差距会被乘法放大。很多企业真正怕的不是模型贵而是流量峰谷、提示词抖动、日志重放把账单吹胖现在非高峰输入未命中回到1元等于给长上下文应用松了绑。输出价格则更像一次姿态修正。空闲输出从4.5元降到4元高峰从9元降到8元降幅11.11%。它不像缓存命中那样戏剧化却覆盖了所有生成型任务文案扩写、代码解释、工单总结、客服兜底、数据清洗后的结构化回填。对输出占比高的应用这11.11%不是噱头是把“敢不敢放开调用量”的信心往回抬了一点。峰谷规则没有变仍然卡在工作日节奏上。高峰时段为北京时间周一至周五9:00到12:00、14:00到18:00其余时间按空闲价执行。这意味着周末、夜间、午休和清晨天然适合做批处理、评测集回放、embedding前的预处理、知识库重建和大规模FIM补全。把重活挪出尖峰不是小聪明是SRE和算法负责人该一起盯的账单开关。把时间线摊开看这轮降价更像一次纠偏。8月中旬DeepSeek V4系列转入峰谷计价Flash系列空闲输入缓存命中0.05元、未命中1.5元、输出4.5元高峰翻倍不到一个月后三档全线下调缓存命中砍半还多。市场上关于“大模型API还会不会继续便宜”的争论至少在这条产品线上得到短期答案价格战没打完只是换了打法从全面补贴变成精细到时段、缓存和任务结构的成本手术。对开发者的实际建议很朴素。先做缓存分层系统提示、工具schema、Few-shot样例尽量稳定再用可控变量控制未命中输入别把整库文档无脑塞进每次请求输出侧给模型明确长度、格式和停止条件减少绕圈。任务编排上把可延迟任务推到空闲窗口把强实时交互留在高峰必要时做结果缓存与请求去重。DeepSeek Flash系列适合高并发、成本敏感、延迟可容忍的场景deepseek-v4-flash-vision-exp同价调整也给图文理解类应用留出了试探空间。当然别只盯着“每百万Token几毛钱”的单价。真正决定DeepSeek API费用的是缓存命中率、输入输出比、重试率、上下文垃圾长度和高峰占比。一个命中率从30%提到70%的改造可能比等下一次官方降价更有效一次把日志上下文精简三成的重构也可能比切换模型更立竿见影。9月10日12点之后账单会重新说话谁把调用链路当成产品来打磨谁就能在这场降价里吃到真红利。