DeepSeek 官宣降价,Flash 老用户的输出价翻倍了

Hello,我是飞飞。
今天早上刷到 DeepSeek 的调价公告,标题里写的是 Flash 系列价格调整。我第一反应不是看新闻,是算账:我的 AI 大脑每天跑 V4-Flash 做检索查重,流水线里也配了它干那种答案固定、对错一判便知的活(查重、格式检查这类),这份公告直接动我的月账单。三个月前我实测它的时候,把它定位成「嫌 Claude 慢就切的快档」,Terminal Bench 2.1 拿了 82.7 分,这个定位现在得重新校准了。
算完发现一个有意思的事:同一份调价公告,Pro 用户看到的是大降价,而我这种 Flash 老用户,看到的输出价翻倍了。这篇就把这笔账摊开给你。
调价公告说了什么
先交代发布节奏,本身就挺戏剧。9 月 8 号下午,DeepSeek 在官方用户群里悄悄开了个测试入口,模型 ID 直译过来叫「V4.1-Flash 于 0910 过期」,按老 Flash 的价格计费,单账号限二十个并发,没有博客没有公告,changelog 里一个字没提。
9 月 9 号开放平台发了通知,说正式版北京时间 9 月 10 日前后上。9 月 10 号,V4.1-Flash 正式来了,那个测试 ID 自带的过期日,变成了发布日。
测试期还有个数字能说明它的性质:测试 ID 每个账号限二十个并发,而正式的 Flash 档公布的并发上限是两千五百个。二十个并发摆明了只够试水,DeepSeek 从起名那天就把这次测试的定位写清楚了。
另外有个容易漏掉的合并:八月单独上线的 Vision-Exp 视觉模型这次退役了,视觉能力直接并进 V4.1-Flash 本体,价格表里还少列一行。
新模型叫 deepseek-flash(版本 DeepSeek-V4.1-Flash),1M 上下文,最大输出 384K,自带视觉能力。官方调价原话是:Flash 系列自北京时间 9 月 10 日 12:00 起调价,谷时输入 cache 命中 0.003 美元、输入 cache 未命中 0.15 美元、输出 0.6 美元,峰时全部翻倍。
两件事同时发生:老的 deepseek-v4-flash 和 vision-exp 两个名称退役,名称照旧接受,你代码里的 model 参数一个字不用改,请求自动由 V4.1-Flash 处理并按新价计费。
从 9 月 14 日 12:00 起,deepseek-v4-pro 的请求全部路由到 V4.1-Flash,也按 Flash 价格计费。官方给的理由是 V4.1 Flash「在性能、成本、速度和总用时上全面超越 V4 Pro」,这话官方口径,独立基准还没出。
降价降给了谁
谷时价格摆一张小表,你自己看:
| 老 Flash | 新 V4.1-Flash | 现行 V4-Pro | |
|---|---|---|---|
| 输入(cache 未命中) | $0.14 | $0.15 | $0.66 |
| 输入(cache 命中) | $0.0028 | $0.003 | $0.022 |
| 输出 | $0.28 | $0.60 | $1.98 |
(峰时一律 ×2。老 Flash 一行是三方追踪站加我自己旧文记录的口径,其余两项是官方定价页今天的抓取。)
看得出来这份公告是发给谁的。Pro 用户从 9 月 14 日起被路由到 Flash 价,谷时输出从 1.98 美元落到 0.6 美元,打了三折出头,输入降了七成七,这是真金白银的大降。而 Flash 老用户这边,输入和 cache 命中基本持平,输出从 0.28 美元翻到 0.6 美元。
降价是真降了,但降给的是原来用 Pro 的那批人。而且有个细节对 Pro 用户算是意外之喜:定价页上 Pro 那行明写着不支持 Vision,而 V4.1-Flash 自带。被路由过去之后,他们花的钱少了,能干的事反而多了。cache 命中的差价也拉开了,Pro 的 0.022 美元对 Flash 的 0.003 美元,差着七倍,路由之后 Pro 用户的重度对话等于白捡。
怎么判断自己是哪半边?看你代码里 model 参数填的是 deepseek-v4-pro 还是 deepseek-v4-flash,前者 9 月 14 号之后自动吃到降价,后者从 10 号起按新价走。
说实话,我这种本来就用便宜档的,拿到的是输出涨价。「降价」这个词在公告里没有主语,读之前得先问一句:降的是谁的价。
我的用量账
我的用法分两块,受影响不一样。
一块是 AI 大脑。库里关键词层九千多篇、向量层一千二百多篇,每天检索查重全跑 V4-Flash。这活输入重、输出短,而且命中 cache 的比例高:系统提示词、常驻规则、索引说明这些前缀每次都一字不差,全落在 cache 里。
cache 命中价从 0.0028 到 0.003 美元,基本没动。这块账我估着持平。顺带说一句,这次 cache 命中没跟着涨算是万幸,真涨的话,大脑这种靠常驻前缀吃命中的用法会首当其冲。
另一块是流水线里让 V4-Flash 干的判得死的活:查重初筛、格式检查、硬扫描那几条规则的跑批。这些输出量占大头,输出价翻倍,这块账会肉眼可见地涨。多智能体那套跑法 token 本来就是普通对话的十几倍,单价再翻倍,乘出来就不是小数了。
谷时峰时那张表还得单算一笔。峰时定义为 UTC 周一到周五的 01:00 到 04:00 和 06:00 到 10:00,换算成北京时间就是工作日上午九点到十二点、下午两点到六点。翻译过来,DeepSeek 的峰时就是我们中国用户的上班时间,这条对国内用户基本无差别,大家全在峰时里。
我白天干活全踩在峰时上,按峰时价,输出是 1.2 美元一百万 token,比老 Flash 的谷时 0.28 美元涨了三倍不止。想吃到谷时价,我得把流水线挪到夜里跑,或者周末跑。省钱从调价改成了倒时差。
不过 9 月的账单还没出,上面是按价格结构推的,等月底真账单出来我再回来对一遍。
两处伏笔到期
旧文里埋过的两条线索,这次一起对个账。
头一条,跳票。5 月写 DeepSeek 融资那篇里提过,V4.1 据 Pandaily 报道安排在 2026 年 6 月发布。实际是 9 月 10 日,跳了三个月,而且顺序变了:先出 Flash,V4.1 Pro 还没影,官方只说等它「未来发布」。
另一条更微妙。4 月 V4 发布的时候,官方定价页有个小字:Pro 的价格受限于高端算力是暂时的,等下半年昇腾 950 超节点上市后会大幅下调。现在是 9 月,正好在「下半年」的窗口里,Pro 的价格也确实大幅下调了,手段是把 Pro 请求路由到便宜档,但整份公告一个字没提昇腾,也没提 950。
时间点吻合,机制对不上:小字说的是成本下降传导到价格,这次发生的是路由到更便宜的档位。这两者是不是一回事,官方没说,我不下结论,你只当时间线看。要验证也简单,等 950 真批量上市那天,看 Pro 或者 V4.1 Pro 的价格有没有第二次动作。
升不升级这笔账
能力这块我先立个牌子:V4.1-Flash 我还没跑过,官方说它「全面超越 V4 Pro」,这是自评,独立基准到现在还没人发布,我一篇都没法引。
能确认的是结构:Vision 能力合并进来了(8 月那个单独跑的 Vision-Exp 退役),上下文 1M,最大输出 384K。这些对我是实打实有用的:大脑检索不用再在文本和视觉两条链路里切,8 月那笔每张图 0.0000054 美元的账也作废重算,这价格约等于一毛钱能跑一万八千张。还要多留个心眼:V4-Flash 那张 82.7 的成绩单是旧模型的,分数不会自动迁移到 V4.1-Flash 头上,新账得新记。
我的打算是让大脑先切到 V4.1-Flash 跑一周,还是老办法,每天记四样:检索延迟、查重质量、账单、返工次数。判得死的活先试,靠谱了再把流水线那部分切过去。涨价的输出我先省着用,能挪到谷时的挪到谷时。账我先记到月底,涨没涨、值不值,到时候都有数。
轮到你了:你在用 DeepSeek 哪一档?这次调价你是降的那半边还是涨的那半边?还有,谷时峰时那个时段表,你的用量踩得到谷时吗?评论区报个数,我想看看这次到底是多数人降了还是少数人降了。