一天动了三处价,我这种付费方式一分没省

Hello,我是飞飞。
三天前我算完 Sonnet 5.5 那笔账,在结尾留了一句话:等我把流水线里几个 skill 换成 Sonnet 5.5 跑一轮,回来跟你报真实扣了多少。
这句话我还没兑现。三天后,Anthropic 一天之内动了三处价,先往桌上多放了一份筹码。
我拿到消息以后没急着去试,先把三处挨个往自己身上套了一遍。Haiku 降价,我走 Max 订阅,月费不动,只兑成额度。缓存减半,同一份额度能多跑些活。那张一百美元的券,我翻到帮助中心一行小字,不含 Claude Code。
算完有点没劲。
三个动作,哪个打到我
一处是发 Haiku 5.5。官方说它的运行成本平均降低约 75%,基准是上一代的 Haiku 4.5。
一处是 Sonnet 5.5 的缓存读取价,从每百万 token 0.20 美元砍到 0.10,当天生效。
还有一处是给 Max 和 Team 订阅发月度 API 额度。Max 5x 是一个月 100 美元,Max 20x 是 200,Team 最多 500 还能共享。
三处动作,两种东西。前两处动的是价签,最后那一处是现金,一百美元。
打个我每天都在用的比方。我付的是包月套餐,一个月固定交一笔,里面跑多少活是我自己的事,不按量加钱。那 100 美元更像运营商另发的一张定向券,只能在名单里那几个应用上用,不冲抵月租。
而恰恰是这张券,官方帮助中心里有一句原文,我抄下来了:Max 套餐附带的月度 API 额度,不能用于 Claude Code 或 Claude 应用,包括额外用量那一部分。
我主力全在 Claude Code 里。那条流水线挂着十几个 skill,从拉资讯一路跑到发公众号。这一百美元,我看得见,摸不着。
便宜 90% 是怎么来的
先说 Haiku 那一处。
官方脚注把话说细了:单价降 90%,有限定,指的是提示在十万 token 以内的那些请求;每任务运行成本降 75%。
90 和 75 中间那 15 个点去哪了?官方自己给了答案。这次同时换了分词器,同一段文字切出的 token 更多。平台文档那边写得更直白,大约多 30%。
说人话就是,价签砍了一半,可盒子也小了一圈。钱少了,但没价签上写的那么多。
这件事我眼熟。
我在算 Sonnet 5.5 那篇里写过:它单价只有 Opus 5.5 的一半,账单反而贵 92%,因为它每任务吐 121.3K 输出 token,是对方的 4.67 倍。单价只是一半,另一半是它干完这件活要吐多少 token。
今天是同一个机制又一次露面。不过这一回,说它的人是提出降价的那一方。
这里我得把话说清楚,免得写成一句谁对谁错。规律不在乎提出它的人是谁。上一回它站在贵的那边,这一回站在便宜的那边,净结果仍然是省,只是省不到价目表上那个数。
它官方给的定位原话是「迄今最便宜、最快、能力最强的小模型」。这句的范围是 Anthropic 自己发过的那些,全行业不算。速度那条还有脚注,比的是各个模型的标准速度,Fast Mode 不在内。
Artificial Analysis 那张智能指数上有一组更硬的对照。Sonnet 5.5 拿 56 分,每任务 7.60 美元;Haiku 5.5 拿 43 分,每任务 0.21 美元。大约三十六分之一的成本,换到七成七的分数。这两个数我核过,出自它官网,不过 Anthropic 自己的发布页上没有这张指数分,那页只有另外两套评测,所以这个 43 不能说成官方公布。
我九月那笔账重算一遍
缓存那一处,才真正碰到我的钱。
先交代我手里那本账。我九月写过,拿 API 跑一条写文章的流水线,一天跑不了几趟。打开后台翻明细,缓存命中率只有三成。提示词每跑一趟就按原价重读一遍,CLAUDE.md 里每一行都跟着重发,钱就漏在这儿。一个月账单干到 106 美元。
后来我把 CLAUDE.md 从 12KB 砍到 4KB,会变的字段挪出提示前缀,命中率到 73%,账单落回 33 美元。
这个 106 是九月的口径,一个月。我 10-06 那篇里也有个 106,那个是一周烧掉的 2800 万 token 按 API 裸价折出来的,两个数碰巧长得一样,不是一回事。
这次减半的是缓存读取价,正好是漏钱的那一格。
那新价下这笔账值多少。官方给了个数,能让这笔账反推回来:减半之后,多数的智能体任务成本降约 20%。0.2 除以 0.5,能得出缓存读取大约占这类任务成本的四成。按这个比例代进去,106 变成大约 85,33 变成大约 26。
这里有三个缺口我必须说出口。
先说基线。我不知道九月那本账的基线是哪一档。Sonnet 4.6 的缓存读取价是 0.30,Sonnet 5 是 0.20,减半之后是 0.10。如果我的基线是 4.6,那实际砍掉的不止一半,是三分之二,上面的数还得再往下走一截。
再一个是,那 106 里含着缓存写入,而写入价这次没动。所以真实降幅一定小于整单减半。
最要紧的一条在这儿:这是 API 口径的账,不进我的 Max 月费。我的月费一分不动。
那一百美元为什么摸不着
最后那笔额度,不用算,只需要读条款。
额度能用在哪,官方列了一张单子:Messages API、Batches API、控制台里的 Playground、Managed Agents、Agent SDK。开发者账号的原话是,用在你自己写的代码里,或者在第三方 harness 里。harness 说人话,就是包在模型外面指挥它的那层壳。
不能用在哪,写得更直接:Claude Code,以及 Claude 应用里的额外用量。
附加的限制还有四条。这笔额度按月清零,不累积;要自己去 claude.ai 网页端领;Pro 和 Enterprise 这两档没有;新订阅要满七天才够格。
有一处官方说法打架,我没核清,只能如实标着。另一篇帮助中心讲 Agent SDK 的时候,把 claude -p 这个命令行模式也算进了覆盖范围。这跟「不含 Claude Code」有张力,可能是交互式的不算、程序化的算,也可能就是两页各写各的。官方没把这句说明白。
我自己六月的记忆是,Agent SDK 和 claude -p 的用量当时从一笔单独的月度额度里扣,跟手动聊天的额度分开算。官方在别的地方确实画过这条线,但这一次两页之间没有互相引用,我不替它下结论。真想用这张券,值得自己把两页对着读一遍。
你到底算哪种用户
答案不复杂:同一次降价,落到你头上是什么,得看你怎么付钱。
包月套餐和按量打表是两套算法。套餐的月费封顶,你跑多少活它不多收一分;打表按分钟往上跳字。
如果你是按月付订阅的,这三处里你一分现金都拿不到。前两处会兑成额度,同样的月费能多跑些活。这不算差,但它是另一种东西。
如果你是拿 API 按量跑的,那这次至少有两处直接打到你的账单上。Haiku 5.5 的输入价是 0.10,输出 0.50,缓存读 0.01;Sonnet 5.5 的缓存读减半。你要是也在跑长任务,这次是实打实的降。
所以判据就两步。先问自己,我的钱是按月交的,还是按量交的。再看自己的钱花在哪,是花在单价上,还是花在输出量和缓存上。单价那一栏这次降得最凶,可它降的是每百万 token 的价钱,不一定是你这件活的实际成本。
我自己属于前一种。我写成本这条线写了一路,写代码多写八倍、CI 涨 25 倍那本,写大厂被账单逼着把最贵模型禁掉那本,写谁在替 AI 掏钱那本,也自己算过 Sonnet 5.5 那一笔。今天这篇的起点跟前面都不一样:前面几篇都是我主动去算,这一篇是平台先动了手,我回头重算。
我打算先拿它试哪类活
最后一件事,是我欠的那次实测。
四月我给自己划过一条线:需要写字、需要语感判断的用 Sonnet,只是搬运数据、调 API 的用 Haiku。当时我数过,搜料、训练、配图、分发这四类活最该降档。改的开关是子代理的环境变量 CLAUDE_CODE_SUBAGENT_MODEL,把它设成当时那代 Haiku。那篇里我还写过一句,Haiku 的输出成本是 Sonnet 的三分之一。今天两边是 0.50 对 10,这句话变成了二十分之一。
现在 Haiku 5.5 来了,官方给的定位正好落在这个区间里:适合范围窄、原本贵到不划算的那些活,点名了摘要、上下文压缩、数据库查询和分类,还说可以给 Opus 5.5 和 Sonnet 5.5 当编码子智能体。
但这里有个坑得提醒一句。Claude Code 那个版本的更新日志我通读了一遍,跟 Haiku 5.5 相关的只有一条,说的是它成了 Anthropic API 上的默认 Haiku 模型。里面没提怎么在 Claude Code 里把子代理切到它。我四月那套机制照改理论上能跑,可这一次官方没给任何说明。
我打算先拿两处最不吃语感的活试,格式转换和文件追加写入。它们出错了也一眼看得出来,摔了不疼。
跑出来的数我照实报,这次不欠着。筹码是厚了,账还是那本账。
回到那张券。它的限制从来不在面额,在能用它的柜台。而你手上那笔开销走的是哪个柜台,才决定了这轮降价跟你有没有关系。
你那边呢,你的 AI 开销是按月交的还是按量交的,最近这轮降价你接住了哪一处?评论区说一下你怎么付钱,我帮你看看有没有你能用上的那一处。