Claude Sonnet 5 与 Sonnet 4.6:上下文、输出上限、价格
在 0.1 倍通道上两者定价完全相同(3/15 美元),但上下文是 100 万对 20 万,输出上限是 12.8 万对 6.4 万。到了 stable 通道,价格关系反过来了。
同样的价格,五倍的空间
在池子通道上,两个 id 的价格是一样的:官方输入每百万 token 3 美元、输出 15 美元,0.1 倍率,实际计费 0.30 / 1.50 美元每百万。老一代在这里并不是"便宜的那个选项"。
真正拉开距离的是容量:claude-sonnet-5 吃 100 万 token 上下文、最多吐 12.8 万 token;claude-sonnet-4-6 是 20 万和 6.4 万。同样的单价,输入空间差 5 倍,输出上限差 2 倍。
其余字段完全对齐——都支持 text、tools、thinking,都走 /v1/messages,请求体可以直接互换。发布时间上,4.6 是 2026-01-22,5 是 2026-05-14,中间差了不到四个月。
curl -sS https://token-share.app/v1/messages \
-H "x-api-key: $TOKEN_SHARE_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-4-6",
"max_tokens": 2048,
"messages": [{"role": "user", "content": "Summarise the failure modes in this log."}]
}'20 万够不够,看你到底往里塞什么
20 万 token 其实装得下很多代码。改单个文件、走一轮 review、跑一串工具调用,多数会话根本碰不到上限——这种情况下 Sonnet 5 多出来的 80 万 token 就是闲置:你没为它付钱,也没从它身上拿到东西。
上限会在两个地方变成真问题。一是工作集本身就塞不进去;二是长时间跑 agent,transcript 一路增长,最后不得不截断会话。如果这两件事在你这儿经常发生,那才是这场对比真正要谈的差别。
更容易被忽略的是 6.4 万的输出上限:要一次生成一个长文件、一份完整迁移脚本、一篇大结构化文档时,4.6 会停下来,5 还能继续往下写。
stable 通道上,老的那个反而更贵
两代都有专用通道,而这里的定价并不一致。stable-claude-sonnet-5 的官方基数是 2/10 美元,乘 0.4 倍等于 0.80 / 4.00 美元每百万;stable-claude-sonnet-4-6 的基数是 3/15 美元,同样乘 0.4 倍,是 1.20 / 6.00 美元每百万。
换句话说:在池子通道上两者持平,一旦换到 stable 通道,老一代反而贵 1.5 倍。如果当初选 4.6 的理由是省钱,那这个理由在切到专用通道的那一刻就不成立了。
stable-* 走的是我们自己 key 承载的专用通道,不经过共享账号池,也不参与池内 failover。权重两边一样,倍率买的是路径,不是模型。
在自己的工作负载上怎么下结论
别从规格表出发,从自己的 token 记录出发。如果每次请求的输入远够不到 20 万、回复也从没接近过 6.4 万,那容量差对你就是零收益——对你而言这两个 id 同价、同形状。
反过来,如果确实经常逼近这些数字,问题就不再是"对比"而是"约束"了:一个装得下你的请求,另一个会把它截断。
剩下的是质量问题,目录回答不了。端点相同、请求体相同、只改一个字段——把评测集在两边各跑一遍,重点看谁在哪里出错。