12 个 Claude model id 怎么挑
按顺序回答四个问题——通道、上下文、价格、能力——12 个 Claude id 就收敛成一份短名单。实付输入价从 0.30 到 4.00 美元每百万。
第一个问题:池子通道还是专用通道
这个问题要放在最前面,因为在有得选的 id 上,它一口气就把价格拉开 4 倍。五个 Claude id 走池子通道、倍率 0.1:claude-opus-5、claude-opus-4-8、claude-opus-4-6、claude-sonnet-5、claude-sonnet-4-6。另外七个是 stable-*,倍率 0.4。
stable-* 指的是我们自己 key 承载的专用通道,不走共享账号池,也不参与池内 failover。两边权重相同——倍率买的是路径,不是另一个模型。
真正有得选的是同时存在于两条通道上的四个模型:Opus 5、Opus 4.8、Sonnet 5、Sonnet 4.6。其余的已经替你定了:claude-opus-4-6 只有池子通道;stable-claude-haiku-4-5、stable-claude-fable-5、stable-claude-fable-5-1 只有专用通道。
第二个问题:20 万够不够装
12 个里有 9 个是 100 万 token 上下文、12.8 万输出上限:两个 Fable、三个 Opus 及其 stable 版本、claude-sonnet-5 和 stable-claude-sonnet-5。另外三个按 20 万上下文、6.4 万输出提供:claude-sonnet-4-6、stable-claude-sonnet-4-6、stable-claude-haiku-4-5。
这是"装不装得下"的问题,不是"好不好"的问题。看一眼你的请求实际带多少 input token、你实际需要多长的回复。两头都够不到上限,大窗口对你就是零收益,可以直接从筛选条件里划掉。
顺带留意:上下文和价格不挂钩。claude-sonnet-5 给满 100 万,官方定价和只有 20 万的 claude-sonnet-4-6 一样是 3/15 美元,两者实付都是 0.30 / 1.50 美元每百万。
第三个问题:每个 id 实际收你多少
下面是实付单价(官方价 × 该 id 的倍率),单位美元每百万 token,输入 / 输出。claude-sonnet-5 与 claude-sonnet-4-6:0.30 / 1.50。stable-claude-haiku-4-5:0.40 / 2.00。claude-opus-5、claude-opus-4-8、claude-opus-4-6:0.50 / 2.50。stable-claude-sonnet-5:0.80 / 4.00。stable-claude-sonnet-4-6:1.20 / 6.00。stable-claude-opus-5 与 stable-claude-opus-4-8:2.00 / 10.00。stable-claude-fable-5 与 stable-claude-fable-5-1:4.00 / 20.00。
这份表里有两处容易看反。一是池子通道的两个 Sonnet 才是最低价,比"小模型"还低——stable-claude-haiku-4-5 是它们的 1.33 倍,因为 1/5 美元乘 0.4,结果高过 3/15 美元乘 0.1。二是 stable-claude-sonnet-5 是唯一一条官方基数低于自己池子版本的专用通道:2/10 对 3/15。
目录里每个 Claude id 的输出单价都是输入的 5 倍,无一例外。所以你"读进去"和"写出来"的 token 比例,决定了这些价差对你有多重要——做摘要的负载和做代码生成的负载,看同一份表会排出不同的顺序。
curl -sS https://token-share.app/v1/messages \
-H "x-api-key: $TOKEN_SHARE_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-5",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "Review this diff for correctness bugs."}]
}' | jq '.usage'
# claude-sonnet-5 bills $0.30 per 1M input and $1.50 per 1M output.
# cost = input_tokens / 1e6 * 0.30 + output_tokens / 1e6 * 1.50第四个问题:要不要 thinking,然后就该实测了
12 个里有 11 个带 text、tools、thinking。stable-claude-haiku-4-5 只有 text 和 tools——如果思考预算是你方案的一部分,它出局;否则它仍在候选里。所有 Claude id 都走 /v1/messages,工具调用和请求结构是共同底座。
上面四个问题都是查表就能答的,答完通常还剩两三个 id。剩下的差别在于它们在你的任务上表现如何,而这一点没有表格排得出来:目录记录的是容量和价格,不是行为。
所以就去跑。端点一样、请求体一样、只改一个字段:把评测集在每个入围 id 上过一遍,重点比失败的样本而不是漂亮的样本。价格完全相同的那几组——claude-opus-5 对 claude-opus-4-8,claude-sonnet-5 对 claude-sonnet-4-6——对比的代价只是把评测集多跑一份,而它回答的正是这一页刻意没有回答的问题。