GPT 5.6 Luna 的 0.3 倍率:倍率更高,账单更低
Luna 的倍率是 0.3,两个同门只有 0.1,但它每 token 仍然是 GPT 5.6 家族里最便宜的。倍率不等于价格,这里把账算清楚。
倍率是折扣,不是价格
倍率是乘在模型自己的官方单价上的,本身不是价格。看到 0.3 倍就断定 Luna 比 0.1 倍的兄弟贵,结论正好反了——因为 GPT 5.6 这三个 id 的官方定价根本不在一个量级。
Sol 官方每百万输入 5 美元、输出 30 美元,Terra 是 2 和 12,Luna 是 0.20 和 1.20。各自乘上倍率:Sol 折算后 0.50 / 3.00,Terra 0.20 / 1.20,Luna 0.06 / 0.36。
换句话说,倍率更低的 Terra 每 token 反而是 Luna 的 3.33 倍,Sol 是 8.33 倍。有个好记的巧合:Luna 的官方原价,恰好等于 Terra 打完折之后的价格,而 Luna 还要在这个基础上再打一次折。
curl https://token-share.app/v1/responses \
-H "Authorization: Bearer $TOKEN_SHARE_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-luna",
"input": "Classify this log line as retryable or fatal: connection reset by peer"
}'Luna 没有缩水的地方
一个家族里便宜的那个,通常是窗口更短或者输出上限更低。Luna 不是:上下文同样是 372,000 token,输出上限同样是 128,000,text、tools、thinking 一样不缺,发布日期也和另外两个一样是 2026-07-09。
路由也一样,都是 /v1/responses,都用 Authorization: Bearer,把流量挪过去不需要改任何构造请求的代码。目录里记录的所有字段,三个 id 只有单价不同。
于是唯一没被目录写下来的维度,就剩答案质量——而这一项只能你自己测。
什么时候省得下来,什么时候是噪音
按 0.06 / 0.36 算,一次送进 100,000 token、拿回 5,000 token 的会话,Luna 大约 0.008 美元,Terra 约 0.026 美元,绝对差额不到两分钱。一个月只有几百次调用,在这里比价就是在优化噪音。
但量到一百万次,同样的差额就是一万八千美元上下,性质完全变了:单价成了账单里的主导项,其余都是零头。批量分类、日志分诊、密集的工具循环、以及任何按事件触发的调用,都属于这个区间。
真正该看的是重试率,不是价目表。Luna 每 token 比 Terra 便宜 3.33 倍,只要它不需要跑到第四次才对,就仍然更划算。拿几百条真实请求分别打到两个 id 上,数一数有多少条产出得重来,比总花费而不是比单价。重试次数落在这个比例之内,省下的钱是真的;超出去,便宜的 id 换来的是更贵的账单。