GPT 5.4 Mini:便宜的那个 OpenAI id,以及它的上限
官方 0.75 / 4.50 美元的定价乘 0.1 倍率,gpt-5.4-mini 折算后是每百万 0.075 / 0.45 美元。tools 和 thinking 一样不少,卡住的是上下文和输出上限——而且还有个同门比它更便宜。
它多便宜,又保留了什么
gpt-5.4-mini 官方定价每百万输入 0.75 美元、输出 4.50 美元,按 0.1 倍率结算,实际是 0.075 和 0.45。和同代的 gpt-5.4 比,两边都便宜 3.33 倍;和 gpt-5.5 比是 6.67 倍。
"mini"这个词通常意味着砍功能。这里没有:目录记录 gpt-5.4-mini 支持 text、tools、thinking,与 gpt-5.4、gpt-5.5 的能力列表完全一致,路由同样是 /v1/responses,同样用 Authorization: Bearer 头。
发布日期也和本代一致,2026-03-15。所以这笔交易不是"少给功能换低价"——功能一项没少,价格更低,而下面要说的那些上限,是整个 5.4/5.5 世代共有的,不是这个 id 独有的短板。
curl https://token-share.app/v1/responses \
-H "Authorization: Bearer $TOKEN_SHARE_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4-mini",
"input": "Return only one word, bug or feature: the commit message is \"allow empty tags in the parser\"."
}'两道上限:进 27.2 万,出 6.4 万
gpt-5.4-mini 接收 272,000 token 上下文,最多输出 64,000 token。这两个数字在这里的 OpenAI 文本模型中都是最小的——GPT 5.6 系列是 372,000 进、128,000 出,stable-gpt-6-astra 是 1,050,000 进。
输出上限这道坎会明着炸。一个必须单次返回超过 64,000 token 的任务——整文件重写、生成长文档——在这里得到的不是更便宜的答案,而是被截断的答案。这是硬限制,与质量无关。
上下文那道坎则是暗着来的。272,000 token 听起来很宽裕,直到一个长时间跑的 agent 会话把工具返回结果一条条堆进对话里,窗口就满了;这时候换便宜 id 省下的钱,会变成管理小窗口的工程成本。
有个同门比它还便宜
在把 gpt-5.4-mini 认定为预算方案之前,先看一眼 gpt-5.6-luna:折算后每百万 0.06 / 0.36 美元,比 0.075 / 0.45 更低。而且 Luna 的上下文是更大的 372,000 token,输出上限也是更高的 128,000。
容易看反的是倍率那一栏——Luna 是 0.3 倍,gpt-5.4-mini 是 0.1 倍。倍率是乘在各自官方定价上的折扣,而 Luna 的官方价起点低得多,所以倍率更大,折完反而更便宜。
这并不意味着选择是自动的。两者是不同世代,目录也没有记录谁的产出更好,唯一靠谱的办法是拿你自己的一批真实 prompt 分别跑,比产出、比重试次数。两个 id 在 /v1/responses 上用同一套请求结构,每条 prompt 多花一次调用就能比出来。