Grok Composer 2.5 Fast:0.05 倍率,以及它换掉的东西
目录里唯一的 0.05 倍率,作用在 3/15 美元的官方定价上,折算后是每百万 0.15 / 0.75 美元——输入是 gemini-3-flash 的三倍。另外它没有 thinking,context 只有 200,000。
倍率最低,不等于价格最低
grok-composer-2.5-fast 按 0.05 倍计费,目录里没有比这更低的倍率——整体从 0.05 倍到 1 倍都有,主流 id 大多落在 0.1 倍。只看这个数字,它像是便宜出一大截的那个选项。
但倍率是折扣,折扣值不值钱要看它打在多少钱上。Composer 的官方定价是输入每百万 3 美元、输出 15 美元,是三个 Grok 文本模型里官方输入价最高的一个。乘上 0.05 之后,输入 0.15 美元、输出 0.75 美元。
再看 gemini-3-flash:倍率只是普通的 0.1 倍,但官方价是 0.50 / 3 美元,折算后是 0.050 和 0.30 美元。也就是说 Composer 的输入贵三倍、输出贵 2.5 倍。折扣最狠的 id 和账单最小的 id,压根不是同一个。
和另外两个 Grok 比,要看你的输出占比
在三个 Grok 文本模型内部,结论会随流量形状翻转。grok-4.6 和 grok-4.5 都是输入 0.20 美元、输出 0.60 美元;Composer 输入更便宜(0.15),输出更贵(0.75)。
这给出一条很干净的分界线:输出不到输入的三分之一时,Composer 更省;超过三分之一,反过来。举例来说,10 万 token 的 prompt 只回 2,000 token,Composer 是 0.0165 美元,grok-4.6 是 0.0212 美元;换成 5,000 token 的 prompt 回 8,000 token,就变成 0.0067 对 0.0058,贵的那个换人了。
所以要问的不是"哪个便宜",而是"我的输入输出比是多少"。决定之前先从真实流量里把这个比例捞出来:读一大段 diff、回一段话的代码审查在分界线一侧,短需求写长文件的生成任务在另一侧。算账时还有一点要留意:grok-4.6 和 grok-4.5 的 0.20 / 0.60 是 sub-200K 档的价格,单次 prompt 达到或超过 200,000 token,xAI 会把两头都翻倍——而这个位置恰好也是 Composer 窗口的尽头。
curl https://token-share.app/v1/chat/completions \
-H "Authorization: Bearer $TOKEN_SHARE_KEY" \
-H "content-type: application/json" \
-d '{
"model": "grok-composer-2.5-fast",
"max_tokens": 2048,
"messages": [
{"role": "user", "content": "Apply this patch and report any conflicts."}
]
}'规格上它让掉了什么
Composer 的能力列表是文本和工具调用,没有 thinking——另外两个 Grok 文本 id 有。这不是"效果差一点"的问题,而是能力本身不在这个 id 上:如果你的 prompt 依赖一段扩展推理,这就是硬差别。
窗口也更小:context 200,000 token,对面 grok-4.6 和 grok-4.5 是 500,000;输出上限 32,768,对面是 65,536。在 4.6 上塞得下的 prompt,这里未必塞得下;在那边完整的回答,这边可能被砍一半。
这些都不说明它是错的选择,只说明它有形状:输入量大、回答短、不需要推理步骤、prompt 不超过 200,000 token。对得上这个形状的流量,账单确实很低;对不上的,要么塞不进去,要么就为输出付每百万 0.75 美元。