三个图像模型怎么选:两种完全不同的计费方式
grok-imagine-image 每张 $0.01、grok-imagine-image-quality 每张 $0.04,都是 1 倍率,没有任何折扣。gpt-image-2 是 0.1 倍率,但按 token 计费而不是按张。
三个里有两个完全没有折扣
先把话说在前面。本站对价格的说法是「低至 0.05 倍,主流模型 0.1 倍」——这句话对文本目录成立,对这一页不成立:grok-imagine-image 和 grok-imagine-image-quality 的倍率都是 1,每张分别 $0.01 和 $0.04,就是官方价,一分不减。
gpt-image-2 算是例外中的例外,它照常是 0.1 倍率,但计费依据是网关记录的 token 而不是张数。官方每百万输入 token 5 美元、输出 30 美元,落到你头上就是 $0.50/M 和 $3.00/M。
结果就是这三个 id 塞不进同一列价格里:两个是「每张多少钱」,固定且事先已知;第三个的成本随你要的尺寸和质量浮动,想知道某组参数到底多少钱,只能先生成一张再回读 usage。
export TOKEN_SHARE_KEY="<your-pool-api-key>"
# Grok Imagine — priced per generated image, so n is the whole cost story.
curl -sS https://token-share.app/v1/images/generations \
-H "Authorization: Bearer $TOKEN_SHARE_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-imagine-image",
"prompt": "A cute baby sea otter",
"aspect_ratio": "1:1",
"resolution": "1k",
"response_format": "url"
}' | jq '.data[].url'
# GPT Image 2 — priced on reported tokens, so size and quality move the bill.
curl -sS https://token-share.app/v1/images/generations \
-H "Authorization: Bearer $TOKEN_SHARE_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-image-2",
"prompt": "A cute baby sea otter",
"size": "1024x1024",
"quality": "high",
"response_format": "b64_json"
}' | jq '.usage'两个 Grok id 之间那 4 倍差价买到什么
grok-imagine-image 和 grok-imagine-image-quality 是同一家族的两个价位:每张 $0.01 和 $0.04,差 4 倍。两者都是 1 倍率,都走 /v1/images/generations,请求结构也一样。
目录里把 quality 那个描述为更高保真、面向成品输出的模型——表格能给的信息到此为止。这个差别在你的 prompt 上、你要的分辨率下、你的用途里看不看得出来,是关于图像的判断,不是一个数字,这一页替你排不了名。
诚实的测法很便宜,一分钟就够:同样二十个 prompt 两个 id 各跑一遍,把结果并排看。二十张图,基础版 $0.20,quality 版 $0.80。到每月一千张时,同一个决定就是 10 美元对 40 美元,那时候才值得有立场。
按张计费和按 token 计费,风险不一样
按张收费的可预测性像订阅:grok-imagine-image 出 5000 张就是 50 美元,quality 版就是 200 美元,任何请求参数都改不了这个数,月度预算跑之前就能定死。
gpt-image-2 用这份确定性换了更低的倍率——$5/M 输入、$30/M 输出的 0.1 倍,收的是网关记录的实际 token,而目录里注明这个量随分辨率和质量变化。于是就有了一种很隐蔽的失控:批处理任务悄悄换成更大的尺寸,账单跟着涨,而那段只统计张数的代码毫无察觉。
所以分两种情况:量是「每天固定几张图」,两个 Grok id 让你乘一下就完事;尺寸和质量本身是变量,就先在 gpt-image-2 上跑一批有代表性的样本,按它回报的 usage 外推,别按拍脑袋的「每张多少钱」估。
这几个 id 不做的事
这三个 id 的能力字段里只有 image,别的什么都没有——没有 text,没有 tools,没有 thinking。它们只负责出图,不是能跟你对话的模型,也不出现在上下文窗口那张表里,因为它们根本不按 context 计费。
视频是另一个 id、另一套计费:grok-imagine-video-1.5 是 0.1 倍率,按视频秒数收费,走 /openai/v1/videos 而不是图像端点。拿图像模型要视频是不行的,路由就不一样。
三个图像 id 都是同一种 OpenAI 形态的调用——POST /v1/images/generations,配 Authorization: Bearer——所以互相切换就是改 model 字段,外加两个家族之间那点参数差异。