Gemini 3.8 Flash 与 3.7 Flash:同样的单价,两倍的倍率
官方定价同样是每百万 0.75 / 3.75 美元,规格也一样,但 3.8 Flash 按 0.2 倍计费、3.7 Flash 按 0.1 倍。结果就是:新的那个在这里正好贵一倍。
同一张价目表,不同的倍率
gemini-3.8-flash 和 gemini-3.7-flash-high 的官方定价一模一样:输入每百万 0.75 美元、输出 3.75 美元。规格也一样——1,000,000 token context、65,536 token 输出上限、支持文本 / 工具调用 / thinking,都走 POST /v1/chat/completions。
不一样的是倍率:3.8 是 0.2 倍,3.7 是 0.1 倍。乘出来,新的那个输入 0.15 美元、输出 0.75 美元;旧的是 0.075 和 0.375。输入输出两头都正好翻倍。
gemini-3.6-flash-high 和 3.7 条件相同:一样的 0.75/3.75 官方价、一样的 0.1 倍率、一样的 1,000,000 窗口和 65,536 上限。所以目录里是两个 0.075/0.375 的 id 加一个 0.15/0.75 的 id,而贵的那个正好是最新的。
翻倍落到一个月的账单上是多少
百分比容易被一句话带过,换成 token 就清楚了。一个月 500 万输入 token、100 万输出 token:gemini-3.7-flash-high 是 0.75 美元,gemini-3.8-flash 是 1.50 美元。单次的大任务 100 万输入、20 万输出,则是 0.15 对 0.30。
这个比例在任何量级下都成立,因为价目表两头是一起翻倍的——不存在某种流量结构能让差距变小或变大。不管你的输入输出比是多少,3.8 Flash 就是 3.7 Flash 的两倍。
这种取舍其实少见地干净:你不需要权衡"输入便宜但输出贵",你只需要判断,2026-08-13 到 2026-09-02 这 20 天里的更新,在你的任务上能不能被察觉出来。
for MODEL in gemini-3.8-flash gemini-3.7-flash-high; do
curl -s https://token-share.app/v1/chat/completions \
-H "Authorization: Bearer $TOKEN_SHARE_KEY" \
-H "content-type: application/json" \
-d "{
\"model\": \"$MODEL\",
\"max_tokens\": 1024,
\"messages\": [
{\"role\": \"user\", \"content\": \"Review this diff for correctness bugs.\"}
]
}" | jq -r '.choices[0].message.content'
done3.8 是不是更好,目录答不了
目录里关于这两个 id 的记录,除了倍率和发布日期之外全都相等:没有 benchmark,没有质量分数,也没有"这个有那个没有"的能力项。有人告诉你新版本推理更强,那不是从这张表里读出来的,我们也不会替他下这个结论。
剩下的只能你自己测,而且测起来很便宜:两个 id 同路由、同请求体,对比就是对两个字符串跑一遍循环。抽一批你自己真实的 prompt,两边各跑一次,把产出摆在一起看。
标准要在跑之前定好,不要跑完再找理由:如果 3.8 Flash 在你的活儿上拿不出一个你指得出来的差别,那这 2 倍买的就是一个版本号;如果拿得出来,翻倍之后也不过是每百万 0.15 和 0.75 美元,值不值得由你的量级说了算。