GPT 6 Astra Stable:105 万 token,走的却是 Anthropic 形状的路由
目录里最大的上下文,105 万 token;官方 10 / 50 美元定价按 0.2 倍率结算;也是唯一一个走 /v1/messages 而不是 /v1/responses 的 OpenAI id。
这里最大的窗口,以及它的价钱
stable-gpt-6-astra 的上下文是 1,050,000 token,目录里最大的一个——最接近的是几个 1,000,000 token 的 Claude id,而 OpenAI 其余文本模型最高只到 372,000。输出上限 128,000 token,与 GPT 5.6 家族持平。能力是 text、tools、thinking,发布日期 2026-09-05。
官方定价每百万输入 10 美元、输出 50 美元,在这里按 0.2 倍率结算,实际是 2.00 和 10.00 美元。相比 gpt-5.6-sol,输入贵 4 倍、输出贵 3.33 倍——多出来的那 678,000 token 空间不是白给的。
规划窗口之前还有个数字要记住:缓存读取的官方价是每百万 1 美元,而新输入是 10 美元。当长前缀确实在多轮之间重复时,正是这一项让大窗口不必每次请求都按全价重算。
它是 OpenAI 模型,请求却是 Anthropic 的形状
目录里其他 OpenAI id 都走 /v1/responses,这一个不是:它记录的 apiRoute 是 /v1/messages,也就是 Anthropic 那套请求形状——用 x-api-key 而不是 Authorization: Bearer,要带 anthropic-version 头,body 里是 messages 数组,而且 max_tokens 是必填。
实际影响是:把 stable-gpt-6-astra 换进一段照着 gpt-5.6-sol 写的代码里,不是改一个字段的事。端点、认证头、请求体三样一起变,这跟 OpenAI 家族内部那种直接替换完全不是一回事。
反过来,如果你的客户端本来就在跟 Claude 的 id 说 Anthropic 消息格式,那这个 id 只改 model 字段就能接上。规划集成之前先看路由那一列,别从厂商名字去推断。
curl https://token-share.app/v1/messages \
-H "x-api-key: $TOKEN_SHARE_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "stable-gpt-6-astra",
"max_tokens": 4096,
"messages": [
{"role": "user", "content": "Trace how the request id flows through these files."}
]
}'stable 是什么,以及百万 token 不是什么
stable- 前缀表示同一个上游模型的专属通道,用我们自己的 key 承载,而不是共享账号池,并且不参与池内故障切换。这是路由属性,不是质量承诺:两条路走到的都是同一份 GPT 6 Astra 权重,溢价买的是通路,不是另一个模型。
再说窗口本身:1,050,000 token 是容量,不是记忆力。窗口是空是满,每 token 单价一模一样,所以每次请求都把整个仓库贴进去,只会让账单翻倍,不会让答案变好。按 2.00 美元每百万算,塞满 1,000,000 token 的一次调用,光输入就是 2.00 美元——在它变成习惯之前,先把这笔账算出来。
什么时候这笔钱花得值:材料必须同时在场的时候——调用图横跨一堆你没法预先挑出来的文件,或者一段很长的对话记录,前面任何一轮都可能被用到。如果你能检索出相关那一小片,那么一个 372,000 token、输入单价只有四分之一的 id 同样能干完这活儿。