通过 Responses API 请求,将 model 设为 gpt-6.1-sol、service_tier 设为 ultrafast。每百万 tokens 的短上下文价格,Standard→Ultrafast 分别为输入 $2→$12、缓存输入 $0.10→$0.60、缓存写入 $2.50→$15、输出 $10→$60。超过 272K 输入 tokens 的请求另适用长上下文价格;地区处理按官方计价表可能有 10% 加价。默认 Ultrafast 速率上限:Build 100 万、Launch 400 万、Grow 4000 万 TPM。WebSocket 持久连接可减少多轮 agent 工具调用的网络开销。该六倍是价格倍数,不是保证六倍速度;未宣布将现有 Standard 请求默认迁移至 Ultrafast,亦未披露需要过渡的旧套餐安排。
OpenAI API|模型性能与计费|Ultrafast
GPT-6.1 Sol 开放 Ultrafast API 模式,计费为 Standard 的六倍
OpenAI 10 月 8 日正式提供这一低延迟档位,面向所有 API 用户开放,但采用独立速率限制。支持全球处理及美国、欧盟数据驻留;这是按使用量付费的可选 API 档位,并非 Codex 或 ChatGPT 订阅额度重置。
