GPT-6.1 Sol 来了:价格、上下文窗口与 Sonnet 5.5 对比(2026)
OpenAI 在 DevDay 2026 发布 GPT-6.1 Sol:接近 Astra 的能力,只要五分之一的价格($2/$10 每百万 tokens),105 万上下文。本文核实全部价格档位、与 Sonnet 5.5 和 Astra 的正面对比,以及现在能在哪些地方用上它。
OpenAI 在 2026 年 9 月 29 日的 DevDay 主题演讲上发布了 GPT-6.1 Sol:能力上紧贴旗舰 GPT-6 Astra 降一档,价格却只有 Astra 标准 API 价的五分之一——每百万输入 tokens $2、输出 $10。发布当天它就对全部付费档位开放(API、Plus、Pro、Business、Enterprise、Edu),GitHub Copilot 也在同日把它加进了模型选择器。OpenAI 官方的定位原话:以接近 Astra 的表现,承担复杂编码、computer use 和专业工作。
如果你是来对比 Claude Sonnet 5.5 的,先说结论,而且这个结论对 Anthropic 不太舒服:GPT-6.1 Sol 的标价和 Sonnet 5.5 一模一样——$2/$10 每百万 tokens,上下文窗口还略大一点,背后是 OpenAI 全套 agentic 工具链。本文是核实过的完整指南:细到缓存价和长上下文附加费的全档位价格、与 Sonnet 5.5 和 Astra 的正面对比,以及它今天到底能在哪儿用。
快速答案
- 价格: 标准 $2 输入 / $10 输出(每百万 tokens),正好是 GPT-6 Astra 的 1/5;缓存读取 $0.10,缓存写入 $2.50。
- 上下文: 1,050,000 tokens(最大输入 922K、最大输出 128K);输入超过 272K 时,整个请求按 2× 输入、1.5× 输出计费。
- 对比 Sonnet 5.5: 标价完全相同($2/$10);Sol 缓存读取便宜一半($0.10 对 $0.20),Sonnet 5.5 则没有 Sol 那条 272K 以上的长上下文附加费。
- 对比 GPT-6 Astra: Astra 仍是 $10/$50 的旗舰。不需要 Astra 天花板的场景,Sol 是省钱的选择。
- 可用性: 所有付费 ChatGPT 档位与 API 现已可用;GitHub Copilot 9 月 29 日起灰度推送(Pro+、Max、Business、Enterprise)。
- Ultrafast 模式: 目前只有 Astra($60/$300),Sol Ultrafast 标注「即将推出」。
GPT-6.1 Sol 到底是什么
GPT-6 家族的梯队现在很清晰,直接引用 OpenAI 模型目录的说法:Astra 扛最难的工作,GPT-6.1 Sol 平衡智能与成本,Luna($0.10/$0.50)吃高并发、对成本敏感的量。容易混淆的是,目录里还有一个 9 月 22 日发布的旧 GPT-6 Sol(没有「.1」)——GPT-6.1 Sol 是它在 DevDay 上的升级版,两个型号目前并列在售,标价同为 $2/$10。最直观的升级在缓存上:旧 Sol 缓存读取 $0.20 每百万,.1 直接砍半到 $0.10。
接入前值得知道的官方规格:
| 规格 | 数值 |
|---|---|
| 模型 ID | gpt-6.1-sol |
| 上下文窗口 | 1,050,000 tokens |
| 最大输入 / 输出 | 922,000 / 128,000 tokens |
| 知识截止 | 2026 年 4 月 30 日 |
| 推理力度档位 | low、medium(默认)、high、xhigh、max |
| 模态 | 文本 + 图片输入,文本输出 |
| 数据驻留 | 美国 / 欧盟(EU 驻留不支持 Fast 模式) |
两个接入要点:工具调用必须走 Responses API(Chat Completions 只支持无工具场景);none 和 minimal 两档推理力度不受支持,下限是 low。用过 Claude Code 的 /effort 滑杆的话,这套 low 到 max 的命名会很眼熟——区别在于这里是模型按步骤自己决定思考多少,medium 是默认值。
GPT-6.1 Sol 价格:卡片上每一个数字
官方宣传语「Astra 标准 API 输入输出价的五分之一」我们逐项对过了,分毫不差:
| 费率(每百万 tokens) | GPT-6.1 Sol | GPT-6 Astra | GPT-6 Luna |
|---|---|---|---|
| 输入(标准) | $2.00 | $10.00 | $0.10 |
| 输出(标准) | $10.00 | $50.00 | $0.50 |
| 缓存读取 | $0.10 | $1.00 | $0.01 |
| 长上下文(输入 >272K) | $4.00 / $15.00 | $20.00 / $75.00 | $0.20 / $1.00 |
| Batch / Flex | $1.00 / $5.00 | $5.00 / $25.00 | — |
| Fast 模式(2× 标准) | $4.00 / $20.00 | $20.00 / $100.00 | — |
| Ultrafast | 即将推出 | $60.00 / $300.00 | — |
表格之外还有几个细节:
- 缓存写入按输入价的 1.25 倍计费($2.50 每百万)——频繁重写长系统提示词的场景要留意。
- 长上下文附加费按整个请求计,不是只对超出部分:一个 300K tokens 的提示词,全部 tokens 都按 2× 输入 / 1.5× 输出结算。922K 的最大输入上限意味着整仓粘贴型用法会直接踩到这条线。
- Fast 模式统一 2× 标准,Batch/Flex 统一半价——最便宜的 Sol 是 Batch 里的 $1/$5。
- Ultrafast 是 DevDay 新出的速度档(Codex 内最高 300 tokens/秒),目前只有 Astra 有定价,Sol Ultrafast 官方口径是「即将推出」。所以今天 Sol 的加速方案顶到头就是 Fast 模式 $4/$20。
价格表还藏了一个对比:Sol 的缓存读取($0.10)甚至比它自己的 Batch 输入价($1.00)还便宜一个数量级,在这代模型上,提示词缓存从来没有这么值钱过——多轮之间复用大系统提示词的 agentic 工作流感受会最明显。
GPT-6.1 Sol 对比 Claude Sonnet 5.5
这是大多数团队真正会比较的一组,因为 Sonnet 5.5 已进入两大编码工具(Claude Code 自 v2.1.284 起成为默认 Sonnet 模型、GitHub Copilot 自 9 月 28 日起正式可用):
| 维度 | GPT-6.1 Sol | Claude Sonnet 5.5 |
|---|---|---|
| 输入 / 输出(百万) | $2.00 / $10.00 | $2.00 / $10.00 |
| 缓存读取(百万) | $0.10 | $0.20 |
| 上下文窗口 | 1,050,000 | 1,000,000 |
| 最大输出 | 128,000 | 128,000 |
| 长上下文计费 | 输入超 272K 后全单 2× 入 / 1.5× 出 | 无——全 1M 窗口统一标准价 |
| 推理力度控制 | low–max effort 参数 | Claude Code / API 的 effort 档位 |
| 编码工具覆盖 | Codex CLI、Copilot、ChatGPT | Claude Code、Copilot、Claude 全家桶 |
标价完全相同——OpenAI 就是照着 Sonnet 5.5 的数字定的价。所以真正的差别全在细则里,而且方向相反:
- 缓存场景 Sol 占优。 Sol 缓存读取是基础输入价的 5%($0.10),Sonnet 5.5 是 10%($0.20)。每轮都重放大系统提示词的编码 agent——这几乎是所有编码 agent 的常态——跑在 Sol 上账单会实打实低一截。
- 长文档场景 Sonnet 5.5 占优。 Anthropic 对 Claude 4.6 及之后的模型在全 1M 窗口内统一按标准价计费——900K tokens 的请求和 9K tokens 的请求单价一样。Sol 只要输入超过 272K,整个请求就切换到 2× 输入 / 1.5× 输出,整仓粘贴是 Sonnet 5.5 明显更便宜的唯一场景。
- 最大输出打平,都是 128K tokens;上下文窗口 1.05M 对 1M,差距可以忽略。
哪个模型编码更强是个实证问题——OpenAI 官方文档自己都说「在你的任务上和 Astra 比一比」。但「留在单一生态」的价格借口,从今天起不存在了。你的工作流在 Claude Code 的话,我们的 Claude Code effort 与 ultracode 指南讲清了 Sonnet 5.5 的 effort 默认档;用 Copilot 的话,模型正在灰度进入选择器。
GPT-6.1 Sol 对比 GPT-6 Astra
Astra 仍是旗舰,DevDay 没有动它的价格:标准 $10/$50(缓存 $1.00,长上下文 $20/$75,Ultrafast $60/$300)。Sol 的存在意义,是接住那些够不着 Astra 天花板的需求:
- 标价便宜 5 倍,上下文窗口(1.05M)和工具面(Responses API、Agents API 的 computer use)完全一致。
- OpenAI 的定位写得很明白:Sol 提供「接近 Astra 的表现,承担复杂编码、computer use 与专业工作」。官方文档给的使用建议也很实在——在你的任务上把两个模型都跑一遍,只在差距真实出现的地方付 5 倍的价。
- Astra Ultrafast 今天就有,Sol Ultrafast 还没有。 现在就需要 300 tokens/秒的速度档,唯一选项是 $60/$300 的 Astra。
- 实操建议:默认流量走 Sol,最难的 agentic 任务保留 Astra——相当于用小得多的质量断崖,复刻了 9 月 Astra/Luna 的分工。
现在能在哪里用上 GPT-6.1 Sol
- API: Responses 与 Chat Completions 端点已上线,Batch 可用;支持美国 / 欧盟数据驻留(EU 不含 Fast 模式)。
- Codex CLI 与 Codex 云端: 模型选择器可选;DevDay 的「Codex in the cloud」刷新后任意设备都能发起。我们的 Codex CLI 教程覆盖选择器与
/model流程,Codex 模型切换指南讲怎么固定默认模型。 - ChatGPT: 全部付费档位(Plus、Pro、Business、Enterprise、Edu)。
- GitHub Copilot: 9 月 29 日起向 Pro+、Max、Business、Enterprise 灰度,覆盖 VS Code、Copilot CLI、coding agent、JetBrains 与 Xcode——按供应商牌价以用量计费(usage-based billing),管理员可通过模型策略管理访问。
本站存在的理由:更便宜的替代路线
$2/$10 是主流前沿模型的价位,但仍然比 DeepSeek 高出约一个数量级——DeepSeek API 低谷时段输入价约 $0.15 每百万 tokens,Z.AI 的编码计划还能更低(我们单独追踪当前的 Z.AI 折扣)。如果你的瓶颈是常规编码工作的 tokens-per-dollar 而不是峰值推理,同一套 agentic 工作流今天就能跑在这些模型上——把 Codex 接到近免费后端的接线指南在我们的 Codex 用量面板详解里。
FAQ
GPT-6.1 Sol 的价格是多少?
标准费率 $2 每百万输入 tokens、$10 每百万输出 tokens。缓存读取 $0.10、缓存写入 $2.50,Batch/Flex 半价 $1/$5,Fast 模式加倍 $4/$20。输入超过 272K tokens 的请求,整单按 2× 输入、1.5× 输出结算。这正好是 GPT-6 Astra 标准价的五分之一。
GPT-6.1 Sol 比 Claude Sonnet 5.5 便宜吗?
标价层面不便宜——两者都是 $2/$10 每百万 tokens。Sol 在账单上的优势是 $0.10 的缓存读取价(Sonnet 5.5 收 $0.20),缓存命中的 agentic 循环里会拉开差距。Sonnet 5.5 的优势是全 1M 窗口统一标准价,而 Sol 输入超 272K 后整单按 2× 输入、1.5× 输出计费。真实成本差异取决于你的缓存命中率和提示词长度,而不是标价。
GPT-6.1 Sol 和 GPT-6 Astra 怎么选?
默认用 Sol,任务真的需要旗舰天花板时再上 Astra。两者上下文窗口和工具面一致;Astra 标准价贵 5 倍,而且是当前唯一有 Ultrafast 速度档的模型。OpenAI 官方对 Sol 的描述就是「以更低成本提供接近 Astra 的表现」,并建议在你的实际工作负载上做对比。
ChatGPT 免费版能用 GPT-6.1 Sol 吗?
不能——它面向付费档位发布:Plus、Pro、Business、Enterprise、Edu,外加 API。Free 和 Go 用户仍在 Luna 档模型上。GitHub Copilot 侧,9 月 29 日起向付费 Copilot 档位灰度。
GPT-6.1 Sol 的上下文窗口和输入上限是多少?
上下文窗口 1,050,000 tokens,最大输入 922,000、最大输出 128,000。输入超过 272K tokens 的请求会切换到长上下文计费(2× 输入、1.5× 输出)——把整个仓库粘进去之前,先算的是这笔账。
GPT-6.1 Sol 支持 Ultrafast 模式吗?
暂时不支持。Ultrafast(Codex 内最高 300 输出 tokens/秒,API 6 倍)目前只有 GPT-6 Astra 有定价,为 $60/$300 每百万 tokens。官方将 Sol Ultrafast 标注为「即将推出」;在此之前,Sol 的加速上限是 Fast 模式($4/$20,标准的 2 倍)。
