Deepseek ArtifactsDeepseek Artifacts
返回博客

GPT-6.1 Sol 来了:价格、上下文窗口与 Sonnet 5.5 对比(2026)

OpenAI 在 DevDay 2026 发布 GPT-6.1 Sol:接近 Astra 的能力,只要五分之一的价格($2/$10 每百万 tokens),105 万上下文。本文核实全部价格档位、与 Sonnet 5.5 和 Astra 的正面对比,以及现在能在哪些地方用上它。

2026年9月30日

OpenAI 在 2026 年 9 月 29 日的 DevDay 主题演讲上发布了 GPT-6.1 Sol:能力上紧贴旗舰 GPT-6 Astra 降一档,价格却只有 Astra 标准 API 价的五分之一——每百万输入 tokens $2、输出 $10。发布当天它就对全部付费档位开放(API、Plus、Pro、Business、Enterprise、Edu),GitHub Copilot 也在同日把它加进了模型选择器。OpenAI 官方的定位原话:以接近 Astra 的表现,承担复杂编码、computer use 和专业工作。

如果你是来对比 Claude Sonnet 5.5 的,先说结论,而且这个结论对 Anthropic 不太舒服:GPT-6.1 Sol 的标价和 Sonnet 5.5 一模一样——$2/$10 每百万 tokens,上下文窗口还略大一点,背后是 OpenAI 全套 agentic 工具链。本文是核实过的完整指南:细到缓存价和长上下文附加费的全档位价格、与 Sonnet 5.5 和 Astra 的正面对比,以及它今天到底能在哪儿用。

快速答案

  • 价格: 标准 $2 输入 / $10 输出(每百万 tokens),正好是 GPT-6 Astra 的 1/5;缓存读取 $0.10,缓存写入 $2.50。
  • 上下文: 1,050,000 tokens(最大输入 922K、最大输出 128K);输入超过 272K 时,整个请求按 2× 输入、1.5× 输出计费。
  • 对比 Sonnet 5.5: 标价完全相同($2/$10);Sol 缓存读取便宜一半($0.10 对 $0.20),Sonnet 5.5 则没有 Sol 那条 272K 以上的长上下文附加费。
  • 对比 GPT-6 Astra: Astra 仍是 $10/$50 的旗舰。不需要 Astra 天花板的场景,Sol 是省钱的选择。
  • 可用性: 所有付费 ChatGPT 档位与 API 现已可用;GitHub Copilot 9 月 29 日起灰度推送(Pro+、Max、Business、Enterprise)。
  • Ultrafast 模式: 目前只有 Astra($60/$300),Sol Ultrafast 标注「即将推出」。

GPT-6.1 Sol 到底是什么

GPT-6 家族的梯队现在很清晰,直接引用 OpenAI 模型目录的说法:Astra 扛最难的工作,GPT-6.1 Sol 平衡智能与成本,Luna($0.10/$0.50)吃高并发、对成本敏感的量。容易混淆的是,目录里还有一个 9 月 22 日发布的旧 GPT-6 Sol(没有「.1」)——GPT-6.1 Sol 是它在 DevDay 上的升级版,两个型号目前并列在售,标价同为 $2/$10。最直观的升级在缓存上:旧 Sol 缓存读取 $0.20 每百万,.1 直接砍半到 $0.10。

接入前值得知道的官方规格:

规格数值
模型 IDgpt-6.1-sol
上下文窗口1,050,000 tokens
最大输入 / 输出922,000 / 128,000 tokens
知识截止2026 年 4 月 30 日
推理力度档位low、medium(默认)、high、xhigh、max
模态文本 + 图片输入,文本输出
数据驻留美国 / 欧盟(EU 驻留不支持 Fast 模式)

两个接入要点:工具调用必须走 Responses API(Chat Completions 只支持无工具场景);none 和 minimal 两档推理力度不受支持,下限是 low。用过 Claude Code 的 /effort 滑杆的话,这套 low 到 max 的命名会很眼熟——区别在于这里是模型按步骤自己决定思考多少,medium 是默认值。

GPT-6.1 Sol 价格:卡片上每一个数字

官方宣传语「Astra 标准 API 输入输出价的五分之一」我们逐项对过了,分毫不差:

费率(每百万 tokens)GPT-6.1 SolGPT-6 AstraGPT-6 Luna
输入(标准)$2.00$10.00$0.10
输出(标准)$10.00$50.00$0.50
缓存读取$0.10$1.00$0.01
长上下文(输入 >272K)$4.00 / $15.00$20.00 / $75.00$0.20 / $1.00
Batch / Flex$1.00 / $5.00$5.00 / $25.00—
Fast 模式(2× 标准)$4.00 / $20.00$20.00 / $100.00—
Ultrafast即将推出$60.00 / $300.00—

表格之外还有几个细节:

  • 缓存写入按输入价的 1.25 倍计费($2.50 每百万)——频繁重写长系统提示词的场景要留意。
  • 长上下文附加费按整个请求计,不是只对超出部分:一个 300K tokens 的提示词,全部 tokens 都按 2× 输入 / 1.5× 输出结算。922K 的最大输入上限意味着整仓粘贴型用法会直接踩到这条线。
  • Fast 模式统一 2× 标准,Batch/Flex 统一半价——最便宜的 Sol 是 Batch 里的 $1/$5。
  • Ultrafast 是 DevDay 新出的速度档(Codex 内最高 300 tokens/秒),目前只有 Astra 有定价,Sol Ultrafast 官方口径是「即将推出」。所以今天 Sol 的加速方案顶到头就是 Fast 模式 $4/$20。

价格表还藏了一个对比:Sol 的缓存读取($0.10)甚至比它自己的 Batch 输入价($1.00)还便宜一个数量级,在这代模型上,提示词缓存从来没有这么值钱过——多轮之间复用大系统提示词的 agentic 工作流感受会最明显。

GPT-6.1 Sol 对比 Claude Sonnet 5.5

这是大多数团队真正会比较的一组,因为 Sonnet 5.5 已进入两大编码工具(Claude Code 自 v2.1.284 起成为默认 Sonnet 模型、GitHub Copilot 自 9 月 28 日起正式可用):

维度GPT-6.1 SolClaude Sonnet 5.5
输入 / 输出(百万)$2.00 / $10.00$2.00 / $10.00
缓存读取(百万)$0.10$0.20
上下文窗口1,050,0001,000,000
最大输出128,000128,000
长上下文计费输入超 272K 后全单 2× 入 / 1.5× 出无——全 1M 窗口统一标准价
推理力度控制low–max effort 参数Claude Code / API 的 effort 档位
编码工具覆盖Codex CLI、Copilot、ChatGPTClaude Code、Copilot、Claude 全家桶

标价完全相同——OpenAI 就是照着 Sonnet 5.5 的数字定的价。所以真正的差别全在细则里,而且方向相反:

  • 缓存场景 Sol 占优。 Sol 缓存读取是基础输入价的 5%($0.10),Sonnet 5.5 是 10%($0.20)。每轮都重放大系统提示词的编码 agent——这几乎是所有编码 agent 的常态——跑在 Sol 上账单会实打实低一截。
  • 长文档场景 Sonnet 5.5 占优。 Anthropic 对 Claude 4.6 及之后的模型在全 1M 窗口内统一按标准价计费——900K tokens 的请求和 9K tokens 的请求单价一样。Sol 只要输入超过 272K,整个请求就切换到 2× 输入 / 1.5× 输出,整仓粘贴是 Sonnet 5.5 明显更便宜的唯一场景。
  • 最大输出打平,都是 128K tokens;上下文窗口 1.05M 对 1M,差距可以忽略。

哪个模型编码更强是个实证问题——OpenAI 官方文档自己都说「在你的任务上和 Astra 比一比」。但「留在单一生态」的价格借口,从今天起不存在了。你的工作流在 Claude Code 的话,我们的 Claude Code effort 与 ultracode 指南讲清了 Sonnet 5.5 的 effort 默认档;用 Copilot 的话,模型正在灰度进入选择器。

GPT-6.1 Sol 对比 GPT-6 Astra

Astra 仍是旗舰,DevDay 没有动它的价格:标准 $10/$50(缓存 $1.00,长上下文 $20/$75,Ultrafast $60/$300)。Sol 的存在意义,是接住那些够不着 Astra 天花板的需求:

  • 标价便宜 5 倍,上下文窗口(1.05M)和工具面(Responses API、Agents API 的 computer use)完全一致。
  • OpenAI 的定位写得很明白:Sol 提供「接近 Astra 的表现,承担复杂编码、computer use 与专业工作」。官方文档给的使用建议也很实在——在你的任务上把两个模型都跑一遍,只在差距真实出现的地方付 5 倍的价。
  • Astra Ultrafast 今天就有,Sol Ultrafast 还没有。 现在就需要 300 tokens/秒的速度档,唯一选项是 $60/$300 的 Astra。
  • 实操建议:默认流量走 Sol,最难的 agentic 任务保留 Astra——相当于用小得多的质量断崖,复刻了 9 月 Astra/Luna 的分工。

现在能在哪里用上 GPT-6.1 Sol

  • API: Responses 与 Chat Completions 端点已上线,Batch 可用;支持美国 / 欧盟数据驻留(EU 不含 Fast 模式)。
  • Codex CLI 与 Codex 云端: 模型选择器可选;DevDay 的「Codex in the cloud」刷新后任意设备都能发起。我们的 Codex CLI 教程覆盖选择器与 /model 流程,Codex 模型切换指南讲怎么固定默认模型。
  • ChatGPT: 全部付费档位(Plus、Pro、Business、Enterprise、Edu)。
  • GitHub Copilot: 9 月 29 日起向 Pro+、Max、Business、Enterprise 灰度,覆盖 VS Code、Copilot CLI、coding agent、JetBrains 与 Xcode——按供应商牌价以用量计费(usage-based billing),管理员可通过模型策略管理访问。

本站存在的理由:更便宜的替代路线

$2/$10 是主流前沿模型的价位,但仍然比 DeepSeek 高出约一个数量级——DeepSeek API 低谷时段输入价约 $0.15 每百万 tokens,Z.AI 的编码计划还能更低(我们单独追踪当前的 Z.AI 折扣)。如果你的瓶颈是常规编码工作的 tokens-per-dollar 而不是峰值推理,同一套 agentic 工作流今天就能跑在这些模型上——把 Codex 接到近免费后端的接线指南在我们的 Codex 用量面板详解里。

FAQ

GPT-6.1 Sol 的价格是多少?

标准费率 $2 每百万输入 tokens、$10 每百万输出 tokens。缓存读取 $0.10、缓存写入 $2.50,Batch/Flex 半价 $1/$5,Fast 模式加倍 $4/$20。输入超过 272K tokens 的请求,整单按 2× 输入、1.5× 输出结算。这正好是 GPT-6 Astra 标准价的五分之一。

GPT-6.1 Sol 比 Claude Sonnet 5.5 便宜吗?

标价层面不便宜——两者都是 $2/$10 每百万 tokens。Sol 在账单上的优势是 $0.10 的缓存读取价(Sonnet 5.5 收 $0.20),缓存命中的 agentic 循环里会拉开差距。Sonnet 5.5 的优势是全 1M 窗口统一标准价,而 Sol 输入超 272K 后整单按 2× 输入、1.5× 输出计费。真实成本差异取决于你的缓存命中率和提示词长度,而不是标价。

GPT-6.1 Sol 和 GPT-6 Astra 怎么选?

默认用 Sol,任务真的需要旗舰天花板时再上 Astra。两者上下文窗口和工具面一致;Astra 标准价贵 5 倍,而且是当前唯一有 Ultrafast 速度档的模型。OpenAI 官方对 Sol 的描述就是「以更低成本提供接近 Astra 的表现」,并建议在你的实际工作负载上做对比。

ChatGPT 免费版能用 GPT-6.1 Sol 吗?

不能——它面向付费档位发布:Plus、Pro、Business、Enterprise、Edu,外加 API。Free 和 Go 用户仍在 Luna 档模型上。GitHub Copilot 侧,9 月 29 日起向付费 Copilot 档位灰度。

GPT-6.1 Sol 的上下文窗口和输入上限是多少?

上下文窗口 1,050,000 tokens,最大输入 922,000、最大输出 128,000。输入超过 272K tokens 的请求会切换到长上下文计费(2× 输入、1.5× 输出)——把整个仓库粘进去之前,先算的是这笔账。

GPT-6.1 Sol 支持 Ultrafast 模式吗?

暂时不支持。Ultrafast(Codex 内最高 300 输出 tokens/秒,API 6 倍)目前只有 GPT-6 Astra 有定价,为 $60/$300 每百万 tokens。官方将 Sol Ultrafast 标注为「即将推出」;在此之前,Sol 的加速上限是 Fast 模式($4/$20,标准的 2 倍)。