OpenAI 发布 GPT-6 Sol 与 GPT-6 Luna,API 价格直接砍半,官方确认不是促销价

2026-09-23·8分钟阅读

2026年9月22日(周二),OpenAI 发布了 GPT-6 家族的两个新成员:GPT-6 Sol 与 GPT-6 Luna,并把 API 价格相对上一代 GPT-5.6 砍掉了大约一半。据 VentureBeat 报道,OpenAI 的一位发言人向该媒体确认,这两个价格是永久价格,不是促销价也不是短期介绍价。据 CNBC 报道,这两款模型是 GPT-6 旗舰 Astra 之下新增的档位:Sol 面向更复杂的工作负载,Luna 面向高吞吐的重复性任务。同一天上午,Anthropic 也发布了 Claude Opus 5.5,两边的新模型在价格表上正好撞在一起。

先把价格数字列清楚,因为这次新闻的全部重量都在数字上。按 VentureBeat 的报道,GPT-6 Sol 定价为每百万 token 输入 2 美元、输出 10 美元;上一代 GPT-5.6 Sol 的现行价格是输入 4 美元、输出 20 美元,两个方向都正好便宜 50%。GPT-6 Luna 定价为每百万 token 输入 0.10 美元、输出 0.50 美元;GPT-5.6 Luna 的现行价格是输入 0.20 美元、输出 1.20 美元,也就是输入便宜 50%、输出便宜约 58.3%。据 CNBC 报道,两家公司都把降价归功于推理效率与 prompt caching(提示缓存)的改进——换句话说,这次不是补贴换份额,而是同样的活干下来真的更省算力了。

第二件要说清楚的事是三个档位的分工。据 CNBC 报道,Sol 位于 Astra 之下,主要面向编码这类更复杂的工作负载;Luna 则面向公司所说的「高吞吐任务」,例如信息抽取或文档摘要。按 VentureBeat 的表述,Sol 瞄准的是开发者与知识工作者反复要做的复杂工作——写功能、审代码、调试、分析数据;Luna 是那些定义得更窄的活,比如摘要、抽取和回答直白的问题;而 Astra 仍然留给跨多种媒介、涉及多个要素的最复杂项目,以及更难的科研与数学问题。OpenAI 表示两款新模型在基准上超过了各自的 5.6 前代,但能力仍然低于本月早些时候发布的旗舰 Astra。

第三个角度是价格表上的邻居,这比降幅本身更有信息量。按 VentureBeat 整理的对照,Sol 的 2 美元输入与 10 美元输出,正好等于 Anthropic 的 Claude Sonnet 5——Anthropic 在 8 月已经把这个介绍价转成了永久价。而 Anthropic 在同一个周二上午发布的 Claude Opus 5.5 定价为输入 4 美元、输出 20 美元,也就是说 Sol 的输出价是新 Opus 的一半;相比之下,Anthropic 面向最高通用档位的 Claude Fable 5.1 是输入 10 美元、输出 50 美元,是 Sol 的五倍。往下看,Luna 的 0.10 与 0.50 相对 Sonnet 5 在两个方向上都便宜 95%。Google 那边,本月初推出的 Gemini 3.8 Flash 介绍价是输入 0.75 美元、输出 3.75 美元,2027年1月1日起涨到 1.50 与 7.50 美元,也就是说即使涨价之后 Gemini 3.8 Flash 仍然比 Sol 便宜,但两家的定价结构不一样:Google 明确写了时间窗口,OpenAI 说 Sol 的 2 美元与 10 美元没有促销到期日。

第四件事是时机,而这里的背景比降价本身更值得注意。据 CNBC 报道,这是两家前沿实验室在行业该不该减速的辩论达到顶点之后的第一次模型发布。报道提到,前 Anthropic 研究员 Jacob Coxon 在 9月8日于 X 上发帖宣布辞职,警告两家实验室在「拿我们的命赌博」,这则帖子点燃了争论;随后 OpenAI 首席执行官 Sam Altman 与特斯拉和 SpaceX 首席执行官 Elon Musk 也加入了 Anthropic 首席执行官 Dario Amodei 的呼吁。CNBC 同时指出,两家公司正在努力满足那些想控制 AI 支出、寻找更划算模型的客户,而它们面对的压力来自提供更便宜开放权重模型的公司,报道中点了三家中国公司的名字:阿里巴巴、Moonshot AI 和 DeepSeek。

第五件事是这对实际做产品的人意味着什么。VentureBeat 的说法是,对企业而言,这种分层之所以重要,是因为 AI Agent 的经济性越来越取决于一次工作流里到底调用了多少次模型、重放了多少上下文、以及公司是否真的每一步都需要前沿模型。索尔和 Luna 这一层的意义就在这里:把简单、重复、定义清楚的调用放到便宜档,把真正需要复杂推理的步骤留在贵档,账单差距会来自调用的分配而不是模型的差距。Anthropic 那边的数字可以交叉印证这一点:Opus 5.5 的缓存读取价格降到每百万 token 0.20 美元,比 Opus 5 的 0.50 美元低了 60%,而缓存读取恰恰是 agent 与编码工作负载里成本占比最大的一块。也就是说,上下文复用的效率对账单的影响,可能不亚于选哪个模型。

最后留两点待观察。第一,永久价格不等于没有取舍:两款新模型的能力仍然在 Astra 之下,哪一步该降档、哪一步不能降,只有拿自己的任务跑一遍评测才知道,公开基准只能用来排除明显不合适的选择。第二,减速的呼吁与发布的节奏并存这件事本身就说明了问题——两家公司同一天各发一个新模型,说明竞争的速度并没有因为公开讨论而放慢。本文所有事实与数字均来自 VentureBeat、CNBC 与 The New Stack 的报道,未加入推测。

🤔 常见问题解答

GPT-6 Sol 和 Luna 到底多少钱?

按 VentureBeat 的报道,GPT-6 Sol 为每百万 token 输入 2 美元、输出 10 美元;GPT-6 Luna 为输入 0.10 美元、输出 0.50 美元。对照组是:GPT-5.6 Sol 为 4 美元与 20 美元,GPT-5.6 Luna 为 0.20 美元与 1.20 美元。也就是说 Sol 在两个方向都便宜 50%,Luna 输入便宜 50%、输出便宜约 58.3%。

这次降价是限时促销吗?

不是。按 VentureBeat 的报道,OpenAI 的一位发言人向该媒体确认,GPT-6 Sol 与 GPT-6 Luna 的价格是永久价格,不是促销价或介绍价。报道同时提到,两家公司都把降价归因于推理效率与提示缓存的改进。需要注意的是,Google 那边的 Gemini 3.8 Flash 目前仍是写明时间窗口的介绍价,2027年1月1日会上调。

Sol、Luna 和 Astra 该怎么选?

按报道里的定位:Astra 是旗舰,留给最复杂、跨多种媒介的项目以及更难的科研与数学问题;Sol 在 Astra 之下,面向编码、审代码、调试、数据分析这类反复出现的复杂工作;Luna 是「高吞吐」档,面向摘要、信息抽取和回答直白问题这类定义更窄的任务。VentureBeat 的提醒是,分层的意义在于把工作流里的调用分类,而不是给整个产品选一个模型。

为什么两家公司在同一天发新模型?

CNBC 给出的解释是,两家实验室都在面对来自更便宜开放权重模型的压力,同时客户在控制 AI 支出、寻找更划算的模型,报道点名了阿里巴巴、Moonshot AI 和 DeepSeek 三家中国公司。报道也指出,这是两家公司在行业减速辩论升温后的第一次发布,而辩论的起点是前 Anthropic 研究员 Jacob Coxon 在 9月8日的辞职帖。

🛠️ 推荐工具

  • AI Token 计数器降价的全部意义取决于你自己的调用量。先把手上提示词与上下文测出 token 数,再乘上 Sol 的 2 美元与 10 美元、Luna 的 0.10 美元与 0.50 美元,才能知道降档到底能省多少。拍脑袋估算 token 数,是成本优化里最常见的自欺欺人
  • AI 代码审查助手Sol 被明确定位在编码场景,而这正是最适合做分层实验的地方:同一批 diff,用便宜档跑第一遍,只把有疑问的部分交给贵档复核。做一周对比,你会得到比任何基准榜都靠谱的答案——因为那是你自己代码库上的答案
  • CSV / JSON 转换器Luna 主打的是抽取与摘要,这类任务的常见做法是让模型输出结构化数据再入库。先把下游要吃的格式固定成 JSON schema 并整理出样例,模型换成哪一档都只是改配置;格式每次靠人工整理,降价省下的钱会在返工里花回去

总结

2026年9月22日,OpenAI 发布 GPT-6 Sol 与 GPT-6 Luna,把 API 价格相对 GPT-5.6 前代砍掉了大约一半:Sol 为每百万 token 输入 2 美元、输出 10 美元,正好是 GPT-5.6 Sol 4 美元与 20 美元的一半;Luna 为输入 0.10 美元、输出 0.50 美元,相对 GPT-5.6 Luna 的 0.20 美元与 1.20 美元,输入便宜 50%、输出便宜约 58.3%。OpenAI 发言人向 VentureBeat 确认这是永久价格而非促销价,降价来自推理效率与提示缓存的改进。Sol 面向编码等更复杂的工作负载,Luna 面向摘要、抽取等高频任务,Astra 仍留给最复杂的问题。同一天上午 Anthropic 发布 Claude Opus 5.5,定价输入 4 美元、输出 20 美元,Sol 的输出价是其一半;Google 的 Gemini 3.8 Flash 目前是写明时间窗口的介绍价。CNBC 指出,这是两家实验室在行业减速辩论升温后的第一次发布,背景是客户在压 AI 支出、以及来自开放权重模型的竞争压力。本文所有事实与数字均来自 VentureBeat、CNBC 与 The New Stack 的报道,未加入任何推测。

来源链接:VentureBeat: OpenAI releases GPT-6 Sol and Luna models, slashing API costs 50% or more
CNBC: Anthropic and OpenAI roll out cheaper models in first release since call for slowdown
The New Stack: OpenAI releases GPT-6 Sol and Luna — and cuts token prices in half