首页AI 资讯GPT-6 Sol 与 Luna 发布:API 永久半价背后的「任务计价」转向,选型影响拆解
GPT-6 Sol 与 Luna 发布:API 永久半价背后的「任务计价」转向,选型影响拆解 封面
产品发布2026-09-2410 分钟

GPT-6 Sol 与 Luna 发布:API 永久半价背后的「任务计价」转向,选型影响拆解

9 月 23 日 OpenAI 发布 GPT-6 Sol(编程/复杂工作负载)与 GPT-6 Luna(轻量高频推理),API 价格较 GPT-5.6 促销价再降 50%。同日 Anthropic 发布 Claude Opus 5.5,以 66.4% 的 Terminal-Bench 4.0 得分与 40% 成本降幅正面应战。比跑分更值得关注的信号:计价单位正从「一次回答」转向「一个任务的价格」。百器AI 未实测,本文区分官方口径与媒体转述。

GPT-6 SolGPT-6 LunaClaude Opus 5.5API 价格价格战选型

核心结论

本次发布最重要的不是跑分,而是计价口径的迁移:从「每百万 token」到「每任务平均成本」。

三家旗舰/次旗舰的基准分均为厂商口径,且互相之间没有同条件对照,任何「谁最强」的结论都不成立。

「追平尚未发布的 Fable 5.1」无法被第三方证伪,引用必须标注官方口径。

降价已被证明能换来调用量(Luna 13.8 倍),但财务面(OpenAI 亏损扩大 vs Anthropic 首次盈利)决定了价格战会继续。

对用户:现在签长期合约的性价比低于按月观察,等待下一次降价是理性策略。

对比判断表

对比维度GPT-6 SolGPT-6 LunaClaude Opus 5.5
定位编程等复杂工作负载轻量、高频推理编码智能体与知识工作
上下文 / 最大输出105 万 / 12.8 万 token105 万 / 12.8 万 token100 万 / 12.8 万 token
输入价(每百万)$2$0.1$4
输出价(每百万)$10$0.5$20
缓存读取官方称默认更高命中率官方称默认更高命中率$0.2(降 60%)
关键基准(厂商口径)AutomationBench xhigh 33.2%、$0.27/任务;Last Exam 56.4%high 强度较前代 +5.4%、成本 -58%Terminal-Bench 4.0 66.4%;FrontierCode 1.1 54.4%
百器AI 实测未实测未实测未实测

落地检查清单

确认你的场景归属:复杂任务(Sol/Opus 5.5)还是高频轻量(Luna/DeepSeek)
用自己的真实任务跑 A/B,不要以厂商基准做唯一依据
成本按「任务」而非「token」测算,加入缓存命中因素
暂缓锁定长期 API 合约,按月观察两家后续降价动作
迁移前对 Luna 做能力回归测试(存在弱于上代的用户反馈)
以官网最新定价为准——本文价格信息为 9/23 发布日报道,按 SKILL #47 属高时效字段

发生了什么:同一天两场发布会,三种「刀法」

本文写于 2026-09-24,记录的是 GPT-6 Sol / Luna API 首次发布与「任务计价」转向(API 价格较 GPT-5.6 促销价再降 50%)——Sol 定位编程/复杂工作负载、Luna 定位轻量高频推理。**2026-10-09 更新:OpenAI 在标准版基础上新增 GPT-6.1 Sol 的 Ultrafast 服务等级(service_tier="ultrafast"),三端同步上线,价格 = Sol Standard × 6(短上下文 $12 / $60),速度最高 8 倍;同时 Batch/Flex 50% 折扣不变、Regional processing 10% 加价不变(OpenAI 官方价格表与 Ultrafast 模式文档)。** 本文聚焦的「任务计价」与「Sol/Luna API 定位」仍然有效;新文章《GPT-6.1 Sol Ultrafast 上线:8 倍速 6 倍价,三端同步,值不值?》(`/news/gpt-6-1-sol-ultrafast-release`) 覆盖了 Ultrafast 在 API/Codex/Work 三端的上线细节、订阅档分化(仅 Pro 500/Enterprise/Edu 开放 Codex/Work 端)与实操建议,请将两篇作为「API 模型 SKU 基础定价 / 加速档定价」的双视角阅读。如做选型,9/24 这篇仍是 Sol Standard 与 Luna 的主参考;如做实时 agent 与低延迟场景,本文 10/09 才是直接参考。

本文写于 2026-09-24,记录的是 GPT-6 Sol / Luna API 首次发布与「任务计价」转向(API 价格较 GPT-5.6 促销价再降 50%)——Sol 定位编程/复杂工作负载、Luna 定位轻量高频推理,但当时这两个 SKU 仅作为 API 模型存在,并未进入 ChatGPT 默认对话流。**2026-10-08 更新:Sol 与 Luna 在 10/7-10/8 被推进 ChatGPT 主聊天默认模型——付费层 10/7 起 Sol、Free/Go 10/8 起 Luna,伴随 Intelligent UI 同步上线。** 本文聚焦的「任务计价」转向与 API 价格体系仍然有效;本次新文章《ChatGPT 全量推送 GPT-6 + Intelligent UI:聊天框从「对话框」变成「即时应用容器」》(`/news/chatgpt-gpt-6-global-rollout-intelligent-ui`) 主要覆盖渠道分发与界面创新,未深入 API 价格细节,请将两篇作为「API 模型 SKU 定位 / 渠道分发 + UI 形态」的双视角阅读。如开发者做选型,9/24 那篇仍是 API 价格与任务计价的主参考;如产品/集成方关心 ChatGPT 用户端体验变化,本文 10/8 才是直接参考。

本文写于 2026-09-24,记录的是 GPT-6 Sol / Luna API 首次发布与「任务计价」转向(API 价格较 GPT-5.6 促销价再降 50%)——Sol 定位编程/复杂工作负载、Luna 定位轻量高频推理,但当时这两个 SKU 仅作为 API 模型存在,并未进入 ChatGPT 默认对话流。**2026-10-08 更新:Sol 与 Luna 在 10/7-10/8 被推进 ChatGPT 主聊天默认模型——付费层 10/7 起 Sol、Free/Go 10/8 起 Luna,伴随 Intelligent UI 同步上线。** 本文聚焦的「任务计价」转向与 API 价格体系仍然有效;本次新文章《ChatGPT 全量推送 GPT-6 + Intelligent UI:聊天框从「对话框」变成「即时应用容器」》(`/news/chatgpt-gpt-6-global-rollout-intelligent-ui`) 主要覆盖渠道分发与界面创新,未深入 API 价格细节,请将两篇作为「API 模型 SKU 定位 / 渠道分发 + UI 形态」的双视角阅读。如开发者做选型,9/24 那篇仍是 API 价格与任务计价的主参考;如产品/集成方关心 ChatGPT 用户端体验变化,本文 10/8 才是直接参考。

本文写于 2026-09-24,记录的是 GPT-6 Sol / Luna API 首次发布与「任务计价」转向(API 价格较 GPT-5.6 促销价再降 50%)——Sol 定位编程/复杂工作负载、Luna 定位轻量高频推理,但当时这两个 SKU 仅作为 API 模型存在,并未进入 ChatGPT 默认对话流。**2026-10-08 更新:Sol 与 Luna 在 10/7-10/8 被推进 ChatGPT 主聊天默认模型——付费层 10/7 起 Sol、Free/Go 10/8 起 Luna,伴随 Intelligent UI 同步上线。** 本文聚焦的「任务计价」转向与 API 价格体系仍然有效;本次新文章《ChatGPT 全量推送 GPT-6 + Intelligent UI:聊天框从「对话框」变成「即时应用容器」》(`/news/chatgpt-gpt-6-global-rollout-intelligent-ui`) 主要覆盖渠道分发与界面创新,未深入 API 价格细节,请将两篇作为「API 模型 SKU 定位 / 渠道分发 + UI 形态」的双视角阅读。如开发者做选型,9/24 那篇仍是 API 价格与任务计价的主参考;如产品/集成方关心 ChatGPT 用户端体验变化,本文 10/8 才是直接参考。

本文写于 2026-09-24,记录的是 GPT-6 Sol / Luna API 首次发布与「任务计价」转向(API 价格较 GPT-5.6 促销价再降 50%)——Sol 定位编程/复杂工作负载、Luna 定位轻量高频推理,但当时这两个 SKU 仅作为 API 模型存在,并未进入 ChatGPT 默认对话流。**2026-10-08 更新:Sol 与 Luna 在 10/7-10/8 被推进 ChatGPT 主聊天默认模型——付费层 10/7 起 Sol、Free/Go 10/8 起 Luna,伴随 Intelligent UI 同步上线。** 本文聚焦的「任务计价」转向与 API 价格体系仍然有效;本次新文章《ChatGPT 全量推送 GPT-6 + Intelligent UI:聊天框从「对话框」变成「即时应用容器」》(`/news/chatgpt-gpt-6-global-rollout-intelligent-ui`) 主要覆盖渠道分发与界面创新,未深入 API 价格细节,请将两篇作为「API 模型 SKU 定位 / 渠道分发 + UI 形态」的双视角阅读。如开发者做选型,9/24 那篇仍是 API 价格与任务计价的主参考;如产品/集成方关心 ChatGPT 用户端体验变化,本文 10/8 才是直接参考。

9 月 23 日凌晨,OpenAI 发布 GPT-6 Sol 与 GPT-6 Luna 两款新模型,把旗舰 GPT-6 Astra 的能力「蒸」进更快更便宜的型号;同日 Anthropic 发布 Claude 5.5 系列首款模型 Claude Opus 5.5。三个新模型指向同一个判断:大模型竞争的主战场正从「谁最聪明」转向「谁又强又便宜」。

分工上,GPT-6 Sol 面向编程等复杂工作负载,Luna 面向轻量高频推理。两款均支持 105 万 token 上下文与 12.8 万 token 最大输出,并提供多档推理强度。OpenAI 同时强调:GPT-6 Astra 仍是整体最强模型,追求最佳效果与无妥协体验仍建议选 Astra。

定价是本次最大变量。GPT-6 Sol 输入/输出为每百万 token $2/$10,Luna 为 $0.1/$0.5,API 价格较 GPT-5.6 促销价下降 50%,且 OpenAI 将其表述为「永久降价」而非限时促销。

另一边的 Claude Opus 5.5 走「够强且更便宜」路线:输入/输出 $4/$20(较 Opus 5 低 20%),缓存读取从 $0.5 降至 $0.2(降 60%),官方称完成任务消耗的 token 与工具调用更少,典型工作负载成本下降 40%、输出速度提升超 30%。

关键变化一:计价单位从「一次回答」变成「一个任务的价格」

在 AutomationBench 跨应用业务流程测试中,官方称 GPT-6 Sol 在 xhigh 强度下取得 33.2% 任务完成率,每项任务平均花费 $0.27,而同一任务在 Claude Opus 5 上约为其 11 倍价格。Last Exam(max effort)中 GPT-6 Sol 得分 56.4%,每任务成本较对照下降 60%。

这是值得选型者注意的口径迁移:新一代模型发布会展示的不再是「每百万 token 多少钱」的单价,而是「完成一类任务平均花多少钱」。对按任务采购、按流程自动化的企业用户,这比跑分更贴近成本真相。

但必须说明:AutomationBench 与 Last Exam 均为厂商口径,无第三方独立复现。「1/11 价格」的对照对象是上代 Opus 5,与本次同场发布的 Opus 5.5 缓存降价后的真实成本对比,目前没有任何一方给出。

国内用户在社交平台的自发对比则显示:折算人民币后 GPT-6 Luna 价格约等于 DeepSeek V4.1 Flash 的闲时价(每百万输入约 1 元、输出约 4 元),但叠加缓存命中优惠后,「跑任务还是 DeepSeek 划算」仍是多数用户的结论。这组判断来自用户实测讨论,百器AI 未做独立测算。

关键变化二:Opus 5.5 把「编码智能体」的领先继续拉大

Anthropic 官方称,Opus 5.5 在大多数工作中达到 Fable 5.1 的水平。媒体披露的基准数据:Terminal-Bench 4.0 得分 66.4%,高于 Fable 5.1 的 55.8% 与 GPT-6 Astra 的 57.9%;衡量代码修改能否真正合并进项目的 FrontierCode 1.1 得分 54.4%,高于 GPT-6 Astra 的 53.3%。

知识工作方向同样突出:在覆盖 44 种职业任务的 GDPval-AA v2.1 上,Opus 5.5 得到 1846 分,高于 Fable 5.1 与 Opus 5。

需要提醒的是,上述分数全部来自 Anthropic 口径。Fable 5.1 尚未发布——「追平未发布旗舰」的表述在逻辑上无法被第三方证伪,引用时应注明「官方称」。

从选型视角看,Opus 5.5 的确定性优势集中在长时间运行的编码智能体与知识工作;如果你的场景是高频轻量调用,Luna 的 $0.1/$0.5 定价可能是更经济的选择。

为什么两家都急:降价是增长叙事的承压动作

把镜头拉远,这次「永久半价」是 OpenAI 下半年的第三次降价:7 月 GPT-5.6 Luna 降价 80%,8 月 GPT-5.6 Sol 再砍 20%,到 GPT-6 Sol/Luna 直接宣布 API 价格永久下降 50%。

降价效果确实立竿见影。据界面新闻转引 OpenRouter 观察:Luna 促销期日均 token 调用量涨至降价前的 13.8 倍、Terra 涨 5.6 倍;约 32% 的促销期用户在价格恢复后保留了部分用量。

但媒体披露的财务面压力同样真实:Anthropic 二季度营收超 115 亿美元(同比约 14 倍)、首次录得 5.59 亿美元调整后营业利润;OpenAI 同期营收 67 亿美元、经营亏损从 93 亿扩大到 123 亿美元。光锥智能还报道称 GPT-6 Astra 发布两周抢走企业 AI 支出约 13% 份额。

对选型者的含义很直接:价格战短期内不会停,现在锁定长期 API 合约的性价比可能不如按月观察——两家在各自财务压力下,都有继续「挥刀」的动机。

选型建议:三类用户的应对

编码/Agent 重度用户:Opus 5.5 与 GPT-6 Sol 都值得纳入候选,但建议用你自己的真实任务各跑一周——两家基准均为厂商口径,且都没有与对方最新模型的同任务成本对照。

高频轻量调用用户:Luna 的 $0.1 输入价已进入国内闲时价区间,适合摘要、分类、批量处理类场景;但能力是否弱于上代 5.6 Luna 存在用户质疑,迁移前先跑回归测试。

成本敏感用户:DeepSeek V4.1 Flash 的缓存命中定价在用户实测讨论中仍被认为更划算。价格战的红利是确定的——你在 9 月拿到的价格,几乎必然高于 10 月。

以上均为基于公开信息的编辑判断(EDITORIAL),百器AI 未对任何模型做实测,请在正式采购前以官网最新价格与试用结果为准。

常见问题

GPT-6 Sol 和 Luna 什么时候发布的?

2026 年 9 月 23 日,OpenAI 发布 GPT-6 Sol 与 GPT-6 Luna;同日 Anthropic 发布 Claude Opus 5.5。百器AI 于 9 月 24 日核验并发布本文。

GPT-6 Sol、Luna 多少钱?

每百万 token:Sol 输入 $2 / 输出 $10;Luna 输入 $0.1 / 输出 $0.5。这是 9/23 发布日报道的口径,OpenAI 称较 GPT-5.6 促销价下降 50%。价格可能随时变动,以 openai.com 官网为准。

Claude Opus 5.5 比 GPT-6 Astra 强吗?

无法给出确定结论。Opus 5.5 在 Terminal-Bench 4.0(66.4% vs 57.9%)与 FrontierCode 1.1(54.4% vs 53.3%)上高于 Astra,但均为 Anthropic 口径,无第三方复现;两者定位也有差异(Astra 是 OpenAI 旗舰,Opus 5.5 是 Anthropic 强性价比款)。建议按你的真实任务分别试用。

GPT-6 Luna 和上一代 5.6 Luna 比怎么样?

有用户反馈认为 Luna 能力不如上代 5.6 Luna(媒体称之为「更便宜的 GPT-5.6 Luna」),但这不是系统评测结论。价格减半是确定的,能力差距需自行验证后决策。

现在换 DeepSeek 还是等 GPT-6?

如果你的成本敏感度高,用户实测讨论普遍认为 DeepSeek V4.1 Flash 的缓存命中价更划算;如果你的任务质量敏感(尤其编码),Opus 5.5 与 GPT-6 Sol 值得试用。百器AI 未做独立实测,此为基于公开信息的编辑判断。

价格还会再降吗?

趋势大概率是。半年内 OpenAI 已三次降价,且媒体披露两家均面临各自财务压力,降价被解读为维持增长叙事的动作。百器AI 无法预测具体时点,但「现在签长期合约」的性价比低于按月观察。

可核验来源

相关工具

相关阅读

产品发布

GPT-6.1 Sol Ultrafast 上线:8 倍速 6 倍价,三端同步,值不值?

OpenAI Developers 2026-10-09 宣布在 API、Codex、ChatGPT Work 三端同步推出 GPT-6.1 Sol 的 Ultrafast 极速版:速度最高 8 倍,定价 6 倍(短上下文输入 $12、输出 $60/百万 token,>272K 输入翻倍),Codex/Work 端仅向 Pro 500、按量付费 Enterprise、配额制 Edu 开放。百器AI 未实测。

产品发布

Anthropic 发布 Claude Haiku 5.5:单价砍到十分之一,官方口径平均运行成本降约 75%

Anthropic 发布 Claude Haiku 5.5(官方公告页标注 2026-10-07 美国时间,中文媒体 10-08 报道),定位高吞吐、成本敏感的小模型:1M token 上下文、128K 最大输出、首款支持 effort 五档调节的 Haiku。价格分两档——10 万 token 以内的请求,官方标价输入 $0.10/百万 token、输出 $0.50/百万 token,是 Haiku 4.5($1/$5)的十分之一;超过 10 万 token 后跳到 $0.50/$2.50。官方口径是「平均运行成本降低约 75%」,而不是 90%——差额来自请求长度分布与新分词器(官方文档称同样文本在新分词器下约多 30% token)。同日官方把 Sonnet 5.5 缓存读取价从 $0.20 腰斩至 $0.10。**百器AI 未实测**:本文所有价格、规格与基准数字均为官方口径或第三方转述,厂商基准无第三方复现。

产品发布

谷歌发布 Gemini 4 Argon:输出上限拉到 100 万 token,『迄今最先进』但你还用不上

9 月 30 日谷歌发布 Gemini 4 Argon,官方称『迄今最先进的 AI 模型』:单次输出上限从 6.4 万 token 提至约 100 万,DeepSWE v1.1 软件工程评测 77.9% 官方称超过 Claude Opus 5.5(74.2%)与 GPT-6 Astra(74.1%)。但 Argon 并未面向公众开放——第一阶段仅通过 Fairwind Program 提供给受信任的网络安全防御者,付费 API 与 Google AI Ultra 用户在后续批次、日期未定。初始定价 $2/$10(每百万 token,缓存低 95%),发布期后涨至 $4/$20。同周 OpenAI 刚在 DevDay 发布 GPT-6.1 Sol 与智能体 Dots,彭博社同时报道谷歌内部员工对 Gemini 4 编码稳定性仍有疑问。百器AI 未实测,所有基准为谷歌官方口径。