首页AI 资讯GPT-6.1 Sol Ultrafast 上线:8 倍速 6 倍价,三端同步,值不值?
GPT-6.1 Sol Ultrafast 上线:8 倍速 6 倍价,三端同步,值不值? 封面
产品发布2026-10-0910 分钟

GPT-6.1 Sol Ultrafast 上线:8 倍速 6 倍价,三端同步,值不值?

OpenAI Developers 2026-10-09 宣布在 API、Codex、ChatGPT Work 三端同步推出 GPT-6.1 Sol 的 Ultrafast 极速版:速度最高 8 倍,定价 6 倍(短上下文输入 $12、输出 $60/百万 token,>272K 输入翻倍),Codex/Work 端仅向 Pro 500、按量付费 Enterprise、配额制 Edu 开放。百器AI 未实测。

GPT-6.1 SolOpenAIUltrafastAPICodexChatGPT Work智能体服务等级Pro 500数据驻留GPT-6 系列Sol 标准版

核心结论

三端同步但门槛分化:API 端所有用户可用 service_tier="ultrafast",Codex/Work 端仅向 Pro 500($500/月)+ 按量付费 Enterprise + 配额制 Edu 开放;Plus/Pro 用户用不到——这是 36氪机器之心报道的「用户不满」直接来源,IT 之家 C114 与 36氪一致。

价格 6 倍不是 8 倍,速度 8 倍不恒定:速度「高达 8 倍」是相对 Sol Standard(官方用「高达」措辞保留),定价 6 倍是绝对值——这两个倍率不对等;按 6 倍买单,按「高达 8 倍」估速度,是编辑判断的两条基本规则。

官方价格表确认所有数字:gpt-6.1-sol Ultrafast 短上下文输入 $12、缓存 $0.6、缓存写入 $15、输出 $60;长上下文 $24 / $1.2 / $30 / $90;272K 是 Sol 全档共享的「短/长上下文分界线」(OpenAI 官方价格表)。

1,050,000 上下文 + 5 档 reasoning effort:GPT-6.1 Sol 官方模型页确认上下文 1,050,000、最大输入 922K、最大输出 128K、reasoning effort 5 档(low/medium/high/xhigh/max,默认 medium),不支持 none/minimal——Ultrafast 共享同一模型 id。

EU 合规差异:GPT-6.1 Sol Ultrafast 支持美/欧数据驻留,GPT-6 Astra Ultrafast 仅支持美国(官方 Ultrafast 模式文档)——欧盟企业需 Ultrafast 时选 Sol 不要选 Astra。

WebSocket 优先于调档:官方明确推荐 agent 类应用用 WebSockets(官方文档原话),HTTP 网络开销会吃掉 Ultrafast 延迟增益——迁移 WebSocket 的优先级比升级 service_tier 更高。

Batch/Flex 不叠加 Ultrafast:官方价格表显示 Batch/Flex 是单独档;批处理/离线任务保留 Standard + Batch(50% 折扣),把 Ultrafast 留给实时交互。

Pro 500 + XHigh effort 慎用:36氪引用开发者反馈「XHigh effort 几分钟烧 1%」(25x 用量额度)——社群反馈未实测,但 Pro 500 用户先在 high effort 以下跑一周记 token 曲线再决定是否升 XHigh。

28 天发布周期内:Ultrafast 处于 Tibo「28 天每天发布新功能或重置」窗口第 4 天(10-08),属「提高效率」类——集成方不要把这周接的 API 行为当成永久约定(36氪机器之心 + 量子位)。

本文所有数字以 OpenAI 官方价格表、官方 Ultrafast 模式文档、官方模型页为准;社群反馈与未实测项已明确标注;百器AI 未做账号级账单或速度实测。

对比判断表

对比维度GPT-6.1 Sol StandardGPT-6.1 Sol UltrafastClaude Sonnet 5.5(10 万 token 以内档)Claude Haiku 5.5(10 万 token 以内档)
模型 id / 厂商gpt-6.1-sol / OpenAI(官方)gpt-6.1-sol(service_tier="ultrafast")/ OpenAI(官方)claude-sonnet-5-5 / Anthropic(官方)claude-haiku-5-5 / Anthropic(官方)
输入单价(每百万 token,短上下文,官方标价)$2.00(官方)$12.00(官方,6 倍 Sol Standard)$2.00(官方)$0.10(官方,10 万 token 以内档)
输出单价(每百万 token,短上下文,官方标价)$10.00(官方)$60.00(官方,6 倍 Sol Standard)$10.00(官方)$0.50(官方,10 万 token 以内档)
缓存输入(每百万 token,短上下文,官方)$0.10(官方)$0.60(官方)$0.20(官方,10/7 起从 $0.40 降至 $0.20)$0.01(官方,10 万 token 以内档)
上下文窗口 / 最大输出1,050,000 / 128,000(官方模型页)同 Sol Standard(共享模型 id,官方 Ultrafast 文档)1,000,000 / 128,000(官方,10/8 文章转述)1,000,000 / 128,000(官方,10/8 文章)
短/长上下文分界≤272K / >272K(官方价格表)同 Sol Standard 规则;>272K 输入/缓存翻倍、输出 1.5 倍(官方价格表)未列长档(官方,10/8 文章)≤100K / >100K(官方分档,10/8 文章)
速度档(厂商口径)正常速度(官方)高达 Sol Standard 8 倍(官方,「高达」措辞保留)Fast 档为标准 2x(官方)官方称「最快」(10/8 文章)
数据驻留(Ultrafast 档,官方文档)—(不适用)美/欧都支持 + 全球处理(官方)—(不适用,Anthropic 走 Prompt Caching)—(不适用)
速率档(官方,Build/Launch/Grow TPM)1M / 4M / 40M(官方)1M / 4M / 40M(与 Standard 相同档但「separate rate limits」,官方)官方未单独披露(NEEDS_VERIFICATION)官方未单独披露(NEEDS_VERIFICATION)
Codex / Work 端订阅门槛Plus/Pro/Business/Enterprise/Edu(9-30 IT 之家)Pro 500 + 按量付费 Enterprise + 配额制 Edu(IT 之家 + 36氪)API 端无门槛(官方)API 端无门槛(官方)
知识截止日期Apr 30, 2026(官方模型页)同 Sol Standard(官方 Ultrafast 文档)2026 年 6 月(官方文档,10/8 文章转述)2026 年 6 月(官方文档,10/8 文章转述)
核验状态官方价格/规格确认;百器AI 未实测官方价格/规格确认;百器AI 未实测;社群反馈「XHigh 几分钟烧 1%」(36氪转述,未实测)官方价格/规格确认;百器AI 未实测官方价格/规格确认;百器AI 未实测

落地检查清单

先查订阅档:Codex/Work 端用 Ultrafast 必须 Pro 500($500/月)+ Enterprise/Edu;Plus/Pro 用户用不到——先确认订阅档再决定调 API。
按 6 倍 / 8 倍算账:当前 Sol Standard 账单 × 6 是 Ultrafast 短上下文预期账单;不要按 8 倍算,速度不是恒定 8 倍(官方用「高达」措辞)。
WebSocket 优先:agent 类应用按官方建议先迁移到 WebSocket,再升级 service_tier;HTTP 下的网络开销会吃掉 Ultrafast 的延迟增益。
按任务分档:决策/规划主线用 Ultrafast + 高 reasoning effort;检索/分类/摘要子任务退回 Sonnet 5.5 或 Sol Standard Fast(2x Standard)——不要全局升级。
EU 合规选 Sol 不要选 Astra:GPT-6.1 Sol Ultrafast 支持美/欧数据驻留,GPT-6 Astra Ultrafast 仅支持美国——欧盟企业如需 Ultrafast 选 Sol 不要选 Astra。
Pro 500 + XHigh effort 慎用:社群反馈「几分钟烧 1%」(36氪转述,未实测)——Pro 500 用户先在 high effort 以下跑一周记 token 曲线再决定是否升 XHigh。

发生了什么:一次三端同步上线,把 GPT-6.1 Sol 顶到「接近旗舰 + 8 倍速」的窄轨道

2026 年 10 月 8 日美国时间、10 月 9 日中文媒体集中报道,OpenAI Developers 通过 C114 通信网、腾讯新闻、站长之家、界面新闻、IT 时代网等渠道宣布:在 API、Codex、ChatGPT Work 三个端点同步推出 GPT-6.1 Sol 的「Ultrafast」极速版。所有第三方一致引用同一组关键数字:速度最高可达 Sol Standard 的 8 倍,定价为标准版 6 倍——每百万 token 输入 12 美元、输出 60 美元(IT 之家人民币口径约 80.5 元/402.7 元)。

把这件事放回时间线看更清楚:标准版 GPT-6.1 Sol 9 月 29 日 OpenAI DevDay 首发(10 月 1 日中文媒体集中转载),9 月 30 日 IT 之家已发布其完整定价表——短上下文标准价输入 $2、输出 $10,缓存输入 $0.1,缓存写入 $2.5;长上下文(>272K 输入)输入/缓存翻倍、输出 1.5 倍。

Ultrafast 的 6 倍定价完全对得上官方价格表(developers.openai.com/api/docs/pricing?latest-pricing=ultrafast)的 Ultrafast 档:gpt-6.1-sol 短上下文输入 $12、输出 $60、缓存输入 $0.6、缓存写入 $15;长上下文 $24 / $1.2 / $30 / $90。

三端区别需要先讲清楚。API 端:所有 API 用户可按 service_tier="ultrafast" 调用,无订阅门槛;Codex 与 ChatGPT Work 端:仅向 Pro 500 订阅(OpenAI 今年新推出的 $500/月高端档,36氪机器之心文章明确写到)、符合条件的按量付费 Enterprise、配额制 Edu 方案开放,且企业用户需由管理员在后台主动开启权限。

普通 ChatGPT Plus($20/月)甚至 Pro($200/月)用户在 ChatGPT 主聊天或 Codex 端都用不上 Ultrafast——这是 36氪/机器之心报道的「用户不满」的直接来源。区域与合规方面,OpenAI 官方 Ultrafast 模式文档写明:GPT-6.1 Sol 的 Ultrafast 同时支持美国和欧盟数据驻留,并支持全球处理;这是与 GPT-6 Astra Ultrafast 的关键差异——后者只支持美国数据驻留,不支持欧盟。

为什么推出:AI「令牌计价」转向后,Ultrafast 是 OpenAI 对「智能体等待时间」的定价回应

把 Ultrafast 单独当作「速度档」是表面理解。理解这件事需要先看 GPT-6 系列近两个月的价格调整节奏:9 月 23 日 GPT-6 Sol / Luna 发布,官方把 API 价格较 GPT-5.6 促销价再降 50%;9 月 29 日 DevDay 发布 GPT-6.1 Sol(短上下文输入 $2 / 输出 $10,相对 Astra 的 $10 / $50 降到 1/5);10 月 8 日起 OpenAI 把 GPT-6 全量推送至 ChatGPT 主聊天。

整条时间线显示 OpenAI 一直把 GPT-6 系列的定价支点压在「比旗舰便宜 N 倍」上——Ultrafast 是这条线上第一次「往快里加钱」的尝试。从分析视角看(编辑判断,标注分析),OpenAI 推 Ultrafast 的动机与三件事有关。

第一,Claude Code / Anthropic Claude Sonnet 5.5 在编程与长程智能体任务上长期被开发者社区视作更稳定的「主线模型」。9 月 30 日 GPT-6.1 Sol 推出后,36氪机器之心报道引用 DevDay 后开发者社群反馈:GPT-6.1 Sol「纸面上的性能和效率很漂亮,真正干活时却依旧慢」——这是 10 月初 OpenAI 遭遇用户信任危机的关键原因之一(参考 36氪 10 月 5 日报道),Ultrafast 可视为对这一反馈的产品回应。

第二,Ultrafast 与 GPT-6 Astra 标准版价格差距并不大:Ultrafast 短上下文 $12 / $60,Astra 标准 $10 / $50——Ultrafast 只比 Astra 贵 1.2 倍,但 OpenAI 开发者关系工程师 Dominik Kundel 的官方定位是「接近 Astra 级别的智能,8 倍于 Sol 的速度,成本仅为 Astra 的 1.2 倍」。

第三,OpenAI 的「Tibo 28 天计划」给了这次发布一个时间窗。10 月 5 日 OpenAI Codex 负责人 Tibo 公开承诺「连续 28 天每天发布新功能或重置额度」,并锁定四个方向:简化产品、提高效率、突破性功能、新模型。Ultrafast 上线正处于这个 28 天窗口的第四天(10 月 8 日),属「提高效率」类——后续 24 天内可能还有类似节奏的更新,集成方不应把这周接的 API 行为当成永久约定。

价格与速度:把 6 倍、8 倍、272K 三条线都画清

先把三组数据「钉在墙上」,全部来自 OpenAI 官方价格表与官方 Ultrafast 模式文档。**第一组:Ultrafast 价 = Sol 标准价 × 6**。短上下文(输入 ≤ 272K token):gpt-6.1-sol Ultrafast 输入 $12、缓存输入 $0.6、缓存写入 $15、输出 $60;长上下文(输入 > 272K token):输入 $24、缓存输入 $1.2、缓存写入 $30、输出 $90(官方价格表)。对照 Sol Standard 短上下文输入 $2、缓存 $0.1、缓存写入 $2.5、输出 $10——倍率严格 6 倍。

**第二组:Ultrafast 速 = Sol 速 × 8**。官方称「高达 8 倍」(up to 8x),但「高达」二字不应被略去——36氪机器之心文章引用 DevDay 后开发者社群观察认为,TPS 标准化后与 Claude 仍有差距,「8 倍」是相对 Sol Standard 的对比,不是绝对值;也没有第三方给出 tokens/s 绝对数。

**第三组:272K token 是 GPT-6.1 Sol 的「短/长上下文分界线」**。官方价格表写明:短上下文 ≤272K 输入 token,长上下文 >272K;进入长上下文后输入与缓存价格翻倍、输出 1.5 倍(注意不是 Ultrafast 单独的规则,是 Sol 全档规则)。GitHub 上 CodexBar 的 #4302 issue 提到 272K 分界点在某些工具显示中可能显示为 200K——这是工具显示口径差异,以 OpenAI 官方价格表为准。

把三组数据放在一起做对照——编辑判断,未实测——Ultrafast 的核心价位是「$12 / $60」这组短上下文价。超过 272K 输入会翻倍(约 $24 / $90),日常短上下文工作直接用短档;只有真正需要 105 万上下文(GPT-6.1 Sol 官方模型页:1,050,000 context window、922,000 最大输入、128K 最大输出)且输入超过 272K 的人才会触发长档。

与 Claude Code 及其他竞品的对照:Ultrafast 不是「更快版 Sol」,是另一种产品形态

机器之心/36氪文章里把 GPT-6.1 Sol Ultrafast 称为「涡轮增压版 Sol」,这个比喻容易让人误以为它只是 Sol 的快速通道。更准确的定位是:Ultrafast 是 OpenAI 给「agent 正在实时跑、每一秒都烧钱」场景单独开的服务等级,与标准 Sol 共享模型权重(model id 相同 gpt-6.1-sol),但底层基础设施、路由策略、限速档都不同。

官方明确「Ultrafast has separate rate limits from Standard and Fast modes」——Build 1M TPM、Launch 4M TPM、Grow 40M TPM,与 Sol Standard 相同的 Build/Launch/Grow 档分法但单独计费。

与 Anthropic Claude Sonnet 5.5 / Claude Code 对照——这是 OpenAI 推 Ultrafast 的直接竞争对象。先看价位:Claude Sonnet 5.5 在 10 万 token 以内档(按 10 月 8 日本站 claude-haiku-5-5-release 文章中 Willison 列出的价格转述):输入 $2.00、输出 $10.00(与 GPT-6.1 Sol Standard 同价);GPT-6.1 Sol Ultrafast 短上下文 $12 / $60,是 Sonnet 5.5 的 6 倍。

但 Sonnet 5.5 没有公开「Ultrafast 档」,Claude Code 这类 agent 工具走的是 effort 五档(low/medium/high/xhigh/max)+ Prompt Caching 控制成本,不另开「速度档」。速度维度(编辑判断):第三方实测出现分歧。机器之心/36氪文章引用 DevDay 后开发者社群观察,GPT-6.1 Sol「纸面漂亮但实际慢于 Claude」;Ultrafast 推出后 36氪报道引用了开发者试用反馈——「XHigh effort 模式下确实快得惊人,但 token 消耗速度也同样惊人,500 美元月费对应的 25 倍用量额度在这种模式下『几分钟就能烧掉 1%』」。

与 Google Gemini Enterprise Agent 对照:今天(10-09)同步上线的谷歌 Gemini 通用工作智能体(Gemini Agent)走的是「给目标、不给指令」的另一条路——以目标驱动调用工具、子智能体协同、可在云端持续运行数小时甚至数天;OpenAI Ultrafast 走的是「单次调用更短延迟」路线,与 Gemini Agent 的「长时持续运行」是不同解法(财新 T 早报 + IT 时代网报道)。这条对照说明 Ultrafast 的「加 N 倍价买 M 倍速」是 OpenAI 当前的差异化定价——不是行业通用做法。

适用场景与编辑判断:什么时候值得多花 6 倍、什么时候不值

编辑判断:把 GPT-6.1 Sol Ultrafast 当成「永远不亏的速度升级」是常见误用。以下四类场景值得考虑,之外的场景先做算账。 **场景 1:实时交互的 agent 主线**。36氪机器之心文章与 OpenAI 官方描述都把「线上故障排查、agent 实时导航、每一秒都在烧钱的实时交互」列为典型用例。理由:Sol Standard 的延迟在 agent 多步工具调用下会被工具响应时间累加放大,Ultrafast 把每步 token 生成时间压到原来的约 1/8,对端到端完成时间有非线性提升。

**场景 2:长上下文 + 短问题的混合负载**。如果你需要在 105 万 token 上下文里检索 + 短答(如整段代码库问答、长 PDF 总结),Ultrafast 让「检索+短答」这一段更短。**但要注意**:进入长上下文(>272K)后,Ultrafast 价翻倍——同样是 100 万 token 输入,$24 vs 标准 Sol 长档 $4,绝对金额明显抬升。

**场景 3:Codex / Work 端 Pro 500 + Enterprise + Edu 客户**。这部分用户对「25x 用量额度」敏感。36氪引用开发者反馈「XHigh effort 几分钟烧 1%」——按 25x 用量、$500/月计算,1% ≈ $20,等于几小时烧 5 美元级。建议这类用户先把任务分为「必须快」与「可不快」两类,前者用 Ultrafast,后者退回 Sol Standard Fast(2x Standard,$4 / $20)或 Standard。

**场景 4:API 端开发者**。API 端没有订阅门槛,直接按 service_tier="ultrafast" 调用即可——这是 36氪报道中特别强调「门槛并不高」的部分。**但即使在 API 端也要算账**:12 美元/百万输入 token ≈ 80 元/百万字(按 6.7 汇率),对单次调试对话可接受,对批量数据处理仍可能比 Batch(50% 折扣)贵得多——把非实时批处理保留在 Standard + Batch 才是合理配比。

**编辑判断:哪些场景不值得**——单次短问答、纯文本写作(不需要边写边流)、PDF/代码库的整段离线分析、Codex 中非主线的子任务(让主 Sonnet 5.5 或 Sol Standard 跑子任务)。这些场景用 Ultrafast 是「把 F1 赛车开去菜市场」。迁移建议:先用一周时间在自有任务上对比 Standard vs Ultrafast 的端到端时间与账单,再决定固定档位。

局限、风险与给开发者的实操建议:先验证再上,按任务分档而非全局升级

**官方明确披露的限制(可直接写成事实,1/2)**。① Codex 与 ChatGPT Work 端的订阅门槛:仅 Pro 500($500/月)、符合条件的按量付费 Enterprise、配额制 Edu 开放,Plus 与 Pro 用户用不到(IT 之家 + 36氪)。② 企业用户需由管理员后台开启(IT 之家 C114)。③ 已上线所有支持区域,但区域处理(Regional processing)有 10% 加价;FedRAMP 端点 10% 加价(官方价格表附注)。

**官方明确披露的限制(续,2/2)**。④ 长上下文(>272K 输入)输入/缓存翻倍、输出 1.5 倍(官方价格表与 Sol 全档共享规则)。⑤ 与 GPT-6 Astra 差异:GPT-6 Astra 的 Ultrafast 仅支持美国数据驻留 + 全球处理,不支持欧盟;GPT-6.1 Sol 的 Ultrafast 同时支持美/欧(官方 Ultrafast 模式文档 + IT 之家)。

**官方没有明确披露或媒体观察到的限制(标注为未核实或据报道)**。① 「高达 8 倍」不是恒定 8 倍——36氪机器之心文章给出「高达」解读,第三方实测 tokens/s 数据未核实。② OpenAI Ultrafast 文档建议「agent 类应用强烈推荐 WebSockets」——如果你走 HTTP 而非 WebSocket,实际延迟增益会被网络开销吃掉(未实测)。③ Pro 500 在不同 effort 档下的速率上限是否分级,官方页面未单独披露(NEEDS_VERIFICATION)。

**风险与代码改造**。一是「8 倍速 + 6 倍价」是相对 Sol Standard 的,如果你的任务是 batch / 离线,不要混用 Ultrafast——Batch 不支持 Ultrafast(官方价格表显示 Batch 档为单独档)。二是 Pro 500 用户的额度消耗问题——36氪引用「几分钟烧 1%」是开发者社群反馈,未实测。三是不在订阅档内但能调 API 的企业,service_tier="ultrafast" 是按 token 计费,与 Pro 500 额度的速率档不同——做容量规划时要分开算。

**给开发者的实操建议**。① 24 小时 A/B:对比 service_tier="ultrafast" 与 "standard" 的端到端时间、token 费用、错误率。② 按任务分档:主线用 Ultrafast + 高 effort,子任务退回 Sonnet 5.5 或 Sol Standard Fast。③ WebSocket 优先。④ 算清账单:Standard $2 / Fast $4 / Ultrafast $12。⑤ Pro 500 先在 high effort 跑一周再升 XHigh。**声明**:百器AI 未实测,价格以 OpenAI 官方价格表为准。

常见问题

GPT-6.1 Sol Ultrafast 比标准版快多少?贵多少?

速度方面,OpenAI 官方称「高达 Sol Standard 的 8 倍」(up to 8x faster speeds than Sol Standard),「高达」二字不能省——这是相对 Sol Standard 的对比,第三方未给出 tokens/s 绝对数(36氪机器之心文章中「高达 8 倍速度」一节)。价格方面,Ultrafast 是 Sol Standard 的 6 倍:短上下文(≤272K 输入)输入 $12、缓存 $0.6、缓存写入 $15、输出 $60;长上下文(>272K 输入)翻倍至 $24 / $1.2 / $30 / $90(OpenAI 官方价格表)。以上均为官方口径,百器AI 未实测。

我可以用 ChatGPT Plus 订阅用上 Ultrafast 吗?

API 端可以——所有 API 用户都能用 service_tier="ultrafast" 调用 GPT-6.1 Sol Ultrafast,没有订阅门槛。Codex 与 ChatGPT Work 端不行:官方明确仅向 Pro 500 订阅($500/月,OpenAI 今年新推出的高端档)、符合条件的按量付费 Enterprise、配额制 Edu 开放;企业用户需管理员在后台主动开启权限。普通 ChatGPT Plus($20/月)与 Pro($200/月)在 ChatGPT 主聊天或 Codex 端都用不到(IT 之家 C114 + 36氪机器之心一致)。

跟 Claude Sonnet 5.5 比怎么样?

价格上:Claude Sonnet 5.5 在 10 万 token 以内档(按 Willison 转述价格,详见本站 10-08 claude-haiku-5-5-release 文章)输入 $2、输出 $10,与 GPT-6.1 Sol Standard 同价;GPT-6.1 Sol Ultrafast 短上下文 $12 / $60,是 Sonnet 5.5 的 6 倍。速度上:Sonnet 5.5 没有公开「Ultrafast 档」,Claude Code 这类 agent 工具走 effort 五档(low/medium/high/xhigh/max)+ Prompt Caching 控制成本;GPT-6.1 Sol Ultrafast 走的是「单次调用更短延迟」路线。能力与稳定性:DevDay 后开发者社群反馈(36氪机器之心引用)认为 GPT-6.1 Sol「纸面漂亮但实际慢于 Claude」,但 Ultrafast 的实际表现仍待独立实测;OpenAI 开发者关系工程师 Dominik Kundel 把 Ultrafast 定位为「接近 Astra 级别的智能,8 倍于 Sol 的速度,成本仅为 Astra 的 1.2 倍」——这是官方口径,未独立验证。

贵这么多值得吗?什么场景才该用?

编辑判断:以下四类场景值得考虑——① 实时交互的 agent 主线(线上故障排查、agent 实时导航);② 长上下文(>272K)+ 短问题的混合负载;③ Codex/Work 端 Pro 500 + Enterprise + Edu 客户(已经付了订阅费,再加 6 倍 token 费比请人工便宜);④ API 端做实时低延迟 demo 或 PoC。不值得的场景:单次短问答、纯文本写作(不需要流式输出)、PDF/代码库整段离线分析、Codex 中非主线的子任务。建议先用一周在自有任务上对比 Standard vs Ultrafast 的端到端时间与账单,再决定固定档位。

上下文窗口是多少?长上下文贵吗?

GPT-6.1 Sol 的上下文窗口为 1,050,000 token(官方模型页),最大输入 922,000、最大输出 128,000。272K 是「短上下文 vs 长上下文」的分界线(官方价格表):短上下文 ≤272K 输入,长上下文 >272K。Ultrafast 短上下文输入 $12、输出 $60;长上下文输入 $24、输出 $90——进入长上下文后价格翻倍。GitHub CodexBar 工具 #4302 issue 中提到部分工具可能把分界点显示为 200K,以 OpenAI 官方价格表的 272K 为准。

可核验来源

相关工具

相关阅读

产品发布

Anthropic 发布 Claude Haiku 5.5:单价砍到十分之一,官方口径平均运行成本降约 75%

Anthropic 发布 Claude Haiku 5.5(官方公告页标注 2026-10-07 美国时间,中文媒体 10-08 报道),定位高吞吐、成本敏感的小模型:1M token 上下文、128K 最大输出、首款支持 effort 五档调节的 Haiku。价格分两档——10 万 token 以内的请求,官方标价输入 $0.10/百万 token、输出 $0.50/百万 token,是 Haiku 4.5($1/$5)的十分之一;超过 10 万 token 后跳到 $0.50/$2.50。官方口径是「平均运行成本降低约 75%」,而不是 90%——差额来自请求长度分布与新分词器(官方文档称同样文本在新分词器下约多 30% token)。同日官方把 Sonnet 5.5 缓存读取价从 $0.20 腰斩至 $0.10。**百器AI 未实测**:本文所有价格、规格与基准数字均为官方口径或第三方转述,厂商基准无第三方复现。

产品发布

谷歌发布 Gemini 4 Argon:输出上限拉到 100 万 token,『迄今最先进』但你还用不上

9 月 30 日谷歌发布 Gemini 4 Argon,官方称『迄今最先进的 AI 模型』:单次输出上限从 6.4 万 token 提至约 100 万,DeepSWE v1.1 软件工程评测 77.9% 官方称超过 Claude Opus 5.5(74.2%)与 GPT-6 Astra(74.1%)。但 Argon 并未面向公众开放——第一阶段仅通过 Fairwind Program 提供给受信任的网络安全防御者,付费 API 与 Google AI Ultra 用户在后续批次、日期未定。初始定价 $2/$10(每百万 token,缓存低 95%),发布期后涨至 $4/$20。同周 OpenAI 刚在 DevDay 发布 GPT-6.1 Sol 与智能体 Dots,彭博社同时报道谷歌内部员工对 Gemini 4 编码稳定性仍有疑问。百器AI 未实测,所有基准为谷歌官方口径。

产品发布

Claude Sonnet 5.5 发布:一周内连发两款 5.5 系列,价格不变但单任务成本最高降 30%

9 月 28 日 Anthropic 在 Opus 5.5 发布仅一周后推出 Claude Sonnet 5.5,作为 5.5 系列第二款模型。Sonnet 5.5 维持 $2/$10 的输入/输出价不变,但在 agentic coding 基准 Terminal-Bench 4.0 上取得 70.6%,比上一代 Sonnet 5 的 10.3% 高近 7 倍,并反超一周前发布的 Opus 5.5(66.4%)。Anthropic 同时把单任务综合成本最高降 30%、输出速度提升 30%+,并首次为 Sonnet 系列配上旗舰级网络安全防护机制。百器AI 未实测,所有基准为厂商口径,跨厂商对比数据来自官方同一张表。