9 月 22 日周二,Anthropic 和 OpenAI 选在同一天降价。Anthropic 发布 Claude Opus 5.5,每百万 token 输入 4 美元、输出 20 美元,比 Opus 5 便宜 20%12。OpenAI 同一天推出 GPT-6 Sol 和 GPT-6 Luna:Sol 定价 2 美元/10 美元,Luna 低到 0.10 美元/0.50 美元,只走 API、ChatGPT Work 和 Codex 三个渠道,Chat 里没有234。两款模型基于 Astra 的技术进展,针对缓存和推理效率做了优化,API 价格较 GPT-5.6 的促销价再降 50%3。
OpenAI 自己给出的数据更激进:GPT-6 Sol 的出错率约为前代一半;GPT-6 Luna 在较高推理强度下可以达到 GPT-5.6 Sol 的水平,成本只有其百分之一左右;提示词缓存的成本最多比未缓存低 90%3。Sol 面向复杂专业工作、编码和智能体,Luna 面向信息提取、文档摘要这类高频低成本任务3。
这一天距离两家公司 CEO 公开呼吁”放缓前沿步伐”只过去十天5,距离 OpenAI 发布旗舰 GPT-6 Astra(10 美元/50 美元)不到三周6。旗舰的价格标签还挂着,中档和轻量档先砍了一半。
Anthropic 那边,Opus 5.5 的批处理价 2 美元/10 美元,Fast mode 8 美元/40 美元(仅 Anthropic 自家 API),输出速度比 Opus 5 快 30% 以上17。
三周时间线
| 日期 | 事件 |
|---|---|
| 2026-09-03 | OpenAI 发布旗舰 GPT-6 Astra,$10 输入 / $50 输出6 |
| 2026-09-12 | Anthropic CEO 达里奥·阿莫迪发文呼吁全球 AI 界放慢发布节奏,OpenAI CEO 山姆·奥特曼随即在 X 上表态支持5 |
| 2026-09-21 | SpaceXAI(前身 xAI)发布 Grok 4.7,200K token 以内 $2 / $68 |
| 2026-09-22 | Anthropic 发布 Claude Opus 5.5($4 / $20);OpenAI 同日发布 GPT-6 Sol($2 / $10)和 GPT-6 Luna($0.10 / $0.50)123 |
价目对比
表:主流模型 API 定价(美元 / 每百万 token) 89107
| 模型 | 输入 | 输出 | 缓存读取 | 发布日 |
|---|---|---|---|---|
| Claude Opus 5.5 | 4 | 20 | 0.20(输入价的 5%) | 2026-09-22 |
| Claude Opus 5 | 5 | 25 | 0.50 | 2026-07 |
| Claude Fable 5.1 | 10 | 50 | 0.25 | 未公布 |
| GPT-6 Astra | 10 | 50 | 1.00(10%) | 2026-09-03 |
| GPT-6 Sol | 2 | 10 | 未公布 | 2026-09-22 |
| GPT-6 Luna | 0.10 | 0.50 | 未公布 | 2026-09-22 |
| GPT-5.6 Sol(促销价) | 4 | 20 | 0.40 | 促销至少到 2026-11-21 |
| Grok 4.7(≤200K) | 2 | 6 | 0.50 | 2026-09-21 |
单看标价,Opus 5.5 是 Astra 的四折,输入输出都差 2.5 倍11。但 agent 时代的账单大头在缓存读取和超长 prompt,这两栏比标价重要。
Opus 5.5 的缓存读取是 0.20 美元,只收输入价的 5%;Astra 收 1.00 美元,10%910。上一代 Opus 5 的缓存读取还是 0.50 美元,这次直接降了 60%17。
长上下文规则差得更远。Astra 的输入一旦超过 272K token,整单重新计价:输入和缓存翻倍、输出 1.5 倍,变成 20 美元/75 美元。Opus 5.5 在整个 100 万 token 窗口里一个价,没有悬崖。Grok 4.7 在 200K 处整单跳到 4 美元/12 美元1112。
Digital Applied 按同一口径算了一笔账:8M 缓存读取 + 400K 未缓存输入 + 600K 缓存写入 + 300K 输出,Opus 5.5 一共 12.20 美元,Astra 不越悬崖 34.50 美元,越过悬崖 61.50 美元,差出约 5 倍11。AlphaCorp 按单次 agent 轮次(100K 输入含 80K 缓存 + 10K 输出)测算,Opus 5.5 约 0.30 美元,Astra 约 0.78 美元,节省 62%;每天一万轮,就是 2,960 美元对 7,800 美元13。
为什么突然打价格战
外部压力先摆在那里。中国的开放权重模型可以本地部署、可以定制,持续从美国实验室手里抢份额,云平台 Vercel 的数据也印证了这一点。阿里、Moonshot、DeepSeek 等低价施压,OpenAI 近几个月已经多次降价31415。
内部动机也清楚。Anthropic 正备战今秋 IPO,外界预计规模将创科技 IPO 历史之最,市场猜测这次发布是递交招股书的催化剂。OpenAI 年初增长乏力,称 2027 年前不太可能上市,降价成了重燃增长的核心手段15。
Ramp 首席经济学家 Ara Kharazian 说得直接:“OpenAI 和 Anthropic 正在进行一场价格战,这导致 AI 的价格下降,从而降低了它们从中获利和提高模型价格的能力。“他指出价格战从两个方向推进:低价模型(Opus 5.5、GPT-6 Sol/Luna)加上旗舰直接降价5。
两家的公告口径也值得对照。OpenAI 把成本降低归功于”缓存和推理方面的改进”,并称把节省的成本直接回馈给用户和客户5。Anthropic 的说法是,企业客户需要高质量模型,但不愿意承受推理成本大幅增加14。两句话翻译过来是一个意思:客户开始算账了。
讽刺的地方在于节奏。9 月 12 日两位 CEO 刚喊完”放缓前沿步伐”,十天后双方同日甩出降价新模型515。放缓的是能力军备竞赛,价格战照打。财联社的点评点到了要害:AI 模型竞争正从旗舰能力的军备赛转向性能与价格的综合比拼,争夺对成本敏感的企业客户3。
每 token 便宜,不等于每单便宜
标价便宜,账单未必便宜。Artificial Analysis 的 Intelligence Index(v4.3.2)里,Opus 5.5 开 max effort 拿 58 分排第一(212 个模型),Astra 53 分,Grok 4.7 46 分。但跑完整个榜单,Opus 5.5 用了约 2.6 亿输出 token、花 8,708 美元;Astra 只用 6,000 万输出 token、花 5,324 美元。折到每个任务,Opus 5.5 输出约 119K token,Astra 约 27K,差了约 4 倍1216。
单价省下的 60%,被多用的 token 吃掉大半。只看输出项,max effort 下 Opus 5.5 每任务约 2.38 美元,Astra 约 1.49 美元,反而更贵1216。
Anthropic 说”典型工作负载运行成本比 Opus 5 低约 40%“,这个说法在默认 medium effort 下成立17。开到 max effort,差距大幅收窄,部分场景直接反转。选模型要算每任务成本,别只盯每 token 单价。
跑分比价格更难读
Terminal-Bench 4.0 上,Anthropic 报 Opus 5.5 拿 66.4%(xhigh 档),OpenAI 自报 Astra 57.9%(high 档)。第三方 Artificial Analysis 用同一条件重跑,两家打平:59.6 对 59.61116。
厂商互测同一模型也能打架。FrontierCode Main 上,Anthropic 给 Opus 5 打 48.0%,OpenAI 给同一个模型打 53.4%,差 5.4 分。这个差距比 Opus 5.5 领先 Astra 的 1.1 分还大近 5 倍。OpenAI 附注说 Astra 是带 Codex 风格 developer message 跑的11。
撇开口径之争,两家各有地盘。Astra 强在推理和科学:GPQA Diamond 96.0%、FrontierMath Tier4 v2 97.6%、ARC-AGI-3 62.71%(ARC Prize 验证)、Terminal-Bench-Science 64.6% 对 58.7%13。Opus 5.5 超出噪声的优势在终端任务和综合价值:Terminal-Bench 4.0 领先 8.5 分,GDPval-AA 1846 对 1542(+304 Elo),HLE with tools 67.7% 对 57.2%11。
厂商自报的成本对比也要打折看。Anthropic 称默认 effort 下 Opus 5.5 在 FrontierCode 上打败 Astra,每任务成本约为其五分之一;Terminal-Bench 4.0 打平 Astra,成本约为 40%。OpenAI 称 AutomationBench 上 GPT-6 Sol 比 Claude Opus 5 高 6.3%,单任务成本只有其 9%。这些都是胜方自己的发布材料,未经独立复现3711。
对开发者意味着什么
第一,算每任务成本,别算每 token 单价。拿自己的任务在相同 effort 档位下重测,厂商口径和第三方口径经常对不上。
第二,盯紧长上下文悬崖。prompt 经常超过 272K token 的负载,Astra 的账单会整单跳档;Opus 5.5 全窗口平价,Grok 4.7 的悬崖在 200K1112。
第三,缓存命中率高的 agent 负载,5% 和 10% 的缓存费率差距会放大到账单层面,比输入标价的差距更实在1113。
第四,轻量高频任务(信息提取、文档摘要)可以看 GPT-6 Luna,0.10 美元/0.50 美元的定价比主流模型低了一个数量级3。
第五,别急着重构。Anthropic 已确认 Sonnet 5.5 和 Haiku 5.5 将在未来几周推出,中低档的牌还没出完2。
参考来源
结语
这一轮降价把竞争的方向掰了过来:能力的军备赛还在打,胜负手换成了每任务成本。两家 CEO 十天前喊放缓,十天后同日砍价,说明谁都输不起企业客户这块市场。接下来看两件事:Sonnet 5.5 和 Haiku 5.5 落地后的定价,以及独立第三方能不能在统一口径下复现厂商的成本主张。
Footnotes
-
Anthropic 模型文档 — Claude Opus 5.5 定价、缓存费率、速度与成本说明 https://platform.claude.com/docs/en/models/opus-5-5/overview ↩ ↩2 ↩3 ↩4 ↩5
-
每日经济新闻 — Opus 5.5 与 GPT-6 Sol/Luna 同日发布,Sonnet 5.5 和 Haiku 5.5 将在未来几周推出 https://www.nbd.com.cn/articles/2026-09-23/4589497.html ↩ ↩2 ↩3 ↩4
-
财联社 / 东方财富 — GPT-6 Sol/Luna 定价与定位、OpenAI 自称数据、行业点评 https://finance.eastmoney.com/a/202609233881630823.html ↩ ↩2 ↩3 ↩4 ↩5 ↩6 ↩7 ↩8 ↩9
-
OpenAI ChatGPT Rate Card — 企业 token 定价与 Sol/Luna 提供渠道 https://help.openai.com/en/articles/20001415-chatgpt-rate-card-enterprise-token-based-pricing ↩
-
格隆汇 — 两位 CEO 呼吁放缓前沿步伐、Ramp 首席经济学家 Ara Kharazian 价格战评论、OpenAI 公告转述 https://m.gelonghui.com/p/6780775 ↩ ↩2 ↩3 ↩4 ↩5
-
DataNorth — OpenAI 发布旗舰 GPT-6 Astra,$10 输入 / $50 输出 https://datanorth.ai/news/openai-launches-gpt-6-astra ↩ ↩2
-
Kingy AI — Claude Opus 5.5 规格、基准与定价对比 https://kingy.ai/blog/claude-opus-5-5-specs-benchmarks-pricing-comparison/ ↩ ↩2 ↩3 ↩4 ↩5
-
TECHSY — Grok 4.7 发布与定价,200K token 以内 $2 / $6 https://techsy.io/en/blog/gpt-6-astra-vs-opus-5-5-vs-grok-4-7 ↩ ↩2
-
OpenAI API 定价页 — GPT-6 系列官方价格与缓存费率 https://developers.openai.com/api/docs/pricing ↩ ↩2
-
Anthropic 定价页 — Claude 系列官方价格与缓存费率 https://platform.claude.com/docs/en/about-claude/pricing ↩ ↩2
-
Digital Applied — Opus 5.5 vs GPT-6 Astra:价格悬崖、示例账单、跑分口径差异 https://www.digitalapplied.com/blog/claude-opus-5-5-vs-gpt-6-astra-comparison ↩ ↩2 ↩3 ↩4 ↩5 ↩6 ↩7 ↩8 ↩9
-
Codersera — Opus 5.5 / GPT-6 Astra / Grok 4.7 三方对比与长上下文跳价 https://codersera.com/blog/claude-opus-5-5-vs-gpt-6-astra-vs-grok-4-7-2026/ ↩ ↩2 ↩3 ↩4
-
AlphaCorp — 基准数据与单次 agent 轮次成本测算 https://alphacorp.ai/blog/claude-opus-5-5-vs-gpt-6-astra-benchmarks-pricing-and-which-is-better ↩ ↩2 ↩3
-
Gate 新闻 — Anthropic 公告转述与开放权重模型竞争背景 https://www.gate.com/zh/news/detail/OPENAI/anthropic-releases-claude-opus-55-with-costs-down-40-24489138 ↩ ↩2
-
cjcn 财经中国 — Anthropic 备战 IPO、OpenAI 增长乏力与降价动机 https://www.cjcn.com.cn/news/show-491793.html ↩ ↩2 ↩3
-
Data Studios — 定价、基准与 effort 档位完整对比报告 https://www.datastudios.org/post/claude-opus-5-5-vs-gpt-6-astra-complete-comparison-and-report-on-pricing-benchmarks-effort-levels ↩ ↩2 ↩3