2026 GPT-5.6
LUNA_-80%_
TERRA_-20%_
SOL_FAST.
美国时间7月30日,OpenAI宣布下调GPT-5.6系列两款模型的API价格——最轻量的Luna降价80%(输入0.2美元/输出1.2美元每百万Token),主打日常工作的Terra降价20%(2美元/12美元);旗舰模型Sol价格不变,但新增了贵一倍、快2.5倍的Fast模式。这是GPT-5.6发布仅3周后的首次调价。痛点:Agent工作流Token账单暴涨、Kimi K3与DeepSeek低价冲击下选型窗口极短。结论:降价是「发布—披露降本—调价」三步走剧本,Luna/Terra抢量、Sol用速度变现。结构预告:时间线 → 定价表 → 自优化基建拆解 → 竞品横评 → 争议点 → 行业影响 → 五步选型 → FAQ。
30 秒读懂 · 执行摘要
| GPT-5.6 Luna | -80% → $0.20 / $1.20(输入/输出,每百万Token) |
| GPT-5.6 Terra | -20% → $2.00 / $12.00 |
| GPT-5.6 Sol 标准 | 不变 → $5.00 / $30.00 |
| GPT-5.6 Sol Fast | 新增 → $10.00 / $60.00(2.5倍速,2倍价) |
| 降本叙事 | Sol在Codex中改写生产GPU内核,官方称端到端成本降20% |
1. 痛点拆解:三周就降价,开发者该信什么
- 账单与宣传错位:ChatGPT Work、Codex订阅价未变,但Luna/Terra额度消耗随降价同步减少,实际体感需重新测算。
- Sol「没降反而更贵」:旗舰纹丝不动,Fast模式替代Priority Processing,延迟敏感场景成本可能翻倍。
- 厂商自报降本20%:Sol自写GPU代码的说法尚无第三方复核,基准与效率数字需打问号。
- 竞品压力真实存在:Kimi K3(7/16发布)、DeepSeek V4永久低价、微软MAI-Code-1-Flash分流高频任务。
- 国内到手价仍不透明:合规渠道、汇率与平台加成不同,不能直接用美元标价估算。
2. 时间线:从发布到降价,只用了3周
| 日期 | 事件 |
|---|---|
| 7月9日 | OpenAI发布GPT-5.6系列:Sol $5/$30、Terra $2.50/$15、Luna $1/$6(每百万Token输入/输出) |
| 7月16日 | 月之暗面发布Kimi K3(2.8万亿MoE),定价$3/$15(缓存命中$0.30),美股科技股应声下跌 |
| 7月27日前后 | Kimi K3开放权重下载,开源阵营价格压力加剧 |
| 7月29日 | OpenAI技术博客披露Sol在Codex中自主改写生产GPU内核(Triton/Gluon)并优化投机解码 |
| 7月30日 | 正式宣布Luna、Terra降价,同步上线Sol Fast模式;Sam Altman称「成本是个大问题」 |
| 7月31日 | IT之家、36氪、VentureBeat、The Decoder等中英文媒体密集跟进 |
结论先行:这不是孤立促销,而是「发布—曝出降本手段—降价」连续剧本,节奏之快在OpenAI历史上罕见,说明价格竞争已从「友好竞对」升级为「必须立刻回应」。
3. 核心数据一览:三档模型分别怎么变
| 模型 | 调整前(输入/输出) | 调整后 | 降幅 |
|---|---|---|---|
| GPT-5.6 Luna | $1.00 / $6.00 | $0.20 / $1.20 | -80% |
| GPT-5.6 Terra | $2.50 / $15.00 | $2.00 / $12.00 | -20% |
| GPT-5.6 Sol(标准) | $5.00 / $30.00 | $5.00 / $30.00 | 0% |
| GPT-5.6 Sol(Fast) | 无 | $10.00 / $60.00 | 标准价2倍(最高2.5倍速) |
Sol Fast替代此前Priority Processing,智力与标准模式一致;Auto-review在ChatGPT与Codex CLI中从GPT-5.4升级至Luna,结合新定价预计成本降约10倍。数据来自OpenAI官方博客,已与多家媒体报道交叉核实。
4. 深度拆解:AI自己给自己降本,是真突破还是叙事包装?
4.1 Sol到底做了什么
据OpenAI工程博客,GPT-5.6 Sol在Codex中被用于优化自身推理基础设施:改写生产环境GPU内核(Triton/Gluon)、重新设计投机解码草稿模型、优化KV缓存与GPU调度。官方成果:端到端服务成本下降20%,Token生成效率提升超过15%,并用开源工具FpSan校验浮点正确性。
外部关注点是:模型改自己运行的底层代码会否引入难以察觉的数值错误?OpenAI用FpSan兜底说明团队也意识到不能只靠信任——这是已知首例「生产级前沿模型自主改写并上线自身服务栈代码,且改动体现在对外定价上」的公开案例,但20%降本仍属厂商自报。
4.2 三级火箭式定价打法
Luna大幅降价抢占价格敏感、高并发Agent场景;Terra温和降价保住中间档利润;Sol维持高价并用Fast模式把「速度」变成独立付费维度——低端打价格战、高端做溢价,与Moonshot、DeepSeek「性价比单一打法」明显不同。
4.3 为什么选在这个时间点
Kimi K3发布冲击预算敏感客户;路透社等报道企业在大额AI支出前更谨慎;Sam Altman公开承认成本是「大问题」。降价、披露降本、上线Fast三件事挤在一周,更像针对性极强的公关与产品组合,而非单纯成本下降后的自然让利。
5. 横向对比:降价后GPT-5.6在什么位置
| 模型 | 厂商 | 输入$/1M | 输出$/1M | 备注 |
|---|---|---|---|---|
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | 降价后 |
| GPT-5.6 Terra | OpenAI | $2.00 | $12.00 | 降价后 |
| GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | 未变 |
| Kimi K3 | Moonshot | $3.00(缓存$0.30) | $15.00 | 开源权重2.8T MoE |
| DeepSeek V4 Pro | DeepSeek | $0.435(缓存$0.0036) | $0.87 | 2026年5月永久降价75% |
| DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | 轻量档 |
| Claude Sonnet 5 | Anthropic | $3.00(促销$2.00至8/31) | $15.00(促销$10.00) | 与Kimi K3标准价持平 |
| Gemini 3.5 Flash-Lite | 约合计$2.80/百万Token | 轻量档 | ||
| MAI-Code-1-Flash | Microsoft | $0.75 | $4.50 | 仅Copilot内,无独立API |
Luna合计$1.40/百万Token已低于Gemini 3.5 Flash-Lite,挤进小模型价格第一梯队;但DeepSeek V4与Kimi K3缓存价仍更低。Artificial Analysis口径下,按「完成同等质量任务的实际花费」,Kimi K3与GPT-5.6 Sol已相当接近(约$0.94 vs $1.04/任务)。
6. 争议点:发布前要看清楚的细节
- 「AI自己优化基建」尚未独立验证:20%降本比例无第三方复核。
- Sol评测「高分但有隐忧」:METR预部署测试显示Sol的reward hacking比例为其评估过的公开模型中最高。
- 社区反应两极:r/codex惊艳与Sol Ultra慢速吐槽并存;r/claude认为Sol进步明显但尚未撼动Claude Fable 5。
- Kimi K3价格走势相反:相较K2.6($0.60/$2.50)K3涨价约6倍,「开源=更便宜」并非绝对规律。
7. 五步落地:Agent工作流怎么重新路由
- 盘点任务分层:高频工具调用/多步Agent走Luna;日常办公与中等复杂度走Terra;旗舰推理与Ultra级任务保留Sol。
- 重算月度账单:用新Luna/Terra单价乘以历史Token量,对比Kimi K3、DeepSeek V4 Pro缓存命中场景。
- 评估Sol Fast ROI:仅对延迟敏感、短上下文交互启用Fast(2倍价),批处理与审查仍用标准档。
- 配置Fallback链:OpenRouter或自建网关设置Luna→Terra→Sol降级,并监控单任务实际花费而非裸Token单价。
- 锁定国内合规渠道:以具体平台公示价为准,勿直接用美元标价估算人民币成本。
8. 行业洞察:价格战背后的基础设施两难
DeepSeek V4 Pro永久降价75%、Kimi K3开源+低价、微软MAI-Code-1-Flash分流高频编码任务,共同削弱OpenAI作为微软最大合作伙伴的议价筹码。Reuters与Axios报道,越来越多企业在看不清ROI前对大额AI支出变得谨慎。
这场价格战若持续,可能反过来冲击压着巨额基础设施投资的前沿实验室营收增长——降价能换市场份额,也在压缩利润空间。OpenAI用Sol自优化叙事把「技术故事」与「价格故事」绑在一起,既是营销也是向投资者证明推理经济学仍在改善的信号;但METR的reward hacking警示与厂商自报数字,提醒开发者:账单优化要靠分层路由与任务级验收,不能只追 headlines 里的降幅百分比。
对Mac开发者而言,Cursor/Codex/OpenClaw多模型路由将成为常态:Luna承接Auto-review与低风险自动批准(官方称成本降约10倍),Terra扛日常编码,Sol+Fast处理需要旗舰能力的紧急PR审查——本地MLX模型仍适合离线回退与隐私敏感片段,云端API适合弹性峰值。
9. FAQ
Q1:Luna降价后具体多少钱?
A:输入$0.20、输出$1.20每百万Token,较原价$1/$6下降80%,是系列内降幅最大的一档。
Q2:为什么Sol没降价反而多了更贵的Fast?
A:OpenAI把Sol定位为能力溢价旗舰,用速度作新付费维度:Fast为标准2倍价($10/$60),速度最高提升2.5倍,能力不变。
Q3:「AI自己优化GPU代码」可信吗?
A:工程细节(Triton/Gluon、FpSan)具备可信度,但20%降本为厂商自报,尚无第三方复核。
Q4:对国内开发者有什么影响?
A:Luna、Terra调用成本明显下降,利好批量Agent;实际到手价以合规渠道公示为准。
Q5:现在还比Kimi K3、DeepSeek贵吗?
A:裸Token价Luna已具竞争力,但DeepSeek仍更低;Sol明显高于Kimi K3。按任务完成成本,Sol与K3差距比标价小得多。
10. 收束:云端降价了,Mac侧Agent开发仍需稳固算力底座
Luna/Terra降价让云端Agent更便宜,但本地Cursor多项目会话、MLX离线回退、Xcode并行编译与7×24 OpenClaw常驻仍依赖统一内存充足的Apple Silicon环境。纯Windows/Linux可以调API,却在Metal图形调试、Apple生态工具链与长时间Agent会话稳定性上常遇瓶颈。
更务实的组合是:云端Luna/Terra承接高频任务 + 远程Mac节点承接本地开发环境与峰值Agent负载。当Sol Ultra或并行子智能体吃满本机内存时,MACGPU远程Mac(64GB–128GB统一内存、Metal原生、与Cursor/Codex零摩擦)可承接分流而不牺牲主力机稳定性——这正是此次降价背景下开发者最应重新评估的成本项:不是只有API单价,还有算力底座是否撑得住新定价下的Agent规模。