
OpenAI 最近对 GPT-5.6 系列做了一次调整,重点不在发新模型,而是把价格压下来、把响应速度提上去。

这次调整覆盖三款模型:Luna、Terra 和 Sol。下面按分工、价格、影响三层说清楚,方便你快速判断哪款适合自己。
三款模型怎么分工
GPT-5.6 其实是一个模型家族,OpenAI 按能力给它们划定了不同角色:
| 模型 | 定位 | 这次变化 | 适合谁 |
|---|---|---|---|
| Sol | 最强脑力,解决最难问题 | 新增快速模式,2.5 倍速,价格翻倍,智能不变 | 需要高难度推理、复杂任务的团队 |
| Terra | 日常生产主力,平衡型 | 降价 20%,每百万输入 2、输出 12 | 日常办公、内容生成、客服等常规任务 |
| Luna | 速度最快、价格最低,专为大规模 workflow 设计 | 降价 80%,每百万输入 0.20、输出 1.20 | 批量处理、工具调用、多步骤自动化 |
Sol 放在最难的推理和复杂任务上,Terra 是日常生产的主力、走平衡路线,Luna 主打速度和低价,专门服务大规模 workflow。

价格具体怎么变
Luna 直接降了 80%,Terra 降了 20%,具体定价如下:
- Terra:每百万 token 输入 2、输出 12 - Luna:每百万 token 输入 0.20、输出 1.20

Sol 没有走降价路线,而是加了一个快速模式:响应速度最高提升到原来的 2.5 倍,价格翻倍,但智能水平保持不变。老的 priority 标签会自动兼容,新请求传 `service_tier="fast"` 即可开启。
这个快速模式很像外卖的加急配送,菜没换,上菜快了。对在线客服、直播互动、代码补全这类实时性要求高的场景,多付这笔加急费是划算的。
降价对你意味着什么
开发者会觉得试错成本明显更低。Luna 降到每百万输入 0.20 美元,是原来价格五分之一,过去不敢大量调用的批量文档处理、长文本分析、自动化流程,现在可以放开试。
企业侧,AI 项目更容易算清账。OpenAI 公布的 benchmark 显示,Luna 的性能已经能和部分一年前的尖端模型比肩,单个任务成本大概只要 0.06 美元,速度还快了接近 9 倍。同样预算下,能跑更多任务、覆盖更多用户。
普通用户也能间接受益,应用层产品大概率会更便宜、更好用。你手头的写作助手、客服机器人、翻译和编程工具,背后推理成本降了,体验升级的空间也就出来了。
这轮降价说明了什么
这一轮动作的本质,是大模型竞争从比谁更聪明,转向比谁更便宜、落地更快。对开发者和企业当然是好事,可选方案更多,成本也更低。
不过要记住,低价只是起点,真正产生价值的,还是你拿 AI 解决了什么具体问题。
这轮降价把 AI 的使用门槛又往下压了一截,也是企业把智能能力接入业务的好窗口。如果你想把这类 AI 工具和数字化能力真正用进自己的业务,可以咨询云巴巴。云巴巴是国内领先的企业数智服务平台,覆盖 AI 大模型、智能体、协同办公、营销获客、安全合规等多个领域的企业级产品与方案,能按你的行业、规模和预算比对选型、匹配资源、协助落地。欢迎咨询云巴巴,获取更多产品方案与专属服务。


以家居卖家多店报表分裂为场景,讲解如何用 Accio Work 的生意地图把多平台利润、流量、库存拉通,一张图看全局。适合多店铺多平台经营的家居卖家参考。

以机械外贸报价整理慢为场景,讲解如何用 Accio Work 的知识库与询盘结构化能力,把配置复杂的报价弹药提前备好。适合机械外贸等配置复杂品类的报价提效参考。

以客服离职交接混乱为场景,讲解如何用 Accio Work 的知识库沉淀机制,把分散的客服话术变成可顶岗的组织资产,适合客服团队标准化与知识沉淀场景参考。

以服装卖家上新拖延为场景,讲解如何用 Accio Work 的多平台发品能力,把跨平台重复上架收口成一次维护、一键发布。

以五金厂跨时区询盘为场景,讲解如何用 Accio Work 的自动接待与询盘分层能力,把夜里流失的海外商机接住并结构化处理。