
几天前刷到 OpenAI 那条调价动态时,我第一反应不是“又便宜了一点”,而是:这次 API 的模型分工终于更容易落地了。
以前给 AI 编程工具选模型,经常会遇到一个很现实的问题:强模型效果好,但高频跑 Agent、批量处理代码或反复调用时,成本很快就上来了;便宜模型虽然适合跑量,复杂任务又不一定扛得住。
这次 GPT-5.6 系列的价格调整,刚好把这个矛盾往前推了一大步。
其中 Sol 价格不变,Terra 输入和输出价格都下降 20%,Luna 更直接,输入和输出价格都下降 80%。如果你的任务本来就适合轻量模型,那么同样的调用量,理论成本只剩原来的五分之一。
这不是“便宜几毛钱”的变化。对于每天让 Codex 读项目、跑脚本、改文件,或者用 API 做批量摘要、分类、数据清洗的人来说,Luna 这次确实有点把性价比拉满了。
说明:本文价格按几天前的官方动态配图整理,采用 API 定价表每百万 tokens 的口径。模型价格、可用范围和计费规则可能继续调整,发布和调用前请以官方说明及 KKFlow 后台实际展示为准。
一、这次到底降了多少?
先直接看价格变化:
| 模型 | 输入价格:调整前 | 输入价格:调整后 | 输出价格:调整前 | 输出价格:调整后 | 变化 |
|---|---|---|---|---|---|
| GPT-5.6 Sol | $5 | $5 | $30 | $30 | 不变 |
| GPT-5.6 Terra | $2.50 | $2 | $15 | $12 | 降 20% |
| GPT-5.6 Luna | $1 | $0.20 | $6 | $1.20 | 降 80% |

这张表最值得看的不是 Sol 没降,而是 Terra 和 Luna 的定位变得更清晰了。
- Sol 继续负责最难、最复杂、最需要推理深度的任务;
- Terra 更适合日常开发、代码理解和质量与成本都要兼顾的任务;
- Luna 则更适合高频、轻量、可批量化的调用。
也就是说,以后不一定要让最贵的模型从头干到尾。更合理的做法,是让不同模型各做自己擅长的部分。
二、为什么我觉得这次 Luna 的意义最大?
Luna 输入从 $1 降到 $0.20,输出从 $6 降到 $1.20,两边都是 80% 的降幅。
由于输入和输出按同样比例下降,对于同一类固定任务,粗略理解就是整体 token 成本也下降约 80%。这会直接影响很多以前“能做,但不舍得一直跑”的场景:
- 批量给代码文件生成摘要;
- 对日志、工单和评论做分类;
- 从大量文本中抽取结构化字段;
- 给 Agent 做第一轮意图识别和任务分流;
- 在主模型工作前整理上下文、压缩资料;
- 高频生成测试数据、提交说明和基础文档;
- 先做便宜的初筛,再把难题交给 Terra 或 Sol。
比如一个代码 Agent,不必每次都直接启动 Sol。完全可以先让 Luna 扫描目录、归类文件、提取报错,再让 Terra 完成常规修改;只有遇到架构决策、大型重构或高风险审查时,才切到 Sol。
Luna:高频扫描、分类、提取、预处理
↓
Terra:日常编码、分析、修改、验证
↓
Sol:复杂推理、架构设计、疑难问题、关键审查
这种“分层调用”比所有任务固定用一个模型更实际。模型降价真正带来的价值,也不是单次聊天少花一点,而是让整条自动化链路有机会长期运行。
三、Terra 降 20%,可能更适合做日常默认模型
Luna 的 80% 很抢眼,但如果你主要做的是开发工作,我反而建议重点关注 Terra。
Terra 输入从 $2.50 调整到 $2,输出从 $15 调整到 $12。降幅没有 Luna 那么夸张,但它对应的是更常见的“平衡型”工作:
- 阅读一个中等规模项目;
- 修改常规业务逻辑;
- 补单元测试;
- 分析接口报错;
- 生成 SQL、脚本和接口文档;
- 做多轮但难度不算极端的 Agent 任务。
这类任务单次可能不贵,可一旦放进 Codex 这类会读文件、执行命令、反复验证的工具里,输入和输出会叠加得很快。统一下降 20%,在持续使用时会比一次性的价格数字更有感觉。
我的理解是:
追求极致能力,选 Sol;
追求日常平衡,优先试 Terra;
追求高频低成本,重点看 Luna。
当然,模型不能只看单价。最终还要看实际任务的成功率、需要重试几次、生成内容是否可直接使用。一个便宜但需要反复返工的模型,未必真的更省。
四、API 降价以后,国内开发者通常还会卡在哪?
价格只是第一步。真正把模型接进 Codex、脚本或自己的产品时,常见问题还是那些:
网络和认证怎么处理?
API Key 放在哪里?
Base URL 到底填什么?
模型 ID 是 Sol、Terra 还是 Luna?
多个客户端能不能共用一套入口?
调用量和消耗去哪里看?
如果官方链路对你来说足够顺畅,当然优先按官方文档接入。
我自己常用的一个 AI API 统一接入入口是:
https://kkflow.org
KKFlow 的定位不是某一个模型的临时入口,而是统一管理 Key、模型和接口地址。Codex、Claude Code、生图 API 或自己的后端脚本,都可以按对应协议接到同一套 API 网关里,切模型和看用量会方便很多。

常用地址如下:
| 用途 | 地址 |
|---|---|
| 主站、登录、后台和指南 | https://kkflow.org |
| OpenAI 兼容 API Base URL | https://kkflow.org/v1 |
| 模型列表测试接口 | https://kkflow.org/v1/models |
需要注意:模型会动态上下架,价格和模型 ID 也可能调整。不要只照着文章硬填,先去 KKFlow 后台确认当前实际可用的模型名称。
五、先测试模型列表,不要上来就改一堆配置
在 Windows PowerShell 里,可以先测试模型列表:
curl.exe "https://kkflow.org/v1/models" `
-H "Authorization: Bearer sk-你的KKFlow密钥"
这里的 sk-你的KKFlow密钥 只是脱敏占位符。真实 Key 不要放进文章、截图、聊天记录或 Git 仓库。
如果返回结果里能看到需要的 GPT-5.6 模型,再继续配置客户端。模型 ID 以后台和接口实际返回值为准,不要凭展示名称猜。
六、用 KKFlow 接入 Codex 的完整配置
Codex 的用户配置通常位于:
Windows:%USERPROFILE%\.codex\config.toml
macOS / Linux:~/.codex/config.toml
按照当前模型规格,可以使用下面这份配置:
model_provider = "kkflow"
model = "gpt-5.6-sol"
review_model = "gpt-5.6-sol"
model_reasoning_effort = "xhigh"
disable_response_storage = true
network_access = "enabled"
windows_wsl_setup_acknowledged = true
model_context_window = 400000
model_auto_compact_token_limit = 360000
[model_providers.kkflow]
name = "KKFlow"
base_url = "https://kkflow.org/v1"
wire_api = "responses"
requires_openai_auth = true
API Key 继续放在 auth.json 的 OPENAI_API_KEY 中:
{
"OPENAI_API_KEY": "sk-你的KKFlow密钥"
}
这里有四个地方必须核对:
model和review_model保持一致;- 模型名称以 KKFlow 后台实际模型 ID 为准;
model_context_window和自动压缩阈值必须匹配模型真实规格;- 修改配置后完全退出旧 Codex 会话,再重新打开终端。
如果你想改用 Terra 或 Luna,不要只改其中一行。确认后台模型 ID 和上下文规格后,同时调整 model、review_model 以及相关上下文参数。
七、降价以后,模型应该怎么选?
我会按任务而不是按“谁最强”来分:
| 任务场景 | 优先尝试 | 原因 |
|---|---|---|
| 大型重构、复杂架构、疑难调试 | Sol | 把成功率和推理深度放在成本前面 |
| 日常编码、代码审查、项目理解 | Terra | 能力与价格更平衡 |
| 分类、抽取、摘要、批处理 | Luna | 调价后更适合高频调用 |
| 多阶段 Agent 工作流 | Luna + Terra + Sol | 先低成本分流,再逐级处理难题 |
正式接入生产环境前,建议拿自己的真实任务做一轮小测试:
同一批任务
-> 分别记录成功率、重试次数、输入输出 tokens
-> 计算完成一个有效任务的真实成本
-> 再决定默认模型和升级策略
不要只比每百万 tokens 的标价。对开发任务来说,“一次做对”本身也有价格。
八、最后说几句
几天前这次调价,表面上看是 Terra 降 20%、Luna 降 80%,更深一层其实是让多模型分工变得更现实。
Sol 继续守住复杂任务,Terra 承担大部分日常工作,Luna 用更低的成本跑高频任务。对于 Codex、Agent 和批量 API 工作流来说,这种组合比单纯追求一个“最强模型”更有性价比。
如果你正好在国内配置 Codex,或者需要把多个 AI 客户端接到统一入口,可以先去 https://kkflow.org 看后台当前支持的模型,再用 https://kkflow.org/v1/models 实测。先把 Key、Base URL、模型 ID 和用量管理跑通,后面模型再更新,也不需要每个工具从头折腾。
参考信息
- OpenAI 官方账号发布的 GPT-5.6 系列价格调整动态(文章配图);
- OpenAI GPT-5.6 介绍:
https://openai.com/index/gpt-5-6/; - KKFlow 主站与后台:
https://kkflow.org。
664

被折叠的 条评论
为什么被折叠?



