GPT-5.6 系列降价:Luna 直降 80%,API 性价比真的拉满了

AI 时代程序员必备技能

Codex、Claude Code、Cursor、Hermes Agent、OpenClaw等工程化实战专栏 ,讲透 AI 如何接管脏活累活

在这里插入图片描述

几天前刷到 OpenAI 那条调价动态时,我第一反应不是“又便宜了一点”,而是:这次 API 的模型分工终于更容易落地了。

以前给 AI 编程工具选模型,经常会遇到一个很现实的问题:强模型效果好,但高频跑 Agent、批量处理代码或反复调用时,成本很快就上来了;便宜模型虽然适合跑量,复杂任务又不一定扛得住。

这次 GPT-5.6 系列的价格调整,刚好把这个矛盾往前推了一大步。

其中 Sol 价格不变,Terra 输入和输出价格都下降 20%,Luna 更直接,输入和输出价格都下降 80%。如果你的任务本来就适合轻量模型,那么同样的调用量,理论成本只剩原来的五分之一。

这不是“便宜几毛钱”的变化。对于每天让 Codex 读项目、跑脚本、改文件,或者用 API 做批量摘要、分类、数据清洗的人来说,Luna 这次确实有点把性价比拉满了。

说明:本文价格按几天前的官方动态配图整理,采用 API 定价表每百万 tokens 的口径。模型价格、可用范围和计费规则可能继续调整,发布和调用前请以官方说明及 KKFlow 后台实际展示为准。

一、这次到底降了多少?

先直接看价格变化:

模型输入价格:调整前输入价格:调整后输出价格:调整前输出价格:调整后变化
GPT-5.6 Sol$5$5$30$30不变
GPT-5.6 Terra$2.50$2$15$12降 20%
GPT-5.6 Luna$1$0.20$6$1.20降 80%

在这里插入图片描述

这张表最值得看的不是 Sol 没降,而是 Terra 和 Luna 的定位变得更清晰了。

  • Sol 继续负责最难、最复杂、最需要推理深度的任务;
  • Terra 更适合日常开发、代码理解和质量与成本都要兼顾的任务;
  • Luna 则更适合高频、轻量、可批量化的调用。

也就是说,以后不一定要让最贵的模型从头干到尾。更合理的做法,是让不同模型各做自己擅长的部分。

二、为什么我觉得这次 Luna 的意义最大?

Luna 输入从 $1 降到 $0.20,输出从 $6 降到 $1.20,两边都是 80% 的降幅。

由于输入和输出按同样比例下降,对于同一类固定任务,粗略理解就是整体 token 成本也下降约 80%。这会直接影响很多以前“能做,但不舍得一直跑”的场景:

  • 批量给代码文件生成摘要;
  • 对日志、工单和评论做分类;
  • 从大量文本中抽取结构化字段;
  • 给 Agent 做第一轮意图识别和任务分流;
  • 在主模型工作前整理上下文、压缩资料;
  • 高频生成测试数据、提交说明和基础文档;
  • 先做便宜的初筛,再把难题交给 Terra 或 Sol。

比如一个代码 Agent,不必每次都直接启动 Sol。完全可以先让 Luna 扫描目录、归类文件、提取报错,再让 Terra 完成常规修改;只有遇到架构决策、大型重构或高风险审查时,才切到 Sol。

Luna:高频扫描、分类、提取、预处理
  ↓
Terra:日常编码、分析、修改、验证
  ↓
Sol:复杂推理、架构设计、疑难问题、关键审查

这种“分层调用”比所有任务固定用一个模型更实际。模型降价真正带来的价值,也不是单次聊天少花一点,而是让整条自动化链路有机会长期运行。

三、Terra 降 20%,可能更适合做日常默认模型

Luna 的 80% 很抢眼,但如果你主要做的是开发工作,我反而建议重点关注 Terra。

Terra 输入从 $2.50 调整到 $2,输出从 $15 调整到 $12。降幅没有 Luna 那么夸张,但它对应的是更常见的“平衡型”工作:

  • 阅读一个中等规模项目;
  • 修改常规业务逻辑;
  • 补单元测试;
  • 分析接口报错;
  • 生成 SQL、脚本和接口文档;
  • 做多轮但难度不算极端的 Agent 任务。

这类任务单次可能不贵,可一旦放进 Codex 这类会读文件、执行命令、反复验证的工具里,输入和输出会叠加得很快。统一下降 20%,在持续使用时会比一次性的价格数字更有感觉。

我的理解是:

追求极致能力,选 Sol;
追求日常平衡,优先试 Terra;
追求高频低成本,重点看 Luna。

当然,模型不能只看单价。最终还要看实际任务的成功率、需要重试几次、生成内容是否可直接使用。一个便宜但需要反复返工的模型,未必真的更省。

四、API 降价以后,国内开发者通常还会卡在哪?

价格只是第一步。真正把模型接进 Codex、脚本或自己的产品时,常见问题还是那些:

网络和认证怎么处理?
API Key 放在哪里?
Base URL 到底填什么?
模型 ID 是 Sol、Terra 还是 Luna?
多个客户端能不能共用一套入口?
调用量和消耗去哪里看?

如果官方链路对你来说足够顺畅,当然优先按官方文档接入。

我自己常用的一个 AI API 统一接入入口是:

https://kkflow.org

KKFlow 的定位不是某一个模型的临时入口,而是统一管理 Key、模型和接口地址。Codex、Claude Code、生图 API 或自己的后端脚本,都可以按对应协议接到同一套 API 网关里,切模型和看用量会方便很多。
在这里插入图片描述

常用地址如下:

用途地址
主站、登录、后台和指南https://kkflow.org
OpenAI 兼容 API Base URLhttps://kkflow.org/v1
模型列表测试接口https://kkflow.org/v1/models

需要注意:模型会动态上下架,价格和模型 ID 也可能调整。不要只照着文章硬填,先去 KKFlow 后台确认当前实际可用的模型名称。

五、先测试模型列表,不要上来就改一堆配置

在 Windows PowerShell 里,可以先测试模型列表:

curl.exe "https://kkflow.org/v1/models" `
  -H "Authorization: Bearer sk-你的KKFlow密钥"

这里的 sk-你的KKFlow密钥 只是脱敏占位符。真实 Key 不要放进文章、截图、聊天记录或 Git 仓库。

如果返回结果里能看到需要的 GPT-5.6 模型,再继续配置客户端。模型 ID 以后台和接口实际返回值为准,不要凭展示名称猜。

六、用 KKFlow 接入 Codex 的完整配置

Codex 的用户配置通常位于:

Windows:%USERPROFILE%\.codex\config.toml
macOS / Linux:~/.codex/config.toml

按照当前模型规格,可以使用下面这份配置:

model_provider = "kkflow"
model = "gpt-5.6-sol"
review_model = "gpt-5.6-sol"
model_reasoning_effort = "xhigh"

disable_response_storage = true
network_access = "enabled"
windows_wsl_setup_acknowledged = true

model_context_window = 400000
model_auto_compact_token_limit = 360000

[model_providers.kkflow]
name = "KKFlow"
base_url = "https://kkflow.org/v1"
wire_api = "responses"
requires_openai_auth = true

API Key 继续放在 auth.jsonOPENAI_API_KEY 中:

{
  "OPENAI_API_KEY": "sk-你的KKFlow密钥"
}

这里有四个地方必须核对:

  1. modelreview_model 保持一致;
  2. 模型名称以 KKFlow 后台实际模型 ID 为准;
  3. model_context_window 和自动压缩阈值必须匹配模型真实规格;
  4. 修改配置后完全退出旧 Codex 会话,再重新打开终端。

如果你想改用 Terra 或 Luna,不要只改其中一行。确认后台模型 ID 和上下文规格后,同时调整 modelreview_model 以及相关上下文参数。

七、降价以后,模型应该怎么选?

我会按任务而不是按“谁最强”来分:

任务场景优先尝试原因
大型重构、复杂架构、疑难调试Sol把成功率和推理深度放在成本前面
日常编码、代码审查、项目理解Terra能力与价格更平衡
分类、抽取、摘要、批处理Luna调价后更适合高频调用
多阶段 Agent 工作流Luna + Terra + Sol先低成本分流,再逐级处理难题

正式接入生产环境前,建议拿自己的真实任务做一轮小测试:

同一批任务
-> 分别记录成功率、重试次数、输入输出 tokens
-> 计算完成一个有效任务的真实成本
-> 再决定默认模型和升级策略

不要只比每百万 tokens 的标价。对开发任务来说,“一次做对”本身也有价格。

八、最后说几句

几天前这次调价,表面上看是 Terra 降 20%、Luna 降 80%,更深一层其实是让多模型分工变得更现实。

Sol 继续守住复杂任务,Terra 承担大部分日常工作,Luna 用更低的成本跑高频任务。对于 Codex、Agent 和批量 API 工作流来说,这种组合比单纯追求一个“最强模型”更有性价比。

如果你正好在国内配置 Codex,或者需要把多个 AI 客户端接到统一入口,可以先去 https://kkflow.org 看后台当前支持的模型,再用 https://kkflow.org/v1/models 实测。先把 Key、Base URL、模型 ID 和用量管理跑通,后面模型再更新,也不需要每个工具从头折腾。

参考信息

  • OpenAI 官方账号发布的 GPT-5.6 系列价格调整动态(文章配图);
  • OpenAI GPT-5.6 介绍:https://openai.com/index/gpt-5-6/
  • KKFlow 主站与后台:https://kkflow.org

AI 时代程序员必备技能

Codex、Claude Code、Cursor、Hermes Agent、OpenClaw等工程化实战专栏 ,讲透 AI 如何接管脏活累活

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值