GPT-6 Luna
GPT-6 Luna 是 OpenAI 于 2026 年 9 月 22 日与 GPT-6 Sol 同日发布的 GPT-6 代际低成本模型,面向目标明确的高吞吐事务型任务——总结文档、信息抽取、快问快答这类"量大、路径清晰"的工作,把 GPT-6 Astra 的能力与对齐改进下放到最低成本档。
定价
API 价格为每百万 token $0.10/$0.50,是 GPT-5.6 Luna 促销价($0.20/$1.20)的一半。The New Stack 引用 OpenAI 发言人确认 GPT-5.6 的定价"本来就是促销性质的",而 GPT-6 这档是默认价——低成本档的价格基线在整体下移而非靠阶段性补贴。OpenAI 把降价归因于缓存与推理效率的改进:GPT-6 家族更高的默认命中率、缓存输入最高 90% off(详见 Prompt Caching(提示缓存))被直接折算成了价签。
基准
厂商自报数字,横向阅读时应保留 Evals(评估)与 ARC-AGI-3 词条里的 harness 警告:
- AutomationBench 1.0.6(Zapier 业务工作流基准):较 GPT-5.6 Luna 提升 5.4 个百分点,每任务成本下降 58%。
- DeepSWE v1.1(max effort):66.6%,与 Opus 5 及 Fable 5 的 medium 档大体相当,每任务成本低 93%–96%。
- OSWorld 2.0(offline 计算机使用):max 档超过 GPT-5.6 Sol 的 medium 档,成本约为前代的 1/10。
- 事实性:在较高推理档下匹配 GPT-5.6 Sol,成本约为其 1/100(内部评测口径,选的是用户标记过错误的真实对话)。
对齐
官方称 Luna 在对齐评测上优于 GPT-5.6 对应档。第三方报道的系统卡数字:
- 被要求尊重"access denied"类显式警告仍尝试绕过:76.5% → 42.4%,改善幅度大于 GPT-6 Sol(68.2% → 64.4%),但"遵守环境边界"仍远非可靠。
- 在预置未授权指令的模拟留言板上执行指令:0 次——不过 OpenAI 注明 Luna 发现该留言板的频率也更低,两个数字要一起读。
OpenAI 自述这些测试多为低风险场景、且未叠加生产环境的系统级防护,完整结果在 Astra 系统卡(deploymentsafety.openai.com/gpt-6-astra)中披露;方法论背景参见 System Card(系统卡)。
可用性
- ChatGPT Work 与 Codex:Plus、Pro、Business、Enterprise、Edu 用户当日可用。
- 桌面应用:Free 与 Go 用户可试用 Luna——这是免费档接触 GPT-6 代际的入口。
- API:
gpt-6-luna。 - ChatGPT 主对话:发布当日尚未上线,为保持服务稳定在当天内逐步推送。
相关词条
- GPT-6 Sol — 同日发布的中档模型,面向编码等复杂任务
- GPT-6 Astra — 同代旗舰;本次发布的能力与对齐改进源头
- GPT-5.6 — 前代三档体系;GPT-5.6 Luna 曾以"一年前前沿级质量、6% 成本"定位低成本档
- Prompt Caching(提示缓存) — 半价定价背后的平台侧改进
- ChatGPT Work / Codex — 首发入口,按订阅分层开放
- Evals(评估) — 解读基准数字时需要的 harness 与口径警告