发布日期:2026-09-23

OpenAI于2026年9月23日正式发布GPT-6系列新成员GPT-6 Sol和GPT-6 Luna,官方定位为把GPT-6 Astra在专业工作、事实性、编码、计算机使用和对齐上的领先能力,带入更快更经济的模型。两者API价格较GPT-5.6促销价直降50%:Sol为输入2美元/百万Token、输出10美元,Luna为输入0.10美元、输出0.50美元。本文解析其定位分工、基准成绩、缓存优化与选型建议。


GPT-6 Sol和Luna是什么?

GPT-6 Sol和Luna是OpenAI GPT-6家族在Astra旗舰之后的规模化成员,采用与Astra类似的方法训练。如果说Astra体现AI智力巅峰,Sol和Luna就是面向千行百业的工业级放大器。

分工明确:Astra要最好效果,Sol要高性价比主力,Luna要极致走量。根据OpenAI官方博客2026年9月23日说明,两款模型均已上线OpenRouter,API型号为gpt-6-sol与gpt-6-luna。

相关实体包括OpenAI、ChatGPT Work、Codex、OpenRouter、Anthropic Claude,以及评测AutomationBench、FrontierCode、DeepSWE。

价格:腰斩背后的双轨策略

本次最直接的变化是价格,只有上一代GPT-5.6的一半。

模型

输入/百万Token

输出/百万Token

降幅

GPT-5.6 Sol → GPT-6 Sol

4美元 → 2美元

20美元 → 10美元

50%

GPT-5.6 Luna → GPT-6 Luna

0.20美元 → 0.10美元

1.20美元 → 0.50美元

50%

GPT-6 Astra(参照)

10美元

50美元

旗舰档

数据来源:OpenAI官方博客,2026年9月。

Sol与Luna差出一个量级:Sol负责难任务迭代,Luna负责海量轻任务。同期OpenRouter数据显示,OpenAI周消费金额在30个月后首超Anthropic,低价走量是关键推手。

叠加缓存优化,Agent复用上下文可享90%的缓存读取折扣。GitHub报告称,数月内需新鲜处理的提示词占比下降超50%,Copilot响应更快。

专业工作:Sol以9%成本超Opus 5

在AutomationBench业务流测试中,GPT-6 Sol xhigh达33.2%,成本仅0.27美元/任务。

  • 超Claude Opus 5 max的26.9%,成本仅为其9%。

  • 超Claude Fable 5.1的31.4%,成本不到1/9。

  • 甚至超过低档Astra的30.3%,成本仅1/3.9。

  • Agents Last Exam达56.4%,接近Opus 5最高分但成本低60%。

Luna同样涨点:高档较前代提升5.4个百分点,单任务成本低58%。事实性上,Sol犯错数约为前代一半,接近Astra水平;Luna高档可 matching GPT-5.6 Sol,成本仅约1/100。

编码:DeepSWE逼近Fable,成本低80%

编码是Sol和Luna的主战场,OpenAI内部日Token消费中位数已超600美元,90分位超7000美元,低成本迭代至关重要。

  • FrontierCode:Sol大幅超5.6 Sol,可 matching Fable 5.1 xhigh,成本远低。

  • DeepSWE v1.1:Sol max达68.8%,距Fable最高的69.9%仅1.1分,成本低约80%。

  • DeepSWE:Luna max达66.6%,相当Opus 5与Fable中档,成本低93%-96%。

  • OSWorld 2.0:Sol xhigh达60.5%,持平Opus 5中档的60.3%,成本低80%;Luna超5.6 Sol中档,成本仅1/10。

开发者可通过标准接口直接调用,例如七牛云推理服务兼容主流调用格式,国内可直接访问,适合把Sol做主力、Luna做批量任务的组合测试。

from openai import OpenAI
client = OpenAI(api_key="YOUR_KEY")
resp = client.chat.completions.create(
    model="gpt-6-sol",
    messages=[{"role": "user", "content": "用React实现Bento网格+右上滑动切换,检查是否真需引入React"}]
)
print(resp.choices[0].message.content)

模型名与Key为占位符,以OpenAI官方文档为准。

协作风格与对齐:更像人,更少忽悠

Sol和Luna继承了Astra的沟通风格:更清晰、更少行话、更少怪异转折、细节更精练。在Bento官网改版对比中,6代会先确认是否真需React并说明测了什么,5.6代则直接开干。

对齐上,两者在编码欺瞒、破坏搜索、绕过评审等项均优于5.6 counterpart。OpenAI提醒,这些是刻意找茬的压力测试,日常失效率远低,详见系统卡。

适合什么场景?

  • Sol主力编码:FrontierCode与DeepSWE逼近旗舰,适合Codex长任务迭代。

  • Luna批量任务:0.1美元输入价,适合分类、抽取、大规模数据收集。

  • 业务流Agent:AutomationBench性价比断层,适合销售、财务、HR跨应用编排。

  • 不适合:极限旗舰任务仍选Astra;Chat免费版暂仅有Luna桌面端,Sol需Plus以上。

已上线ChatGPT Work与Codex的Plus、Pro、Business、Enterprise、Edu,Free与Go可在桌面用Luna,Chat暂未上,全天灰度中。

常见问题

Q:GPT-6 Sol和Luna最大区别是什么? Sol是主力性价比,输入2美元输出10美元;Luna是极致走量,输入0.10美元输出0.50美元,两者均比5.6便宜50%,能力分别对标中高档与轻量任务。

Q:Sol真能替代Astra或Opus 5吗? AutomationBench上Sol以9%成本超Opus 5,DeepSWE距Fable仅1.1分,适合多数任务;极限深度仍需Astra,建议以自身任务实测为准。

Q:怎么接入?型号名是什么? API型号为gpt-6-sol与gpt-6-luna,已上OpenRouter,ChatGPT Work与Codex今日灰度,需Plus以上,Luna另有免费桌面入口。

Q:缓存90%折扣怎么用? 开启提示缓存仪表盘与诊断工具,调推理力度与工具开关不再破坏缓存,用显式断点控制前缀,Agent长对话复用率最高。

Q:国内如何低成本对比? 可用国内可直接访问的多模型平台同题跑Sol、Luna与竞品,记录质量与单任务成本后再定主力。

总结

GPT-6 Sol和Luna是一次 industrial级放大:Astra的方法论,Sol的价格,Luna的量。据OpenAI官方博客2026年9月数据,其成本智能曲线已全面领先,OpenRouter消费反超即是注脚。本文基于2026年9月数据,价格与灰度状态可能调整,以官方定价页为准。

参考资料: