AI 快讯 编译自 simon_willison #模型发布#定价更新#OpenAI

OpenAI 发布 GPT-5.6 系列:Sol、Terra、Luna 三款模型,定价与缓存机制更新

OpenAI 开始限量预览 GPT-5.6 系列模型,包括旗舰 Sol、平衡 Terra 和快速 Luna。Terra 性能接近 GPT-5.5 但价格减半,Luna 成本最低。新引入可预测的 prompt caching 机制。了解定价、可用性及对中文用户的影响。

编译发布 2026/06/26 原文发布 2026/06/26

一句话看懂

OpenAI 发布 GPT-5.6 系列三款模型(Sol、Terra、Luna),Terra 性能持平 GPT-5.5 但价格减半,并引入更可预测的 prompt caching 机制。

详细发生了什么

OpenAI 于 2026 年 6 月 26 日宣布开始限量预览 GPT-5.6 系列模型,包括旗舰模型 Sol、日常平衡模型 Terra 和快速低成本模型 Luna。Terra 在性能上与 GPT-5.5 相当,但价格便宜 2 倍;Luna 则以最低成本提供强大能力。

定价方面,按每百万 token 计费:Sol 输入 $5 / 输出 $30;Terra 输入 $2.50 / 输出 $15;Luna 输入 $1 / 输出 $6。

GPT-5.6 还引入了更可预测的 prompt caching,支持显式缓存断点(explicit cache breakpoints)和 30 分钟最低缓存寿命。缓存写入按模型未缓存输入价格的 1.25 倍计费,缓存读取仍享受 90% 的缓存输入折扣。

OpenAI 表示,作为与美国政府持续合作的一部分,他们提前预览了计划和模型能力。应政府要求,此次先从一小批可信合作伙伴开始限量预览,随后几周内将广泛开放。

中文圈视角

对中文用户来说,GPT-5.6 系列的直接使用仍需要梯子访问 OpenAI API 或 ChatGPT Plus。不过,价格下降趋势值得关注:Terra 的价格仅为 GPT-5.5 的一半,Luna 更是低至 $1/百万输入 token,这可能会进一步压低国内 API 调用成本。

国内模型如 DeepSeek-V2、Kimi、智谱 GLM-4 等已在价格上极具竞争力(部分免费或远低于 $1/百万 token),但 OpenAI 的性能优势依然存在。对于需要高质量输出的中文写作、编程、翻译场景,Terra 或 Sol 可能仍是首选。

此外,prompt caching 机制对高频调用场景(如客服、内容生成)能显著降低成本,国内用户若使用 OpenAI API,可关注如何利用缓存断点优化 prompt 结构。

监管方面,OpenAI 与美国政府的合作模式值得注意——国内大模型厂商与监管机构的类似沟通可能也会影响产品发布节奏。

几条值得记住的细节

  • GPT-5.6 系列包括三款模型:Sol(旗舰)、Terra(平衡)、Luna(快速低价)。
  • Terra 性能与 GPT-5.5 相当,但价格便宜 2 倍。
  • 定价:Sol $5/$30,Terra $2.50/$15,Luna $1/$6(每百万 token 输入/输出)。
  • 新 prompt caching 支持显式缓存断点和 30 分钟最低缓存寿命。
  • 缓存写入按 1.25x 未缓存输入价计费,缓存读取享 90% 折扣。
  • 限量预览先对可信合作伙伴开放,几周内广泛可用。

一句话总结

GPT-5.6 系列以更低价格和更智能的缓存机制降低了 AI 调用成本,中文用户可关注 Terra 的性价比和缓存优化技巧。