GPT-5.6 正式发布:Sol、Terra、Luna 三档模型亮相,旗舰版性能飙升但价格不变

89次阅读
没有评论

共计 1276 个字符,预计需要花费 4 分钟才能阅读完成。

信息整理

GPT-5.6 来了: 旗舰版碾压 GPT-5.5, 价格却没涨

OpenAI 把 GPT-5.6 做成了像苹果芯片一样的产品矩阵。

OpenAI 于近日正式发布了 GPT-5.6 系列模型, 一改以往的命名方式, 推出了 Sol、Terra、Luna 三款产品, 分别对应旗舰级、均衡型和轻量级。这一系列在性能上大幅超越前代 GPT-5.5, 但价格并未上涨, 甚至更低。值得注意的是, 由于美国政府要求, 新模型目前仅面向少数合作伙伴进行有限预览。

📌 三档模型: 从太阳到月亮的全场景覆盖

GPT-5.6 系列以天体命名:Sol(太阳)为旗舰 ,Terra(地球) 为日常均衡型,Luna(月亮)为轻量快速型。API 定价方面,Sol 输入 5 美元 / 百万 token, 输出 30 美元;Terra 输入 2.5 美元, 输出 15 美元;Luna 输入 1 美元, 输出 6 美元。与 GPT-5.5 相比,Sol 价格与标准版持平,Terra 降至一半,Luna 仅为五分之一, 性价比显著提升。

从已披露信息看, 这一变化更值得关注的, 不只是表面动作本身, 还包括其对后续行业节奏、用户预期和市场竞争的连锁影响。

🔍 性能亮点: 代码、生物与网络安全三大突破

OpenAI 重点展示了 GPT-5.6 Sol 在三个领域的表现:

  • 代码能力:在 Terminal-Bench 2.1 测试中,Sol 得分 88.8%,Ultra 模式下更高, 能自主完成从理解问题到调试验证的完整开发流程。
  • 生物学研究:在 GeneBench v1 上,Sol 用更少 token 取得比 GPT-5.5 更强的结果。
  • 网络安全:在 ExploitBench 上,Sol 的表现可与 Mythos Preview 媲美, 但输出 token 仅为其三分之一。

此外,Sol 引入了“最大推理强度”和“Ultra 模式”两种新机制, 允许模型进行更长时间的深度推理, 并通过多个子智能体协同处理复杂任务。

💡 政府介入: 有限预览背后的安全考量

GPT-5.6 系列目前仅通过 Codex 和 API 向少数“值得信赖的合作伙伴”开放, 且预览名单已与美国政府共享。这一做法源于美国政府近期对前沿 AI 模型安全性的关注, 尤其是涉及代码、网络安全的模型。OpenAI 强调,Sol 尚未达到其“Cyber Critical”门槛, 但为了探索可重复的发布流程, 选择了与政府合作。不过,OpenAI 也指出, 这种政府访问流程不应成为长期机制, 以免延缓最佳工具的普及。

📊 行业观察:AI 模型发布进入新阶段

GPT-5.6 的发布模式标志着前沿 AI 模型正进入一个政府介入的新阶段。当模型能力触及代码、生物、网络安全等关键领域时, 其发布权不再完全由公司掌控。这既是对技术风险的审慎应对, 也可能影响未来 AI 产品的迭代速度。对于用户而言,Sol 的旗舰性能、Terra 的均衡性价比以及 Luna 的低成本优势, 提供了更灵活的选择。

🚀 总结

GPT-5.6 系列以清晰的层级和显著提升的性能, 巩固了 OpenAI 在 AI 领域的领先地位。尽管受限于政府预览要求, 但三档模型的价格策略和性能突破, 仍为开发者和企业带来了新的可能性。未来, 随着模型全面开放, 其实际表现值得持续关注。

本文基于公开信息整理, 如有侵权请联系删除。
正文完
 0