OpenAI GPT-5.6 Sol 以卓越效率挑战 Fable 5
OpenAI 通过发布 GPT-5.6 Sol 正式打破了前沿模型的层级结构。这款旗舰模型以极低的价格提供了几乎同等的智能水平。通过优化性能与价格之间的关系,OpenAI 正在为智能体工作流(agentic workflows)和企业级部署设定新标准。
打破基准:编程领域的统治力与智能水平的持平
来自独立评估平台 Artificial Analysis 的最新数据显示,GPT-5.6 Sol (max) 正在紧追 Anthropic 的顶级模型。在智能指数(Intelligence Index)上,Sol 获得了 59 分,仅落后 Claude Fable 5 一分。这使其领先于 Claude Opus 4.8(56 分)和 GPT-5.6 Terra(55 分)等其他重量级模型。
虽然 Fable 5 在整体通用智能方面保持着微弱优势,但 OpenAI 在专业领域取得了明显的胜利。在全新的编程智能体指数(Coding Agent Index)中,GPT-5.6 Sol 在 OpenAI 的 Codex 环境下运行并获得了 80 分,位居榜首,超越了 GPT-5.6 Terra(77 分)和 Claude Fable 5(77 分)。此外,在衡量现实办公任务表现的 AA-Briefcase 基准测试中,Sol 在所有测试模型中获得了最高的 "Presentation Elo"。
新的帕累托前沿:激进的成本削减
GPT-5.6 发布最显著的影响在于其经济效率。Artificial Analysis 指出,Sol “定义了智能与单项任务输出 Token 数量之间的新帕累托前沿(Pareto frontier)”。虽然 Claude Fable 5 的单项任务成本约为 2.75 美元,但 GPT-5.6 Sol 在达到同等水平的情况下,成本仅为 1.04 美元——大约只有三分之一的价格。
OpenAI 还推出了分层生态系统,以满足不同复杂程度的需求:
- GPT-5.6 Sol: 每百万输入 Token 5 美元 / 每百万输出 Token 30 美元。
- GPT-5.6 Terra: 每百万输入 2.50 美元 / 每百万输出 15 美元(比 Sol 便宜 50%)。
- GPT-5.6 Luna: 每百万输入 1 美元 / 每百万输出 6 美元(比 Sol 便宜 80%)。
为了进一步降低重复工作流的延迟和成本,OpenAI 引入了缓存写入费(cache-write fee),并为缓存读取(cache reads)提供了高达 90% 的折扣。此外,CEO Sam Altman 指出,Sol 在 Token 消耗方面效率显著提高,在执行智能体编程任务时,其输出 Token 的使用量比同类模型减少了高达 54%。
日益激烈的全球价格战
此次发布标志着 AI 军备竞赛的战略转移。随着中国开源模型、Meta 的 Muse 1.1 以及 xAI 的 Grok 4.5 对利润率施加下行压力,OpenAI 不再仅仅在原始智能上进行竞争,而是在单位经济效益(unit economics)上展开较量。
通过在性能和价格两方面对 Anthropic 施压,OpenAI 正在迫使整个市场进行演进。虽然这种定价上的“逐底竞争”(race to the bottom)有利于寻求扩展智能体应用的开发者和创始人,但它也创造了一个激烈的竞争格局,这将决定哪些 AI 实验室能够在长期内保持可持续发展。
核心要点
- 性能持平: GPT-5.6 Sol 在智能指数上与 Claude Fable 5 的差距在 1 分以内,并在编程智能体指数中以 80 分占据统治地位。
- 经济颠覆: Sol 以 Fable 5 三分之一的成本(每项任务 1.04 美元 vs 2.75 美元)提供了接近前沿水平的智能。
- 智能体效率: 包括缓存读取 90% 折扣和编程任务输出 Token 减少 54% 在内的新优化,使 Sol 针对自主智能体进行了高度优化。
