在 Agents' Last Exam 中,GPT‑5.6 Sol 创下 53.6 的新高,领先 Claude Fable 5(自适应)13.1 分。
在中等推理水平下,它以约为四分之一估计成本的优势领先 Fable 5 达 11.4 分。GPT‑5.6 Terra 和 Luna 也以约为十六分之一的成本优于 Fable 5。

了解 GPT-5.6 Sol 如何以更低成本实现更高性能,以及 Terra 和 Luna 的性价比表现。

了解不同推理水平下的性能与成本对比,为模型选择提供参考。
深入阅读
在 Agents' Last Exam 中,GPT‑5.6 Sol 创下 53.6 的新高,领先 Claude Fable 5(自适应)13.1 分。
在中等推理水平下,它以约为四分之一估计成本的优势领先 Fable 5 达 11.4 分。GPT‑5.6 Terra 和 Luna 也以约为十六分之一的成本优于 Fable 5。
