所有基准测试

正面对比

ChatGPT‑6 vs Claude Opus 5

Claude Opus 5 是一款打磨成熟、价格昂贵且拥有超大上下文的旗舰模型。ChatGPT-6 的质量非常接近,而且在预览期间免费使用。

Anthropic

结论

Claude Opus 5 是 Anthropic 的顶级模型——在高难度编程和长篇写作方面表现卓越,拥有 1M-token 上下文,面向将质量视为唯一变量的企业定价。ChatGPT-6 在基准测试中仅相差几个百分点,在智能体编程方面略胜一筹,并且在早期访问期间费用为 $0。如果预算有任何影响,这种差距就很难证明其合理性。

并排对比

来自完整基准测试表的相同数据,缩减为两列。

Metric
ChatGPT-6
Opus 5
智能指数71*68
智能体编程86*82
上下文窗口400K1M
最大输出128K64K
吞吐量(tps)58*55
价格 / 1M 输出代币$0$25
多模态
开放权重
免费使用
ChatGPT-6 胜出的领域
  • 预览期间免费——Opus 5 每百万输出 token 的费用约为 $25
  • 更高的智能体编程得分
  • 最大输出量翻倍(128K 对比 64K token)
  • 无需账号、银行卡或应用即可开始使用
Opus 5 的领先之处
  • 更大的上下文窗口(1M 对比 400K)
  • 稳定且获官方支持、提供 SLA 的 API
  • 长篇写作领域的顶级润色质量

你应该选择哪一个?

如果符合以下情况,请选择 ChatGPT-6

你希望免费获得前沿级别的推理和编程能力,而 400K 上下文已经足够。

如果符合以下情况,请选择 Opus 5

你今天就需要最大的上下文和生产级保障。

免费试用 ChatGPT-6

无需账户、无需银行卡、无需应用——打开控制台,亲自比较。

打开控制台