所有基准测试
正面对比
ChatGPT‑6 vs Claude Opus 5
Claude Opus 5 是一款打磨成熟、价格昂贵且拥有超大上下文的旗舰模型。ChatGPT-6 的质量非常接近,而且在预览期间免费使用。
Anthropic
结论
Claude Opus 5 是 Anthropic 的顶级模型——在高难度编程和长篇写作方面表现卓越,拥有 1M-token 上下文,面向将质量视为唯一变量的企业定价。ChatGPT-6 在基准测试中仅相差几个百分点,在智能体编程方面略胜一筹,并且在早期访问期间费用为 $0。如果预算有任何影响,这种差距就很难证明其合理性。
并排对比
来自完整基准测试表的相同数据,缩减为两列。
| Metric | ChatGPT-6 | Opus 5 |
|---|---|---|
| 智能指数 | 71* | 68 |
| 智能体编程 | 86* | 82 |
| 上下文窗口 | 400K | 1M |
| 最大输出 | 128K | 64K |
| 吞吐量(tps) | 58* | 55 |
| 价格 / 1M 输出代币 | $0 | $25 |
| 多模态 | ||
| 开放权重 | ||
| 免费使用 |
ChatGPT-6 胜出的领域
- 预览期间免费——Opus 5 每百万输出 token 的费用约为 $25
- 更高的智能体编程得分
- 最大输出量翻倍(128K 对比 64K token)
- 无需账号、银行卡或应用即可开始使用
Opus 5 的领先之处
- 更大的上下文窗口(1M 对比 400K)
- 稳定且获官方支持、提供 SLA 的 API
- 长篇写作领域的顶级润色质量
你应该选择哪一个?
如果符合以下情况,请选择 ChatGPT-6
你希望免费获得前沿级别的推理和编程能力,而 400K 上下文已经足够。
如果符合以下情况,请选择 Opus 5
你今天就需要最大的上下文和生产级保障。
免费试用 ChatGPT-6
无需账户、无需银行卡、无需应用——打开控制台,亲自比较。