一句话判断
本文提供了 Opus 5 与 Fable 5 的具体成本对比和基准成绩,显示 Anthropic 在性价比上超越 Fable 5,值得点击原文查看完整基准数据。
核心信息
Anthropic 发布 Claude Opus 5,在多个基准测试中接近或超越 Fable 5,但成本仅为一半:CursorBench 差 0.5% 成本减半,OSWorld 超越且成本低三分之二,ARC-AGI 3 得分是次优模型的 3 倍,Frontier-Bench 性能是 Opus 4.8 的两倍多。定价与 Opus 4.8 相同,为 $5/百万输入 token、$25/百万输出 token,现为 Claude Max 默认模型。
原始内容
相关动态
OPUS 5超越Fable 5
Chubby♨️发布OPUS 5模型对比,声称在大多数评估中超越Fable 5。核心数据为评估结果比较,但未具体披露参数量、版本号或具体分数
Claude Opus 5登顶ARC-AGI-3
ARC Prize 公布 Anthropic 的 Claude Opus 5 在 ARC-AGI-3 基准上达到 30.2% 的新 SOTA,远超前最高分 7.8%(由 GPT-5.6 Sol (Max) 创造),并展现出解决之前未击败环境的新颖行为。
Opus 5 发布:价格减半性能领先
Anthropic 发布 Claude Opus 5,定价 $5/$25 每百万 token(与 Opus 4.8 相同),仅为 Fable 5 的一半,但在绝大多数基准测试中击败了 Fable 5。它支持五种努力设置,默认启用推理,并在编码、操作计算机等经济价值高的任务上表现更强,具有自主验证和恢复能力。
Cursor宣布Claude Opus 5上线
Cursor平台上线Claude Opus 5模型,在CursorBench基准测试中得分66.7,与Fable 5的66.5分持平,但价格仅为后者一半(输入5美元、输出25美元每百万token),且支持零数据保留,而Fable 5仍保留数据30天。
Claude 发布 Opus 5 模型
Claude 官方发布 Opus 5 模型,称其 thoughtful and proactive,接近 Fable 5 的前沿智能,价格仅为后者一半。