头版Folia Daily Briefing
← 返回头版
人工智能

Claude Opus 5发布,性能大幅提升价格保持不变

Anthropic推出了Claude Opus 5大模型。新模型相比前代Opus 4.8实现了显著的性能提升,同时维持原有价格——输入令牌$5/百万,输出令牌$25/百万。

Anthropic推出了Claude Opus 5大模型[1]。新模型相比前代Opus 4.8实现了显著的性能提升,同时维持原有价格——输入令牌$5/百万,输出令牌$25/百万[1]。

Claude Opus 5在多个权威评估基准上实现了业界领先成绩[1]。在Frontier-Bench v0.1评估中,其性能相比Opus 4.8提升一倍以上[1]。在ARC-AGI 3评估上,该模型的得分达到次优模型的三倍[1]。在计算机使用能力方面,Claude Opus 5在OSWorld 2.0基准上以仅Fable 5成本三分之一的价格超越了后者的最佳成绩[1]。在Zapier AutomationBench上的通过率约为次优模型的1.5倍[1]。

在代码编程和科学研究领域表现尤为突出[1]。软件工程任务中的性能翻倍提升[1],有机化学任务上较Opus 4.8提高10.2个百分点,蛋白质相关任务上提高7.7个百分点[1]。在CursorBench 3.2最大努力设置下,该模型性能接近Fable 5峰值成绩,但成本仅为一半[1]。

新模型已上线所有平台,成为Claude Max的默认模型和Claude Pro的最强选择[1]。用户可选择Fast模式,其运行速度约为默认速度的2.5倍,但价格为基础价格的两倍[1]。此外,Claude Opus 5在自动行为审计中被评为目前最对齐的模型,欺骗行为率最低[1]。

在某些专业领域,该模型仍存在差距[1]。生物学研究和网络安全方面的性能仍落后于Mythos 5[1]。


Claude Opus 5Anthropic大模型AI产品发布性能评测

来源

  1. Hacker News · Claude Opus 5