前出塞知识网
首页 / 作文知识 / Claude Opus 5发布!性能接近Fable5
文章封面

Claude Opus 5发布!性能接近Fable5

刘耀文的大沙雕
发布时间:2026-07-25 18:56:44 阅读:12589
论文 降低AIGC 知网
作者:Claude Opus 5发布!性能接近Fable5

Claude Opus 5 来了!智能水平接近Fable 5,但价格仅只有Fable 5的一半! 已经在Claude.ai、Claude API、Claude Code等全平台上线了 目前是Claude Max的默认模型,也是Claude Pro中的最强选项 定价与前代Opus 4.8完全一致:输入5美元/百万token,输出25美元/百万token。 Fast模式可实现约2.5倍速度,定价翻倍为输入10美元/输出50美元/百万token。 模型支持100万token上下文窗口,最大输出约12.8万token,知识截止时间为2026年5月,好新! 在基准测试上,Opus 5整体接近Fable 5水平,但成本效益更高: CursorBench 3.2在最大努力模式下,Opus 5得分与Fable 5峰值相差不到0.5%,但任务成本仅为后者一半。 OSWorld 2.0中,Opus 5在任意成本下均超越所有模型,并以约三分之一的成本超过Fable 5的最佳成绩。 FrontierCode 1.1和Frontier-Bench上,Opus 5接近Fable 5水平,成本仅为一半。 SWE-bench Pro中,Opus 5得分79.2%,Fable 5为80%,两者几乎持平。 SWE-bench Multilingual中,Opus 5以89.5%领先Fable 5的86.6%。 SWE-bench Multimodal中,Opus 5得分59.4%,高于Fable 5的54.1%。 DeepSWE v1.1中,Opus 5为68.8%,Fable 5为69.7%,差距极小。 AutomationBench最大努力下,Opus 5达到26.0%,显著高于Fable 5的17.4%。 Humanity’s Last Exam(带工具)中,Opus 5得分64.7%,略高于Fable 5的63.9% 系统卡片显示,Opus 5是迄今为止最对齐的Claude模型。对Claude宪法的遵守率最高 技术细节上,模型支持effort参数灵活调节推理深度与成本。默认在较高努力级别下运行 它新增了对话中途更换工具而不失效prompt cache的beta功能。并支持自动安全回退 视觉输出能力也明显增强,能够生成更精确的交互式界面 #opus5