ITCOW牛新网 7月25日消息,Anthropic 今日正式推出 Claude Opus 系列最新旗舰 Opus 5,在能力大幅跃升的同时延续了上代 Opus 4.8 的定价体系——输入每百万 token 5 美元、输出 25 美元,成为 Claude Max 默认模型与 Claude Pro 用户能调用的最高规格通用模型。官方给它的定位很巧妙:部分能力逼近更高阶的 Claude Fable 5,但价格只有后者大约一半,把“旗舰体验、中高阶级账单”做成主卖点。

据ITCOW牛新网了解,Opus 5 在 Frontier-Bench v0.1 上把 Opus 4.8 的任务性能翻了一倍以上且单任务成本更低;CursorBench 3.2 最高努力模式下仅比 Fable 5 峰值低 0.5%,但单项开销砍半,单位成本性能在各努力档位均居前列。知识工作与科学端同样凶猛:ARC-AGI-3 得分约是第二名的三倍,Zapier AutomationBench 通过率约为同成本区间模型的 1.5 倍,OSWorld 2.0 亦交出高位成绩;科研向的结构生物学、有机化学、生物信息学任务中,依光谱推分子结构比 4.8 高 10.2 个百分点,预测蛋白序列变化对功能影响高 7.7 个百分点。

实操层面它学会“验证自己”——面对只能拿到机器零件图纸像素、无法直接读矢量的场景,Opus 5 自写 CV 流程从原始图像抽几何并重建 FreeCAD 三维模型;还在某开源包管理器里挖出真实漏洞、补完了社区补丁漏掉的部分,有交易公司工程师借它在单次会话搭起新交易所数据接口并自带解析校验工具。

安全护栏是这代最有意思的让步:Anthropic 称 Opus 5 的安全分类器触发次数预计比 Fable 5 少约 85%,不再经过专门网络攻击训练,但二进制漏洞扫描、渗透测试与利用代码生成仍被拦下。


生物领域沿用 4.8 机制,是目前向公众开放的最强科研模型,只是长程自主科研的“自动驾驶”模式仍受控。伴随主模型还放出 Opus 5 Fast(速度约 2.5 倍、价格双倍)、Claude 平台对话中途切工具、API 自动回退(被安全层拦截时无缝转交其他模型而非直接报错)等配套能力,面向普通用户依旧不设数据保留强制要求。随着 Opus 5 以“半价逼近 Fable 5”的姿态入局,高端闭源模型的性价比中线正被重新拉低。