一个小站的自留地
据市场消息,Anthropic 有望于下周发布 Claude Opus 5,作为性能介于 Claude Opus 4.8 与 Claude Fable 5 之间的新模型。 与此同时,有消息表示 Anthropic 内部正讨论是否继续延长 Fable 模型存在于付费订阅计划中的时间,但不排除继续缩减其配额。 与此同时,Codex 负责人 Tibo 宣布,移除所有 Codex 付费计划的 5h 限制的措施暂时会继续实行,并将在活跃用户达到七百万时再次重置用量。
Anthropic 发布 Claude Opus 5

Anthropic 近日正式发布新一代旗舰模型 Claude Opus 5,定位为「接近 Claude Fable 5 前沿智能水平,但价格仅为其一半」的日常可用模型。Opus 5 现已成为 Claude Max 的默认模型,同时是 Claude Pro 订阅中可使用的最强模型。

性能方面,Opus 5 在编码与知识工作评估中达到新的业界最佳水平,仅在网络安全任务上落后于 Mythos 5。软件工程场景下,Opus 5 在 Frontier-Bench v0.1 上超越所有其他模型,性能是前代 Opus 4.8 的两倍以上,且单任务成本更低;在 CursorBench 3.2 最大努力档位,性能与 Fable 5 峰值差距仅 0.5%,但单任务成本减半,在高、超高、最大努力档位下均实现同成本下的性能领先。

对齐与安全方面,Opus 5 是 Anthropic 迄今对齐程度最高的模型,在网络安全领域虽漏洞发现能力接近 Mythos 5,但漏洞利用开发能力显著落后;生物学研究方面,成为目前能力最强的通用发布模型,Fable 5 中被阻止的生物相关请求将路由至 Opus 5。

Opus 5 的安全保障机制与前代类似,但对部分网络安全任务的防护更有针对性:网络安全分类器允许查找源代码漏洞,但阻止二进制漏洞扫描、渗透测试和利用代码生成,干预频率比 Fable 5 低约 85%,被标记的请求默认回退至 Opus 4.8;加入 Cyber Verification Program 的企业和研究人员可使用限制更少的版本。

价格与可用性方面,Opus 5 现已在全平台上线,定价与 Opus 4.8 相同:输入 5 美元每百万词元,输出 25 美元每百万词元。同时提供 Fast 模式,运行速度约为默认模式的 2.5 倍,价格为基础版的两倍,可通过 Claude 平台或 Claude Code 额度使用。伴随发布,Anthropic 还推出两项 beta 功能:对话中途修改工具定义不致使提示缓存失效,以及 API 自动回退机制,被安全分类器标记的请求将自动路由至其他模型而非直接拒绝。

Anthropic
 
 
Back to Top