🤖
🤖
核心导读
Anthropic于上周五发布旗舰模型Opus 5,相比Fable 5更小、更便宜且限制更少,在多项基准测试中表现更优。该模型不受30天数据保留政策约束,安全防护措施触发频率降低85%。同时推出“自动回退”功能,在触发安全分类器时自动转至较弱模型,确保API用户获得有效响应。
上周五,Anthropic发布了其长期旗舰模型的最新版本Opus 5。虽然比Fable 5更小,但该模型比Fable更便宜且限制更少,很可能在大多数使用场景中更受青睐。
值得注意的是,在公告中提及的多项基准测试中,Opus 5实际上优于Fable 5。
Opus 5距离5月28日上线的Opus 4.8仅隔两个月。Mythos 5、Fable 5和Sonnet 5均在6月发布,目前仅有轻量级模型Haiku尚未升级至5系列。
在宣布新模型的博文中,Anthropic强调Opus 5在“验证自身工作并仔细迭代直至成功”方面显著增强,并引用了一系列基准测试为例,比如Opus 5根据不完整的提示词自行编写了计算机视觉管线。
关键的是,Opus 5还摆脱了Fable自发布以来所面临的诸多限制。与其前代产品一样,Opus 5不受适用于Fable和Mythos的30天数据保留政策的约束,该政策曾引发部分注重隐私用户的担忧。
Opus仍保留有重要的安全防护措施,尤其是在漏洞利用生成和渗透测试等网络安全任务方面。例如,Opus 5的安全防护禁止其用于扫描软件二进制文件中的漏洞,但允许搜索源代码中的漏洞,因为后者更可能用于防御目的。
总体而言,Anthropic预计这些分类器在Opus 5上的触发频率将比在Fable 5上低85%,这反映了对能力较弱的模型采用了更轻的监管力度。
Anthropic还推出了一项新工具,旨在减少安全措施在触发时的干扰。用户现在可以选择加入名为“自动回退”的测试功能,当提示词触发安全分类器时,该功能会自动将请求路由到能力较弱的模型。这样一来,启用该设置的API用户将获得功能性响应,而非错误消息。
分享这篇文章: