Anthropic半年连推五代模型:Opus 5比自家旗舰更便宜、限制更少还更好用

Anthropic又出手了。上周五,它悄悄上线了Opus 5——旗下那条主力重量级模型线的最新一代。有意思的是,Opus 5比自家旗舰Fable 5个头更小,但价格更便宜、限制也更少,多数场景下反而更好用。

Opus 5在官方给出的多项基准测试里,成绩甚至反超了体量更大的旗舰Fable 5。

Anthropic Opus 5 发布
Anthropic 上线 Opus 5 模型(图片来源:TechCrunch)

半年连推五代,节奏快得有点吓人

这个更新速度值得说一句。Opus 5距离5月28日发布的Opus 4.8才过了两个月。再往前看,Mythos 5、Fable 5、Sonnet 5全挤在6月上线。算下来,整个5系列里现在只剩最轻量的Haiku还没跟上,其余全部完成了换代。对开发者来说,这意味着几乎每隔几周就得重新掂量一遍:手头的活儿到底该调用哪个模型最划算。

更会”自己检查作业”

Anthropic在发布博客里反复强调,Opus 5″更擅长核验自己的工作成果,会耐心地反复迭代直到把任务做成”。他们举了个例子:给它一段并不完整的提示,让它写一条计算机视觉处理流水线,Opus 5能自己把缺的部分补齐、跑通。这种”不满足于交个半成品、会自己回头查漏补缺”的特质,恰恰是过去大模型最让人头疼的短板。

松绑:隐私党最在意的那条限制没了

Opus 5另一个卖点是”限制更少”。它摆脱了一直缠着Fable的不少束缚,其中最关键的一点:它和前代一样,不受那条针对Fable、Mythos的30天数据留存政策约束。这条政策此前让不少注重隐私的用户心里犯嘀咕,如今Opus这边算是给了个交代。

当然,安全护栏没有完全撤掉,尤其是网络安全相关的敏感操作。比如,Opus 5会拦住你去扫描一个软件二进制文件里的漏洞,但允许你在源代码里找漏洞——因为后者更可能是出于防御目的。Anthropic预计,这套安全分类器在Opus 5上被触发的频率,会比Fable 5低大约85%,算是给能力稍弱的模型松了松绑。


被护栏挡住时,不再直接报错

针对护栏偶尔”误伤”正常请求这件事,Anthropic还顺手上了个新功能。用户可以选择开启一个叫”Automatic Fallbacks(自动回退)”的测试版特性:当某个提示触发了安全分类器,系统会自动把请求转给一个能力较弱、但不受限的模型来处理。这样一来,开启该设置的API用户拿到的就是一条能用的回复,而不是冷冰冰的报错信息。

  • Opus 5比旗舰Fable 5更小,却更便宜、限制更少,多数场景更实用
  • 距上一代Opus 4.8仅两个月,5系列只剩Haiku未更新
  • 更擅长自我核验与迭代,能从残缺提示补全计算机视觉流水线
  • 不受30天数据留存政策约束,安全分类器触发率比Fable 5低约85%
  • 新增Automatic Fallbacks测试功能,触发护栏时自动改用弱模型回应
📎 原文来源:Anthropic launches Opus 5 (TechCrunch, Russell Brandom)

评论

2 条对“Anthropic半年连推五代模型:Opus 5比自家旗舰更便宜、限制更少还更好用”的回复

  1. MWTAH51627 的头像
    MWTAH51627

    两个月就从4.8跳到5,这更新频率对开发者其实挺折腾的,每次都得重新测一遍成本和效果。不过30天数据留存那条限制取消是真香,之前公司法务就卡在这一点上一直不让上Fable。

  2. PRFKY42165 的头像
    PRFKY42165

    最实用的其实是那个Automatic Fallbacks,护栏误伤直接返回报错这事太劝退了,尤其做安全研究的。改成自动降级给个能用的回复,起码工作流不至于断掉。就是不知道弱模型顶上来质量掉多少。

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注