DefiRWA

 找回密码
 立即注册
搜索
热搜: 活动 交友 discuz
查看: 20|回复: 0

Claude Opus 5性能追平Fable 5价格砍半:AI模型进入"每美元智能"竞赛

[复制链接]

1190

主题

1201

帖子

4006

积分

版主

Rank: 7Rank: 7Rank: 7

积分
4006
发表于 2026-7-25 09:14:54 | 显示全部楼层 |阅读模式
2026年7月24日,Anthropic正式发布Claude Opus 5。它的定价与上一代Opus 4.8相同,每百万输入token 5美元、输出25美元,仅为旗舰Fable 5的一半。但官方对比表显示,Opus 5在多个核心基准上已经接近甚至追平Fable 5。这是Anthropic首次用同一代的两款模型,把"智能"和"安全"拆成两条独立的产品线分别定价。


一、跑分差距小到AI自己都"翻车"

Anthropic在发布博客里给出的对比表出现了一个被开发者社区截图疯传的细节:Frontier-Bench v0.1一行,Opus 5的53.4%被加粗高亮为"最优",而紧挨着的Fable 5那格是53.5%。官方图本身是AI生成的,于是全球网友第一件事就是帮模型核对答案。玩笑归玩笑,把这张图反过来读,刚好是这次发布的真正卖点:Opus 5和Fable 5的差距已经小到分不出谁赢。

具体的数字更说明问题。Frontier-Bench v0.1上Opus 5得分43.3%,是Opus 4.8的21.1%的两倍多,比Fable 5的33.7%高出近10个百分点;ARC-AGI-3(衡量解新题能力)上Opus 5得30.2%,是第二名(GPT-5.6 Sol的7.8%)的近4倍。CursorBench Max档单独比较,Fable 5得70.5%,Opus 5得70.0%,相差仅0.5个百分点,但单任务成本Opus 5只要8.23美元,Fable 5是17.32美元,价格差9美元,token用量还少40%。


二、自动回退让"安全"变成可编排资源

Opus 5最大的产品变化在安全侧。Anthropic明确把这款模型定位为"不推进高风险两用能力前沿"的产品:生物研究、攻击性网络任务等敏感场景,Opus 5被刻意训练得落后于只向少数机构开放的Mythos 5。这一策略体现在内部测试OSS-Fuzz上:让模型找漏洞,Opus 5的成绩已接近Mythos 5;但让模型把漏洞写成可利用的攻击代码,它又被甩开一大截。Opus 5看得见漏洞,却被刻意教得不会把漏洞变成武器。

对应的副作用是,官方预计Opus 5安全分类器的拦截频率会比Fable 5低85%左右——这对每天跑代码的人意味着被误伤的概率大幅下降。更关键的是API侧同步推出"自动回退"测试版:被分类器拦截的请求,不再收到一句冷冰冰的"我帮不了你",而是自动路由到Opus 4.8继续干活。Fable 5上被拦截的生物类请求也改道到Opus 5。安全从一句话升级为可编排资源,"我拒绝了"变成了"我换个能帮你的"。


三、Claude Max/Pro默认模型切换的商业信号

Opus 5发布后立即成为Claude Max订阅的默认模型,也是Pro用户能摸到的最强模型。Anthropic同时推出"努力程度"设置:低/中/高三档,开发者可以根据任务难度调节成本。Fast mode同步上线,速度是默认的2.5倍,价格翻倍,目前处于研究预览阶段。

这套组合拳的本质是把企业级AI的"分层使用"从"按模型分层"改成"按努力程度分层"。过去,开发者要在Haiku、Sonnet、Opus、Fable之间手动切换;现在大多数任务可以直接用Opus 5,只在特别复杂的环节临时拉到Fable 5。这意味着Fable 5不再被当作"日常模型",而是真正变成"专家模型"——这是Anthropic产品线第一次主动放弃让旗舰承担通用流量。


四、对竞品定价策略的连锁冲击

Opus 5发布时,中国AI公司正用Kimi K3这样的开源权重模型压价,GPT-5.6则在7月初推送。Anthropic没有降单价,改讲"每美元能干成多少活"——这是面向CFO的叙事。两种解释并不冲突:一种讲给市场听,一种讲给监管和企业客户听。当模型真的被放进工作流,"能被信任的那一个"可能比"最强的那个"更值钱。

对于OpenAI和Google的旗舰模型来说,Opus 5的存在意味着"日常通用任务"这块市场已经不再需要顶级智能,价格-智能比的拐点正式到来。CursorBench 70.5% vs 70.0%的故事会反复出现:模型之间的差距是0.5个百分点,价格差距是1倍。任何企业CIO在2026年下半年重做AI预算时,都会问一句"我为什么要为差0.5%的智能付一倍的钱?"


五、结论

Opus 5的价值不在于它比Fable 5差0.5个百分点,而在于它把这种"几乎一样好"的差距定价为一半。这是Anthropic第一次主动承认:智能可以打折,安全要单独计价。接下来的问题是,OpenAI、Google、Meta会不会被迫在2026年Q3推出"日常版旗舰"来对标Opus 5?答案是几乎一定会,否则它们的中端产品将面临巨大的价值真空。


数据来源

Anthropic官方博客《Introducing Claude Opus 5》(2026.07.24);Digital Applied《Claude Opus 5: Frontier Intelligence at Half the Price》(2026.07.25);极客公园《Claude Opus 5正式发布》(2026.07.25);Cursor官方CursorBench 3.2榜单(2026.07.24)。具体基准数字以官方系统卡为最终依据,第三方对比应独立交叉验证。
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

QQ|货物清仓|Archiver|手机版|小黑屋|倒数|舒尔特|好邻卡|RWA+DeFi|融资计划|内购渠道|Github|Web4

GMT+8, 2026-9-5 11:19 , Processed in 0.058166 second(s), 20 queries .

Powered by Discuz! X3.4

Copyright © 2001-2023, Tencent Cloud.