DefiRWA

 找回密码
 立即注册
搜索
热搜: 活动 交友 discuz
查看: 3|回复: 0

Anthropic Fable 5.1登顶+缓存降价75%:腾讯混元Hy4 770B以1M上下文迎战

[复制链接]

1197

主题

1208

帖子

4029

积分

版主

Rank: 7Rank: 7Rank: 7

积分
4029
发表于 2 小时前 | 显示全部楼层 |阅读模式
2026年9月5日,Anthropic正式发布Claude Fable 5.1与Mythos 5.1双旗舰,并以66分登顶Artificial Analysis智能指数。同日缓存输入Token价格下调75%至每百万0.25美元,降幅超出多数分析师预期。同日腾讯混元Hy4 preview开源:770B总参数、49B激活、上下文1M token,163名内部专家盲测均分优于GLM-3与Kimi K3。前沿闭源+国产开源两线同时打出“极致性价比”。


Fable 5.1的关键变化

Fable 5.1的核心更新集中在三点。第一,长上下文理解稳定性提升,多轮对话和超长文档分析场景下的遗忘与漂移明显收敛。第二,工具调用和复杂任务推理能力增强,适合企业级Agent和代码助手场景。第三,缓存价格大幅下调:缓存输入Token从约1美元/百万降至0.25美元/百万,降幅75%。对于长会话、知识库、企业Agent等高频调用场景,这是直接的成本红利。


国产开源阵营正面回应

腾讯混元Hy4 preview用770B参数、49B激活、1M上下文做出回应。1M上下文意味着模型可以一次性读完整本书、整套代码库或一整年的财报序列,而不必反复切片检索。163名腾讯内部专家盲测中,Hy4在软件工程、办公分析、科研三类任务上均分优于GLM-3与Kimi K3。模型已登陆HuggingFace与腾讯云TokenHub,并配套CodeBuddy限免活动至9月10日。


闭源与开源的分工正在重写

闭源阵营的逻辑是用最强模型+最低缓存价格绑定企业级Agent;开源阵营的逻辑是把超长上下文+大参数开放给开发者自行部署。两条路线并不冲突,反而形成了清晰分工:对成本敏感、数据敏感、自主可控需求强的场景,国产开源更合适;对智能指数、单任务能力、稳定性要求极高的场景,闭源旗舰仍是首选。


企业选型的三步判断法

第一步,看任务是否真的需要1M或更大的上下文。过长的窗口会带来额外延迟和推理成本,未必比高质量的检索增强生成更划算。第二步,看调用频率。如果平均会话长度超过10轮,或者平均每轮有大量重复上下文,缓存价格下调75%的实际收益会非常明显。第三步,看数据合规。涉及核心代码、客户隐私、财务数据的场景,优先考虑可私有化部署的开源方案。


结语

Fable 5.1+缓存降价、Hy4 770B开源两件事放在一起,意味着前沿模型竞赛已经从“谁能跑分更高”转向“谁能把单位任务成本压得更低”。企业真正该关注的,是谁能用更低的成本完成可计费、可审计、可规模化的任务闭环。
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

QQ|货物清仓|Archiver|手机版|小黑屋|倒数|舒尔特|好邻卡|RWA+DeFi|融资计划|内购渠道|Github|duckwolf.cn - Tom Wu 的 AI 商业化与社区媒体智能投放站

GMT+8, 2026-9-6 10:04 , Processed in 0.062405 second(s), 20 queries .

Powered by Discuz! X3.4

Copyright © 2001-2023, Tencent Cloud.