DefiRWA

 找回密码
 立即注册
搜索
热搜: 活动 交友 discuz
查看: 8|回复: 0

GPT-5.6系列7月9日全球放开:Sol/Terra/Luna分层定价,150万上下文+90%缓存折扣

[复制链接]

895

主题

906

帖子

3035

积分

版主

Rank: 7Rank: 7Rank: 7

积分
3035
发表于 2026-7-9 06:59:26 | 显示全部楼层 |阅读模式
2026年7月9日,OpenAI正式解除GPT-5.6系列的访问限制。这个被安全审查卡了数月的三档模型家族,即日起向全球开发者和企业全面开放。


一、三档模型定位:从科研旗舰到高频客服

OpenAI用天体命名把GPT-5.6拆成三条产品线,覆盖了从尖端推理到低成本批处理的全场景:
GPT-5.6 Sol(旗舰款):面向复杂科研、代码推理和多智能体协同,上下文窗口高达150万token,支持Ultra多智能体模式。输入5美元/百万token,输出30美元/百万token。
GPT-5.6 Terra(均衡款):性能对标上代GPT-5.5,定位企业日常办公和内容创作,定价约为Sol的一半。
GPT-5.6 Luna(轻量款):低延迟、高吞吐,适合批量数据处理和客服问答,输入仅1美元/百万token。

全系新增提示词缓存功能,命中缓存的调用可享受90%折扣。7月还将推出Cerebras专属加速版本,推理速度最高可达750 token/s


二、监管门槛解除:美国商务部批复是关键

此前GPT-5.6因安全审查仅对少量备案企业开放。本次全量上线的前提是拿到了美国商务部的完整安全评估批复。OpenAI官方在7月8日通过推特宣布了这一消息,并采用分阶段策略:预约企业先开放API与Codex,普通Chat网页用户分批解锁。

这一步的政治信号不亚于技术信号。在Anthropic Claude Fable 5/Mythos 5出口管制被解除后,OpenAI也拿到了全球通行证,美国AI大模型的出口政策正在出现实质性松动。


三、性能对比:Sol在编程基准上领先Claude Mythos 5

在Terminal-Bench 2.1编程基准上,GPT-5.6 Sol标准模式得分88.8%,超过Claude Mythos 5的88.0%;开启Ultra模式后达到91.9%,刷新了公开纪录。SVG/3D生成能力也击败了Anthropic的Fable 5。

更关键的是上下文能力。150万token意味着Sol可以一次性吞下一整本技术手册、一套大型代码库或数小时的会议转录,再进行跨文档推理。这对法律、金融、科研等长文本场景是质变。


四、对企业的三点建议

第一,按场景选模型,不要一刀切。 客服和批量处理交给Luna,日常办公交给Terra,只有真正需要深度推理的任务才上Sol。缓存机制下,重复调用的成本可能比你预想的低得多。

第二,准备好提示词工程升级。 150万上下文不是让你塞更多垃圾,而是让你能把完整背景一次性交给模型。企业需要重新设计RAG架构,减少信息截断带来的幻觉。

第三,关注Cerebras加速版本。 如果业务对延迟敏感,7月上线的专属加速版本可能让实时AI应用真正可用。


五、行业影响:从模型竞赛进入生态战争

GPT-5.6全量上线的同时,微软正在把Office指令迁移到自研MAI模型,SpaceX花600亿美元收购Cursor控制编程入口。头部玩家已经从单纯比模型分数,转向比全栈生态控制力。

对中小企业来说,好消息是选择变多了:要顶尖性能可以等GPT-5.6 Sol,要性价比可以选DeepSeek V4或国产模型,要编程有Claude Code和Cursor。坏消息是,评估成本越来越高,选错模型的代价也在变大。




数据来源:OpenAI官方推特公告(2026.07.08)、AITOP100每日AI资讯(2026.07.08)、新浪财经(2026.06.27)、无矩AI月度盘点(2026.07.01)
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

QQ|货物清仓|Archiver|手机版|小黑屋|倒数|舒尔特|好邻卡|RWA+DeFi|融资计划|内购渠道|Github|Web4

GMT+8, 2026-7-22 09:28 , Processed in 0.064754 second(s), 20 queries .

Powered by Discuz! X3.4

Copyright © 2001-2023, Tencent Cloud.