DefiRWA

 找回密码
 立即注册
搜索
热搜: 活动 交友 discuz
查看: 19|回复: 0

DeepSeek V4 Pro + Qwen3.8 + Grok 4.6 同日发布:开源围攻闭源的临界点

[复制链接]

1190

主题

1201

帖子

4006

积分

版主

Rank: 7Rank: 7Rank: 7

积分
4006
发表于 2026-8-13 18:42:01 | 显示全部楼层 |阅读模式
8 月 13 日成为 2026 年最具标志性的一天eepSeek、阿里千问、xAI 三家在不到 24 小时内接连发布旗舰模型,这是历史上首次中美头部 AI 实验室在同一日历日完成同步迭代。DeepSeek V4 Pro 0813 是 1.6 万亿参数 MoE,激活 49B,1M 上下文,定价 0.435/0.87 美元每百万 token;阿里 Qwen3.8-2.4T-A95B 总参数 2.4 万亿、激活 95B,BF16 权重 4.9TB,FP8 版本 2.5TB;xAI Grok 4.6 闭源发布,在 Artificial Analysis Intelligence Index 上拿到 61 分,与 GPT-5.6 Sol 持平。三家定价、性能、可获取性的差异,正在重新定义全球开发者与企业客户的模型选型决策。


一、同一日三家发布:巧合还是周期共振

8 月 13 日之前,DeepSeek V4 Pro 在公测期的 AI 编程智能体基准测试 DeepSWE 中得分从 12.8 升至 62.7,正式版直接翻 4.9 倍;阿里千问团队为 Qwen3.8-Max 安排了 16 天连续自主编程、超 2000 轮交互经营虚拟电商企业等极限测试,展示长程 Agent 能力;Grok 4.6 则是 xAI 第一次在 4.5 基础上做增量升级,守住闭源前沿的位置。

这一节奏并非偶然。根据 Hugging Face 2026 年春季报告,中国自研开源模型下载占比已经达到 41%,首次超过美国;OpenRouter 数据显示,国产大模型周调用量连续 15 周居全球首位。三家头部在同一日发布,既是产品迭代的自然节拍,也是对"开源追赶闭源"叙事的集体宣示。


二、DeepSeek V4 Pro:1.6 万亿 MoE 把价格打到七分之一

DeepSeek V4 Pro 是 DeepSeek V4 系列的正式旗舰版本,1.6 万亿总参数、49B 激活,采用与 V4-Flash 相同的 MLA + MoE 架构,上下文窗口拓展到 1M。在输出价格上,V4 Pro 定为 0.87 美元每百万 token,仅为 xAI Grok 4.6 闭源版本(约 6 美元每百万 token)的七分之一。

Hacker News 上有开发者用同样的编码任务在 Codex CLI 上做了实测eepSeek V4 Pro 12 分钟完成、消耗 0.12 美元,但有一个 bug;Grok 4.6 3 分钟完成、消耗 1.41 美元,无 bug。这构成了当下选型的核心张力eepSeek 价格约为 Grok 的十分之一,但 token 效率低、bug 概率略高;Grok 快且稳,但单位成本高 10 倍。对中国开发者而言,V4 Pro 是低成本 Agent 自动化的事实标准;对海外企业而言,Grok 4.6 是性能稳定的高端选择。


三、Qwen3.8-2.4T-A95B:阿里首次把 Max 级模型开放权重

Qwen3.8-2.4T-A95B 是阿里首次把 Max 级旗舰模型开放权重,总参数 2.4 万亿、激活 95B,采用 92 层架构、隐藏维度 8192、词表 248320。在 DeepSWE 编程基准上,Qwen3.8 拿到 56.6 分,与 Kimi K3 和 DeepSeek V4 Pro 处于同一梯队。

发布当日社区最关注的两个细节:第一,BF16 权重 4.9TB、FP8 权重 2.5TB,Unsloth 提供的 1-bit 量化版本可压缩到 397GB,使得爱好者硬件理论上可运行 Opus 4.5 级别性能;第二,Qwen3.8 开源权重不含视觉模态与 1M 上下文,这两项仍保留在 Qwen3.8-Max 托管 API 上。这种"开源权重 + 闭源高端能力"的分层策略,与 Mistral、META 的做法一致,既给开发者可下载的资产,又保留商业化护城河。


四、Grok 4.6 闭源路线与"系统提示注入"争议

Grok 4.6 选择了完全闭源路线,定价显著高于国产开源模型。值得注意的是,Hacker News 用户发现 Grok API 会在每个请求中注入隐藏系统提示,指令模型不讨论自身规则,且该指令覆盖用户自定义系统提示。这意味着 API 用户无法通过提示词调整让 Grok 解释自己的行为边界,引发了开发者对"闭源模型可控性"的讨论。

xAI 同时发布 Grok Bot——一款云端桌面代理,可登录用户应用、并行执行多步任务、学习工作流,直接对标 OpenAI、Anthropic、Microsoft 的企业 Agent 产品。Grok Bot 与 Claude Code、Cursor Ultra、Anthropic Banking Agents 共同构成企业 Agent 的"四大门派",而 xAI 通过把价格战(由 DeepSeek 发起)与产品战(由 GPT-5.6/Grok 4.6 主导)分开,把自身定位为"前沿性能 + 高定价"的代表。


五、行业判断:开源与闭源进入"错位竞争"阶段

第一,价格错位:同档性能下开源模型输出价格已不到闭源的七分之一,长尾应用与 Agent 工作流将快速迁移到开源。第二,能力错位:闭源模型在前沿 benchmark(AAII、OSWorld、TerminalBench)仍保持 5-10% 领先,但开源已具备"足够好"的能力,大量企业级任务不再必须依赖闭源。第三,生态错位:闭源厂商靠工具链与多模态锁定高端客户,开源厂商靠价格与可私有化部署锁定大众市场。

对中国 AI 行业的启示eepSeek、Qwen3.8、Kimi K3、智谱 GLM-5.2 已经形成第一梯队,继续深耕长程 Agent 与垂直行业落地是 2026 年下半年的主线;对全球开发者而言,8 月 13 日是"模型可选项爆发"的临界点——三款全球第一梯队模型同日发布、价差 10 倍、可获取性梯度丰富,模型选型第一次真正成为产品决策而非预算决策。
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

QQ|货物清仓|Archiver|手机版|小黑屋|倒数|舒尔特|好邻卡|RWA+DeFi|融资计划|内购渠道|Github|Web4

GMT+8, 2026-9-5 10:59 , Processed in 0.058399 second(s), 20 queries .

Powered by Discuz! X3.4

Copyright © 2001-2023, Tencent Cloud.