
# Qwen3.8-Max 开源兑现2.4T 旗舰首次交权「最强即闭源」规则终结 — 深度分析这是一篇深度研究不是新闻简报。基于 30 个来源的交叉验证。一、说好的「下周开源」窗口开了两天还没兑现2026 年 8 月 3 日阿里巴巴发布 Qwen3.8-Max2.4T 总参数、约 95B 激活的 MoE1M 上下文原生多模态定价 $2/$6——并宣布这是 Max 系列首次开放权重「下周」经阿里云 Model Studio 放出。[A] 对熟悉 Qwen 历史的人来说这句话的分量不亚于模型本身此前 Qwen3-Max、3.6-Max、3.7-Max 全部只提供 API闭源是旗舰线的默认规则。现在规则要变了。8 月 10 日「下周」的窗口正式开启。截至今天8 月 11 日Hugging Face 与 ModelScope 上依然没有出现 Qwen3.8-Max 的仓库、许可证或模型卡——日本 PC Watch 给出的具体时间是 8 月 12 日 11:00JST。[B] 这个「承诺—兑现」的间隙成为本周 AI 圈讨论度最高的话题如果 2.4T 权重如期落地千问就集齐了国产开源三强最关键的一块拼图与 Kimi K32.8T、DeepSeek V41.6T构成一个前所未有的「万亿级开源层」如果再次跳票「营销先行于工件」的质疑就会坐实。本文想回答三个问题为什么 2.4T 的开源是件大事它在技术上到底意味着什么以及当「最强模型也得开源」成为新规则后谁受益、谁买单。二、技术拆解2.4T 的「开源」到底是什么2.1 国产开源三强的技术底牌把三家旗舰摊开看技术路线高度收敛又各有侧重。模型总参/激活注意力量化开源状态强项Qwen3.8-Max2.4T / ~95B混合 MHA线性注意力未披露权重待放8/12PaperBench 93.0、OSWorld 86.1Kimi K32.78T / ~104BKDA 门控线性注意力MXFP4已开源7/27Frontend Code Arena 1679DeepSeek V41.6T / ~49BProCSAHCA 压缩注意力FP4FP8已开源MIT单任务成本 ~$0.03上图国产开源三强在 MoE 稀疏激活、线性注意力、4-bit 量化三条线上高度收敛共同构成「万亿级开源层」三条路线的共性比差异更重要。第一MoE 激活比全线降到 3%-4%——参数总量越来越像营销数字真正决定成本的是激活参数、KV cache 和互联带宽。第二线性/混合注意力成为百万上下文的标准答案Kimi K3 用 69 层 KDA 24 层门控 MLA 把长上下文 KV cache 砍掉约 75%DeepSeek V4 在 1M 上下文下只需 V3.2 的 27% FLOPs、10% KV。[A] 第三4-bit 量化感知训练成为标配K3 与 V4 都在 SFT 阶段就按部署精度训练这才让 2.8T 的模型变成一个约 1.4-1.6TB 的下载包而不是 5TB。[A]2.2 谁强谁弱一张自测表的两面阿里官方自测表里Qwen3.8-Max 在 PaperBench93.0、MathVision95.2、OSWorld-Verified86.1上领先12 项编程测试只赢 1 项SWE-bench Pro 67.7 明显落后 Fable 5 的 80.0HLE 43.6 是旗舰里最弱的一档。[B] 这个「偏科」结构很说明问题开源旗舰在 Agent 场景、计算机使用、多模态上已经贴脸闭源但在「仓库级软件工程」和「最难推理」上仍有明显差距。Kimi K3 是唯一在编码榜Frontend Code Arena 1679登顶的开源模型靠的是 KDA 注意力在长序列 agentic 任务上的效率优势而非纯能力碾压。DeepSeek V4-Flash 则以 284B 的体量把单任务成本压到约 0.03 美元是 Fable 5 的约 1/105——用最小的参数拿到了最锋利的价格刀。[B]2.3 开源权重的「三重现实」上图2.4T 开源的「三重现实」——自托管门槛极高真实价值是价格锚点、可审计性与派生生态2.4T 的开源价值不在自托管。满精度约 4.8TBFP8 约 2.4TBINT4 约 1.2TB——即使量化到 INT4也需要 2-3 台 8 卡 H100/A100 服务器外加 InfiniBand 互联一台 8 卡 H200 节点月租约 2.3 万美元。[B] 对大多数团队「开源」的真实价值是三层一是 API 价格锚点Qwen3.8-Max $2/$6约为 Fable 5 的 1/9二是可审计性独立复测基准、安全审查、checksum 校验三是派生生态小模型蒸馏、多平台托管竞争。真正接得住这块需求的是头部云和第三方托管商不是单个开发者。三、竞争格局闭源阵营的定价防守与政策攻防3.1 美国的回应降价的降价锁价的锁价上图2026 年 4-8 月国产开源旗舰发布节奏与美方定价防守、政策攻防的时间线开源三强把美国闭源阵营逼进了「定价防守」通道。7 月 30 日 OpenAI 把 GPT-5.6 Luna 砍价 80% 到 $0.20/$1.20、Terra 降 20%8 月 10 日 Anthropic 宣布把 Claude Sonnet 5 的 $2/$10 促销价永久化取消原定 9 月 1 日涨到 $3/$15 的计划——一个直接的原因就是给开发者一个稳定的 agentic 成本基线正面硬抗日趋廉价的国产旗舰。[B] Google 用 Gemini 3.6 Flash$1.50/$7.50卡中端Meta 则罕见地重新转向开源8 月 10 日发布 Muse Glimmer 30BApache 2.0。每一条都指向同一个判断模型层的溢价窗口正在被开源权重快速收窄。3.2 更深的博弈蒸馏指控与政策框架能力之争之外政策层面开始动手。6 月 24 日 Anthropic 致信美国参议员指控阿里通过约 2.5 万个虚假账户、2880 万次 Claude 对话进行「工业级蒸馏」7 月 22 日白宫 OSTP 主任 Kratsios 指控月之暗面大规模蒸馏 Fable 模型财长贝森特威胁将月之暗面列入实体清单。[B] 另一边白宫 8 月 4 日敲定的「自愿预发布网络安全测试框架」明确只覆盖闭源前沿模型、排除开源权重——一个看似「利好开源」的框架和针对开源模型的制裁威胁同时出现说明华盛顿在开源问题上还没有统一立场。这种「既给糖又举刀」的摇摆正是开源阵营打开战略窗口的缝隙。[D]3.3 开源收费免费午餐的终结比 API 涨价更深的商业转向是开源权重的「分层收费」。Kimi K3 的许可证设定了模板MaaS 业务年收入超 2000 万美元须与月之暗面签商业协议、分成最高 30%阿里据路透报道正在跟进同一套打法具体比例尚未敲定。[B] 开源从「纯免费获客工具」变成了「商业化漏斗入口」——这是 2026 年开源生态最重要的规则变化。DeepSeek 全程 MIT、GLM-5.2 无门槛成了这场「开源商业化」运动里最显眼的对照物谁收费谁就可能把开发者推向真正的「自由开源」。四、采用与生态钱往哪走模型就往哪走采用数据已经不能用「趋势」来形容。OpenRouter 数据美国企业流向中国开源模型的 token 占比自 2 月 8 日以来每周超过 30%4 月峰值 46%一年前只有 4.5%截至 7 月 26 日前 28 天中国模型占 OpenRouter 全球调用量 63.5%单平台口径。[B] 生态侧同样惊人Kimi K3 上线 48 小时下载约 10 万次、30 分钟冲上 HF 趋势第一Qwen 超过 Llama 成为全球自托管量模型中国开源模型占 HF 总下载 41%首次超过美国。[B]但有一个被多数报道忽略的反差尽管用量占 30-60%中国厂商在美国市场攫取的收入占比不足 10%。企业通过美国云和第三方托管消化了成本红利——Kimi K3 在 Microsoft Foundry 以 $3.30/$16.50 上架Together AI、Fireworks 等 7 家托管商首日接入。[B] 对国内则是另一套逻辑信创与「数据不出域」规则让银行、国企把 Qwen/DeepSeek 本地部署变成硬需求——北京农商行、常熟农商行100 卡集群、52 个 AI Agent、江苏农商联合体日调用 10 万次都是实证。[C]社区情绪出现微妙分层。LINUX DO 上支持与嘲讽并存有人点赞「开源也要吃饭」有人批评「还没当上第一就收钱」更尖锐的点评是「名为开源、实为闭源经济学的阳谋」美国 Hacker News 上 Kimi K3 发布帖拿到 1856 分兴奋与警惕并存。[C] 一个确定的事实是开发者有了退出选项——任何一家收费流量可以瞬间迁移到不收费的那家。这套「多模型路由」已经成了 2026 年企业的事实默认架构。五、战略含义「最强即开源」之后把「万亿级开源层」放回整个行业坐标系它的含义已经超出模型本身上图「最强即开源」的传导链——开源权重同时压低价格、绑定生态、招来政策博弈最终把竞争重心推向成本结构与生态第一「开源」的定义正在被重写。一个合格的「开放权重」声明需要三件套可下载的文件模型卡、可读的许可证、以及能在购买者算力边界内跑起来的体积。Kimi K3 是「开放权重而非开源软件」不披露训练数据与代码DeepSeek 是真正的 MITQwen 的许可证至今未公开——三者把「开源」拆成了三种语义。[B]第二竞争重心从「模型能力」转向「成本结构与生态绑定」。SuperCLUE 7 月评测把 Agentic 编程权重提到 25%Qwen3.8-Max 71.48 登顶、Kimi K3 70.68 紧随但 Qwen 与 Kimi 都被标了「效率偏低」、DeepSeek 性价比第一——能力-效率的平衡成为新战场。[B]第三地缘与合规压力成为不确定变量。中国厂商缺席欧盟透明度准则签署名单叠加美国的蒸馏指控与实体清单威胁开源模型的「信任溢价」正在被政治化。对国内企业国家超算互联网聚合 250 万张 GPU 卡、1700 模型提供了官方 API 之外的「便宜算力」出口这层缓冲是全球开发者没有的。[D]六、我的评估先下结论「最强模型就得闭源」的规则确实变了但「开源」这两个字的含金量也在变。Qwen3.8-Max 权重落地与否只是这条主线的第一块多米诺骨牌——真正重要的是中国首次把旗舰级能力放进开放层并试图用「开源分成」的模式为它定价。我判断未来 12 个月有三个观察点。第一Qwen3.8-Max 的许可证到底长什么样——如果出现地域限制传闻禁止美欧英韩下载或高额分成会直接削弱「开源」叙事的可信度DeepSeek 的 MIT 就成了对比的标尺。第二分成模式会不会逼走开发者——Kimi K3 的 30% 上限针对的是 MaaS 大客户普通开发者不受影响但「分层开源」一旦成为行业惯例「开源免费」就只剩营销意义。第三闭源阵营会不会在模型能力上拉开新差距——Fable 5 在 SWE-bench Pro 上的 80.0 对 Qwen 的 67.7是开源三强暂时够不到的天花板也是 OpenAI/Anthropic 最后的定价权来源。我原以为这场开源浪潮会以「中小模型开源、旗舰闭源」的格局收场研究完才发现Kimi K3 和 Qwen 用 2.8T/2.4T 的规模直接掀翻了这张牌桌——开源边界已经从「能不能用」推进到「最强也在开源」。被打脸的风险同样真实如果 8 月 12 日权重再次跳票或者许可证出现苛刻条款「开源三强」的叙事会从「规则变了」退回到「营销先行」如果 63.5% 的调用量份额因为 DeepSeek 涨价、分成收费而回落说明「超廉价」和「真开源」都在被重新定价。先不下结论的只有一个问题当开源权重也开始收费它和闭源 API 之间还剩下多少本质区别。这可能是未来一年整个 AI 行业最需要想清楚的账——也是这次「开源兑现」事件真正值得盯的东西。参考来源阿里云 — 阿里云发布 Qwen3.8-MaxKimi K3 技术报告arXiv:2607.24653DeepSeek-V4Hugging FaceeWeek — Alibaba Launches 2.4T-Parameter Qwen3.8-MaxThe Verge — Alibaba takes another swipe at America’s AI supremacyCNBC — HF CEO: China dominating open modelsLA Times — China’s AI blitz puts OpenAI and Anthropic in ‘death zone’第一财经 — 阿里Max级模型将首次开源最强模型就得闭源的规则变了量子位 — 阿里Qwen3.8-Max来了Forkast — Alibaba pioneers revenue-share on open-weight modelsVentureBeat — Kimi K3 full weights: open with a caveatSuperCLUE 7 月评测ZOLPandaily — Kimi K3: 41% of world open-source downloadsReuters — Anthropic says Alibaba illicitly extracted Claude capabilitiesPondero — Alibaba promises open weights for Qwen3.8-Max this weekAI 辅助深度研究人工视角解读。每日更新。