Other 2026-07-19
Product Launch 影响: Major 置信: 85%

阿里发布2.4T参数Qwen3.8-Max,MoE架构与0.2折定价冲击AI市场

内容摘要

阿里巴巴发布Qwen3.8-Max-Preview,总参数2.4万亿,采用MoE架构,支持多模态和1M上下文窗口。同步推出Qoder平台与Token Plan,限时折扣低至0.2折,大幅降低推理成本。官方声称综合能力仅次于Anthropic Fable 5,标志着中国AI进入参数军备与开源竞争双轨制。

核心要点

阿里巴巴于2026年7月19日通过Qoder平台正式发布Qwen3.8-Max-Preview预览版,总参数量达2.4万亿,是通义千问团队首个突破1万亿参数的多模态模型。该模型采用MoE(Mixture-of-Experts)架构,推理时仅激活部分权重,大幅降低实际算力开销。支持原生多模态(图片+视频+文档)及1M token上下文窗口,与Kimi K3Meta Muse Spark 1.1持平。官方宣称综合能力“在全球范围内仅次于Anthropic Fable 5”,并承诺“很快”开放完整模型权重。
同步上线Qoder/QoderWorkToken Plan个人版,推出限时优惠:Credit消耗1折,夜间22:00-08:00再享0.2折。Token Plan定价(限时):Lite ¥39/月(6.5折),Standard ¥139/月(7.7折),Pro ¥499/月(8.3折)。团队版席位¥150-¥1,398/月。
未披露细节包括:激活参数规模、授权协议条款、完整model card及第三方基准测评结果(如Arena.ai)。分析师关注点:2.4T总参数 ≠ 2.4T激活参数(MoE特性),实际推理成本可能远低于名义参数。阿里同时投资Moonshot,其K3 2.8T与Qwen3.8-Max形成内部“内战”。7月待发布:Qwen3.8-Max正式版、DeepSeek V4正式版、GLM-5.5。行业生态背景:2026年至今39次大模型发布,17个开源模型中13个来自中国厂商。国内外差距持续缩小:GLM-5.2(接近Opus)、Kimi K3(与Fable 5一桌)、Qwen3.8-Max(仅次于Fable 5)。战略意义:中国AI从“追赶”进入“围攻”阶段,价格战升级,国产开源模型首次在能力宣传上对标顶级闭源模型。

重要性说明

表面上是阿里在参数规模和性能上的跃进,本质上是阿里内部Qwen团队与投资标的Moonshot之间的资源争夺战,同时对外合围Anthropic Fable 5。通过Qoder平台和Token Plan的限时折扣,阿里试图快速抢占用户心智并锁定API调用习惯,但“很快开源”的承诺可能只是延缓用户转向其他开源模型的缓兵之计。
从硬核工程视角看,MoE架构虽降低理论算力开销,但实际部署中面临严重的专家负载均衡问题:若路由策略不当,部分专家可能过载导致尾部延迟飙升,影响用户体验。1M token上下文窗口在自注意力机制下计算复杂度为O(n²),实际长序列推理时可能产生不可忽略的时延显存压力,尤其在高并发场景下。阿里未公布激活参数规模和第三方基准,使得“仅次于Fable 5”的宣称缺乏可验证性。此外,限时折扣结束后,用户可能面临价格陷阱:若已深度集成Qoder API,迁移成本高昂,形成供应商锁定

PRO 决策建议

【厂商】竞争对手如AnthropicMoonshot AIDeepSeekGoogle应利用阿里透明度不足的弱点:Anthropic可强调Fable 5的已验证基准和完整model card;Moonshot可突出K3 2.8T的更大参数规模及独立评测结果;DeepSeek可宣传其完全开源模型和更低的实际推理成本;Google可依托TPU生态和Gemini的多模态集成优势。这些对手应通过第三方测试(如Arena.aiArtificial Analysis)直接对比,揭露阿里未公布激活参数和基准的潜在水分。
【企业】CIO与架构师必须执行零信任技术审计:要求阿里提供完整model card、激活参数规模、授权协议及第三方基准测试;在自身负载下独立评估MoE的尾部延迟和吞吐量;警惕限时折扣后的价格恢复,计算长期TCO;采用多模型策略避免单一API锁定,确保跨平台可移植性。
【投资者】应看穿公关辞令:阿里内部Qwen与Moonshot的竞争可能分散资源,削弱Qwen长期投入;未开源和未公布基准意味着实际能力可能不及宣传,价格战将压缩利润率;关注阿里是否兑现开源承诺,若拖延则反映其护城河薄弱,长期价值存疑。

来源: 36氪
查看原文 →

觉得这篇分析有用?

每周收到3-5条AI基础设施关键信号 →

💬 评论 (0)