[中国] 智能 CHINA ON AI · THE OTHER RIVER
← 中国脉搏
labs · 2026年7月22日

DeepSeek V4正式发布,阿里随即推出2.4万亿参数Qwen 3.8DeepSeek V4 Goes Live, Alibaba Fires Back With 2.4T-Parameter Qwen 3.8

两款中国旗舰大模型在数小时内相继发布,均声称性能接近西方前沿模型,价格却只是零头。

阅读英文全文 →

更新 · 2026年7月23日

周日,阿里巴巴Qwen团队的出手时机耐人寻味。就在月之暗面Kimi K3于世界人工智能大会(WAIC)发布开源权重版本的数小时后,Qwen团队随即将Qwen3.8-Max预览版上线至Token Plan与Qoder编程助手平台,定价为标准API费率的十分之一。这不是巧合,而是一次经过设计的节奏卡位。

对外打出的核心数字是2.4万亿总参数量,阿里将其定位为在已公开基准测试的系统中仅次于"Fable 5"。MarkTechPost报道了本次发布并提及其与WAIC的时间关联;Cybernews将其纳入中国前沿实验室集体发动成本压力战役的叙事框架;Silicon Republic重点引述了参数规模。三家媒体都关注了已披露的信息,却都忽略了更值得追问的缺席。

没有披露的内容,往往比已披露的更关键。目前:没有模型卡,没有确认的开源许可证(Apache或其他),最重要的是,没有活跃参数数量。对于2.4万亿参数几乎必然暗示的混合专家(MoE)架构而言,活跃参数才是决定每个token实际推理成本的数字。没有这个数字,2.4万亿只是一个营销数据,而非技术数据。以4位量化存储全部权重,大约需要1.2TB显存——即便是八卡H200节点,这也是颇为别扭的算术。专家路由配置能否将实际部署成本压缩至该定价所隐含的水平,目前无从验证。

只有总参数量、没有活跃参数量,就像只有画框、没有画布。

但定价信号本身是真实的,值得认真解读。预览版以十分之一的价格上线,不是折扣促销,而是在地上插一根桩:无论前沿能力当前的市场价是多少,Qwen会更便宜。这套打法与Qwen2.5系列早期版本的策略如出一辙——先上线,先压价,让基准测试卡慢慢跟上。值得关注的是:这一预览价格能否撑过30天,以及它是否会锚定正式发布后的长期定价。

Hacker News上的社区反应沿着一条熟悉的断层线分裂:期待又一个具备竞争力的开源前沿模型的开发者热情高涨,而另一部分人则表现出疲态——过去18个月里,他们见过太多厂商基准测试声索跑在可复现评估之前的案例。这种疲态有其合理性。Qwen团队过去发布过质量严谨的技术报告——Qwen2.5系列的技术文档详尽且可复现——正因如此,这次等量级文档的缺席才显得格外突出,而非可以忽略。

阿里此番施压同时指向多个目标。在国内,这是对月之暗面借助国家级会议舞台打出开源信誉牌的直接回应。在国际层面,它将Qwen家族置于与Meta Llama、Mistral争夺"单位能力成本"话语权的赛道。十分之一定价叠加Qoder编程工具的集成,意味着初期部署重心在于企业编程工作流——这一场景的迁移成本足够低,价格确实能够驱动转换。

接下来你要盯住三件事:第一,模型卡发布日期——若在两周内落地,预览框架尚可成立;若拖过30天,"预览"这个标签就在替文档做本该由文档完成的工作。第二,活跃参数披露——这一个数字将告诉你十分之一定价背后的服务经济学是结构性可持续的,还是阶段性促销。第三,阿里是否确认将在Hugging Face或魔搭(ModelScope)上发布开源权重——许可证声明的缺席,对任何考虑集成的企业用户都具有法律和商业上的实质影响。定价是这句话的语气,模型卡才是它的意思。现在,你只看到了其中一半。