阿里巴巴本周推出了 Qwen 3.8,这是一个拥有 2.4 万亿参数的多模态模型,其权重将公开发布。此举使这家中国科技巨头直接进入了前沿 AI 竞赛,并为开发者提供了一个罕见的开源权重替代方案,以对抗目前主导市场的闭源巨头。
规模为何如此重要
参数量大致衡量了一个模型可以存储多少知识;每一次万亿级的跨越通常都会在推理、编程和数据分析任务中带来显著的提升。阿里巴巴团队表示,新模型“达到了当前的前沿基准”,在性能上仅次于未具名的“Fable 5”。具体数据尚未公开,但这一说法表明了其与顶尖大语言模型竞争的雄心。
从文本到视觉及更多领域
Qwen 3.8 是阿里巴巴首个突破 1 万亿参数大关的多模态模型。在实际应用中,它不仅能处理纯文本,还能理解并对图像、视频剪辑和复杂文档进行推理。开发者 Shuai Bai 将这种能力描述为将模型从聊天机器人转变为“全能智能体(comprehensive agent)”,它可以阅读设计图、观看简短的教程视频,然后生成相应的代码。阿里巴巴的目标是高价值的生产力场景:全栈软件开发、高级数据分析以及办公工作流自动化。
开源权重的角度
阿里巴巴不仅仅是在展示一个更大的模型,它还承诺“很快”就会发布权重。这使得 Qwen 3.8 与大多数处于私有 API 或云服务背后的前沿模型区别开来。通过发布权重,阿里巴巴允许任何人对模型进行微调、将其嵌入私有基础设施或构建定制化应用,而无需将数据发送到第三方服务器。对于担心数据泄露的企业来说,这种隐私优势可能是决定性的。
该公司已经通过其 Token Plan、Qoder 和 QoderWork 平台开启了预览,访问价格仅为标准费率的 10%。这一低成本切入点旨在吸引早期采用者,让他们在权重全面开放之前测试模型的编程和分析能力。
对 Moonshot AI 的战略反击
Qwen 3.8 的发布似乎是针对 Moonshot AI 的。Moonshot AI 的 Kimi K3 模型因其快速的营收增长(截至 6 月,年度经常性收入达到 3 亿美元)及其严密控制的生态系统而备受关注。Moonshot 将开发者限制在聊天应用和付费 API 内,并隐藏了底层模型。阿里巴巴的开源权重承诺直接挑战了这种控制模式,为开发者提供了更多的灵活性和所有权。
总结
阿里巴巴的 Qwen 3.8 在争夺 AI 阶梯顶端地位的同时,也向外界敞开了其庞大模型的大门。
