阿里巴巴于2026年8月3日发布其最新、最强大的AI模型“Qwen 3.8-Max”,该模型拥有2.4万亿参数,是当前中国最大的人工智能模型 [1, 2]

“Qwen 3.8-Max”采用混合专家(Mixture-of-Experts, MoE)架构,每次运行激活约950亿参数,以显著降低计算成本和延迟,同时支持文本、图像和视频的多模态输入,单次处理能力可达100万标记(tokens) [1, 2]。尽管在Arena.AI文本模型排行榜中位列中国模型第一,但其性能仍略逊于Anthropic公司的Claude Fable 5及Opus系列模型 [1, 2]

阿里巴巴计划于8月3日发布后一周,在其阿里云模型工作室正式上线“Qwen 3.8-Max” [1, 2]

在阿里巴巴发布新模型前几天,深鉴于7月31日推出了名为“V4-Flash”的超低成本AI模型,继续推进低价策略 [3, 1, 2]。据研究机构Artificial Analysis测算,V4-Flash的每百万输入标记成本仅为0.14美元,输出标记成本为0.28美元,是全球知名AI模型中运行成本最低的选择 [3, 1, 2]。其平均每次基准测试成本约为0.03美元,显著低于Moonshot AI的Kimi K3(0.86美元)、OpenAI的GPT-5.6 Sol(1.86美元)和Anthropic的Claude Fable 5(3.15美元) [3, 1, 2]

据报道,深鉴正在准备潜在的首次公开募股(IPO) [3, 1, 2]

中国AI公司普遍强调开放权重(open-weight)模型策略,即允许开发者下载并定制模型参数,这与OpenAI、Anthropic和谷歌等公司采用的封闭模型形成鲜明对比 [1, 2]。市场分析师Omdia首席分析师苏练杰评价道:“中国AI企业已找到一个重要市场。许多企业的应用场景实际上并不需要业界最顶尖的模型,而是性能够、价格合理、透明且容易取得的模型,而开放权重模型正好能满足这类需求” [1]

目前,阿里巴巴将在8月第二周开始通过阿里云模型工作室正式推广“Qwen 3.8-Max”,届时该模型将向更多开发者和企业用户开放 [1, 2]