中国人工智能初创公司DeepSeek于2026年7月31日正式发布其旗舰AI模型V4-Flash,该模型采用了混合专家(MoE)架构,拥有2840亿总参数量和130亿激活参数 [1, 2, 3]。
根据多方数据分析机构Artificial Analysis估算,V4-Flash模型处理每百万输入令牌的运营成本约为0.14美元,百万输出令牌的成本约为0.28美元,完成一次基准测试的平均费用约为0.03美元 [1, 4, 5, 6, 3]。这一成本水准远低于竞争对手,例如Moonshot AI的Kimi K3为0.86美元,OpenAI的GPT-5.6 Sol为1.86美元,Anthropic的Claude Fable 5为3.15美元。Artificial Analysis指出,“该比较涵盖处理和生成的数据量,更真实反映了AI模型的使用成本” [4]。
性能方面,V4-Flash在涵盖编程、推理及职场模拟的九项基准任务中取得了智力指数50分(满分100),与谷歌Gemini 3.6 Flash持平,但略低于Meta Muse Spark 1.1和智谱AI GLM-5.2,以及明显低于Kimi K3(57分)、Claude Opus 5、Claude Fable 5和GPT-5.6,这些模型的分数普遍高出9分以上 [1, 4, 5, 6, 3]。
此外,V4-Flash兼容OpenAI Response API格式,并支持OpenAI Codex,使开发者能够轻松切换模型,降低迁移成本 [2]。
面对DeepSeek的价格冲击,OpenAI在7月下旬宣布对GPT-5.6 Luna模型实施80%的降价 [2, 3]。
发布后首周,V4-Flash在OpenRouter API平台上的周令牌使用量达7.22万亿,OpenCode平台单日令牌使用量达到8万亿 [3],显示出市场快速接受度。
DeepSeek相关负责人表示,公司希望借助低成本优势“重夺AI市场动力” [1]。有消息称,DeepSeek正为潜在的首次公开募股(IPO)进行准备,推动公司下一步发展 [1, 4, 6]。