中国AI初创公司智谱AI于8月26日确认,旗下高性能免费AI模型Ox Alpha正式命名为GLM-5.3-Flash,属GLM系列新版本 [1, 2, 3, 4, 5, 6, 7]。

该模型于8月20日以匿名身份在OpenRouter平台上线,六天内处理了约42兆tokens,使用量超过此前领先的DeepSeek超过两倍,成为当时平台上最受欢迎的语言模型 [1, 2, 3, 5, 7]。OpenCode社交媒体曾表示,“Ox Alpha在免费期间的使用量一度超越DeepSeek两倍以上,六天内处理约42兆tokens,使用量高居首位” [5]。

GLM-5.3-Flash支持多模态输入,涵盖文本、图像和视频,最大上下文窗口达105万个token,特别适合编程和AI连续体代理等复杂任务 [1, 3, 5, 6]。其参数数量达到7430亿,模型权重超过300GB,用户可通过包括Hugging Face在内的平台免费下载部署,无需订阅或API费用 [5, 6]。

智谱AI创始人唐杰强调,GLM-5.3-Flash不会使用用户提交的提示进行训练,保障用户隐私安全 [6]。该模型完全基于国产芯片,配合智谱自研高带宽互联技术运行,推动了中国人工智能硬件生态的发展 [1, 7]。此外,GLM-5.3-Flash在并发处理和成本效率上表现出色,以大约一成的推理成本实现优于之前版本GLM-5.2的性能 [1, 5, 6]。

在早期社区测试中,Ox Alpha在编程和AI连续代理任务上优于OpenAI GPT-5.6 Sol和Anthropic Fable 5 [5, 6, 7]。Artificial Analysis对其评价为57分,全球排名第8,性能与GPT-5.6 Terra相当,超过谷歌Gemini 3.7 Flash和Anthropic Fable 5 [7]。其输入token成本约为每百万0.15美元,输出为每百万0.5美元,远低于美国同类模型 [7]。

智谱AI于今年8月14日发布了GLM-5.3全功能版,随后6天匿名上线精简高效的GLM-5.3-Flash版本。公司表示,此前已有阿里、小米等厂商采用匿名模式,先让模型“跑”起来,再公布开发者信息,便于市场验证和反馈收集 [1, 2, 5]。

目前智谱AI公布将对外开放GLM-5.3-Flash模型权重,支持广大开发者进行部署和二次开发,凸显开放生态建设愿景 [1, 2, 3, 5, 6]。

随着这款国产高性能多模态模型走向开源及应用推广,智谱AI将在未来继续推动国产AI软硬件全面协同发展,助力产业升级。