智谱今晚上线 系列的首个原生多模态模型。该模型总参数量为 320B,激活参数仅 18B。
智谱在正式发布前,以匿名模型 Ox-Alpha在 OpenCode 和 OpenRouter 上进行了大规模测试。Ox-Alpha 迅速成为当周最受欢迎的模型,创下双平台调用量新高。而这些请求流量全部由国产芯片提供算力支持。
官方表示,GLM-5.3-Flash 在各项基准测试和实际使用中,全面超越参数量高出一倍的 GLM-5.2,定价却仅为后者的 1/10。
据介绍,这得益于其全新模型架构。GLM-5.3-Flash 的架构专为极低成本而设计,总参数量与 GLM-4.5 相当,但激活参数量与层数几乎减半。结合最新的 30T Token 多模态预训练语料,GLM-5.3-Flash 能够以更少的计算资源实现更强的性能。
GLM-5.3-Flash 同时进行了多项架构升级,是首个采用稀疏注意力与线性注意力混合架构的开源前沿模型,在保持精准长上下文能力的同时,大幅降低长上下文服务成本;并采用流形约束超连接提升模型 Scaling 能力。
官方表示,GLM-5.3-Flash
GLM-5.3-Flash 进一步拓展至 Office、金融研究和专业文档等工作场景。它能够自主拆解复杂目标、调用合适工具、检查并优化输出,完成从研究分析、模型构建到 PPTX、PDF、DOCX、XLSX 成品交付的完整工作流。










