智谱开源 GLM-5.3-Flash:320B参数模型性能对标Opus 4,定价仅为1/40
2026/08/27 11:06阅读量 5
智谱AI正式上线并开源了GLM-5.3-Flash大语言模型。该模型拥有3200亿参数,在性能上达到与Opus 4相当的水平,但推理成本大幅降低,定价仅为后者的1/40。此举旨在通过高性价比的开源模型推动开发者生态建设。
事件概述
智谱AI(Zhipu AI)正式发布了其最新一代大语言模型 GLM-5.3-Flash,并同时将其开源。该模型的核心亮点在于其在保持高性能的同时,实现了极致的成本控制,旨在为开发者和企业提供更具性价比的选择。
核心信息
- 模型规格:GLM-5.3-Flash 是一个拥有 3200亿(320B) 参数的混合专家(MoE)架构模型。
- 性能表现:根据官方数据,GLM-5.3-Flash 的综合能力已达到与 Opus 4 相当的水平。这意味着它在逻辑推理、代码生成、数学计算及多语言理解等关键基准测试中,能够与当前顶尖闭源模型竞争。
- 成本优势:该模型最大的竞争优势在于定价。其API调用价格仅为 Opus 4 的 1/40。这一巨大的价差使得大规模部署和长上下文处理在经济上更加可行。
- 开源策略:智谱选择将 GLM-5.3-Flash 开源,允许社区和研究者自由访问权重和代码。这有助于加速基于该模型的微调、垂直领域适配以及创新应用的开发。
值得关注
- 市场影响:GLM-5.3-Flash 的高性价比可能对当前高端大模型市场形成冲击,特别是对于那些对成本敏感且需要接近顶级性能的企业用户。
- 开发者生态:作为“开源 × AI”社区的一部分,智谱此举意在吸引更多开发者参与其生态系统,促进基于 GLM 系列模型的二次开发和工具链完善。
- 技术路线验证:320B 参数规模结合 MoE 架构实现顶级性能,进一步验证了稀疏激活架构在平衡性能与效率方面的有效性。
