🌀 AIBB-Flywheel

新闻数据飞轮
← 返回文章列表
ithome 国际 科技 采集 2026-08-26T16:11:18+00:00

智谱开源原生多模态模型GLM-5.3-Flash

原始标题:Ox Alpha 现身:智谱开源 GLM-5.3-Flash 原生多模态模型,限时折扣价为 GLM-5.3 的 1/20

来源
ithome
发布时间
2026-08-26T14:21:30
采集批次
2026-08-26-16
字数
1224
URL 指纹
92ea20cc1819ff77

📌 AI 总结(286 字)

智谱发布并开源GLM-5.3-Flash(320B总参、18B激活),这是GLM-5系列首个原生多模态模型。前期以匿名Ox-Alpha在OpenCode和OpenRouter测试,双平台调用量创新高,全部由国产芯片提供算力。该模型在Artificial Analysis指数中取得57分,与Claude Opus 4.8持平;编程表现也与之相当。定价仅为GLM-5.3的1/10,限时折扣1/20,约为Opus 4.8的1/40。架构上采用稀疏与线性注意力混合、流形约束超连接等技术,激活参数和层数较GLM-4.5近乎减半,视觉能力原生融入编程循环,并已开源接入多个平台。
📄 正文(1224 字)
智谱今晚上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列的首个原生多模态模型。该模型总参数量为320B(3200亿),激活参数仅18B(180亿)。

智谱在正式发布前,以匿名模型Ox-Alpha(中文社区称作牛来)在OpenCode和OpenRouter上进行了大规模测试。Ox-Alpha迅速成为当周最受欢迎的模型,创下双平台调用量新高。而这些请求流量全部由国产芯片提供算力支持。

GLM-5.3-Flash能力超过GLM-5.2,在全球权威的Artificial Analysis Intelligence Index(AA综合智能指数)中取得57分,进入全球前沿模型能力区间,与Anthropic最受欢迎的模型Claude Opus 4.8得分持平。在自研Z.aiCode Bench体感评估中,其编程表现与Claude Opus 4.8相当。

与此同时,GLM-5.3-Flash定价为GLM-5.3的1/10,限时折扣内为GLM-5.3的1/20,为Opus 4.8的1/40。官方表示,GLM-5.3-Flash在各项基准测试和实际使用中,全面超越参数量高出一倍的GLM-5.2,定价却仅为后者的1/10。

据介绍,这得益于其全新模型架构。GLM-5.3-Flash的架构专为极低成本而设计,总参数量与GLM-4.5相当(355B vs. 320B),但激活参数量(32B → 18B)与层数(92 → 45)几乎减半。结合最新的30T Token多模态预训练语料,GLM-5.3-Flash能够以更少的计算资源实现更强的性能。

GLM-5.3-Flash同时进行了多项架构升级,是首个采用稀疏注意力与线性注意力混合架构的开源前沿模型,在保持精准长上下文能力的同时,大幅降低长上下文服务成本;并采用流形约束超连接(Manifold-Constrained Hyper-Connections,mHC)提升模型Scaling能力。

官方表示,GLM-5.3-Flash视觉能力被原生融入Coding循环,使模型能够主动观察界面、渲染结果与交互反馈,并据此持续测试和改进。无论是前端开发、游戏构建、Blender 3D场景,还是BUA、CUA驱动的真实环境操作,模型都能在代码、浏览器和图形界面之间协同完成任务。

GLM-5.3-Flash进一步拓展至Office、金融研究和专业文档等工作场景。它能够自主拆解复杂目标、调用合适工具、检查并优化输出,完成从研究分析、模型构建到PPTX、PDF、DOCX、XLSX成品交付的完整工作流。

GLM-5.3-Flash正式面向全球开源,已接入ZCode等编码平台,并纳入GLM Coding Plan(每天限量发放10000张体验卡),同步开放API调用。此外,GLM Coding Plan全员额度已重置,所有用户后台「用量统计」可见使用额度回满。