🌀 AIBB-Flywheel

新闻数据飞轮
← 返回文章列表
ithome 科技 采集 2026-08-14T07:15:49+00:00

智谱发布GLM-5.3,开源最强编程模型,两周后开放权重

原始标题:智谱正式发布 GLM-5.3:编程能力最强开源模型,较 GLM-5.2 提升 50%

来源
ithome
发布时间
2026-08-14T05:36:12
采集批次
2026-08-14-07
字数
1283
URL 指纹
efc962205ff85ada

📌 AI 总结(267 字)

智谱于8月14日正式发布GLM-5.3模型,基座与GLM-5.2相同,通过后训练Scaling大幅提升智能上限。该模型在编程能力上号称当前最强开源模型,内部体感评测较前代提升50%,在Terminal Bench 3.0、Agents' Last Exam等公开基准测试中均取得开源第一。网络安全的白盒代码审查与漏洞发现能力表现突出,接近闭源模型水平。模型权重将在安全评估完成后两周内开源,并已上线ZCode、AutoClaw等官方工具,同步开放多家第三方编码平台抢先体验及API服务,GLM Coding Plan全员额度同步重置。
📄 正文(1283 字)
智谱今日正式发布GLM-5.3,与GLM-5.2相比,基座模型没变,但通过后训练Scaling大大提高了模型的智能上界:数十倍的长程任务环境、更丰富多样的环境类型、超长的后训练时间。

相比前代,GLM-5.3的新能力包括:

更强的编程能力。GLM-5.3是编程能力最强的开源模型,在内部自建体感评测中较GLM-5.2提升50%,在包括Terminal Bench 3.0、Agents' Last Exam (CLI)在内的公开基准测试中取得开源第一。

网络安全能力。在白盒代码审查与漏洞发现等安全任务中,GLM-5.3的表现持平Mythos 5,展现出面向网络安全防御场景的强大潜力。

后训练Scaling。上述全部提升都来自后训练。基于IndexShare、SAO、以及持续演进的新一代Slime框架,智谱在与GLM-5.2完全相同基座上高效推进强化学习,可能智谱还远未开发出这个基座的智能上界。

开源。智谱将在发布两周后开放模型权重,此前完成安全评估与模型加固。

智谱表示,在多项主流基准测试中GLM-5.3是当前排名最高的开源模型,编程与智能体能力接近Claude Fable 5,编程体感超过其他国产模型。

在衡量模型于真实终端环境中完成复杂任务的Terminal-Bench 3.0上,GLM-5.3得分从4.6提升至28.3;

在聚焦长程软件工程与持续代码修改能力的DeepSWE v1.1上,得分从46.2提升至66.9;

在覆盖多类真实专业场景、强调跨工具协作与长程任务的Agents' Last Exam上,得分从23.8提升至28.5;

在覆盖44种职业、考察真实高价值知识工作的GDPval-AA v2中得分1,769,展现基于编程能力涌现的专业任务执行能力。

智谱自研的Z.aiCode Bench评估模型在真实编程场景中的综合体感。模型会被置于复杂的本地开发环境,并在不同思考档位下执行端到端任务,更接近开发者实际使用Coding Agent时的体验。

测试结果显示,GLM-5.3在效果和Token利用率之间取得了更好的平衡。在High档位下,GLM-5.3达到31.4%的准确率,超过Claude Opus 4.8最高档位的29.5%,每项任务平均输出约5万tokens,而Opus 4.8需要约12万tokens,意味着GLM-5.3可以用更短的执行路径完成任务。

即日起上线智谱官方编程工具ZCode、效率工具AutoClaw,上线GLM Coding Plan全量用户及开放订阅。

TraeWork、TraeCode、扣子、WorkBuddy、CodeBuddy、Qoder、QwenWork、CatPaw、JoyCode、OpenCode等编码平台开放抢先体验。

API很快上线,完整模型权重将在两周内开源,此前需完成必要的安全加固,尽可能限制其潜在攻击能力,保留其防御价值。

智谱公告显示,今天13:00,GLM Coding Plan全员额度重置,所有用户后台「用量统计」可见使用额度回满。