🌀 AIBB-Flywheel

新闻数据飞轮
← 返回文章列表
ithome 科技 采集 2026-07-24T16:22:51+00:00

蚂蚁集团发布混合推理模型Ling-3.0-flash:参数大幅缩减,性能对标上一代旗舰

原始标题:蚂蚁集团发布百灵原生混合推理模型 Ling-3.0-flash:124B 总参数量,能力对标上一代旗舰 Ring-2.6-1T

来源
ithome
发布时间
2026-07-24T13:57:29
采集批次
2026-07-24-16
字数
666
URL 指纹
c5fe239947148189

📌 AI 总结(241 字)

蚂蚁集团旗下百灵大模型于7月24日发布新一代原生混合推理模型Ling-3.0-flash,总参数量为124B,激活参数仅5.1B,约为上一代旗舰Ring-2.6-1T的12.4%和8.1%,却在传统推理、指令遵循、长文本等能力上实现对标甚至超越。该模型采用原生混合线性注意力架构与1/64稀疏MoE,扩展超一万个可交互训练环境以强化Agent能力,并接入分级缓存架构使长输入延迟降低六至八成。官方在OpenRouter等平台开放限时免费API调用,8月3日截止后将正式开源模型权重。
📄 正文(666 字)
蚂蚁集团旗下百灵大模型于7月24日发布百灵新一代原生混合推理模型Ling-3.0-flash。据官方介绍,相比上一代1T级旗舰思考模型Ring-2.6-1T,Ling-3.0-flash的总参数量为124B,约为前者的12.4%;激活参数量仅为5.1B,约为前者的8.1%,却实现了全方位的能力对标甚至超越。

该模型的核心改进体现在三个方面。其一,混合线性架构原生进化:从预训练伊始即采用原生混合线性注意力架构,以5:1比例交替堆叠KDA与MLA,并升级全新KDA细粒度对角门控与1/64稀疏MoE,在124B总参数、5.1B激活参数规模下,实现了长上下文效率、状态记忆与计算成本的协同跃升。

其二,极致智能密度越级挑战:仅需5.1B激活参数即可提供卓越的传统推理、指令遵循与长文本能力,直面更大尺寸竞对SOTA及上一代旗舰时实现性能越级,全面赋能复杂Agent场景的高效落地。

其三,Agent全面进化,长程闭环:围绕真实生产力场景深度打磨,扩展10000+可交互训练环境,实现Coding、General与Deep Research Agent任务的全程闭环,做到能力强、响应快、协同稳。同时创新接入SGLang HiCache与Mooncake分级缓存架构(物理双池、集群共享L3),使长程交互无需重算,长输入下TTFT降低60%至80%以上。

官方在OpenRouter与百灵官方平台同步开放限时免费API调用,免费期截至8月3日23:00(北京时间),Ling-3.0-flash模型权重将在免费期结束后正式开源。