ithome
科技
体育
采集 2026-09-10T16:15:14+00:00
DeepSeek V4.1 Flash 上线国家超算互联网
原始标题:DeepSeek V4.1 Flash 模型上线国家超算互联网
来源
ithome
发布时间
2026-09-10T11:47:00
采集批次
2026-09-10-16
字数
470
URL 指纹
3cb3ca7d380bf472
📌 AI 总结(256 字)
DeepSeek 近日推出 V4.1 Flash 模型并上线国家超算互联网,用户可通过超算官网的「模型服务」页面调用 API。该模型为 552B 参数的 MoE 架构,采用全新的 Causal-Encoder-Decoder 结构,输入激活仅 8B、输出激活 16B,成本低于同尺寸模型。经新预训练方式和大规模强化学习后训练,基准测试中超越包括 V4 Pro 在内的旗舰模型。此外,模型大幅压缩 KV Cache,对显存需求降至上一代的四分之一、固态硬盘需求降至八分之一,显著降低 Agent 类任务的使用成本。
📄 正文(470 字)
DeepSeek V4.1 Flash 模型今日上线国家超算互联网中心。用户可登录国家超算互联网官网,从首页进入「模型服务」页面,即可快速打开 DeepSeek V4.1 Flash 模型 API 调用界面。 据IT之家了解,DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。 同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。 此外,DeepSeek V4.1 Flash 大幅减少了 KV Cache 缓存的大小,与上一代模型相比,对 HBM 的需求减少到 1/4,对 SSD 的需求减少到 1/8。在 Agent 使用场景中,缓存命中的费用往往占比较高,对 KV Cache 的压缩大幅降低了 Agent 类任务的使用成本。