七牛云上线 DeepSeek V4.1 Flash,更强、更快、更普惠的体验即刻开启
七牛云 MaaS 平台正式第一时间上线 DeepSeek V4.1 Flash 模型,用户现在即可直接体验这款全新旗舰模型。截至目前,我们已上线 DeepSeek V4、MiniMax H3、GLM5.3、Kimi K3 等一百余款行业主流旗舰大模型,持续为用户扩充前沿 AI 能力矩阵。

本次上线的 DeepSeek V4.1 Flash,是 DeepSeek 全新模型结构系列中最小尺寸的模型,具备原生多模态视觉理解能力。新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。以下所有模型性能数据,均来自 DeepSeek 官方发布内容。
01非对称模型结构,小成本大智能
DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型的智能水平。

02更少缓存,更省成本
新一代模型大幅减少了 KV Cache 缓存的大小,与上一代模型相比,对 HBM 的需求减少到 1/4,对 SSD 的需求减少到 1/8。在 Agent 使用场景中,缓存命中的费用往往占比较高,对 KV Cache 的压缩大幅降低了 Agent 类任务的使用成本。如图展示了 DeepSeek 在减少上下文存储方面的持续进展,相对于初代模型,KV Cache 已经缩小了 437 倍。

03全链路原生适配,开箱即用解锁旗舰能力
这是七牛云 MaaS 平台上线的又一款行业主流旗舰大模型,已完成 DeepSeek V4.1 Flash 的全链路原生适配,完整兼容原生多模态、百万上下文等核心能力。
如果你需要更强、更快、更普惠的旗舰级 AI 能力,不管是全流程代码开发、超长文本处理,还是自动化业务流程落地,都可以在七牛云 MaaS 平台体验,开启效率升级的全新可能。
目前,DeepSeek V4.1 Flash 已在七牛云 MaaS 平台全量开放,新用户注册即送免费 Token,点击阅读原文,即刻体验更强、更快、更普惠的全新旗舰 AI 能力。