DeepSeek 正式发布 DeepSeek V4.1 Flash。官方称其为全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解;为 552B 参数 MoE,采用 Causal-Encoder-Decoder 结构,输入激活 8B、输出激活 16B。官方称经更大规模强化学习后训练,基准测试超越包括 DeepSeek V4 Pro 在内的一众旗舰模型。
新架构大幅压缩 KV Cache:相对上一代,HBM 需求降至约 1/4,SSD 需求降至约 1/8;相对初代模型,KV Cache 已缩小约 437 倍。
API 已同步上线,将模型名改为 deepseek-flash 即可调用。官方称 V4.1 Flash 已全面超越 V4 Pro,计划有序下线后者。
(DeepSeek)