一个小站的自留地
DeepSeek 调整 Flash 系列 API 定价 DeepSeek 宣布,将于北京时间 2026 年 9 月 10 日 12:00 起调整 Flash 系列定价。空闲时段输入缓存命中价为 0.02 元 / 百万 tokens,缓存未命中价为 1 元 / 百万 tokens,输出价为 4 元 / 百万 tokens。 高峰时段价格为上述空闲时段价格的 2 倍。
DeepSeek V4.1 Flash 发布

DeepSeek 正式发布 DeepSeek V4.1 Flash。官方称其为全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解;为 552B 参数 MoE,采用 Causal-Encoder-Decoder 结构,输入激活 8B、输出激活 16B。官方称经更大规模强化学习后训练,基准测试超越包括 DeepSeek V4 Pro 在内的一众旗舰模型。

新架构大幅压缩 KV Cache:相对上一代,HBM 需求降至约 1/4,SSD 需求降至约 1/8;相对初代模型,KV Cache 已缩小约 437 倍。

API 已同步上线,将模型名改为 deepseek-flash 即可调用。官方称 V4.1 Flash 已全面超越 V4 Pro,计划有序下线后者。

DeepSeek
 
 
Back to Top