DeepSeek旧版V4 Flash与V4 Flash Vision Exp模型下线,API请求临时路由至V4.1 Flash
DeepSeek V4.1 Flash已同步上线DeepSeek API,旧版本模型V4 Flash与V4 Flash Vision Exp现已下线。模型名deepseek-v4-flash、deepseek-v4-flash-vision-exp将被暂时路由到V4.1 Flash。
DeepSeek于2026年9月10日正式发布V4.1 Flash。该模型采用全新的Causal-Encoder-Decoder架构,是一款552B参数的MoE模型,也是DeepSeek全新模型架构系列中尺寸最小的成员。DeepSeek称,其在Agentic Benchmark等测试中超越DeepSeek V4 Pro、GLM5.3、Kimi-K3等旗舰模型。
与V4 Flash相比,V4.1 Flash对HBM的需求降至四分之一,对SSD的需求降至八分之一。DeepSeek同时下调V4.1 Flash定价,新价格于2026年9月10日12:00生效,闲时输入(缓存命中)0.02元、未命中1.0元、输出4.0元,高峰时段输入(缓存命中)0.04元、未命中2.0元、输出8.0元。
此外,DeepSeek将从北京时间2026年9月14日12:00起有序下线V4 Pro,所有deepseek-v4-pro请求将路由到新模型,并按V4.1 Flash单价计费。
- 2026-09-10 02:23 | 36氪:刚刚,DeepSeek新模型上线,长文本缓存硬盘占用暴降88%阅读原文
智东西9月10日报道,刚刚,DeepSeek正式发布DeepSeek V4.1 Flash,该模型采用全新架构,是一款552B参数的MoE模型,为DeepSeek全新模型架构系列中尺寸最小的成员,在性能上超越了包括DeepSeek V4 Pro在内的一众旗舰模型。 模型开源地址: https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash 论文链接: https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash/blob/main/DeepSeek_V41_Tech_Report...