返回新闻列表
2026-09-09 06:55
AI123

DeepSeek下调Flash系列大模型定价 缓存命中价格降幅达60%

据DeepSeek开放平台公告,DeepSeek宣布自2026年9月10日12时起调整Flash系列模型定价,涉及deepseek-v4-flash与deepseek-v4-flash-vision-exp两款模型。

调整后,空闲时段输入缓存命中价格降至每百万Token 0.02元,较此前下降60%;输入缓存未命中价格降至每百万Token 1元,降幅为33.33%;输出价格降至每百万Token 4元,降幅为11.11%。高峰时段各项价格均为空闲时段价格的两倍。

公开资料显示,Flash系列目前包含上述两款模型,具体调价详情可参考官方平台公告。

来源
  1. 2026-09-10 19:52 | 21财经:智谱、MiniMax双双大跌,较巅峰市值合计蒸发万亿
    阅读原文

    来源:ZAKER财经   万亿港元市值,说缩水就缩水了。 9月10日,两大国产大模型龙头智谱与MiniMax携手跳水。截至收盘,智谱报819港元,跌10.34%,盘中最低摸到807港元;MiniMax报292港元,跌8.98%,最低下探288.6港元。两家公司当日成交额分别飙到60.59亿和44.89亿港元。 进入9月,两家公司的股价几乎天天下挫。 月内累计回撤,智谱高达29.58%,MiniMax也有14.27%。 智谱在9月8日就跌破了1000港元心理关口,而6月22日它还站在2980港元的历史之巅,三个月不到,膝盖斩。 MiniMax更惨,3月18日摸到1330港元峰值后便一路向南,7月...

  2. 2026-09-10 17:08 | 新浪财经:DeepSeek调价引余震?智谱月内跌幅接近30%
    阅读原文

    (文/汤普济 编辑/吕栋)9月10日,港股大模型公司股价再度走弱。截至收盘,智谱报819港元,跌10.34%;MiniMax报292港元,跌8.98%,跌幅均较午间扩大。智谱股价MiniMax股价DeepSeek自北京时间9月10日12时起,下调Flash系列模型调用价格。空闲时段每百万Token的缓存命中输入价格由0.05元降至0.02元,下降60%;缓存未命中输入价格由1.5元降至1元,下降约33.3%;输出价格由4.5元降至4元,下降约11.1%。高峰时段价格仍为空闲时段的两倍。DeepSeek于8月17日引入峰谷定价,将Flash模型每百万Token输出价格由2元提高至空闲时段4.5元...

  3. 2026-09-10 17:00 | 新浪财经:DeepSeek V4.1 Flash转正,模型价格战继续
    阅读原文

    “鲸鱼回来了。”9月10日,经过两天内测,DeepSeek正式发布V4.1 Flash模型。对普通用户而言,最直观的变化是生成速度更快了;对开发者而言,则是调用成本进一步下降。凭借性能提升与价格下探,DeepSeek巩固了其在高性价比模型市场中的位置。相比内测的信息,这一次DeepSeek放出了更多基准测试和细节介绍,首次披露了V4.1 Flash采用的非对称模型结构,可以用小成本输出“大智能”。DeepSeek还在公告中提到了与腾讯的合作,腾讯旗下的WorkBuddy、CodeBuddy和OpenCode一起成为V4.1 Flash的官方合作伙伴,并已全量接入新模型。值得注意的是,在Deep...

  4. 2026-09-10 16:16 | 36氪:DeepSeek V4.1 Flash发布,用pro的能力收flash的钱
    阅读原文

    图片由AI生成 9月10日,DeepSeek正式发布V4.1 Flash,同步下调API价格,并宣布将于北京时间9月14日12时下线V4 Pro服务,相关请求随后转由新模型处理。 按照DeepSeek官方的说法,V4.1 Flash在性能、费用、速度和任务总用时等指标上已全面超越V4 Pro。这款采用新架构、原生支持视觉理解的模型,开始接过上一代Pro的位置。 此次更新的重点,也由此落在了三个相互关联的变化上:新架构提升能力与效率,视觉理解并入主力模型,更低的价格让开发者有机会把更多工作交给Flash。 01、5520亿参数,输入与输出采用不同计算规模 V4.1 Flash...

  5. 2026-09-10 15:11 | 新浪财经:DeepSeek发布最新模型V4.1 Flash
    阅读原文

    C114讯 9月10日消息(岳明)今天,DeepSeek V4.1 Flash模型正式发布。DeepSeek方面表示,这是该公司全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。据悉,DeepSeek V4.1 Flash为552B参数的MoE模型,采用了全新的Causal-Encoder-Decoder结构,输入和输出不对称,输入激活只有8B,输出激活16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括...

  6. 2026-09-10 14:59 | 新浪财经:DeepSeek V4.1 Flash正式发布:性能超V4 Pro,API 定价同步下调
    阅读原文

    【TechWeb】9月10日消息,DeepSeek官宣正式发布全新模型 DeepSeek V4.1 Flash。该模型是 DeepSeek 全新模型结构系列中尺寸最小的版本,具备原生多模态视觉理解能力。据官方介绍,新模型结构的设计初衷是追求更高的能力上限、更快的推理速度、更大的吞吐量,并可扩展至更大参数规模的模型。非对称结构实现“小成本大智能”DeepSeek V4.1 Flash 采用 552B 参数的 MoE 架构,并引入全新的 Causal-Encoder-Decoder 结构。其输入与输出不对称:输入激活仅为 8B,输出激活为 16B,成本显著低于已知的同尺寸模型。同时,该模型采用新的...

  7. 2026-09-10 14:09 | 澎湃新闻:DeepSeek V4.1 Flash发布:具备原生多模态视觉理解能力,下调API定价
    阅读原文

    今天,我们正式发布 DeepSeek V4.1 Flash 模型。这是我们全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。非对称模型结构,小成本大智能DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 Deep...

  8. 2026-09-10 14:09 | t.cj.sina.com.cn:DeepSeek正式发布V4.1 Flash
    阅读原文

    今天,我们正式发布 DeepSeek V4.1 Flash 模型。这是我们全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。非对称模型结构,小成本大智能DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 Deep...

  9. 2026-09-10 13:50 | IT之家:DeepSeek V4.1 Flash 模型正式发布:全面超越 V4 Pro、原生多模态视觉理解,API 定价下调
    阅读原文

    IT之家 9 月 10 日消息,深度求索今日正式发布 DeepSeek V4.1 Flash 模型。这是其全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。新模型结构的设计初衷是:能力上限更高、推理速度更快、吞吐更大、可扩展到更大参数模型。DeepSeek V4.1 Flash 为 552B 参数的 MoE 模型,采用了全新的 Causal-Encoder-Decoder 结构,输入和输出不对称,输入激活只有 8B,输出激活 16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash 还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括 De...

  10. 2026-09-10 13:45 | 中华网:DeepSeek今日降价,但大模型竞争不再只拼API单价
    阅读原文

    (图源:视觉中国)蓝鲸新闻9月10日讯(记者卢思叶)9月9日,DeepSeek连续更新多个动态。DeepSeek开放平台先是公告,自9月10日12时起将对Flash系列模型降价,后又宣布10日前后将正式发布V4.1Flash模型,在性能、费用、速度、总用时等各项指标上全面超越V4Pro。具体看这次降价,空闲时段输入缓存命中价格由此前每百万Tokens 0.05元降至0.02元,降幅60%;缓存未命中由1.5元降至1元,降幅约33%;输出则由4.5元降至4元,降幅约11%。高峰时段价格仍为空闲时段的2倍。这次价格调整距离8月13日DeepSeek V4 Pro正式版上线时的涨价,还不到一个月,D...

  11. 2026-09-10 11:42 | 新浪财经:券商进场!DeepSeek筹备科创板IPO!
    阅读原文

    2026年9月9日,有市场消息称,DeepSeek已委托中信证券(27.600, 0.27, 0.99%)筹备科创板IPO。21世纪经济报道记者从知情人士处获悉,该消息属实。目前,中信证券已与DeepSeek方面接洽并进入尽职调查阶段,但双方尚未签订正式的上市辅导协议。今年6月,DeepSeek首轮融资落地。天眼查显示,本轮融资总额达510亿元人民币,投后估值近4000亿元,创下目前国内AI行业单轮融资规模最高纪录。详见《510亿!DeepSeek完成首轮融资!》。据交易公开信息显示,本轮融资由创始人梁文锋领投,腾讯、宁德时代(338.060, 1.22, 0.36%)、网易、京东、IDG资本...

  12. 2026-09-10 11:14 | 新浪财经:DeepSeek涨价不足1月又宣布最高降价6成
    阅读原文

    围绕AI模型使用费,价格竞争越来越激烈DeepSeek在8月中旬才刚刚上调过价格。但9月9日宣布,自10日起下调旗舰模型“V4”部分服务的使用费。在DeepSeek涨价之后,竞争对手抓住机会,接连推出低价模型……  中国AI初创企业DeepSeek于9月9日宣布,自10日起下调旗舰模型“V4”部分服务的使用费,最高降幅达60%。该公司在8月中旬才刚刚上调过价格。此次降价意在通过价格战对抗竞争对手。  V4系列包含主打响应速度的“V4-Flash”以及擅长更复杂任务处理的“V4-Pro”等版本。本次的降价对象为V4-Flash。输入、输出每100万token的单价下调11%~60%。  Deep...

  13. 2026-09-10 03:37 | 36氪:DeepSeek V4.1 Flash上线,崔添翼加入“义父之战”
    阅读原文

    就在DeepSeek测试V4.1 Flash中间版的两天后,V4.1 Flash就正式上线了。 总参数552B的MoE模型,采用了全新的Causal-Encoder-Decoder非对称结构。输入激活只有8B、输出激活16B,推理成本大幅低于同尺寸模型,还原生支持多模态视觉理解,无需外挂视觉模块。 并且通过KV Cache压缩,对显存需求需求降至上一代的1/4、SSD降至1/8,社区实测输出速度达300到500 tokens/秒。 通常来说,又小又快的模型性能也就越低。然而V4.1 Flash不一样,各项基准全面超越V4 Pro,GPQA Diamond达90.9。 而且它还降...

  14. 2026-09-10 02:23 | 36氪:刚刚,DeepSeek新模型上线,长文本缓存硬盘占用暴降88%
    阅读原文

    智东西9月10日报道,刚刚,DeepSeek正式发布DeepSeek V4.1 Flash,该模型采用全新架构,是一款552B参数的MoE模型,为DeepSeek全新模型架构系列中尺寸最小的成员,在性能上超越了包括DeepSeek V4 Pro在内的一众旗舰模型。  模型开源地址: https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash 论文链接: https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash/blob/main/DeepSeek_V41_Tech_Report...

  15. 2026-09-09 23:08 | 新浪财经:DeepSeek的烦恼:任务越来越多,人不够用了
    阅读原文

    (来源:财闻) 9月7日晚,DeepSeek Harness团队负责人崔添翼在社交平台公开招聘,一次性释放约150个名额。 以“小团队、高人才密度”著称的DeepSeek,开始大规模补充工程人员。9月7日晚,DeepSeek Harness团队负责人崔添翼在社交平台公开招聘,一次性释放约150个名额。他称,这是“前所未有的150个HC的招聘需求”,公司目前有“很多新方向、新系统、新需求需要搞”。两天后,DeepSeek又宣布下调Flash系列API价格,缓存命中输入价格最高下降60%。相比价格变化,此次招聘更能反映DeepSeek在业务规模扩大后...

  16. 2026-09-09 20:55 | 华尔街见闻:DeepSeek为什么在这个节点降价?
    阅读原文

    竞争压力与新品上线前夕,迫使DeepSeek对旗舰轻量模型实施降价,但此举并未改变其在细分市场的定价劣势。 9月9日,DeepSeek宣布对V4 Flash模型实施降价,自次日起生效。此次调整覆盖非峰值时段的缓存输入、非缓存输入及输出三项定价,降幅分别为60%、33%和11%。调整后,非缓存输入价格降至每百万token人民币1.5元,缓存输入降至0.03元,输出降至6元。 据追风交易台消息,摩根士丹利分析师Gary Yu、Lydia Lin及Yang Liu认为,此次降价有两重驱动力:一是来自阿里巴巴旗下Qwen3.8-flash及智谱AI GLM5.3-flash的竞争压力,两款模型均于今年...

  17. 2026-09-09 17:27 | 华尔街见闻:Deepseek官宣降价!缓存命中单价0.02元、未命中1元,价差50倍
    阅读原文

    李佳 09-09 17:27 DeepSeek将于9月10日调整API定价,重点优惠缓存命中场景:闲时命中价0.02元/千token,未命中价1元,价差50倍。新策略鼓励开发者提高上下文复用率,降低长文本、高频调用成本,同时引导错峰使用以优化算力效率,重点吸引RAG、代码助手等高粘性用户。 DeepSeek再度调整API定价策略,这次并非简单的全面降价,而是将降价重点放在“缓存命中”上,同时引入高峰、空闲时段差异化计费,进一步瞄准高频调用和长上下文场景。 根据DeepSeek开放平台公告,Flash系列将于北京时间2026年9月10日12:00起实施新定价。空闲...

  18. 2026-09-09 13:18 | 新浪财经:涨价不到一个月,DeepSeek宣布降价,最高降幅60%
    阅读原文

    转自:红星新闻红星资本局9月9日消息,DeepSeek在开放平台发布公告,宣布从9月10日12:00起,正式下调其flash系列模型的定价。本次降价主要针对输入(缓存命中)场景,降幅显著,高达60%。▲图据DeepSeek官网此外,输入(缓存未命中)及输出价格降幅分别为33.33%和11.11%。调整后,空闲时段输入(缓存命中)价格由每百万Tokens0.05元降至0.02元,输入(缓存未命中)价格由1.5元降至1元,输出价格由4.5元降至4元。DeepSeek表示,价格区分“空闲时段”与“高峰时段”,高峰时段价格是空闲时段价格的2倍。高峰时段为北京时间周一至周五的9:00-12:00和14:...

  19. 2026-09-09 12:38 | 新浪财经:DeepSeek下调Flash系列模型定价,最高降幅60%,人工智能主题指数盘初涨超1%后回落
    阅读原文

    截至2026年9月9日午间收盘,中证人工智能主题指数(930713)下跌0.53%,盘初最高涨超1%。成分股中航成飞(65.270, 3.06, 4.92%)上涨5.32%,光迅科技(185.100, 5.18, 2.88%)上涨2.96%,中际旭创(911.990, 9.62, 1.07%)上涨0.93%,复旦微电(53.860, 0.25, 0.47%)、新易盛(417.630, 1.23, 0.30%)等个股跟涨。消息面上,9月9日,DeepSeek在官方开放平台宣布,将于北京时间2026年9月10日12:00起,调整flash系列模型的定价:空闲时段输入缓存命中单价0.02元、输入缓存...

  20. 2026-09-09 11:43 | t.cj.sina.com.cn:DeepSeek官宣降价!Flash系列全线下调,最高直降60%
    阅读原文

    DeepSeek官宣降价!Flash系列全线下调,最高直降60%#DeepSeek##Flash系列##AI##大模型##人工智能##黑科技[超话]#

  21. 2026-09-09 11:23 | 新浪财经:DeepSeek官宣flash系列模型降价 最高直降60% 9月10日中午起执行峰谷新价
    阅读原文

    【TechWeb】9月9日,DeepSeek在开放平台发布价格调整公告,宣布自北京时间2026年9月10日12:00起调整flash系列模型定价,继续采用峰谷分时计费模式,其中缓存命中输入价格最高直降60%。调整后,空闲时段(每百万Token)价格为:输入缓存命中0.02元、输入缓存未命中1元、输出4元;高峰时段价格为空闲时段的2倍,即缓存命中0.04元、缓存未命中2元、输出8元。高峰时段划定为北京时间周一至周五9:00-12:00、14:00-18:00,其余时间均为空闲时段。对比旧价,本次降价幅度明显:空闲时段输入缓存命中价格由0.05元降至0.02元,降幅60%;输入缓存未命中由1.5元...

  22. 2026-09-09 10:28 | 界面新闻:DeepSeek官宣flash模型新定价,缓存命中单价低至0.02元,南方基金司南投顾关注AI降本与商业化平衡
    阅读原文

    基金那些事儿 18分钟前 南方基金司南投顾关注AI产业链从算力向应用扩散的机会,通过组合配置分散单一环节的波动风险。 9月9日,DeepSeek开放平台公告,将于9月10日12:00起调整flash系列定价:空闲时段输入缓存命中单价0.02元、输入缓存未命中单价1元,输出单价4元;高峰时...

  23. 2026-09-09 09:54 | 新浪财经:DeepSeek将调整flash系列定价
    阅读原文

    来源:上海证券报·中国证券网上证报中国证券网讯 DeepSeek开放平台公告,将于北京时间2026年9月10日12:00起,调整flash系列定价:空闲时段输入缓存命中单价0.02元、输入缓存未命中单价1元,输出单价4元;高峰时段价格为空闲时段价格的2倍。 海量资讯、精准解读,尽在新浪财经APP ...

  24. 2026-09-09 09:12 | 观点网:DeepSeek调整flash系列定价 空闲输出4元高峰2倍
    阅读原文

    DeepSeek开放平台9月9日公告,自北京时间9月10日12时起调整flash系列定价:空闲时段输入缓存命中单价0.02元、未命中1元、输出4元,高峰时段价格为空闲时段价格的2倍。 观点网讯:9月9日,DeepSeek开放平台发布公告,自北京时间9月10日12时起调整flash系列模型定价:空闲时段输入缓存命中单价0.02元,输入缓存未命中单价1元,输出单价4元;高峰时段价格为空闲时段价格的2倍。 公告明确,高峰时段为北京时间周一至周五9时至12时、14时至18时,其余时间均为空闲时段。 免责声明:本文内容与数据由观点根据公开信息整理,不构成投资建议,使用前请核实。

  25. 2026-09-09 08:28 | 爱范儿:早报|库克看到华为三星后,推动苹果加速研发折叠屏iPhone/小米中折叠「卖爆了」,首销增长310%​/《旅行青蛙・中国之旅》12月8日停运
    阅读原文

    ⚡看到华为三星折叠机受关注后,库克推动苹果加速研发折叠屏 iPhone 🧠OpenAI 发布 Navier–Stokes 千禧年难题候选解,等待数学界检验 🏷️DeepSeek Flash 系列 9 月 10 日起降价,V4.1 Flash 同步开启内测 🚗两部门要求车企定期报告供应商账期,重点企业每年接受评估 🏢小米中折叠「卖爆了」,首销较上代大折叠增长 310% 💻曝微信 PC 版接入 AI 助手「小微」,可操作聊天与小程序 💼蔚来与云南交投新一批高速换电站投运,覆盖 5 条高速双向服务区 🤖DeepSeek 新开约 150 个工程岗位,聚焦后端与 Agent 弹性计算 🤝...

  26. 2026-09-09 07:54 | 界面新闻:DeepSeek官宣调整flash系列模型定价
    阅读原文

    9月9日,DeepSeek开放平台公告,将于北京时间2026年9月10日12:00起,调整flash系列定价:空闲时段输入缓存命中单价0.02元、输入缓存未命中单价1元,输出单价4元;高峰时段价格为空闲时段价格的2倍。高峰时段是指北京时间周一至周五9:00-12:00、14:00-18:00(其余为空闲时段)。

  27. 2026-09-09 06:39 | IT之家:DeepSeek 官宣明日 flash 系列 AI 模型降价:输出为每百万 Token 4 元
    阅读原文

    IT之家 9 月 9 日消息,据 DeepSeek 开放平台公告,官方宣布将于北京时间明日(2026 年 9 月 10 日)12 时起执行新价格,调整 Flash 系列定价。根据明日调整的新价格:空闲时段:输入缓存命中价格为每百万 Token 0.02 元输入缓存未命中为每百万 Token 1 元输出为每百万 Token 4 元高峰时段各项价格均为上述空闲时段价格的两倍。IT之家查询公开资料,Flash 系列目前包含 deepseek-v4-flash 和  deepseek-v4-flash-vision-exp 两款模型,附上两款模型价格调整对比表格如下:价格deepseek-v4-fla...

  28. 2026-09-09 06:04 | 36氪:DeepSeek想赚钱,最大的对手却是自己
    阅读原文

    DeepSeek史上最声势浩大的一次全面涨价, 只持续了23天。 8月17日,DeepSeek正式调整V4系列的API价格。无论是主打性价比的Flash,还是能力更强的Pro,输入和输出价格都明显上涨。 有的媒体甚至在精打细算之下,算出了高达1100% 的涨幅。 当时不少人都觉得,那个靠低价震惊世界的DeepSeek,终于也准备认真赚钱了。  结果新价格还没满月,DeepSeek又突然宣布降价。价格松动的,是负责走量、主打性价比的Flash模型。  从9月10日12点开始, Flash系列的缓存命中输入最高降价60%,缓存未命中输入降价约33%,输出价格也有所下调 。  ...

  29. 2026-09-08 21:29 | 36氪:DeepSeek官宣大降价:最高降60%
    阅读原文

    机器之心·2026年09月09日 12:29谷价基本回到涨价前。 本周二晚间,DeepSeek 开放平台发布公告,计划再次调整大模型 API 定价,这次是喜闻乐见的降价。 闲时价格统一为:输入(缓存命中)0.02 元、输入(缓存未命中)1 元、输出 4 元(单位均为元 / 百万 token)。高峰时段价格仍为空闲时段的两倍,即缓存命中 0.04 元、缓存未命中 2 元、输出 8 元。 本次调整只涉及 V4-Flash 系列,定位更高的 V4-Pro 价格维持不变。新价格将在北京时间 9 月 10 日 12:00 生效。 官方同时明确,高峰时段为北京时间周一至...

  30. 2026-09-08 19:26 | 36氪:DeepSeek开始追求极致的“智能密度”
    阅读原文

    DeepSeek 给新Flash出了一道题:能不能把自己的Pro替下来? 昨天,V4.1 Flash中间版本开启内测。新的模型结构、原生多模态、更快的速度,都是公告里的卖点。但在配套反馈问卷中,DeepSeek直接问用户:“你觉得这个模型能全面替换线上的 DeepSeek V4 Pro 么”。 好嘛,我打我自己。DeepSeek正在测试,把flash到底从效果上能不能超过pro,能不能交给更便宜、更适合大量调用的型号。 Pro 与 Flash 之间,本来就有实实在在的价格差。目前高峰时段每百万输出 token,Flash 收 9 元,Pro 收 27 元。 但是就在刚才,...

其他新闻

查看全部