返回新闻列表
2026-08-15 09:14

DeepSeek V4 Pro 登陆硅基流动:1M 上下文,缓存价格低至 0.44 美元

文本核心速览
  1. Day-0 首发硅基流动DeepSeek-V4-Pro-0813 在硅基流动 Day-0 首发,支持 1M 上下文窗口与低/高/最大三档推理强度,主攻编码、工具调用和智能体工作流,MIT 协议保持不变。
  2. 缓存定价低至 0.44 美元输入 1.32 美元/百万 token,输出 3.96 美元,缓存命中仅 0.44 美元。这一价格显著降低长上下文与重复调用场景的成本,适合频繁触发相似提示词的自动化任务。
  3. Flash 与 Pro 定位互补同系列 V4 Flash 面向追求速度与性价比的日常生产负载,V4 Pro 则侧重复杂推理、编码与智能体工作流,两者按实际场景清晰分流,用户可按需选择。
  4. 适配长文档与 Agent 服务V4 Pro 面向超长文档或代码库、高频工具调用及多轮复杂推理设计。缓存成本优势使长期运行、反复查询的 Agent 服务成为可能,配合 MIT 协议便于灵活集成。

DeepSeek V4 Pro 登陆硅基流动:百万上下文、三档推理强度,主打 Agent 工作流

DeepSeek-V4-Pro-0813 现已正式上线硅基流动 SiliconFlow,并实现了 Day-0 首发。本次更新围绕三个关键数字展开:1M 上下文窗口低/高/最大三档推理强度,以及更明确的产品取向——将重心放在编码、工具调用和智能体工作流上。开源协议维持 MIT 不变。

定价结构:缓存命中成为亮点

官方公布了清晰的定价方案:

  • 输入:每百万 token 1.32 美元
  • 输出:每百万 token 3.96 美元
  • 缓存命中:每百万 token 仅 0.44 美元

其中,缓存命中价格是本次最值得关注的数字。对于大量依赖重复调用和长上下文输入的 Agent 工作流来说,将缓存成本压到这一水平,意味着长文本场景下的单位成本测算有了更具体的锚点,不再需要担心一跑长上下文就烧穿预算。

实际使用中,合理利用缓存机制可大幅降低长期运行成本,尤其适合频繁触发相似提示词的自动化任务。

同系列定位差异:Flash 与 Pro 各司其职

在硅基流动同系列中,还陈列着 DeepSeek-V4-Flash-0731,其定位与 Pro 版本截然不同:

  • V4 Flash:面向追求速度与高性价比的日常生产负载,走“快而省”的路线。
  • V4 Pro:瞄准复杂推理、编码和智能体工作流,更强调“思考能力”。

两个型号一快一重,将日常生产与重度推理的档位清晰分开,用户可以根据实际场景灵活选择。

适用场景与影响

从配置与定价来看,V4 Pro 显然是为以下需求设计:

  1. 需要处理超长文档或代码库的开发者;
  2. 高频调用工具(Function Calling)的智能体应用;
  3. 需要多轮复杂推理的自动化流程;
  4. 对成本敏感、但要求高吞吐的长上下文服务。

缓存命中价格的优势,使得构建长期运行、反复查询的 Agent 服务成为可能。结合 MIT 开源协议,团队可在内部系统或商业产品中灵活集成。

结语

DeepSeek V4 Pro 的登场,补全了 V4 系列在高端推理侧的拼图。百万级上下文与三档推理强度的组合,配合极具竞争力的缓存定价,将推动更多开发者把复杂任务迁移到大模型工作流中。对于中文开发者而言,硅基流动的同步首发也降低了接入门槛。

可以预见,随着模型能力的迭代与推理成本的持续下探,AI 原生应用将迎来更广阔的设计空间。

来源: aibase阅读原文

其他新闻

查看全部