2026-08-15 09:14
DeepSeek V4 Pro 登陆硅基流动:1M 上下文,缓存价格低至 0.44 美元
文本核心速览
- Day-0 首发硅基流动—DeepSeek-V4-Pro-0813 在硅基流动 Day-0 首发,支持 1M 上下文窗口与低/高/最大三档推理强度,主攻编码、工具调用和智能体工作流,MIT 协议保持不变。
- 缓存定价低至 0.44 美元—输入 1.32 美元/百万 token,输出 3.96 美元,缓存命中仅 0.44 美元。这一价格显著降低长上下文与重复调用场景的成本,适合频繁触发相似提示词的自动化任务。
- Flash 与 Pro 定位互补—同系列 V4 Flash 面向追求速度与性价比的日常生产负载,V4 Pro 则侧重复杂推理、编码与智能体工作流,两者按实际场景清晰分流,用户可按需选择。
- 适配长文档与 Agent 服务—V4 Pro 面向超长文档或代码库、高频工具调用及多轮复杂推理设计。缓存成本优势使长期运行、反复查询的 Agent 服务成为可能,配合 MIT 协议便于灵活集成。
DeepSeek V4 Pro 登陆硅基流动:百万上下文、三档推理强度,主打 Agent 工作流
DeepSeek-V4-Pro-0813 现已正式上线硅基流动 SiliconFlow,并实现了 Day-0 首发。本次更新围绕三个关键数字展开:1M 上下文窗口、低/高/最大三档推理强度,以及更明确的产品取向——将重心放在编码、工具调用和智能体工作流上。开源协议维持 MIT 不变。
定价结构:缓存命中成为亮点
官方公布了清晰的定价方案:
- 输入:每百万 token 1.32 美元
- 输出:每百万 token 3.96 美元
- 缓存命中:每百万 token 仅 0.44 美元
其中,缓存命中价格是本次最值得关注的数字。对于大量依赖重复调用和长上下文输入的 Agent 工作流来说,将缓存成本压到这一水平,意味着长文本场景下的单位成本测算有了更具体的锚点,不再需要担心一跑长上下文就烧穿预算。
实际使用中,合理利用缓存机制可大幅降低长期运行成本,尤其适合频繁触发相似提示词的自动化任务。
同系列定位差异:Flash 与 Pro 各司其职
在硅基流动同系列中,还陈列着 DeepSeek-V4-Flash-0731,其定位与 Pro 版本截然不同:
- V4 Flash:面向追求速度与高性价比的日常生产负载,走“快而省”的路线。
- V4 Pro:瞄准复杂推理、编码和智能体工作流,更强调“思考能力”。
两个型号一快一重,将日常生产与重度推理的档位清晰分开,用户可以根据实际场景灵活选择。
适用场景与影响
从配置与定价来看,V4 Pro 显然是为以下需求设计:
- 需要处理超长文档或代码库的开发者;
- 高频调用工具(Function Calling)的智能体应用;
- 需要多轮复杂推理的自动化流程;
- 对成本敏感、但要求高吞吐的长上下文服务。
缓存命中价格的优势,使得构建长期运行、反复查询的 Agent 服务成为可能。结合 MIT 开源协议,团队可在内部系统或商业产品中灵活集成。
结语
DeepSeek V4 Pro 的登场,补全了 V4 系列在高端推理侧的拼图。百万级上下文与三档推理强度的组合,配合极具竞争力的缓存定价,将推动更多开发者把复杂任务迁移到大模型工作流中。对于中文开发者而言,硅基流动的同步首发也降低了接入门槛。
可以预见,随着模型能力的迭代与推理成本的持续下探,AI 原生应用将迎来更广阔的设计空间。
来源: aibase阅读原文