AI123AI123
AI 工具
资讯
教程/指南
排行榜
全球 AI 流量榜中国 AI 流量榜全球 AI 模型榜中国 AI 模型榜
技能市场
提示词
模型广场

© 2026 AI123. All rights reserved.

想让你的 AI 工具被更多人发现?申请收录
  1. 首页
  2. 模型
  3. DeepSeek V4 Flash 0731
DeepSeek V4 Flash 0731

DeepSeek V4 Flash 0731

开源

DeepSeek V4 Flash 0731 是 DeepSeek 公司推出的一款稀疏混合专家(MoE)大语言模型,总参数量达 284B,其中每次推理仅需激活 13B 参数。该版本经过了重新训练与调优,专为编程、推理和智能体(Agent)工作流等场景设计。得益于稀疏 MoE 架构,模型在保持大规模知识容量的同时,显著降低了计算与内存开销,能够以较低延迟处理复杂任务,非常适合部署于对效率与成本有实际要求的各类生产环境。

1024k上下文
868.6K下载量
3.0K点赞

性能基准

AA Agentic Index
48.4
AA Coding Index
69.1
AA Intelligence Index
51.8

快速链接

Hugging Face

技术规格

上下文窗口
1024k
训练数据截止日期
未知

API 定价

输入
$0.08/1M tokens
输出
$0.252/1M tokens

相似模型

基于相同分类「同类」推荐的模型

DeepSeek V4 Pro

DeepSeek V4 Pro

DeepSeek V4 Pro 是 DeepSeek 推出的大规模混合专家(Mixture-of-Experts)模型,总参数量 1.6T,激活参数 49B,支持 1M token 的上下文窗口。其设计面向高级推理、编程和长周期智能体工作流,在知识、数学和软件工程基准测试中均表现出色。与 DeepSeek V4 Flash 基于相同架构,它引入了混合注意力系统,以实现高效的长上下文处理。支持 `high` 和 `xhigh` 两种推理强度,其中 `xhigh` 对应最大推理。它非常适合全代码库分析、多步骤自动化和大规模信息整合等复杂工作负载,这些场景对能力和效率都要求极高。

1024kopen_source
gpt-oss-claude-mlx

gpt-oss-claude-mlx

deburky

gpt-oss-claude-mlx

Text131072proprietary
Internlm2.5 1.8b Chat

Internlm2.5 1.8b Chat

上海人工智能实验室

InternLM2.5_1.8B_Chat 是基于 InternLM2.5 基座模型优化的对话模型,经有监督微调和 online RLHF 训练,具备指令遵循、共情聊天及工具调用能力,适用于下游对话交互应用。

1985670979074003000kproprietary
Spark Lite Patch

Spark Lite Patch

科大讯飞

Spark Lite Patch(星火精简补丁版)是科大讯飞 (iFLYTEK) 讯飞星火认知大模型系列中的一个特定版本或称呼.

1985670066305372200kproprietary