大模型大全
一站式收录主流AI大模型,帮你快速找到合适的。
模态
许可证
提供商

DeepSeek V4 Pro
DeepSeek V4 Pro 是 DeepSeek 推出的大规模混合专家(Mixture-of-Experts)模型,总参数量 1.6T,激活参数 49B,支持 1M token 的上下文窗口。其设计面向高级推理、编程和长周期智能体工作流,在知识、数学和软件工程基准测试中均表现出色。与 DeepSeek V4 Flash 基于相同架构,它引入了混合注意力系统,以实现高效的长上下文处理。支持 `high` 和 `xhigh` 两种推理强度,其中 `xhigh` 对应最大推理。它非常适合全代码库分析、多步骤自动化和大规模信息整合等复杂工作负载,这些场景对能力和效率都要求极高。

DeepSeek V4 Flash 0731
DeepSeek V4 Flash 0731 是 DeepSeek 公司推出的一款稀疏混合专家(MoE)大语言模型,总参数量达 284B,其中每次推理仅需激活 13B 参数。该版本经过了重新训练与调优,专为编程、推理和智能体(Agent)工作流等场景设计。得益于稀疏 MoE 架构,模型在保持大规模知识容量的同时,显著降低了计算与内存开销,能够以较低延迟处理复杂任务,非常适合部署于对效率与成本有实际要求的各类生产环境。

Internlm2.5 1.8b Chat
InternLM2.5_1.8B_Chat 是基于 InternLM2.5 基座模型优化的对话模型,经有监督微调和 online RLHF 训练,具备指令遵循、共情聊天及工具调用能力,适用于下游对话交互应用。

Grok 2 Mini
Grok-2 mini 是 xAI 推出的轻量化 AI 模型,基于 Grok-2 优化,特点为快速响应、文本交互友好,适用于简单文本任务。支持多语言处理,可集成实时检索能力,应用于问答、信息检索及基础文本生成。

Spark Lite Patch
Spark Lite Patch(星火精简补丁版)是科大讯飞 (iFLYTEK) 讯飞星火认知大模型系列中的一个特定版本或称呼.

Hunyuan Large Longcontext
Hunyuan-Large-Longcontext是腾讯开源的大语言模型,属MoE架构,总参389B、激活参52B,支持256K超长文本序列,Instruct模型支持128K。采用CLA结构与FP8量化优化,节省显存并提升吞吐,适配vLLM推理框架与Hugging Face生态,可用于长文档处理、代码生成等场景。

Grok 3 Mini
Grok-3 Mini是xAI推出的轻量级AI模型,属Grok-3系列,主打高效推理。特点:131K tokens上下文窗口,支持高推理模式(AIME竞赛得分超90),低推理模式平衡响应速度与准确性。适用于日常对话、邮件撰写、基础编程及中小学数学解题等场景。

Qianfan QI VL
Qianfan-QI-VL是百度开源的企业级通用视觉语言模型系列,包含3B/8B/70B参数量版本,基于Llama 3.1架构与InternViT视觉编码器,支持32k上下文长度与4K分辨率图像理解。核心特点包括文档理解与OCR增强、思维链推理(8B/70B支持)及多尺寸部署优化,适用于边缘实时光学字符识别、服务器端通用场景微调及复杂推理任务,可应用于文档识别、数学解题、图表分析等企业级多模态场景。

GLM 4 Long
GLM-4-Long是智谱AI推出的长文本大模型,支持1M tokens(约150-200万字)上下文,100万tokens仅需1元。适用于小说创作、学术综述、代码文档生成等场景,提供“构思-初稿-润色”全流程支持。

GPT 4.1 Mini
GPT-4.1 mini是OpenAI推出的中小型多模态模型,支持百万token上下文,可处理文本、图像及视频。性能媲美GPT-4o,MMMU测试得分73%超前代,延迟降半、成本减83%,适用于开发者API调用,处理长内容与视觉任务。

Cogview 4
CogView-4是智谱2025年发布的开源文生图模型,支持中英双语输入与任意分辨率图像生成,采用GLM-4 encoder提升中文语义理解,在DPG-Bench测试中综合评分第一,达开源SOTA水平,遵循Apache 2.0协议,适用于广告设计、教育插图等场景。

Deepseek R1 Distill Qwen 14B
DeepSeek-R1-Distill-Qwen-14B是基于Qwen架构的14B参数蒸馏语言模型,具备较强复杂任务处理能力与中等资源需求,适用于数据分析、智能推荐、自然语言处理及长文本生成等中等复杂度场景。