
GLM-4-Long是智谱AI推出的长文本大模型,支持1M tokens(约150-200万字)上下文,100万tokens仅需1元。适用于小说创作、学术综述、代码文档生成等场景,提供“构思-初稿-润色”全流程支持。
GLM-4-Long是智谱AI推出的长文本大模型,支持1M tokens(约150-200万字)上下文,100万tokens仅需1元。适用于小说创作、学术综述、代码文档生成等场景,提供“构思-初稿-润色”全流程支持。
基于相同分类「同类」推荐的模型

DeepSeek V4 Pro 是 DeepSeek 推出的大规模混合专家(Mixture-of-Experts)模型,总参数量 1.6T,激活参数 49B,支持 1M token 的上下文窗口。其设计面向高级推理、编程和长周期智能体工作流,在知识、数学和软件工程基准测试中均表现出色。与 DeepSeek V4 Flash 基于相同架构,它引入了混合注意力系统,以实现高效的长上下文处理。支持 `high` 和 `xhigh` 两种推理强度,其中 `xhigh` 对应最大推理。它非常适合全代码库分析、多步骤自动化和大规模信息整合等复杂工作负载,这些场景对能力和效率都要求极高。

DeepSeek V4 Flash 0731 是 DeepSeek 公司推出的一款稀疏混合专家(MoE)大语言模型,总参数量达 284B,其中每次推理仅需激活 13B 参数。该版本经过了重新训练与调优,专为编程、推理和智能体(Agent)工作流等场景设计。得益于稀疏 MoE 架构,模型在保持大规模知识容量的同时,显著降低了计算与内存开销,能够以较低延迟处理复杂任务,非常适合部署于对效率与成本有实际要求的各类生产环境。
deburky
gpt-oss-claude-mlx

上海人工智能实验室
InternLM2.5_1.8B_Chat 是基于 InternLM2.5 基座模型优化的对话模型,经有监督微调和 online RLHF 训练,具备指令遵循、共情聊天及工具调用能力,适用于下游对话交互应用。