Fine-tuned gpt-oss-20b for Claude Code integration and Harmony tool calls, quantized to 4-bit for Apple Silicon via mlx-lm .
基于相同分类「同类」推荐的模型

DeepSeek V4 Pro 是 DeepSeek 推出的大规模混合专家(Mixture-of-Experts)模型,总参数量 1.6T,激活参数 49B,支持 1M token 的上下文窗口。其设计面向高级推理、编程和长周期智能体工作流,在知识、数学和软件工程基准测试中均表现出色。与 DeepSeek V4 Flash 基于相同架构,它引入了混合注意力系统,以实现高效的长上下文处理。支持 `high` 和 `xhigh` 两种推理强度,其中 `xhigh` 对应最大推理。它非常适合全代码库分析、多步骤自动化和大规模信息整合等复杂工作负载,这些场景对能力和效率都要求极高。

DeepSeek V4 Flash 0731 是 DeepSeek 公司推出的一款稀疏混合专家(MoE)大语言模型,总参数量达 284B,其中每次推理仅需激活 13B 参数。该版本经过了重新训练与调优,专为编程、推理和智能体(Agent)工作流等场景设计。得益于稀疏 MoE 架构,模型在保持大规模知识容量的同时,显著降低了计算与内存开销,能够以较低延迟处理复杂任务,非常适合部署于对效率与成本有实际要求的各类生产环境。

上海人工智能实验室
InternLM2.5_1.8B_Chat 是基于 InternLM2.5 基座模型优化的对话模型,经有监督微调和 online RLHF 训练,具备指令遵循、共情聊天及工具调用能力,适用于下游对话交互应用。

科大讯飞
Spark Lite Patch(星火精简补丁版)是科大讯飞 (iFLYTEK) 讯飞星火认知大模型系列中的一个特定版本或称呼.