2026-10-08 06:40
AI123

微软GitHub Copilot将于本月底支持本地AI推理

10月8日消息,微软在10月7日于旧金山举行的发布会上宣布,GitHub Copilot将在2026年10月底前支持本地AI模型推理。开发者可在云端模型与设备端模型之间自动或手动切换,并可在GitHub Copilot CLI、Copilot应用与Visual Studio Code中设置偏好。

GitHub Copilot目前依赖云端托管模型,由协调器根据性能、成本与准确性路由请求。微软计划扩展该机制,允许Copilot自动选择云端模型与本地AI模型,后台统一协调推理任务。本地模型选择支持指定提供程序、模型或端点,开发者可通过Windows ML选择MAI Code 1.1 Flash,或连接OpenAI兼容的本地端点并选用其暴露的模型。

同时,微软推出MAI Code 1.1 Flash混合专家模型,总参数1370亿,活跃参数68亿,采用量化与推测解码技术优化响应速度与内存占用。该模型在Surface Laptop Ultra上实测,提示长度从2K到256K Token时,解码吞吐量介于每秒40至63个词元。

来源
  1. 2026-10-08 06:17 | IT之家:GitHub Copilot 不再纯云端 AI 模型:Surface Laptop Ultra 本地推理吞吐量最高每秒 63 词元
    阅读原文

    感谢IT之家网友 愚公骑马 的线索投递! IT之家 10 月 8 日消息,太平洋时间 10 月 7 日上午 10 点(北京时间 10 月 8 日凌晨 1 点)在美国旧金山举办的发布会中,微软宣布 GitHub Copilot 将在本月底前支持本地 AI 模型推理,开发者可在云端模型与设备端模型之间自动或手动切换。GitHub Copilot 是微软推出的 AI 编程助手,可集成于 Visual Studio Code、CLI 等工具,根据代码上下文生成补全、解释或重构建议。GitHub Copilot 目前依赖云端托管模型,由协调器根据性能、成本与准确性路由请求。微软计...

其他新闻

查看全部