物界前沿 · 资讯情报卡(IT之家 · 2026/10/8)

微软为GitHub Copilot增加本地AI模型推理支持

核心事实

关键数据

1370亿MAI Code 1.1 Flash总参
68亿MAI Code 1.1 Flash活跃
每秒40-63词元解码吞吐量
2K-256K Token测试提示长度范围

物界观察

本地推理让Copilot摆脱云端依赖,对隐私敏感和网络受限的开发者是实质利好。但40-63词元/秒的吞吐仅够轻量补全,复杂重构仍得靠云端。微软此举更像卡位端侧AI入口,而非替代云端。

来源:IT之家原文 ↗