微软宣布Windows引入本地云端混合智能
微软在北京时间10月8日的Windows发布会上宣布,将系统升级为同时调度本地与云端模型的混合AI平台。模型路由、Windows ML和本地算力将根据任务复杂度、成本及隐私要求自动选择执行位置,GitHub Copilot的HydraFusion也将在10月晚些时候支持直接调用Windows PC上的本地模型,并陆续覆盖应用、CLI和VS Code。
黄仁勋与微软CEO Satya Nadella回顾了双方数十年的合作。黄仁勋称,Windows 95、DirectX、GeForce和CUDA共同推动GPU从图形处理走向通用计算;微软早期基于InfiniBand建设的Azure高性能计算基础设施,后来也成为OpenAI训练GPT模型的重要底座。两人认为Agent正成为新的“电脑用户”,操作系统需要原生提供隔离、身份、权限、治理和可观测性,MXC可能成为下一代Agent基础设施。
微软正通过量化和Windows ML把更大模型带到终端。MAI Code 1.1 Flash拥有1370亿总参数、68亿激活参数,约3比特量化后体积缩小近80%,仍保留256K上下文;英伟达超过700亿参数的Nemotron量化到2比特后占用略高于20GB,DeepSeek V4 Flash经1.66比特量化后可在本地运行,占用约60GB。Windows ML还将引入Llama.cpp,支持模型在GPU、NPU和CPU间运行。
GitHub Copilot新版自动模式可把代码清理、问题分诊等简单任务交给本地模型。演示中,云端GPT-6 Luna负责主任务,同时启动3个本地子Agent并行构建和测试,其中一次本地会话输入约166万Token、输出约1.05万Token,不产生额外云端模型费用。Windows Copilot则新增本地上下文、本地操作和本地模型能力,Copilot Home可理解本机文件,Copilot Code支持生成原生Windows应用并通过MXC沙箱执行代码。
微软还展示了企业级Autopilot:它能读取会计邮件、寻找并整理报税材料、生成ZIP压缩包,再起草回复邮件;涉及税务信息的文件处理由本地模型完成,发送前仍需用户确认。Hermes、OpenClaw和Perplexity等Agent已开始构建Windows体验,常驻Agent可通过原生Gateway部署在长期运行的迷你“Claw Box”上。
硬件方面,超过40%的商用笔记本已属于Copilot+ PC,相关设备每月本地完成超过2万亿次推理。Surface Laptop Ultra搭载英伟达RTX Spark,最高配备128GB统一内存、提供1 PFLOP AI算力;Windows版DGX Station则可本地运行Llama 4 Maverick、Kimi K2.6及超过1万亿参数的DeepSeek V4 Pro。黄仁勋称,未来PC既服务于人,也将成为个人Agent使用的工具。Satya开玩笑称黄仁勋应“分一些市值”给微软,但微软股价当日仅涨约0.1%,次日下跌1.35%。
本文基于公开渠道信息整理,内容可能存在不准确或遗漏之处,不代表本站立场,如内容涉及侵权或错误,请联系我们处理。
阅读原文