Microsoft正加速把Windows打造成AI代理的核心运行平台,并提出“混合智能”战略,即根据任务场景,在PC端与云端之间灵活分配AI负载,由更适合的一端完成推理与执行。
Microsoft Windows + Devices执行副总裁Pavan Davuluri当地时间7日在官方博客发文称,公司正将Windows建设为“混合智能”的核心平台,并进一步披露了相关产品路线与差异化方向。
在模型层面,Microsoft首先从今年5月在Build开发者大会上发布的编码模型MAI Code 1.1 Flash入手。该公司已对模型进行压缩,压缩后体量缩小近80%,以便在PC端本地运行。该模型总参数量为1370亿,激活参数为68亿。
硬件方面,搭载NVIDIA RTX Spark的Surface Laptop Ultra最高可配备128GB统一内存,可在本地运行1200亿参数以上模型。计划于今年底推出的DGX Station Windows版,则可运行万亿参数级模型,并支持同时运行至少32个AI代理,承担团队级Token处理平台的角色。
成本控制是Microsoft推动“混合智能”的重要卖点之一。GitHub的HydraFusion可让用户根据任务选择合适的AI模型。该功能此前仅支持云端模型,如今已扩展至支持在PC端运行的模型。按照Microsoft的说法,能够在本地完成的任务将尽可能留在PC端处理,以降低云端开销。
Pavan Davuluri表示,随着AI模型规模持续扩大,单纯依赖云端预算已难以覆盖全部需求,客户希望在不牺牲前沿性能的前提下,尽可能减少Token消耗。
除成本外,安全也是Microsoft重点强调的方向。Microsoft已在Windows 11中正式推出MXC(Microsoft Execution Containers)。这一机制可限制AI代理可访问的文件和网络范围,并在运行过程中实施强制隔离与约束。
目前,OpenAI Codex和GitHub Copilot已开始支持MXC;Meta个人AI代理Muse也计划以可在MXC中运行的Windows应用形式推出。与此同时,Microsoft还将提供AI代理操作追溯能力,并通过Agent 365与Intune对AI代理实施管理与控制。
Pavan Davuluri称,在本地完成推理,有助于企业和组织将敏感数据与知识产权保留在自身体系内。
按照Microsoft的介绍,在获得用户许可后,Copilot可读取PC中的文件以及近期工作上下文,并执行文件整理、问题排查等任务。相关能力将在未来数月内向Copilot+ PC推送。
从产品节奏来看,HydraFusion的本地协同能力将于10月底以实验版本推出;DGX Station Windows版以及基于RTX Spark的迷你台式机计划于今年底发布。通过Windows搜索框直接触发任务的功能,则将在短期内优先向Windows Insider实验频道用户开放。
不过,对Microsoft而言,要做大“混合智能”生态仍面临不小挑战。Anthropic Claude Code、Perplexity、Manus等公司虽已预告将支持MXC,但目前仍停留在承诺阶段。与此同时,由于MXC同样支持其他操作系统,市场也有观点认为,Microsoft仍需更清晰地证明,AI企业为何应优先选择Windows。对此,Microsoft强调,其与Windows的深度整合可提供从进程隔离到虚拟机的更广泛选项。
硬件能力也可能成为变量。本地运行大模型需要具备大容量统一内存的高性能PC。Microsoft称,RTX Spark PC相较Apple MacBook Pro 16英寸(M5 Pro),首Token响应速度最高可提升2.1倍,AI图像生成速度最高可提升4.3倍,视频生成速度最高可提升6.2倍;不过,上述数据均以峰值表现为口径。