据爱范儿报道,微软于10月7日举行围绕Windows和Surface的特别发布会,微软CEO萨提亚·纳德拉、Windows与设备执行副总裁帕万·达武鲁里和英伟达CEO黄仁勋同台,发布Surface Laptop Ultra,并推出围绕本地AI与Agent的Windows更新,核心是让AI任务在本地与云端之间调度。

Surface Laptop Ultra搭载NVIDIA RTX Spark Superchip,把Blackwell RTX GPU、Grace CPU和统一内存放进同一平台,最高提供128GB统一内存,可在本地运行超过1200亿参数的AI模型,并提供最高1 petaflop的AI性能。其起售价为2599.99美元,约合人民币17500元。微软官方展示的数据称,相比16英寸MacBook Pro(M5 Pro),Surface Laptop Ultra的首个Token生成快2.1倍,AI图像生成快4.3倍,AI视频生成快6.2倍。该机机身厚度低于18mm,重量低于4.5磅,配备15英寸PixelSense Ultra触摸屏,散热系统热容量最高达到现有Surface Laptop的2.5倍,并提供3个USB-C接口、HDMI、USB-A、SD读卡器和耳机接口,支持最多3台4K外接显示器,SSD可自行更换。它于10月7日开放预订,10月16日开始供货。

微软同时将RTX Spark扩展成Builder PC产品线,ASUS ProArt P16/P14、Dell XPS 16 Creator、HP OmniBook Ultra 16、Lenovo Yoga 9n 2-in-1、MSI Prestige N16 Flip AI+和Surface Laptop Ultra均已开放预订,10月16日开始发货。面向开发者,微软推出Surface RTX Spark Dev Box,售价5999美元,11月开始发货,预装Visual Studio Code、Git、GitHub CLI、GitHub Copilot、WSL、Python和Node,主要参数包括NVIDIA RTX Spark N1X、6144核GPU和20核CPU、128GB统一内存和2TB SSD。面向更高端工作负载,微软宣布DGX Station for Windows,搭载NVIDIA GB300 Grace Blackwell Ultra Desktop Superchip,最高提供748GB统一内存和20 petaflops的FP4 AI算力,可在本地运行超过一万亿参数的模型。

Windows的Agent能力也同步升级。Copilot被拆分为Home、Code和Autopilot三个体验:Home可读取用户正在处理的文件和近期活动,帮助整理协作材料;Code可根据提示创建原生Windows应用,并在更安全环境中运行代码;Autopilot继续向持续运行、主动执行任务的个人Agent发展。它们依赖本地上下文、本地操作和本地模型三种能力。现场演示中,Agent可以搜出散落的报税文件、打包成Zip并起草发给会计的邮件,全程不离开本机、每一步都要授权,还能用一句提示词生成一个原生Windows应用。Windows Search也将在任务栏直接执行数千种操作,用户可输入打开深色模式、开启勿扰模式、调暗屏幕、整理窗口或给某人发短信等指令。

针对Agent在个人电脑上运行带来的隐私和管理问题,微软推出Microsoft Execution Containers(MXC)。容器可在Agent运行过程中限制其能访问哪些文件和网络,并按照策略执行进程隔离、会话隔离、虚拟机、WSL和Windows 365 for Agents等不同层级的隔离。Codex、GitHub Copilot、OpenClaw、Replit、LM Studio、NVIDIA OpenShell和Unsloth已支持MXC,Claude Code、Box、Egnyte、Manus、Perplexity、Raycast等产品准备接入,Meta的Muse for Windows之后也会以原生应用形式集成MXC。微软希望Windows成为所有Agent的默认运行环境。

这场发布会的核心词是“混合智能”。微软官方博客称,混合智能是让智能体在该用本地算力时跑在本地、需要云端时连接云端,并以组织期待的安全性和可管理性运行。纳德拉在7月底的财报电话会上曾表示,Windows可以成为不计量智能的承载端。为支撑这一定位,微软自研的MAI Code 1.1 Flash拥有1370亿总参数和68亿活跃参数,经过3-bit处理后模型体积缩小近80%,并支持在本地使用256K上下文;英伟达即将推出的Nemotron模型有700多亿参数,2-bit量化后占20GB出头内存;2840亿参数的DeepSeek V4 Flash也将成为混合智能的重要本地模型。GitHub的HydraFusion从云端路由扩展到Windows,自动判断任务该用本地还是云端模型;Windows ML宣布支持llama.cpp,可把模型部署到GPU、NPU和CPU上。