资讯 · 改写稿

本地跑 1,200 亿参数与系统级 Agent 隔离:微软这波更新意味着什么

这一波更新最值得记住的不是某一台机器的参数,而是两条线同时往前走了:统一内存把大模型搬进笔记本,系统层则给「能在后台动你文件」的智能体加了一道可撤销的围栏。

10 月 7 日微软与英伟达在旧金山联合发布,硬件与系统两条线一起更新。硬件侧的关键词是「大内存与显存合一」;系统侧的关键词是「给后台跑着的智能体加一层系统级围栏」。

硬件:统一内存里装下 1,200 亿参数

主角是 Surface Laptop Ultra,芯片为 RTX Spark,最高配到 20 核 Grace CPU、6,144 核 Blackwell GPU 与 128GB 统一内存;微软的说法是本地可跑「超过 1,200 亿参数」的模型。屏幕 15 英寸、3:2、mini-LED 触控,峰值亮度 2,000 尼特。最低配(18 核 CPU、5,120 核 GPU、24GB 内存、512GB 存储)定价 2,599.99 美元,10 月 16 日发货;台式机 Dev Box 报 5,999 美元、11 月上架。

本站计算:按「每 10 亿参数 4-bit 量化约占 0.6GB」估,128GB 统一内存理论上能装约 213B 参数;官方口径「超过 1,200 亿」是留出了 KV 缓存、系统占用与显存共享之后的保守说法。也就是说,这一档机器真正的门槛不是「装不装得下」,而是「装下之后还剩多少给你自己跑别的东西」。显存与量化档位怎么配,可参考站内本地模型 4 步。

系统:MXC 给后台智能体加围栏

微软把「执行容器」(Microsoft Execution Containers,缩写 MXC)转为正式可用:它做的事,是给在后台跑着的智能体加一层系统级隔离。同期推出的「混合智能」则让 Copilot 在获得授权后读取本机文件与近期活动,用来整理文件、排查故障,并可按需选用本地或云端模型;新版 Copilot 被拆成 Home、Code、Autopilot 三块,会在未来几个月推给 Copilot+ PC。

把这两件事放一起看,方向很明确:要让智能体能碰本机文件与近期活动,前提是把它关进一个可撤销、可限权的容器里。权限边界怎么划,可对照站内执行容器那篇的做法。

顺带一条图像模型的价格

Google 同日把图像模型 Nano Banana 2.1 铺到 Gemini 应用、搜索 AI 模式、AI Studio、Flow、Stitch 与 Gemini Enterprise Agent Platform。按官方说法,它单次最多参考 14 张图,多轮编辑中最多维持 4 个角色与 10 个物体的连贯,支持 1:1 到 8:1 画幅的 4K 输出,成品带 C2PA 内容凭证。价格上,1K 图 0.0336 美元、4K 图 0.0756 美元,大致是上一代的一半;批量再打五折。

本站计算:4K 单价比 1K 高约 2.25 倍(0.0756 ÷ 0.0336);批量五折后 1K 约 0.0168 美元、4K 约 0.0378 美元一张。若一天出 100 张 4K,批量价下约 3.78 美元/天。

容易踩的坑

把「可本地跑 1,200 亿参数」当成「开箱即用」——还要装运行时、选量化、留 KV 缓存余量。

以为系统级隔离等于绝对安全——容器只是把爆炸半径限住,授权范围仍要自己收紧。

把新模型的「约上一代一半」当成所有档位都降——这里说的是牌价,批量还有自己的折扣规则。

自检清单

下一步:算清自己的显存能装多大模型,读 本地大模型 4 步;要给 Agent 划权限边界,读 执行容器。

常见问题

128GB 统一内存能跑多大的本地模型?

按每 10 亿参数 4-bit 约 0.6GB 估,理论上约 213B 参数;实际要扣掉系统占用与 KV 缓存,所以官方「超过 1,200 亿」是保守口径。

MXC 是什么?

微软执行容器(Microsoft Execution Containers),为在后台运行的 AI 智能体提供系统级隔离,已正式可用。

Nano Banana 2.1 贵吗?

1K 图每张 0.0336 美元、4K 每张 0.0756 美元,约为上一代一半,批量再打五折;具体以官方价目为准。

来源参考

以上为外部来源;本文为 RefHub 用自己的结构重写,事实以来源页为准,价格与政策会变,请回源核对当日。

下一步:算清显存能装多大模型,读 本地大模型 4 步;给 Agent 划权限边界,读 执行容器。