技术热点透视20260926:微软 Copilot 大改版,Autopilot 成了常驻云端的 Agent
原创 · 约 18 分钟阅读 · 阅读 --

技术热点透视20260926:微软 Copilot 大改版,Autopilot 成了常驻云端的 Agent

作者: Alex Xiang


本文完全由 WorkBuddy 独立收集资料、调试代码并完成文章写作。

扫码注册 WorkBuddy 即可获取 2000 积分

我是 Alex Xiang,前百度/微博工程师,现在专注于 AI 工程与工具产品。更多文章欢迎关注微信公众号「字与码」。

一个聊天框是怎么变成「运行时」的

2026 年 9 月 25 日,微软 AI at Work 的 CMO Jared Spataro 在官方博客公布了新版 Copilot。表面看是又一次 App 改版,但真正变的东西不在界面层:Copilot 从「一个你打开来问东西的聊天助手」,被重新定义成「一个受治理的企业级 AI 运行时」。Satya Nadella 在采访里给的说法更直白——“a new OS for work”,工作用的新操作系统,并明确表示要在个人 Agent 这条线上挑战 Meta 的 Muse。

「运行时」这个词在工程语境里很重。它不是功能,是地基。你管一个东西叫运行时,等于在说:谁执行、在哪执行、执行多久、执行的时候归谁管、花谁的钱、出问题看谁的日志。过去两年 Copilot 的故事一直停在模型能力那一层,这次微软把话题整个搬到了下面一层。

最直观的证据是 Autopilot。它不是对话框旁边多出来的一个按钮,而是一个有自己目录身份(directory identity)、有角色、有目标、有工作区、有记忆的常驻 Agent,托管在云端。你在开会、在睡觉、在过周末,它都接着干。它可以在 Teams、Outlook、频道和文档里被 @ 到,也可以自己去监控一个 Teams 频道然后自主完成任务。Nadella 想让它变成个人生活里的一个“AI chief of staff”。

这个描述的重量在于:有身份、有记忆、有工作区、常驻、可被 @、归租户托管。这不是一份功能清单,这是一台机器在组织里的入职档案。

三块拼图:Home / Code / Autopilot

新版 Copilot 把整个 App 重新切成三个平面。

Home 是默认入口,把原来的 Chat 和 Cowork 合并了进去,里面是 Today 面板、活动流、建议,以及可以委派出去的工作。它对应的问题已经从「我今天想问点什么」,变成「我这一天该让 Agent 替我干什么」。看着只是措辞变化,交互模型完全不同——前者是搜索框,后者是派工单。

Code 用自然语言创建应用、看板、自动化和工作流。底层与 GitHub Copilot 同源,跑在“Copilot Managed Runtime”里:租户内托管、沙箱隔离。它能承载的不只是小工具——持久化的桌面小组件、数据看板、企业内部云应用都算。等于把「随手做个小东西」从个人玩具,提升成了有托管、有隔离、能长期运行的企业资产。

从聊天助手到受治理运行时的位置变化

Autopilot 就是前面那台常驻机器,前身是 2025 年 6 月预览过的 Scout。它背后是 OpenClaw 技术栈,微软与独立开发者 steipete(Peter Steinberger)从今年 3 月起一起做加固。这一点值得单独讲,它是全篇最有意思的反讽。

治理是微软这次讲得最卖力、也最容易被当成公关话术略过的部分。Copilot Managed Runtime、租户内隔离的 Autopilot agent,身份、权限、数据边界、支出与行为审计都交给 IT 掌控;Fabric IQ 把 Power BI 的语义模型作为上下文接进来,Dynamics 365 与 Power Platform 提供业务数据 grounding;插件走统一注册表,微软自家、合作伙伴、企业自建的都从这里进,形式是 MCP 连接器加 Agent Skills。

把这些摆在一起你会看到:微软卖的不是「更强的 Agent」,是「Agent 的运行环境」。

harness 边界上移:一周四连发

一周之内,harness 的边界被连续推向 OS 层

只看微软这一条,很容易当成孤立发布。放进过去一周,画面就完全不同了。

9 月 21 日,OpenAI 的 Agents API 把托管搬上云端;9 月 23 日,阿里 Qwen Book 把“OS as Harness”直接写进产品定位;9 月 24 日,Meta 的 Muse 给每位用户发一台免费云端 Ubuntu 电脑,首周用户破 50 万;9 月 25 日,微软把 Autopilot 做成常驻云端、带目录身份的 Agent。

四天,四家公司,同一个方向:harness——也就是把模型驱动起来的那套外壳,包括循环、工具、状态、权限、执行环境——正在从 SDK 里、从框架里、从你的笔记本里,一路往上爬,最后爬进租户的操作系统本身。

对写代码的人意味着什么?你真正要盯的东西变了。模型是租的,能力在趋同,价格在往下走。运行时不是。谁掌握运行时,谁就掌握三件事:身份(这个 Agent 究竟是谁)、审计链(它做过什么、能不能复盘)、计费表(它花了多少钱)。这三样恰好是大企业采购里权重最高、同时也是模型厂商最难替代的部分。

所以最保守的那个玩家,用一次架构级重构,给「OS as agent harness」投出了这一周最重的一票赞成票。

反讽与真相:微软的常驻 Agent 跑在别人开源上

现在说那个反讽。

微软是全球最大的企业 AI 厂商之一,这次的旗舰常驻 Agent,却建立在 OpenClaw 这个开源项目之上,而项目来自独立开发者 steipete。微软从今年 3 月起和他一起加固,然后把它放进自家的企业级运行时,配上目录身份、工作区和审计。

这不是丑闻,这是一条关于「agent 栈里真正的杠杆在哪」的实证。杠杆如果在模型上,微软自己训一个就是了;如果在 UI 上,它也没必要去接一个外部项目。它接 OpenClaw,恰恰说明常驻 Agent 最难的部分——循环怎么稳、上下文怎么续、工具怎么接、跑一整夜怎么不崩——不在模型权重里,在运行时工程里。而运行时工程这件事,一个足够强的独立开发者能把关键的一层做出来,大厂负责把它加固、托管、治理、计费。

对做 Agent 的团队来说,这条信息很值钱:护城河未必在你能调哪个模型,而在你有没有把「跑得住」做成可交付物。

按用量计费:Agent 第一次变成 P&L

计费方式的变化,可能是这次改版里最少被讨论、长期影响却最大的部分。

微软给 Autopilot 和 Code 换上按用量计费(UBB),并给这件事起了个名字:FinOps for AI。翻译一下就是——“包月固定费率、AI 随便用”的补贴模式结束了。

计费方式决定了一件事在组织里的身份。固定费率的时候,Agent 是市场费用、获客成本、Demo;按用量计费之后,它变成一条真实的损益科目,要和人力预算、软件采购预算摆在同一张表里被审视。

好的一面是,它逼着产品把价值讲清楚,也逼着团队真去优化单位任务成本。坏的一面同样明显,而且和 Autopilot 的核心卖点直接冲突:卖点是「关掉电脑它还在跑」,那么一个永不下班的员工,账单由谁来关?无界的自主运行时,对应的就是无界的支出风险。企业 IT 会喜欢「可审计的支出」,但 CFO 看到一个 7×24 自己找活干、还会盯着 Teams 频道主动完成任务的 Agent,第一反应多半不是惊喜,是限额。所以「支出」这个词会和身份、权限并列出现在治理叙事里——这不是凑数,是真实需求。

泼冷水:预览不等于交付

该说点不舒服的了。

目前公布的大部分是预览,没有真实交付。Home 和 Code 要在未来几周通过 Frontier 早期访问推送,Autopilot 9 月底扩大私有预览,Code 对 M365 Premium/Pro 订阅用户是今年晚些时候才进入预览。今天你能拿到的是路线图和 demo,不是产品。

合规与审计目前是「宣称」,不是「演示」。博客里说 IT 掌握身份、权限、数据边界、支出和行为审计,这些能力好不好用,要看企业客户上手跑三个月之后的反馈。治理写进发布会,和通过一次真实的安全评审,是完全不同的两件事。

Autopilot 那个「自主监控 Teams 频道并完成任务」的能力,和「企业治理」之间存在结构性张力,这是 keynote 解决不了的。每一次自主性提升都会先在权限模型上撞一次墙:一个能读你所有频道、能代表你发言、能自己决定做哪件事的常驻进程,最小权限集怎么定义?它误判一次,责任归谁?

最后一点最需要警惕:一个「有自己的电脑、自己的工作区、自己的记忆」的常驻 Agent,正是本周让 Anthropic 被五角大楼以“安全风险”为名除名的同一类攻击面。同样的架构能力,换个语境就是风险源。微软的治理叙事讲得很完整,但治理成熟度和功能上线速度之间的那个缺口是真实的,多写一段博客补不上。

这周之后,agent 赛道该看什么

能力竞争已经结束,工程竞争才刚开始。四家公司这一周做的事情里,没有一件是「我们的模型更聪明」,全是「我们的运行时更完整」。模型还会继续进步,但进步会越来越快地被抹平;真正拉开距离的是身份、审计、隔离、计费、跑多久不崩——这些词听起来很无聊,但它们决定了 Agent 能不能进企业。

开源在这一层依然有巨大的杠杆。微软接 OpenClaw 这件事,是所有做 runtime 的团队的一针强心剂,也是所有只看模型排行榜的投资人的一记提醒。

自主性和治理是同一个问题的两面。谁先把这对矛盾当成产品问题、而不是公关问题来解决,谁就拿到下一阶段的入场券。微软这次把治理摆在很显眼的位置,方向没错;但从「宣称掌握」到「能被企业安全团队签字」,中间隔着一整个工程周期。

至于公布后股价早盘涨约 3%——市场为这个故事付了定金。定金不等于交付。

其他动态

  • Docker 发布 Cloud Sandboxes,为自主 coding agent 提供常驻 microVM 环境,支持用 sbx move my-project --to cloud 在本地与云端之间迁移,覆盖 Claude Code、Codex、Copilot、Antigravity 等;9 月 22 至 26 日注册送 250 美元额度。
  • 普林斯顿 9 月 24 日的论文 AgenticGenTAMP:让 coding agent 在 28 个仿真环境、9.8 万次评估中合成可部署的 TAMP 策略,Claude Code(Opus 5)成功率 82%、Codex(GPT-6 Astra)95%,远超手工规划器的 47%。
  • Fastino 开源 GLiNER2.5-Decide:一个 340M 的编码器决策模型,在 Agent 管道的意图路由等任务上以 60.1% 胜出 4B 级解码模型,CPU 推理 167ms,Apache 2.0 许可,印证 Agent 基建正从「一个大模型包揽」走向「小模型分工」。
  • AWS 为 MCP Server 增加 SES 与 End User Messaging 的 AI agent skills,开发者可以用自然语言、经 Claude Code、Codex、Cursor、Kiro 等工具配置生产级邮件与 RCS/WhatsApp 消息流。
  • Meta Muse 给每位用户一台免费的云端 Ubuntu Linux 电脑,带 Sentinel 进程、文件可查,首周用户突破 50 万。
  • 智元第 20000 台具身机器人交付长隆,横琴长隆飞船乐园引入超 300 台,成为全球首个大规模具身智能主题乐园,覆盖导览、研学、服务零售等 7 大场景。
  • Anthropic 为 Claude Code 文档补充 Wrap-Up Allowance(用量上限中途触达时可短暂收尾到一个合理的停止点),同时补上 effort 参数与付费插件目录;MCP 用量同比增长 110 倍。
  • Prompt2ELF(GitHub 用户 faustinoaq)让 AI 直接产出 Linux x86-64 可执行文件,跳过编译器与汇编器,只保留一个极简的 hex→binary 收尾步骤。
打开原图 ↗