微软为 Agent Framework 的 harness 加上四项扩展能力
微软在 Agent Framework 的第三篇文章中提出对 harness 的四项扩展:按需加载的 Skills、受控的 Shell、用代码计算的 CodeAct 和可并行的 Background agents,旨在把代理能力模块化以提升扩展性和生产就绪性。该系列从规划到安全数据接入,再到可扩展工作系统,下一步将聚焦观测、治理与托管部署。
微软在 Agent Framework 的第三篇文章中提出对 harness 的四项扩展:按需加载的 Skills、受控的 Shell、用代码计算的 CodeAct 和可并行的 Background agents,旨在把代理能力模块化以提升扩展性和生产就绪性。该系列从规划到安全数据接入,再到可扩展工作系统,下一步将聚焦观测、治理与托管部署。
微软 7 月 9 日在开发者博客发布 《Agent Harness: Scaling the claw or harness capabilities》,继续推进其“Build your own claw and harness with Microsoft Agent Framework”系列。文章的重点不是再给模型堆一层提示词,而是把一个面向开发者的代理系统拆成四个可组合方向:按需加载的技能、受控的 shell、用代码计算的 CodeAct,以及可并行分工的背景代理。
这篇文章也延续了前两篇的路线:6 月 22 日的 Part 1 先把基础 harness、web search 和 planning 搭起来;6 月 29 日的 Part 2 再加入文件访问、审批和持久记忆。到了第三篇,微软要解决的已经不是“能不能回答”,而是“能不能更像一个可扩展的工作系统”。
四个方向,分别补齐 agent 的短板
第一个方向是 Skills。微软把技能定义成独立的 SKILL.md 文件,模型一开始只看见技能名称和简介,只有在请求匹配时才加载完整内容。这样做的目的很直接:把 valuation、risk-scoring 这类领域知识从系统提示词里拆出去,避免上下文越来越臃肿。文章同时提到两种实现方式:文件型 skills 由本地目录提供,Foundry skills 则通过 Toolbox MCP 端点集中管理,技能可以在云端更新,运行中的 agent 直接拿到最新版本。
第二个方向是 Shell。当代理需要整理目录、批量改名、移动文件时,文件读写已经不够,shell 才是合适的工具。不过微软在文中也强调,shell 只适合带审批的、受约束的执行环境:它会被限制在特定工作目录里,危险命令还会先经过 deny-list 过滤。这个设计与 AIFlux 之前的 “别为 agents 重写你的 CLI” 形成了一个有意思的呼应:对代理来说,保留简单的命令面比盲目改成 JSON 更稳,也更省成本。
第三个方向是 CodeAct。微软的意思很明确:有些问题不是靠模型“想”出来,而是让模型写一小段代码去算。文章展示了 .NET 版的 HyperlightCodeActProvider,以及 Python 里的 Monty 方案,让代理把多步工具调用压缩成一次隔离的代码执行。微软在 BUILD 2026 的总览文章 《Microsoft Agent Framework at BUILD 2026: Agent Harness, Hosted Agents, CodeAct, and more》 里给过一组代表性数据:同一类多步骤工作负载上,传统方式耗时 27.81 秒、消耗 6,890 tokens,CodeAct 则降到 13.23 秒和 2,489 tokens。
第四个方向是 Background agents。如果主代理要同时研究多个对象,把每一步都塞进同一个上下文,既慢也乱。微软的做法是把任务扔给专门的子代理并行处理,再把结果汇总回主流程。文章里的示例是一个只负责 web search 的研究型子代理,主代理可以发起多个后台任务、等待完成,再统一总结。这种 fan-out / fan-in 的思路,也和 AIFlux 之前整理的 微软 Agent Framework 编排模式达 1.0 互相衔接:前者强调并行分工,后者强调稳定的协调模式已经成型。
从“会聊天”到“会干活”
把这四个方向放在一起看,微软实际上是在把 agent 的核心能力模块化:技能负责专业知识,shell 负责系统级操作,CodeAct 负责计算,背景代理负责并行协作。这样做的好处是,开发者不必把一切都塞进单一提示词,也不必为每个场景重写整套代理。模型依然负责推理,但真正决定系统能不能扩展、能不能复用、能不能接近生产环境的,是 harness 这一层。
这也是整个系列的主线。Part 1 先让 agent “能规划”,Part 2 让它“能安全接触数据”,Part 3 则让它“能学新技能、能算、能并行、能重组文件”。按照微软在 BUILD 2026 和 1.0 GA 之后释放的路线图,下一步会转向观测、治理、评估和托管部署。换句话说,这不是一个单点功能更新,而是微软把 Agent Framework 从原型框架往生产工具链再推了一步。
不错过任何一条 AI 大事
订阅 AIFlux 早报,每天 3 分钟看懂产业动态。

