Agent 基础能力
Agent 运行时与治理
把权限、状态、工具、失败处理和人工接管留在模型之外,形成可审计的运行边界。
- 本页重点
- 能力边界、接入契约、失败语义与验收场景。
- 公开边界
- 仅展示治理思路与状态关系,不含系统拓扑、权限配置或运行日志。
核心判断
模型只做有限判断;权限、状态、工具和失败处理留在可审计的运行边界。
这里把共性能力、接入依赖和验收场景放在一起,用来判断新场景先复用什么,再决定是否增加自主行为。
从问题到验证
- 接收任务
- 受控规划
- 工具执行
- 证据校验
- 人工接管
- Plan
- 计划必须受任务边界、预算和可用工具约束
- Act
- 高风险工具动作先预览、确认,并留下可审计记录
- Verify
- 证据不足时追问或降级,不以自然语言掩盖失败
只保留状态关系,不含内部模块、接口或权限配置。
谁需要共用运行基线
面向需要在同一组织内建设多个 Agent 场景的产品与平台团队。重点不是再做一个对话入口,而是提供各场景都必须遵守的运行和治理基线。
共性能力散在每个 Agent 里
表面上是每个 Agent 都需要工具、记忆和流程编排,真实问题是控制权、权限、证据和失败责任没有统一承载层。能力散落后,复用与审计都会失真。
模型不掌握全部控制权
运行时只承载跨场景共性能力,不吸收具体业务规则。模型负责有限判断,代码负责权限与不变量,业务负责人负责高责任节点,避免平台变成不可解释的万能层。
用失败路径验收运行时
用成功、缺数据、无权限、工具失败、超预算和人工接管等端到端场景验证。验收关注状态是否可追踪、失败是否可恢复、责任是否可定位。
检查清单
- 先确定谁控制主循环
- 把权限和证据当作产品能力
- 用失败路径检验架构,而不是只看成功演示