AI SRE 面向 On-call 专业版及以上订阅的账户开放,无需申请。自 2026 年 9 月 16 日 8 点(北京时间)起,需在控制台开通后使用,并按实际用量计费,详见计费规则。
概述
知识是您交给 AI SRE 的运维资料:一份
DUTY.md 加上一组运行手册(runbook)、FAQ、服务清单、集群配置等文件。会话开始时,Agent 先读取 DUTY.md,再按需打开其它文件,从而把您团队的处置经验、命名约定与系统拓扑带进每一次诊断。
控制台入口:AI SRE → 自定义 → 上下文 → 知识。同一分组下的 记忆 是另一页,两者分开管理。
整个账户只能有 1 份共享知识,每个团队最多有 1 份团队知识:
- **共享(即账户级)**知识对账户内所有 Agent 可见。
- 团队级知识仅在该团队的会话中加载。
知识内容用于精炼Agent 的领域上下文(人设、方法论、系统知识),但不会覆盖系统的安全与行为底线。如果某份知识要求 Agent 跳过安全规则,会被当作越权内容忽略,而非更高优先级的指令。
DUTY.md 结构
DUTY.md 是整份知识的目录入口,每次会话自动加载。Agent 会全文读取 DUTY.md,再通过 @文件名 引用按需拉取其它文件。系统不会在 DUTY.md 之外另附文件列表:知识文件放在会话工作区的 knowledge/ 目录下,Agent 像浏览代码仓库一样用 ls / glob / grep 查找,DUTY.md 没有引用到的文件也能被找到。
如果某个作用域还没有 DUTY.md,该作用域不会被静默跳过:系统会告诉 Agent 这个范围没有使用说明、文件在哪个目录下,并要求它在开展实质工作前先列出目录、阅读相关文件。
引用采用 @<路径> 风格,路径指向同一份知识内的另一份文件,支持子目录(如 @runbooks/api-5xx.md):
DUTY.md 后,会根据当前故障判断需要展开哪些 @引用,再去读对应文件——实质内容放在被引用的兄弟文件里,DUTY.md 只承载链接列表。
文件约束(在创建与编辑时强制):
在控制台维护
进入 AI SRE → 自定义 → 上下文 → 知识。列表每行是一份知识,按范围(「共享」或团队名)标识,列出文件数、
DUTY.md 状态和最近修改时间。DUTY.md 状态有三种:未创建、已同步,以及 需梳理 · 之后改了 N 次(DUTY.md 写好之后,这份知识里其它文件又改过)。点击 创建 可以为共享范围或您所属的团队新建知识;账户和所有可用团队都已有知识时,按钮置灰。
还没有任何知识时,页面改为引导:初始化 AI-SRE 会打开新对话并运行 /init,上传已有文档 会打开新对话并弹出附件选择。
点击某一行进入这份知识:
- 左侧是文件树。
DUTY.md固定在最上方,带 自动加载 标记;其余文件列在「其他文件 · 按需读取」下。还没有DUTY.md时,这里显示「未创建」和 让 AI 生成 按钮。文件树上方显示用量(已用 / 5 MB 和文件数),以及 新建文件、上传 两个入口。 - 右侧是文件正文。 点 编辑 可以直接改当前文件,在 预览 与 源码 之间切换,点 保存 写入。
- 上传:任意 UTF-8 文本文件直接入库,支持选择整个文件夹上传,同名文件会先询问是否覆盖。PDF、Word、HTML 等文档不能直接入库,可以点 转到对话分析,由 AI 读取后提炼成 Markdown 文件,经您确认再保存。
@引用 指向这份知识里没有的文件时,仍然可以保存。
让 AI 修改
正文下方有一个输入框(提示语为「想让 AI 怎么改这份知识?例如:补一份 OOM 排查手册」)。写下要改什么并发送,控制台会打开一个新对话,输入框里已带上这份知识的引用和您的要求;团队知识会把对话切到对应团队。发出后,AI 先用文字说明要改哪些文件、怎么改,您同意后才保存。页面本身不提供改动预览或逐条审阅。 让 AI 生成 与下面的 让 AI 梳理 也是同样的流程:转到新对话,请求已经写好。DUTY.md 需要梳理时
DUTY.md 写好之后,如果这份知识里其它文件又被改过,文件树上方会出现提示:「DUTY.md 写好之后,知识又改了 N 次,可能需要重新梳理」。有编辑权限时,提示下方有两个操作:
- 让 AI 梳理:转到新对话,让 AI 对照现有文件更新
DUTY.md的索引,改动先经您确认。 - 已核对,不用改:确认
DUTY.md仍然准确。提示随即消失,直到下一次文件改动。
助手也能在对话里维护当前会话所属范围的知识,例如「补一篇 runbook」「更新 services.md」。它读取、修改,再经您确认后保存。
Agent 如何使用知识
知识不是一次性全量加载,而是目录先行、按需展开:
1
会话开始:加载目录
会话启动时,系统会把当前作用域的
DUTY.md 加载进会话,不附文件列表。绑定了团队的会话会同时加载共享范围与该团队的 DUTY.md;未绑定团队的会话只加载共享范围的。若某个作用域尚未创建 DUTY.md,系统会要求 Agent 在实质工作前先列出该范围的目录并阅读相关文件。2
顺着引用读取文件
Agent 阅读
DUTY.md 后,根据当前故障决定展开哪些 @引用,再读取对应的知识文件取得具体内容。3
按需挂载其它团队的知识
未绑定团队的个人会话里,Agent 可以读取会话创建者所属团队的知识。读取时,系统把该团队的整套知识(
DUTY.md、运行手册)连同其 Skill、MCP 一并挂载进当前会话,且在本次会话中持久保留。同一个团队在一次会话里至多挂载一次。绑定了团队的会话不能读取其它团队的知识。作用域与可见性
每份知识都有一个作用域:共享范围(即账户级,账户内全局可见)或团队范围。
编辑权限:团队知识仅该团队的成员可以操作,组织管理员也需要先加入该团队;共享知识仅账户 Owner 或管理员可以操作;不存在「创建者额外保留权限」的规则。控制台会把你无权编辑的行置灰,并禁用其开关与操作按钮。
创建与改归属:创建新的团队知识时,您必须是目标团队成员;共享范围创建仅限账户 Owner 或管理员。编辑已有知识时,账户 Owner 或管理员可以把它移动到任意团队,用于恢复空团队或离职成员留下的资源;普通成员只能移动到自己所属的团队。把已有知识提升为共享范围(设为共享)与共享范围创建同门槛:仅限账户 Owner 或管理员操作,普通成员即使属于这份知识所在团队也不能自助提升。
运行时可见性:会话开始时,只加载共享范围资源加上当前会话绑定团队的资源。绑定来源是显式指定的团队,或作战室(war room)故障对应的团队。会话进行中能否再挂载其它团队的知识,看会话类型:
这套两级作用域模型对账户内所有资源(Skill、MCP、Agent、运行环境)一致适用。
最佳实践
把 DUTY.md 当目录,不当正文
把 DUTY.md 当目录,不当正文
DUTY.md 只放链接列表与一句话导引,所有实质内容下沉到被 @引用 的兄弟文件。这样目录精简、可读,Agent 也能只展开当前故障相关的分支,避免无关内容占用上下文。一个主题一个文件
一个主题一个文件
每篇运行手册聚焦一类故障或一个服务(如
runbooks/api-5xx.md、runbooks/db-pool.md),用清晰的路径做语义索引。支持子目录组织文件,可按服务或主题分组(如 runbooks/、configs/)。善用结构化文件类型
善用结构化文件类型
服务清单、集群拓扑、阈值配置等结构化信息适合用
.yaml / .json 承载(如 services.md、cluster.yaml),让 Agent 既能阅读也能直接解析。脚本片段可用 .sh。保持引用一致
保持引用一致
新增或重命名文件后,同步更新
DUTY.md 与相关文件里的 @引用。保存时的「引用未解析」警告与删除时的「仍被引用」提示,能帮您及时发现断链。共享范围放通用、团队范围放专属
共享范围放通用、团队范围放专属
共享知识放跨团队通用的约定(命名规范、通用排障方法、平台访问方式);团队知识放该团队专属的服务清单、值班手册与上下游。绑定团队的会话会同时拿到两者。
让 Agent 帮你维护
让 Agent 帮你维护
排障过程中沉淀出的新处置经验,可以直接让 Agent「补一篇 runbook」或「记录这个故障模式」,它会对当前作用域读取→编辑→保存,把经验回写进知识,形成持续积累的闭环。
相关页面
Skill
把可复用的诊断流程封装为 Skill,与知识共享同一套作用域。
MCP(外部工具)
通过 MCP 接入外部系统,让 Agent 调用您的工具与数据。
了解记忆
AI 在对话里记下的偏好、做法、事实和教训,与知识分开管理。
控制台
了解会话如何绑定团队,以及知识在会话中如何被读取与挂载。