本文以 ops-agent 的真实构建过程为线索,完整讲解如何设计并实现一个"默认只读、高风险操作需授权、可回滚、全审计"的 Claude Code 运维 Agent 。所有代码均可在本仓库中对照阅读,文末附有改造清单,可复用到你自己的 Agent 场景。 0. 我们要造什么 一个运维 Agent ,满足四个硬要求: 默认只读 —— 查状态、看日志直接执行,无感通过。 高风险操作需授权 —— 写操作必须先出"变更单"(风险说明 + 回滚计划),经用户在会话中显式批准后才能执行。 可回滚 —— 执行前自动快照,一条命令回滚。 全审计 —— 批准、校验、执行、中止,每个事件都落日志。 最终形态(本仓库): ops-agent/ ├── .claude/ │ ├── agents/ops.md # Agent 定义:第一层防线( prompt 纪律) │ └── settings.json # PreToolUse hook:第二层防线(硬拦截) ├── core.py #...