Agent 自维护体系 - Digest
一句话总结
AI 写代码只是开始,维护循环才是真正的战场——本文复盘如何用”5 个动作 + 6 个零件”把人工维护循环改造为 Agent 自维护体系;关键结论:诊断 / 修复 / 发布三套 Skill + Sub Agents 独立裁判 + Token 分级控制 + 知识库复利飞轮,可把”40 分钟/人次排查”降至”48 分钟跑完全量扫描 + 1 分钟人工审批”,月度省 20+ 人天。
关键数字
- 40 分钟:旧流程每条 ERROR 排查耗时
- 48 分钟:新流程全量扫描耗时
- 1 分钟:人工审批时间
- 334 条:单次修复全量测试 case
- 80%:分级策略后 Token 成本下降幅度
- 20+ 人天/月:月度节省工时
- 30%:工具链建设占工作量
- 5 条:起步告警规则数(收缩自 15 条)
- 6 层验证:Sub Agents 独立裁判检查项
- 8 Phase + 6 Step + 11 步:诊断 / 修复 / 发布 三套 Skill 结构
8 节点速查表
| # |
节点 |
核心 |
| 1 |
三个断裂点 |
看不见(错误散落)/ 记不住(关窗失忆)/ 没闭环(自证修复) |
| 2 |
四层进化 |
Prompt(2022)→ Context(2025)→ Harness(2026 初)→ Loop(2026.06) |
| 3 |
跳级必翻车 |
不在前三层地基就建 Loop = 循环空转烧钱;AutoGPT 是反例 |
| 4 |
五个动作 |
发现 → 交付 → 验证 → 持久化 → 调度(缺任一都不行) |
| 5 |
实施顺序 |
Connectors → Automations → Skills → Worktrees → Sub Agents → State |
| 6 |
三套 Skill |
诊断 8 Phase(含证据链)/ 修复 6 Step(含知识库)/ 发布 11 步(含 4 道熔断) |
| 7 |
Sub Agents 独立裁判 |
6 层验证,拦截日志降级假修复(check_log_level_not_downgraded) |
| 8 |
真实数据 + 4 教训 |
工具链工期翻倍 / 告警宁缺勿滥 / Token 分级 / 数据类问题不让 Agent 修 |
三笔账速览
- 建设账:1 名高级工程师 + 半个 SRE / 4 周工期(工具链占总 30%)
- 运行账:分级策略后降 80% 成本(5K 小模型初筛 + 按需大模型深度诊断 + 2 道熔断)
- 收益账:每月省 20+ 人天(按每周两轮算)
5 句核心金句
- “AI 写代码只是开始,维护循环才是真正的战场”
- “跳级必翻车。Loop 不是买一个产品就有的,是在前三层地基上垒出来的”
- “SKILL.md 是一份严格的操作手册,不是一段描述;规则不写死,Agent 一定偷懒”
- “掩盖故障和合理降级,只有独立验证才能区分,不能让修复者自证”
- “知道什么不该自动化,和知道什么该自动化一样重要”
3 个反直觉点
- 修复者永远不应该给自己打分:验证权要交给独立 Sub Agents,否则批量生产假绿灯
- 诊断报告是 Skill 之间的接口:修复 Skill 自动读取结构化诊断报告接管后续,人不需要在中间传话——这是 6 层验证之外的复利层级
- Token 消耗一定要分级控制:全量诊断 200K+ Token 一周穿预算;5K 小模型初筛 + 按需大模型才省钱(成本降 80%)
关联
- 方法论对偶 [[Loop-Engineering-验证才是瓶颈]] / [[Addy-Osmani-Loop-Engineering]]:本文是 Loop 工程化主线”维护循环”维度的延伸
- 方法论同主线 [[架构腐朽与Loop-Engineering]] / [[AI循环-Claude-GPT和Mira到底什么才是真正好用的]]:四层进化框架一致
- 方法论对偶 [[Lilian-Weng-Harness-Engineering-自我改进]]:Harness 是 Loop 的前置层(”先把前三层地基打好”)
- 方法论对偶 [[loonggg-Claude-Code-技能心法-11条建议]]:本文明示”SKILL.md 是操作手册”是该篇心法的实战化展开
- 方法论对偶 [[腾讯程序员-AI-Coding到Harness-Engineering-应用宝活动平台实践]]:本文诊断 Skill 8 Phase 与该篇 product-state.json 状态文件驱动同主线
- 方法论对偶 [[WorkBuddy-Harness工程复盘-从模型到可用Agent]]:本文 Sub Agents 6 层验证是该篇 Context Engineering + 验证闸门的工程化
- 方法论对偶 [[生产级Agent全景]]:本文”维护循环比 Coding 速度更重要”是该篇”三线合一”的维护环节具体化
待补证
- 每月省 20 人天数字基于”每周两轮”测算,原文未给多团队样本
- Token 降 80% 是单团队运行经验,未给不同规模行业基准
- 6 个零件实施顺序是该团队经验总结,未给独立验证来源
- 公众号文末互动话题与正文无关已剔除
已知限制
- 单一团队经验(Soyoger 团队),Seetong 等不同规模团队需重新评估规模与工期
- 文章含较多特定技术栈(MCP / SLS / Langfuse / Playwright),Seetong 适配时需映射等价工具
- 工具链建设 30% 占比是经验值,不同基础设施差异较大
- 部分代码示例(curl 命令)有跨平台细节未展开
- 抓取时间为推送日同天,内容时效性高
标签
#主题/Loop-Engineering #主题/Agent自维护 #主题/Skill设计 #主题/Harness #主题/Sub-Agents #主题/验证闸门 #主题/Token-分级 #主题/知识库飞轮 #主题/MCP #主题/工程实践 #主题/Seetong借鉴 #场景/写代码后维护 #场景/自动修复链路 #公众号/Soyoger #公司/Soyoger #节点/三个断裂点 #节点/四层进化 #节点/五个动作 #节点/六个零件 #节点/三套Skill #节点/Sub-Agents独立裁判 #节点/6层验证 #节点/4个教训 #手法/工程化实战 #手法/Skill模板