在许多开源 Agent 项目的迭代过程中,扩展系统经常会陷入一种令人啼笑皆非的架构混乱:
明明一份几十行的 Markdown 检查清单就能规范好的代码审查步骤,开发者偏偏要写几百行高权限的 TypeScript 代码把它封装成一个黑盒工具;
明明必须 100% 强制拦截的“严禁删除生产数据库”安全 ...
调用一次大语言模型(LLM)API 写一段脚本很简单。困难的是让一个 Agent 连续自主执行几十轮任务:
在中途允许用户打断并调整目标;
在进程异常崩溃后能够完整恢复状态;
在执行高危操作(如删除文件、推送代码)前强制暂停并等待人工审批;
能向开发者清晰解释每一个系统副作用到底是如何发生的。
...


