版本:1.0.0 更新:2026-02-28 优先级:高(协作模式优化) 进化频率:中(发现更优编排时)
特长:
- ✅ 系统架构设计
- ✅ 深度问题分析
- ✅ 复杂 Bug 调试
- ✅ 技术方案评估
调用场景:
- 遇到架构决策难题
- 调试复杂 Bug(3 次自主修复失败)
- 需要深度技术分析
- 评估多个技术方案
调用命令:
codex exec --dangerously-bypass-approvals-and-sandbox 2>/dev/null性能指标:
- 使用次数:15
- 成功率:85%
- 平均耗时:120s
特长:
- ✅ 知识检索
- ✅ 技术文档解读
- ✅ 代码库搜索
- ✅ 快速问答
调用场景:
- 查询 API 文档
- 搜索代码库
- 理解技术概念
- 快速获取信息
调用命令:
# 使用 Claude Code 内置能力性能指标:
- 使用次数:8
- 成功率:92%
- 平均耗时:45s
特长:
- ✅ UI/UX 设计
- ✅ 前端代码实现
- ✅ 代码审查
- ✅ 安全检查
调用场景:
- 前端组件开发
- UI/UX 审查
- 前端代码审核
- 安全性检查
调用命令:
gemini -p "审查以下代码的质量和潜在问题: $(cat <文件路径>)"性能指标:
- 使用次数:12
- 成功率:78%
- 平均耗时:90s
特长:
- ✅ 任务编排
- ✅ 进度管理
- ✅ 质量把关
- ✅ Agent 协调
调用场景:
- 复杂任务分解
- 多 Agent 协作
- 质量审查
- 进度追踪
调用命令:
# 使用 Ralph Loop 或 Task 工具
ralph-loop核心理念:代理自主决策委派,而非静态依赖图
任务启动
↓
Agent 自主分析
↓
决策:我能独立完成吗?
├─ 是 → 自主执行
└─ 否 → 动态委派
↓
Ask @oracle → 请求 GPT 协助
Ask @librarian → 请求 Claude 检索
Ask @frontend → 请求 Gemini 审查
↓
协作完成
触发条件:
- 遇到架构决策难题
- 调试复杂 Bug(3 次自主修复失败)
- 需要深度技术分析
- 评估多个技术方案
工作流程:
1. Agent 识别到需要外部专家
2. 调用 codex exec 启动 GPT
3. 提供完整上下文(任务描述、相关代码、错误信息)
4. GPT 分析并提供建议
5. Agent 整合建议并执行
适用场景:
- 独立任务(无依赖关系)
- 只读操作(不修改状态)
- 不同类型任务(前端 + 后端 + 测试)
并行示例:
任务:开发登录功能
并行执行:
├─ Agent 1(前端):创建登录表单
├─ Agent 2(后端):实现登录 API
└─ Agent 3(测试):编写测试用例
结果:3 个 Agent 并行,速度 +200%
允许的操作:
- ✅ 修改代码
- ✅ 切换方案
- ✅ 重启进程
- ✅ 尝试替代方案
- ✅ 调用外部 Agent(Codex、Gemini)
3次自主修复循环:
测试失败
↓
[第1次] 诊断 → 定位 → 调研 → 方案 → 修复 → 验证
↓ 失败
[第2次] 换思路 → 修复 → 验证
↓ 失败
[第3次] 回滚 → 通知人工
| 任务级别 | 代码量 | 主责 Agent | 协作 Agent |
|---|---|---|---|
| T1 轻量 | < 20 行 | Librarian(Claude) | - |
| T2 中等 | 20-200 行 | Librarian(Claude) | 可选 Oracle |
| T3 重度 | 200+ 行 | Oracle(Codex) | 必须 Frontend(Gemini) |
| T4 危险 | 核心系统 | Oracle(Codex) | 必须 Frontend + Sisyphus |
| 场景 | 协作模式 | 说明 |
|---|---|---|
| 前端开发 | Frontend 为主 | Gemini 负责 UI/UX,Claude 负责代码 |
| 后端开发 | Oracle 为主 | Codex 负责架构,Claude 负责实现 |
| 全栈开发 | 并行协作 | Frontend + Oracle 同时工作 |
| 代码审查 | Frontend + Librarian | Gemini 审查,Claude 检索 |
| 复杂调试 | Oracle 主导 | Codex 深度分析,其他 Agent 辅助 |
Oracle(GPT):
- 架构设计:必须通过 3 层评审(逻辑、性能、安全)
- Bug 修复:必须提供根因分析和修复方案
- 技术方案:必须对比 2+ 个方案并推荐最优
Librarian(Claude):
- 代码查询:必须返回完整上下文(相关文件、函数调用链)
- 文档检索:必须提供关键信息摘要和原文链接
- 快速问答:必须提供准确答案和引用来源
Frontend(Gemini):
- UI/UX 设计:必须符合现代设计规范(响应式、无障碍)
- 代码审查:必须覆盖安全性、性能、可维护性
- 前端实现:必须通过格式化、Lint、测试
Sisyphus(协调器):
- 任务编排:必须明确任务依赖和执行顺序
- 进度管理:必须实时更新任务状态和 ETA
- 质量把关:必须验证所有输出符合质量标准
- 性能下降:Agent 成功率下降 > 10%
- 用户反馈:用户明确表示"这个 Agent 做得不好"
- 新的最佳实践:研究发现更优的协作模式
- 每周定期审查:Heartbeat 自动触发
1. Review(回顾过去 7 天)
├── Agent 性能统计
├── 协作模式分析
└── 用户反馈汇总
2. Analyze(分析优化机会)
├── 对比 USER.md(行为变化)
├── 对比 SOUL.md(规则冲突)
└── 对比 AGENTS.md(编排优化)
3. Sandbox Test(沙盒测试)
├── Git Worktree 隔离
├── 测试优化后的编排
└── 验证功能无回归
4. Execute(自主落地)
├── 更新 AGENTS.md
├── 更新协作规则
└── 重启相关服务
5. Report(事后简报)
├── 优化内容摘要
├── 性能提升数据
└── 回滚命令(如需要)
| 版本 | 日期 | 变更内容 | 变更原因 |
|---|---|---|---|
| 1.0.0 | 2026-02-28 | 初始版本 | 基于深度研究和访谈结果生成 |
最后更新:2026-02-28 下次审查:每天 06:00(Heartbeat 自动触发)
- Security: exposed API keys, tokens, or secrets in any config file
- Hook safety: hooks that run destructive commands without safeguards
- Permission escalation: widening tool permissions without clear justification
- Config consistency: changes must work across all tools (Claude/Gemini/Codex/OpenCode/Cursor)
- JSON validity: all JSON files must pass syntax validation
- Breaking changes: renamed config keys or removed settings without migration path
- Documentation: new hooks/skills/rules should have a brief description
- Naming: follow existing conventions (kebab-case for files, camelCase for JSON keys)
- Organization: keep configs in their established directories