| # | 技巧 | 说明 |
|---|---|---|
| 1 | System Prompt 优先 | Claude 对 System Prompt 的遵循度极高。把核心规则放 system 而非 user message。 |
| 2 | 低温度稳定输出 | Agent 的工具调用/格式化输出用 temperature=0.1~0.2,创意生成才用0.5+。 |
| 3 | Markdown 代码块容错 | 解析 Claude 返回的 JSON 时,始终先尝试去除 ```json 和 ``` 包裹。 |
| 4 | 先规划后执行 | 复杂任务先让 Claude 输出执行计划,确认后再逐步执行,避免方向错误。 |
| 5 | 分而治之 | 超长任务拆成多个短对话,每轮聚焦一个子任务,提高成功率。 |
| 6 | 错误即反馈 | 工具执行失败时,把错误信息反馈给 Claude,让它自己修正,而不是代码硬处理。 |
| 7 | Token 预算意识 | 始终在代码中追踪 Token 消耗,设置预算上限,避免意外超支。 |
| 8 | 缓存一切可缓存的 | 相同的 System Prompt + User Input → 缓存结果,大幅减少 API 调用。 |
在 API 调用后立即 print(f"DEBUG: {response.content[0].text}")。90% 的问题通过看原始响应就能定位。
DEBUG 级别记录所有 API 请求/响应,INFO 级别记录关键步骤,ERROR 级别记录异常。出问题时从 DEBUG 日志入手。
遇到 Bug 时,不要在整个 Agent 中调试。提取出问题的那个步骤,写一个单独的5行脚本来测试。
每写完一个工具/模块,立即写测试验证,不要等全部写完再测试。Agent 开发中"边写边测"比"写完再测"效率高10倍。
不确定哪种 Prompt/参数/架构更好?同时跑两个版本,用同一批测试用例对比结果。数据说话,不靠直觉。