v1.2 真实模型接入 + Thinking 死循环修复

- 新增 OpenAIProvider / ClaudeProvider,接入 Deepseek 真实 API
- 修复 Deepseek thinking 模式 reasoning_content 回传问题
- 修复 Thinking 阶段过渡指令每轮重复插入导致的死循环
- 新增 maxTurns 保护、dumpMessages/dumpTools 调试输出
This commit is contained in:
zhuyongxin
2026-05-14 20:35:44 +08:00
parent f75d0c49ae
commit daa89531f5
9 changed files with 491 additions and 47 deletions
+24
View File
@@ -65,6 +65,30 @@ func main() {
## 版本历史
### v1.2 — 真实模型接入与 Thinking 死循环修复
#### 变更
- **接入真实大模型** — 新增 `OpenAIProvider` 和 `ClaudeProvider`,分别基于 OpenAI V3 SDK 和 Anthropic SDK 连接 Deepseek API,替换原有的 Mock Provider
- **Deepseek thinking 模式适配** — 修正 `reasoning_content` 字段丢失导致的 API 400 错误,在 `schema.Message` 中新增字段并在请求中回传
- **Thinking 死循环修复** — 过渡指令只在首轮插入,防止模型每轮重复调用工具
- **最大轮数保护** — 新增 `maxTurns = 10` 上限,防止意外死循环
- **调试输出** — 新增 `dumpMessages` 和 `dumpTools`,每轮打印上下文消息和工具列表
#### 踩坑记录
| 问题 | 原因 | 解决 |
|---|---|---|
| API 400: `reasoning_content must be passed back` | Deepseek thinking 模式返回了 `reasoning_content` 字段,回传请求时未携带 | 从响应 RawJSON 中提取该字段,用 `param.Override` 注入原始 JSON 回传 |
| 模型在 Phase 2 不调用工具 | Phase 1 的思考内容作为 Assistant 消息追加后,模型认为对话已结束 | 在思考后插入一条 User 角色过渡指令:"根据推理,使用工具完成任务" |
| 引擎死循环跑到 maxTurns | 过渡指令每轮都插入,模型每轮都被要求调用工具 | 过渡指令只在 `turnCount == 1` 时插入,后续轮次模型根据观察结果自行判断 |
#### 经验教训
1. **上下文即状态** — Agent 的所有行为都由上下文驱动。插入一条消息就能改变模型行为,不需要改代码逻辑
2. **非标准 API 字段需手动处理** — 大模型厂商的扩展字段(如 `reasoning_content`)不在 SDK 类型中,需要从 RawJSON 手动提取并用注入方式回传
3. **过渡指令的作用域很重要** — "使用工具"这种指令适合在首轮引导,重复出现会导致模型无法自行判断任务是否完成
### v1.1 — 慢思考模式 (Thinking Phase)
将 ReAct 循环从单阶段升级为双阶段架构: