ReAct 循环:思考-行动-观察
2026/8/23大约 2 分钟
AICon 2026 学习系列 · 阶段 3 · Agent 工程 · 第 16/43 篇 · 🚧 占位待学
上一篇:《从 RAG 到 Agentic 数据:语义层与数据治理》
下一篇:《工具设计工程学:写给模型看的 API 文档》
学习大纲:《AICon 2026 学习总纲》
状态:待学习。 本文为占位文档:知识点清单、实验与验收标准已就绪,正文待按「先学习、先实验、再撰写」补全。
对应总纲单元:阶段 3 · 单元 3.1
一、本文要解决的问题
Agent 和一次问答的本质区别是什么?就一个词:循环。ReAct 让模型「想一步、做一步、看一步」,把阶段 1 的 function calling 循环装上方向盘。
二、知识点清单
- ReAct 的思想:Reason 与 Act 交错,观察驱动下一步
- 循环的构成:目标 → 思考 → 行动 → 观察 → …… → 最终答案
- 停止条件:给出答案 / 达到步数上限 / 识别不可完成
- 失败模式:死循环、提前放弃、工具滥用
三、动手实验(学习时必须真跑)
- 裸写 50 行 ReAct 循环(阶段 1 的调用循环 + 「观察后再思考」)
- 给它一个必须三步以上的任务(查数据 → 计算 → 写文件),看轨迹
四、验收标准(全部通过才进入下一篇)
五、写作提示(补正文时遵守)
- 开篇问题驱动;结构走「是什么 → 为什么 → 怎么做 → 背景知识」
- 所有代码、命令、输出必须先在本机跑通再写入,不得杜撰
- 版本口径以总纲环境清单为准(Python 3.12 / Ollama / vLLM 与 SGLang 最新版 / Spring AI 1.x)
- 涉及版本敏感结论时标注出处与时间
本篇完成后,把文首导航块的「🚧 占位待学」去掉,并在总纲处打卡。