《AI Agent Book》阅读路线:从原理到可复现实验
从上下文消融实验开始
选择第一章的一个小任务,让模型、服务商和上下文模式都可追溯。
从上下文消融实验开始知识学习CN编辑简报更新 2026-09-26
你将学会
- 限定实验环境
- 一次只改一个上下文条件
- 区分准备与结论
开始前需要
- Python 环境基础
- 运行实时实验时所需的模型服务商账号
把一节上下文课变成有记录的实验和设计判断。
先看结论
- 先做一项实验,再安装全书环境。
- 最初只控制一个变量。
- 生成文件不证明推理有效。
限定实验环境
根 README 推荐带锁文件的 uv 环境,并提供 pip 兜底。第一章说明了模型服务商凭据与 chapter1/context 路径。只安装选定实验所需的依赖。
把密钥放进安全的环境或密钥文件,不写进文章和共享输出。首次测试选不含敏感文档的小任务。
一次只改一个上下文条件
章节列出 full、no_history、no_reasoning、no_tool_calls、no_tool_results。让同一任务在两种模式下运行,保存原始输出、模型与版本。
两次结果不同,不足以证明差别来自被删掉的上下文。应重复运行,并实际检查发给服务商的消息。
区分准备与结论
运行脚本能写出证据文件,但有输出目录不等于模型实验成功。还要检查完成情况、正确性和目标上下文是否真的消失。
本文没有声称执行过示例。下方命令只是阅读线索,使用前仍需核对固定版本实验说明里的参数。
如何选择
| 比较维度 | 方案 A | 方案 B |
|---|---|---|
| Best when | You need predictable behavior and easy auditing | You need adaptive optimization and have reliable telemetry |
| Main risk | May leave performance on the table | Can become difficult to explain or debug |
实施步骤
- 1
建立锁定环境并配置一个服务商密钥。
- 2
用合成任务比较 full 和 no_tool_results。
- 3
保存请求、结果与差异解释。
可复制示例
sh
uv sync
uv run python chapter1/context/main.py
# inspect chapter1/context/README.md for provider and mode flags常见问题
必须用默认服务商吗?
不用,章节文档列出几种可选服务商。
no_reasoning 证明模型没有推理吗?
不能。该模式涉及历史上下文保留,服务商行为也可能不同。
资料来源
- AI Agent Book / README.md来源核查 2026-09-26
- AI Agent Book / chapter1/context/README.md来源核查 2026-09-26