| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
docs: 修正 5 处事实与引用错误(ch5 工具集 / ch6-7 配图 / ch8 引用编号 / ch10 基准数) (#1130) * docs(ch5): 修正 Codex 工具集描述 原文称「OpenAI Codex 就只提供 Bash Shell 一个工具,用这一个工具完成所有 文件读写、查找操作」,与实际不符:Codex CLI 除 shell 外还提供语法受约束的 apply_patch 工具,文件修改主要走它(参见 openai/codex 中 apply_patch 作为 二进制内置虚拟工具的实现)。改为准确描述其工具集构成。 * docs(ch6,ch7): 修正配图中的基准数与 Elo 更新公式 - fig6-9:Qwen3-Omni 由「22/36 基准达 SOTA」改为「32/36 达开源 SOTA」。 原数字把两个统计口径混为一谈:Qwen3-Omni 技术报告称在 36 个音频/视听基准 中 32 个达到开源 SOTA,22 是其中超过 Gemini 2.5 Pro 与 GPT-4o 的基准数。 - fig7-6:Elo 更新公式 R_A' = R_A + K*(1-E_A) 漏掉实际得分项,通式为 R_A' = R_A + K*(S_A - E_A)。 * docs(ch8,ch10): 修正 DreamGym arXiv 编号与 Plan-and-Act 成功率 - ch8 脚注 14:DreamGym 的 arXiv 编号 2511.01824 有误,该编号对应另一篇 论文(Simulating Environments with Reasoning Models for Agent Training, Yuetai Li 等);DreamGym 的正确编号为 arXiv:2511.03773。 - ch10:Plan-and-Act 在 WebArena-Lite 的成功率原文写作 54%,论文摘要为 「state-of-the-art 57.58% success rate on the WebArena-Lite benchmark」。 | 17 天前 | |
add updated pdf | 2 个月前 | |
docs: 润色全书中文行文 (#928) 对 book/ 下全部 13 个文件做一遍行文润色,只改表述、不改技术内容与结论: - 统一用词:“人的先验”→“人类先验”、“鲁棒”→“稳健”、“发挥方向”→“应用方向”, 以及第一章实验叙述中残留的 7 处“您”改为全书通用的“你” - 收紧冗余表述、理顺长句断句,例如“工具一旦失败就会变成 Agent 的死锁” →“工具一旦调用失败,Agent 就可能陷入死锁” - 修订 4 处小节标题措辞(第 5、9、10 章) - 修正第 5 章一处加粗小标题的标点位置,与全书其余 72 处 **……。** 对齐 第 3、5、6 章与 main 上 #926 的润色有重叠,已按三方合并逐处取本次修订版本; 其中第 6 章一处 “也可使用指向自托管 vLLM/SGLang 等” 语句不通,一并改为 “也可连接自托管的 vLLM/SGLang 等服务”。 其余 12 个语种的同步翻译将在后续 PR 中跟进。 Co-authored-by: Claude Opus 5 <noreply@anthropic.com> | 1 个月前 | |
docs(book): reorganize chapters for version 2.0 (#909) | 1 个月前 | |
| 14 天前 | ||
docs: 修正 5 处事实与引用错误(ch5 工具集 / ch6-7 配图 / ch8 引用编号 / ch10 基准数) (#1130) * docs(ch5): 修正 Codex 工具集描述 原文称「OpenAI Codex 就只提供 Bash Shell 一个工具,用这一个工具完成所有 文件读写、查找操作」,与实际不符:Codex CLI 除 shell 外还提供语法受约束的 apply_patch 工具,文件修改主要走它(参见 openai/codex 中 apply_patch 作为 二进制内置虚拟工具的实现)。改为准确描述其工具集构成。 * docs(ch6,ch7): 修正配图中的基准数与 Elo 更新公式 - fig6-9:Qwen3-Omni 由「22/36 基准达 SOTA」改为「32/36 达开源 SOTA」。 原数字把两个统计口径混为一谈:Qwen3-Omni 技术报告称在 36 个音频/视听基准 中 32 个达到开源 SOTA,22 是其中超过 Gemini 2.5 Pro 与 GPT-4o 的基准数。 - fig7-6:Elo 更新公式 R_A' = R_A + K*(1-E_A) 漏掉实际得分项,通式为 R_A' = R_A + K*(S_A - E_A)。 * docs(ch8,ch10): 修正 DreamGym arXiv 编号与 Plan-and-Act 成功率 - ch8 脚注 14:DreamGym 的 arXiv 编号 2511.01824 有误,该编号对应另一篇 论文(Simulating Environments with Reasoning Models for Agent Training, Yuetai Li 等);DreamGym 的正确编号为 arXiv:2511.03773。 - ch10:Plan-and-Act 在 WebArena-Lite 的成功率原文写作 54%,论文摘要为 「state-of-the-art 57.58% success rate on the WebArena-Lite benchmark」。 | 17 天前 | |
docs(ch2): 补充 Claude preserved thinking——前缀改动会让历史 thinking 失效 (#1151) - 更正关于 Claude 历史 thinking 的旧说法 - 缓存作为架构约束:新增两段,说明防蒸馏的前缀绑定与缓存得出同一条“只追加”纪律 - 压缩与 KV Cache:补充保留尾部的压缩会让保留轮次的 thinking 失效 Co-authored-by: Bojie Li <i@01.me> Co-authored-by: Claude Opus 5.5 (1M context) <noreply@anthropic.com> | 13 天前 | |
Update chapter3.md (#937) | 1 个月前 | |
docs(ch4): add applicability conditions to MCP/Skill disclosure, risk and sandbox claims (#1063) (#1129) * docs(ch4): add applicability conditions to MCP/Skill disclosure, risk and sandbox claims (#1063) Chinese source and English edition. Translations follow in the same PR. Co-Authored-By: Claude Fable 5.1 <noreply@anthropic.com> * docs(ch4): sync the MCP/Skill boundary-condition rewrite to all 13 translations Also resyncs the execution-isolation list in ten editions that still carried the older OS-level/resource-quota bullets, dedupes a repeated lead-in (id) and a repeated progressive-disclosure paragraph (he), and adds the missing Hebrew intro paragraph of the Skills tool-discovery section. Co-Authored-By: Claude Fable 5.1 <noreply@anthropic.com> --------- Co-authored-by: Bojie Li <i@01.me> Co-authored-by: Claude Fable 5.1 <noreply@anthropic.com> | 17 天前 | |
docs: 修正 5 处事实与引用错误(ch5 工具集 / ch6-7 配图 / ch8 引用编号 / ch10 基准数) (#1130) * docs(ch5): 修正 Codex 工具集描述 原文称「OpenAI Codex 就只提供 Bash Shell 一个工具,用这一个工具完成所有 文件读写、查找操作」,与实际不符:Codex CLI 除 shell 外还提供语法受约束的 apply_patch 工具,文件修改主要走它(参见 openai/codex 中 apply_patch 作为 二进制内置虚拟工具的实现)。改为准确描述其工具集构成。 * docs(ch6,ch7): 修正配图中的基准数与 Elo 更新公式 - fig6-9:Qwen3-Omni 由「22/36 基准达 SOTA」改为「32/36 达开源 SOTA」。 原数字把两个统计口径混为一谈:Qwen3-Omni 技术报告称在 36 个音频/视听基准 中 32 个达到开源 SOTA,22 是其中超过 Gemini 2.5 Pro 与 GPT-4o 的基准数。 - fig7-6:Elo 更新公式 R_A' = R_A + K*(1-E_A) 漏掉实际得分项,通式为 R_A' = R_A + K*(S_A - E_A)。 * docs(ch8,ch10): 修正 DreamGym arXiv 编号与 Plan-and-Act 成功率 - ch8 脚注 14:DreamGym 的 arXiv 编号 2511.01824 有误,该编号对应另一篇 论文(Simulating Environments with Reasoning Models for Agent Training, Yuetai Li 等);DreamGym 的正确编号为 arXiv:2511.03773。 - ch10:Plan-and-Act 在 WebArena-Lite 的成功率原文写作 54%,论文摘要为 「state-of-the-art 57.58% success rate on the WebArena-Lite benchmark」。 | 17 天前 | |
docs(ch6): 补充原生异步实验 6-3 并同步 15 语种 (#1066) * docs(ch6): add Astra native async and mid-turn steering experiment * docs(ch6): explain native async principles and renumber experiments * docs(ch6): translate native async principles across all 14 editions | 30 天前 | |
docs(ch7): 说明 τ²-bench 需自行克隆,而非收在配套仓库中(15 译本同步) (#1054) * docs(ch7): 说明 τ²-bench 需自行克隆,而非收在配套仓库中 第七章「一条评估任务的解剖」称源码「位于仓库的 chapter7/tau2-bench」, 但该路径被 .gitignore 第 54 行排除,仓库里并不存在,读者按书查找会落空 (issue #1050)。 τ²-bench 是 Sierra 的开源项目,本仓库刻意不做 vendoring,克隆命令固定在 chapter7/tau2-bench-eval/README.md 中(含 pin 住的上游 commit)。正文改为 指向该 README,并说明克隆到 chapter7/tau2-bench 之后任务文件的位置。 15 个语种同步。 Fixes #1050 Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_018iSm7JBWoy87hxSpUkJ49T * docs(ch7): 按作者意见收紧措辞,直接讲怎么拿到任务文件 去掉「并未收入配套仓库」的解释和 chapter7/tau2-bench 这个具体路径,改为 一句话说明来源并直接给出操作:克隆到本地后打开任务文件。15 个语种同步。 Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_018iSm7JBWoy87hxSpUkJ49T --------- Co-authored-by: Claude Opus 5 (1M context) <noreply@anthropic.com> | 1 个月前 | |
docs: 修正 5 处事实与引用错误(ch5 工具集 / ch6-7 配图 / ch8 引用编号 / ch10 基准数) (#1130) * docs(ch5): 修正 Codex 工具集描述 原文称「OpenAI Codex 就只提供 Bash Shell 一个工具,用这一个工具完成所有 文件读写、查找操作」,与实际不符:Codex CLI 除 shell 外还提供语法受约束的 apply_patch 工具,文件修改主要走它(参见 openai/codex 中 apply_patch 作为 二进制内置虚拟工具的实现)。改为准确描述其工具集构成。 * docs(ch6,ch7): 修正配图中的基准数与 Elo 更新公式 - fig6-9:Qwen3-Omni 由「22/36 基准达 SOTA」改为「32/36 达开源 SOTA」。 原数字把两个统计口径混为一谈:Qwen3-Omni 技术报告称在 36 个音频/视听基准 中 32 个达到开源 SOTA,22 是其中超过 Gemini 2.5 Pro 与 GPT-4o 的基准数。 - fig7-6:Elo 更新公式 R_A' = R_A + K*(1-E_A) 漏掉实际得分项,通式为 R_A' = R_A + K*(S_A - E_A)。 * docs(ch8,ch10): 修正 DreamGym arXiv 编号与 Plan-and-Act 成功率 - ch8 脚注 14:DreamGym 的 arXiv 编号 2511.01824 有误,该编号对应另一篇 论文(Simulating Environments with Reasoning Models for Agent Training, Yuetai Li 等);DreamGym 的正确编号为 arXiv:2511.03773。 - ch10:Plan-and-Act 在 WebArena-Lite 的成功率原文写作 54%,论文摘要为 「state-of-the-art 57.58% success rate on the WebArena-Lite benchmark」。 | 17 天前 | |
docs(ch9): 增加历史回放驱动的探索策略进化机制 (#1103) * docs(ch9): 增加历史回放驱动的探索策略进化机制 * test(web): update Chapter 9 Chinese footnote count | 18 天前 | |
docs(book): reorganize chapters for version 2.0 (#909) | 1 个月前 | |
合入全书正文与编译版 PDF,本仓库成为书籍开源主仓库 - 新增 book/:引言、第一至第十章、后记的正文源码,编译版 book.pdf(v1.0,312 页), 以及构建工具链(build_pdf.sh、cover.tex、preamble.tex、*.lua、gen_*_figs.py 等) 与编译所需插图 book/images/ - README 更新:标题改为书名《深入理解 AI Agent:设计原理与工程实践》, 新增「电子书」区块说明正文位置与编译方式,配套代码归入「配套代码」小节 - 仅收录发布所需内容:历史草稿、信息图、内部评审记录、未跟踪本地文件均不纳入 Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com> | 2 个月前 | |
Revert "Merge pull request #12 from nsdevaraj/main" This reverts commit 927d1352b7517fa2c569623aba88f0e167558a3b, reversing changes made to 0ab5d1ea24ba499e6993a1824115f1957d329a69. | 2 个月前 | |
chore: remove secret-shaped placeholders | 2 个月前 | |
docs: 润色全书中文行文 (#928) 对 book/ 下全部 13 个文件做一遍行文润色,只改表述、不改技术内容与结论: - 统一用词:“人的先验”→“人类先验”、“鲁棒”→“稳健”、“发挥方向”→“应用方向”, 以及第一章实验叙述中残留的 7 处“您”改为全书通用的“你” - 收紧冗余表述、理顺长句断句,例如“工具一旦失败就会变成 Agent 的死锁” →“工具一旦调用失败,Agent 就可能陷入死锁” - 修订 4 处小节标题措辞(第 5、9、10 章) - 修正第 5 章一处加粗小标题的标点位置,与全书其余 72 处 **……。** 对齐 第 3、5、6 章与 main 上 #926 的润色有重叠,已按三方合并逐处取本次修订版本; 其中第 6 章一处 “也可使用指向自托管 vLLM/SGLang 等” 语句不通,一并改为 “也可连接自托管的 vLLM/SGLang 等服务”。 其余 12 个语种的同步翻译将在后续 PR 中跟进。 Co-authored-by: Claude Opus 5 <noreply@anthropic.com> | 1 个月前 | |
Fix page numbers on chapter opening pages | 2 个月前 | |
| 14 天前 | ||
chore(book): remove obsolete SVG generators (#446) | 2 个月前 |
| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
| 17 天前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 1 个月前 | ||
| 14 天前 | ||
| 17 天前 | ||
| 13 天前 | ||
| 1 个月前 | ||
| 17 天前 | ||
| 17 天前 | ||
| 30 天前 | ||
| 1 个月前 | ||
| 17 天前 | ||
| 18 天前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 2 个月前 | ||
| 1 个月前 | ||
| 2 个月前 | ||
| 14 天前 | ||
| 2 个月前 |