| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
change PyPDF2 to pypdf and a Annotation error (#1044) | 5 天前 | |
exp(ch1,ch5): 实验 1-4 文生图工作流对照 + 实验 5-7 CAD vs 生成模型实现与验收证据 (#939) * exp(ch1,ch5): 实验 1-4 文生图工作流对照与实验 5-7 CAD vs 生成模型 - chapter1/image-gen-workflow/:具体/宽泛两类需求 × 工作流路线 (kimi-k3 改写提示词 + 通义万相 wan2.2-t2i-flash)与原生路线 (gemini-3.1-flash-image-preview,主用例加跑 gpt-image-2)真实对照; 两轮正式运行(20260821T014534Z / 20260821T020405Z)证据齐备, 首次失败运行如实保留;25 个离线测试全绿 - chapter5/cad-vs-diffusion/:同一法兰盘规格双路线——Kimi k2.5 生成 CadQuery 全尺寸零偏差 vs Hunyuan3D-2.1(HF 公共 Space)通孔全丢、 外径偏差 -99.4%;M5→M6 变更成本对比与绿植对照组(3 vs 8 反转); manifest 含 13 个产物哈希 + 9 条 receipts,10/10 验收门通过 - chapter1/chapter5 README 新增 1-4、5-7 行,原 5-7~5-13 顺延为 5-8~5-14;两个 EXPERIMENT_LEDGER 同步(含 renumbering history 说明) 正文改动见 PR #938 * exp(ch1-1-4): 修正实验路线为三条(Nano Banana 2 + GPT-Image 2 真实 API 验证) - 原生路线统一使用 gemini-3-pro-image(书稿所称 Nano Banana 2), 删除临时的 gemini-3.1-flash-image-preview 路线 - GPT-Image 2(gpt-image-2)扩展至全部 5 句需求,不再限宽泛需求 - 最终正式运行 20260821T040450Z:15/15 全部成功 - 更新 config/pipeline/evidence/main/README/测试/LEDGER 保持一致 - SELECTION_NOTES 不再提及书稿未提及的 gemini-3.1-flash-image-preview Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01WMHQamkbj17Bjkc6WPa81z --------- Co-authored-by: Claude Sonnet 4.6 <noreply@anthropic.com> | 17 天前 | |
docs(book): reorganize chapters for version 2.0 (#909) | 21 天前 | |
fix(ch1): handle null response in search codegen agent (#786) * fix(ch1): handle null response in search codegen agent * fix(ch1): use importlib.util to avoid agent module name collision in CI The web-search-agent-tests workflow installs the agentbook package which puts chapter2/system-hint/agent.py on sys.path. The test's sys.path.insert then loses to that module, causing ImportError. Switch to importlib.util dynamic import with a unique module name. | 28 天前 | |
fix(ch1): 实验 1-2 默认超时从 30 秒提到 180 秒,并区分速率限制与超时 (#1058) issue #1032 里三次运行有两次以 "Request timed out" 收尾。根因是 Config.SEARCH_TIMEOUT 默认 30 秒,并被当作 OpenAI 客户端的整体 timeout: - kimi-k3 以 reasoning_effort=max、max_tokens=32768 运行,单次 completion 常需 1-3 分钟。本目录保留的真实运行证据里就有 161 秒、121 秒、64 秒、 41 秒的 chat completion(validation/real_20260729T163003Z 等)。 - run_experiment_1_2.py 的 --timeout 默认是 180 秒,所以验收脚本跑得通, 而 README 让读者用的 main.py 交互模式跑不通——两条入口配置不一致。 - 429 会被 SDK 自动重试,重试把 30 秒预算耗完后,最终抛出的是 APITimeoutError,读者只看到 "Request timed out",看不出真正原因是限流。 改动: 1. Config.SEARCH_TIMEOUT 默认 30 → 180,与 run_experiment_1_2.py 对齐。 2. 新增 _error_hint():速率限制直说是限流;超时则报出超时预算、说明 kimi-k3 单次调用的量级,并提示去日志里查 429。 3. README(中英)配置表与注意事项、env.example 同步;补 4 个单元测试。 Fixes #1032 Claude-Session: https://claude.ai/code/session_018iSm7JBWoy87hxSpUkJ49T Co-authored-by: Claude Opus 5 (1M context) <noreply@anthropic.com> | 4 天前 | |
fix(ch1): 修正实验 1-1 的消融设计与度量,并按原理重写正文结论 (#971) (#984) 读者用 DeepSeek-V4-Flash 复现实验 1-1 时报了三处现象。三处都成立,其中 一处的问题在实验本身而不在模型。 复现门槛: --model 默认硬编码 kimi-k3,与 --provider 相互独立,只传 --provider deepseek 会五臂全部失败。现改为从共享注册表解析默认模型, --provider 的候选值与 key 查找也一并改用注册表,不再手抄一份表。顺带修掉 一个自己踩到的坑:validation/latest.json 原本无条件覆盖,一次失败的运行 就会冲掉被引用的证据;现在只有既是标准配置又通过验收的运行才会提升。 度量:✓ Completed 区分不出「拒绝」和「自信地编」。新增 grounding.py, 依据**实际发出的消息**判断回答里的营收量级数字能否在任务或观测中找到来源; 每一臂新增 outcome(correct / no_unsupported_numbers / unsupported_numbers / incorrect / no_terminal_response),main.py 的对照矩阵相应地把原来显示 ✓ 的格子显示为 ⚠ UNSUPPORTED。可依据性与正确性是两条独立的轴。 另外两处:「移除工具定义后没有工具行动」标注为构造性必然;对没有真正到达 提供商的实验组,结论记为 null——此前一次全部 402 的运行会把四条正文结论中 的三条报成「已观察到」。 实验本身:no_tool_results 臂原先把观测替换成可见的 [Tool result hidden due to context mode],这等于**补上**了一个本该被消融 掉的信号——模型能读出「有观测被藏了」并就此停下。标准做法改为静默隐藏(内容 置空;协议要求这条消息必须存在)。Kimi K3 重复运行:静默 7 次里 6 次跑到迭代 上限,可见占位符 4 次里只有 1 次;正文的「盲目执行」是对的,是 harness 把它 盖住了。marker 与 --task unguarded 作为探针保留,证据见 validation/probes_20260825T/。 正文(按原理改写,不写模型名与运行次数,因为模型迭代很快): - 工具定义:失去行动能力不等于沉默;究竟是拒绝还是就地补全,取决于上下文里 有没有「不得自行估计」这类约束。 - 工具执行结果:「无限循环」改为「反复重试直到耗尽迭代预算」,并补上「能被 察觉的缺失与察觉不到的缺失是两种故障」——这也是工具应返回显式错误而非空 结果的原因。 - 思考过程:删去未复现的「前后矛盾的决策」断言(本仓两次 Kimi K3 运行、 读者的 DeepSeek 复现与串行深度阶梯均测不出效应)。改为说明该臂剥离的是 历史中保留的 reasoning 而非生成本身:reasoning 记录「为什么」,工具结果 记录「发生了什么」,「为什么」可从「发生了什么」重建时丢掉它几乎没有代价。 - 核心洞察:「缺失任何一个组件都会严重退化」改为按信息能否从别处重建来衡量, 并提醒读者在自己关心的模型上重跑。 - 新增「『给出了回答』不等于『完成了任务』」。 - 本章小结与思考题 4 同步。 翻译版本未动,留待 i18n 同步。 Claude-Session: https://claude.ai/code/session_01Nt69cMUbhpnXLfzm1cSJqC Co-authored-by: Claude Opus 5 (1M context) <noreply@anthropic.com> | 13 天前 | |
fix(i18n): add missing exp 1-4 & 5-7 entries + renumber ch5 in 14 locales chapter1/README: add experiment 1-4 (image-gen-workflow) to ar, id, ko, ru, ta, vi — these were omitted from the earlier i18n sync (#942) which only updated en/es/hu/ja/tr/zh-TW. chapter5/README: add experiment 5-7 (cad-vs-diffusion) and renumber old 5-7…5-13 → 5-8…5-14 in ar, id, ko, ru, ta, vi, zh-TW; add the missing 5-7 row to en (which was already renumbered correctly but lacked the new entry). Fixes i18n consistency CI failure on main. Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01WMHQamkbj17Bjkc6WPa81z | 17 天前 | |
docs(i18n): sync ch1 image-gen workflow & ch5 3D/CAD routing to 13 language editions (#942) Propagate PR #938 additions to all translated book editions: Chapter 1 (book-XX/chapter1): - 新增文生图工作流示例(适配层与原生图像生成的对比) - 新增实验 1-4(Nano Banana 2 + GPT-Image 2 × 工作流路线) - 新增 Harness 被内化的规律总结 Chapter 5 (book-XX/chapter5): - 新增「3D 与工业零件:代码生成与生成模型的边界」论述 - 新增实验 5-7(法兰盘两条生成路线 + 绿植对照组) - 旧实验 5-7..5-13 → 5-8..5-14 重新编号 Reference answers (reference-answers.XX): 5-8→5-9(原 5-7→5-8 改为 5-8→5-9) Experiment READMEs (chapter1/README.XX, chapter5/README.XX): - 新增实验 1-4 行(chapter1/README.{en,es,hu,ja,tr,zh-TW}) - 新增实验 5-7 行、旧 5-7..5-13 重新编号(chapter5/README.{en,es,hu,ja,tr}) Languages: ar, en, es, he, hu, id, ja, ko, ru, ta, tr, vi, zh-TW Claude-Session: https://claude.ai/code/session_01WMHQamkbj17Bjkc6WPa81z Co-authored-by: Claude Sonnet 4.6 <noreply@anthropic.com> | 17 天前 | |
docs(i18n): sync ch1 image-gen workflow & ch5 3D/CAD routing to 13 language editions (#942) Propagate PR #938 additions to all translated book editions: Chapter 1 (book-XX/chapter1): - 新增文生图工作流示例(适配层与原生图像生成的对比) - 新增实验 1-4(Nano Banana 2 + GPT-Image 2 × 工作流路线) - 新增 Harness 被内化的规律总结 Chapter 5 (book-XX/chapter5): - 新增「3D 与工业零件:代码生成与生成模型的边界」论述 - 新增实验 5-7(法兰盘两条生成路线 + 绿植对照组) - 旧实验 5-7..5-13 → 5-8..5-14 重新编号 Reference answers (reference-answers.XX): 5-8→5-9(原 5-7→5-8 改为 5-8→5-9) Experiment READMEs (chapter1/README.XX, chapter5/README.XX): - 新增实验 1-4 行(chapter1/README.{en,es,hu,ja,tr,zh-TW}) - 新增实验 5-7 行、旧 5-7..5-13 重新编号(chapter5/README.{en,es,hu,ja,tr}) Languages: ar, en, es, he, hu, id, ja, ko, ru, ta, tr, vi, zh-TW Claude-Session: https://claude.ai/code/session_01WMHQamkbj17Bjkc6WPa81z Co-authored-by: Claude Sonnet 4.6 <noreply@anthropic.com> | 17 天前 | |
docs(i18n): sync ch1 image-gen workflow & ch5 3D/CAD routing to 13 language editions (#942) Propagate PR #938 additions to all translated book editions: Chapter 1 (book-XX/chapter1): - 新增文生图工作流示例(适配层与原生图像生成的对比) - 新增实验 1-4(Nano Banana 2 + GPT-Image 2 × 工作流路线) - 新增 Harness 被内化的规律总结 Chapter 5 (book-XX/chapter5): - 新增「3D 与工业零件:代码生成与生成模型的边界」论述 - 新增实验 5-7(法兰盘两条生成路线 + 绿植对照组) - 旧实验 5-7..5-13 → 5-8..5-14 重新编号 Reference answers (reference-answers.XX): 5-8→5-9(原 5-7→5-8 改为 5-8→5-9) Experiment READMEs (chapter1/README.XX, chapter5/README.XX): - 新增实验 1-4 行(chapter1/README.{en,es,hu,ja,tr,zh-TW}) - 新增实验 5-7 行、旧 5-7..5-13 重新编号(chapter5/README.{en,es,hu,ja,tr}) Languages: ar, en, es, he, hu, id, ja, ko, ru, ta, tr, vi, zh-TW Claude-Session: https://claude.ai/code/session_01WMHQamkbj17Bjkc6WPa81z Co-authored-by: Claude Sonnet 4.6 <noreply@anthropic.com> | 17 天前 | |
fix(i18n): add missing exp 1-4 & 5-7 entries + renumber ch5 in 14 locales chapter1/README: add experiment 1-4 (image-gen-workflow) to ar, id, ko, ru, ta, vi — these were omitted from the earlier i18n sync (#942) which only updated en/es/hu/ja/tr/zh-TW. chapter5/README: add experiment 5-7 (cad-vs-diffusion) and renumber old 5-7…5-13 → 5-8…5-14 in ar, id, ko, ru, ta, vi, zh-TW; add the missing 5-7 row to en (which was already renumbered correctly but lacked the new entry). Fixes i18n consistency CI failure on main. Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01WMHQamkbj17Bjkc6WPa81z | 17 天前 | |
docs(i18n): sync ch1 image-gen workflow & ch5 3D/CAD routing to 13 language editions (#942) Propagate PR #938 additions to all translated book editions: Chapter 1 (book-XX/chapter1): - 新增文生图工作流示例(适配层与原生图像生成的对比) - 新增实验 1-4(Nano Banana 2 + GPT-Image 2 × 工作流路线) - 新增 Harness 被内化的规律总结 Chapter 5 (book-XX/chapter5): - 新增「3D 与工业零件:代码生成与生成模型的边界」论述 - 新增实验 5-7(法兰盘两条生成路线 + 绿植对照组) - 旧实验 5-7..5-13 → 5-8..5-14 重新编号 Reference answers (reference-answers.XX): 5-8→5-9(原 5-7→5-8 改为 5-8→5-9) Experiment READMEs (chapter1/README.XX, chapter5/README.XX): - 新增实验 1-4 行(chapter1/README.{en,es,hu,ja,tr,zh-TW}) - 新增实验 5-7 行、旧 5-7..5-13 重新编号(chapter5/README.{en,es,hu,ja,tr}) Languages: ar, en, es, he, hu, id, ja, ko, ru, ta, tr, vi, zh-TW Claude-Session: https://claude.ai/code/session_01WMHQamkbj17Bjkc6WPa81z Co-authored-by: Claude Sonnet 4.6 <noreply@anthropic.com> | 17 天前 | |
fix(i18n): add missing exp 1-4 & 5-7 entries + renumber ch5 in 14 locales chapter1/README: add experiment 1-4 (image-gen-workflow) to ar, id, ko, ru, ta, vi — these were omitted from the earlier i18n sync (#942) which only updated en/es/hu/ja/tr/zh-TW. chapter5/README: add experiment 5-7 (cad-vs-diffusion) and renumber old 5-7…5-13 → 5-8…5-14 in ar, id, ko, ru, ta, vi, zh-TW; add the missing 5-7 row to en (which was already renumbered correctly but lacked the new entry). Fixes i18n consistency CI failure on main. Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01WMHQamkbj17Bjkc6WPa81z | 17 天前 | |
exp(ch1,ch5): 实验 1-4 文生图工作流对照 + 实验 5-7 CAD vs 生成模型实现与验收证据 (#939) * exp(ch1,ch5): 实验 1-4 文生图工作流对照与实验 5-7 CAD vs 生成模型 - chapter1/image-gen-workflow/:具体/宽泛两类需求 × 工作流路线 (kimi-k3 改写提示词 + 通义万相 wan2.2-t2i-flash)与原生路线 (gemini-3.1-flash-image-preview,主用例加跑 gpt-image-2)真实对照; 两轮正式运行(20260821T014534Z / 20260821T020405Z)证据齐备, 首次失败运行如实保留;25 个离线测试全绿 - chapter5/cad-vs-diffusion/:同一法兰盘规格双路线——Kimi k2.5 生成 CadQuery 全尺寸零偏差 vs Hunyuan3D-2.1(HF 公共 Space)通孔全丢、 外径偏差 -99.4%;M5→M6 变更成本对比与绿植对照组(3 vs 8 反转); manifest 含 13 个产物哈希 + 9 条 receipts,10/10 验收门通过 - chapter1/chapter5 README 新增 1-4、5-7 行,原 5-7~5-13 顺延为 5-8~5-14;两个 EXPERIMENT_LEDGER 同步(含 renumbering history 说明) 正文改动见 PR #938 * exp(ch1-1-4): 修正实验路线为三条(Nano Banana 2 + GPT-Image 2 真实 API 验证) - 原生路线统一使用 gemini-3-pro-image(书稿所称 Nano Banana 2), 删除临时的 gemini-3.1-flash-image-preview 路线 - GPT-Image 2(gpt-image-2)扩展至全部 5 句需求,不再限宽泛需求 - 最终正式运行 20260821T040450Z:15/15 全部成功 - 更新 config/pipeline/evidence/main/README/测试/LEDGER 保持一致 - SELECTION_NOTES 不再提及书稿未提及的 gemini-3.1-flash-image-preview Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01WMHQamkbj17Bjkc6WPa81z --------- Co-authored-by: Claude Sonnet 4.6 <noreply@anthropic.com> | 17 天前 | |
fix(i18n): add missing exp 1-4 & 5-7 entries + renumber ch5 in 14 locales chapter1/README: add experiment 1-4 (image-gen-workflow) to ar, id, ko, ru, ta, vi — these were omitted from the earlier i18n sync (#942) which only updated en/es/hu/ja/tr/zh-TW. chapter5/README: add experiment 5-7 (cad-vs-diffusion) and renumber old 5-7…5-13 → 5-8…5-14 in ar, id, ko, ru, ta, vi, zh-TW; add the missing 5-7 row to en (which was already renumbered correctly but lacked the new entry). Fixes i18n consistency CI failure on main. Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01WMHQamkbj17Bjkc6WPa81z | 17 天前 | |
fix(i18n): add missing exp 1-4 & 5-7 entries + renumber ch5 in 14 locales chapter1/README: add experiment 1-4 (image-gen-workflow) to ar, id, ko, ru, ta, vi — these were omitted from the earlier i18n sync (#942) which only updated en/es/hu/ja/tr/zh-TW. chapter5/README: add experiment 5-7 (cad-vs-diffusion) and renumber old 5-7…5-13 → 5-8…5-14 in ar, id, ko, ru, ta, vi, zh-TW; add the missing 5-7 row to en (which was already renumbered correctly but lacked the new entry). Fixes i18n consistency CI failure on main. Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01WMHQamkbj17Bjkc6WPa81z | 17 天前 | |
docs(i18n): sync ch1 image-gen workflow & ch5 3D/CAD routing to 13 language editions (#942) Propagate PR #938 additions to all translated book editions: Chapter 1 (book-XX/chapter1): - 新增文生图工作流示例(适配层与原生图像生成的对比) - 新增实验 1-4(Nano Banana 2 + GPT-Image 2 × 工作流路线) - 新增 Harness 被内化的规律总结 Chapter 5 (book-XX/chapter5): - 新增「3D 与工业零件:代码生成与生成模型的边界」论述 - 新增实验 5-7(法兰盘两条生成路线 + 绿植对照组) - 旧实验 5-7..5-13 → 5-8..5-14 重新编号 Reference answers (reference-answers.XX): 5-8→5-9(原 5-7→5-8 改为 5-8→5-9) Experiment READMEs (chapter1/README.XX, chapter5/README.XX): - 新增实验 1-4 行(chapter1/README.{en,es,hu,ja,tr,zh-TW}) - 新增实验 5-7 行、旧 5-7..5-13 重新编号(chapter5/README.{en,es,hu,ja,tr}) Languages: ar, en, es, he, hu, id, ja, ko, ru, ta, tr, vi, zh-TW Claude-Session: https://claude.ai/code/session_01WMHQamkbj17Bjkc6WPa81z Co-authored-by: Claude Sonnet 4.6 <noreply@anthropic.com> | 17 天前 | |
fix(i18n): add missing exp 1-4 & 5-7 entries + renumber ch5 in 14 locales chapter1/README: add experiment 1-4 (image-gen-workflow) to ar, id, ko, ru, ta, vi — these were omitted from the earlier i18n sync (#942) which only updated en/es/hu/ja/tr/zh-TW. chapter5/README: add experiment 5-7 (cad-vs-diffusion) and renumber old 5-7…5-13 → 5-8…5-14 in ar, id, ko, ru, ta, vi, zh-TW; add the missing 5-7 row to en (which was already renumbered correctly but lacked the new entry). Fixes i18n consistency CI failure on main. Co-Authored-By: Claude Sonnet 4.6 <noreply@anthropic.com> Claude-Session: https://claude.ai/code/session_01WMHQamkbj17Bjkc6WPa81z | 17 天前 | |
docs(i18n): sync ch1 image-gen workflow & ch5 3D/CAD routing to 13 language editions (#942) Propagate PR #938 additions to all translated book editions: Chapter 1 (book-XX/chapter1): - 新增文生图工作流示例(适配层与原生图像生成的对比) - 新增实验 1-4(Nano Banana 2 + GPT-Image 2 × 工作流路线) - 新增 Harness 被内化的规律总结 Chapter 5 (book-XX/chapter5): - 新增「3D 与工业零件:代码生成与生成模型的边界」论述 - 新增实验 5-7(法兰盘两条生成路线 + 绿植对照组) - 旧实验 5-7..5-13 → 5-8..5-14 重新编号 Reference answers (reference-answers.XX): 5-8→5-9(原 5-7→5-8 改为 5-8→5-9) Experiment READMEs (chapter1/README.XX, chapter5/README.XX): - 新增实验 1-4 行(chapter1/README.{en,es,hu,ja,tr,zh-TW}) - 新增实验 5-7 行、旧 5-7..5-13 重新编号(chapter5/README.{en,es,hu,ja,tr}) Languages: ar, en, es, he, hu, id, ja, ko, ru, ta, tr, vi, zh-TW Claude-Session: https://claude.ai/code/session_01WMHQamkbj17Bjkc6WPa81z Co-authored-by: Claude Sonnet 4.6 <noreply@anthropic.com> | 17 天前 |
第 1 章 · Agent 基礎知識
Agent = LLM + 上下文 + 工具;Harness 工程才是競爭力
如何閱讀實驗
正文用短小的機制 skeleton 說明控制流;實驗目錄放完整的 SDK 適配、日誌、測試與驗收證據,不需要逐行讀完每個檔案。
- Starter: 先讀目標、最小指令與驗收條件;可從 context;
- Builder: 沿著入口、核心迴圈、狀態/訊息 schema、工具與驗證器閱讀。
- Maintainer: 最後再看測試、證據 manifest、失敗處理、回滾路徑與 provider adapter。
第一次閱讀可先跳過憑證載入、展示層和 provider 相容層;要重現數字時再回來查看。
配套專案
| 編號 | 專案 | 型別 | 一句話說明 |
|---|---|---|---|
| 1-1 | context | ✅ | 系統性消融實驗展示 Agent 上下文各元件的重要性;支援 SiliconFlow Qwen、字節 Doubao、月之暗面 Kimi 等多提供商 |
| 1-2 | web-search-agent | ✅ | Kimi K3 模型即 Agent,具備基礎深度搜尋能力,能進行多輪搜尋和資訊整合 |
| 1-3 | search-codegen | ✅ | GPT-5 原生工具整合,綜合利用網路搜尋與程式碼沙箱實現複雜分析 |
| 1-4 | image-gen-workflow | ✅ | 具體/寬泛兩類需求 × 工作流(kimi-k3 改寫 + 通義萬相)與原生(Gemini / GPT-Image 2)雙路線真實對照:具體需求下原生更忠實(海報文案被改寫節點丟進負面詞),寬泛需求下改寫的場景具象化帶來想象力,但 GPT-Image 2 自己就能補觀點——適配層被模型內化的實證 |
| 7-1, 7-2 | learning-from-experience | ✅ | 對比 Q-learning 與基於 LLM 的上下文學習,復現 Shunyu Yao 的 "The Second Half":LLM 以 250–400 倍樣本效率超越傳統 RL |
專案型別說明
| 圖示 | 型別 | 含義 |
|---|---|---|
| ✅ | 可獨立執行 | 本倉庫自帶完整程式碼,配置好 API Key 即可執行 |
| 📖 | 復現指南 | 依賴需自行 git clone 的外部倉庫(訓練框架、評測基準等) |
| 🚧 | 設計文件 | 僅包含架構與實現方案,可執行程式碼仍在完善中 |