| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
feat: 支持 Qwen3.6-27B A4W4 MXFP4 Attn-Linear 和 MLP 量化实践 Co-authored-by: siiri0817<2862602548@qq.com> # message auto-generated for no-merge-commit merge: !241 merge feat/qwen3_6_27b_a4w4_mxfp4_casebook into master docs: 新增 Qwen3.6-27B A4W4 MXFP4 量化 CaseBook Created-by: sirillo Commit-by: siiri0817 Merged-by: cann-robot Description: ## 描述 本 PR 将 Qwen3.6-27B Dense 的 A4W4 MXFP4 量化实践整理到现有 Qwen3.5/3.6 CaseBook,并同步最小必要导航。 主要内容: 1. 在现有 .agents/docs/casebook/qwen/qwen3.5-3.6.md 中新增 Qwen3.6-27B Dense,复用 qwen3_5 adapter,记录 64 个 decoder block 的结构与适配信息; 2. 汇总 attn-linear / mlp 两类 A4W4 MXFP4 目标下 Direct、LWC、LAC、LWC+LAC、OmniQuant、AutoRound、FlatQuant 的复测 PPL; 3. 明确区分 PTQ calibration(PileVal,nsamples=16,seq_len=1024)与 PPL evaluation(WikiText2 test,seq_len=4096)。 本 PR 为纯文档变更,不包含模型代码、PPL 调试、评测 workflow 或临时兼容修复。 ## 如何测试 实验数据来自 Qwen3.6-27B A4W4 MXFP4 的PPL评测与既有 Deploy / clean reload 验证。本次未修改代码,因此未运行代码单元测试或重新执行大模型实验。 ## 文档更新 更新: - .agents/docs/casebook/README.md - .agents/docs/casebook/qwen/README.md - .agents/docs/casebook/qwen/qwen3.5-3.6.md ## 类型标签 - [ ] Bug修复 - [ ] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 代码重构 - [ ] 其他,请描述: See merge request: cann/amct!241 | 11 天前 | |
feat(agents): tracked symlink 自动加载,兼容 Windows 客户端 Co-authored-by: xieyajun<xieyajun1@huawei.com> # message auto-generated for no-merge-commit merge: !190 merge feat/agent-symlink-autoload into master feat(agents): tracked symlink 自动加载,兼容 Windows 客户端 Created-by: xieyajun Commit-by: xieyajun Merged-by: cann-robot Description: ## 描述 将 Agent 配置的分发机制从「手动执行脚本生成」改为「git-tracked 符号链接自动加载」,并配套 Windows 兼容修复与文档完善。 ### 一、结构改造(tracked symlink) - 新增 7 个 mode 120000 git-tracked symlink:.claude/{skills,agents,hooks,docs} 和 .opencode/{skills,agents,docs} 指向 .agents/ 对应路径,clone 后即可直接使用,无需手动执行安装脚本 - 删除 scripts/init-agent.sh(115 行),该脚本在 symlink 机制下完全冗余 - .gitignore 移除对 /.claude/、/.opencode/、/CLAUDE.md 的忽略规则(已改为 tracked) - AGENTS.md 新增「Agent Skills」段落,说明自动加载机制并修正 gitcode skill 引用路径 ### 二、配置文件迁移与 Windows 兼容 - .agents/settings.json → .claude/settings.json(R100,真实文件 100644) - .agents/opencode.json → .opencode/opencode.json(R100,真实文件 100644) - 配置文件改为真实文件后,Windows 下 core.symlinks=false 时客户端仍可正常启动 - settings.json 完整保留 45 项权限(含 amct-ops-dev、install-default-skills 等),与 master 一致 ### 三、文档完善 - .agents/README.md:重写标题与定位描述,补充内置技能清单;新增 Windows symlink 修复指引(3 种方式:管理员终端 / 开发者模式 / mklink /J) - .agents/docs/architecture.md:§3 单一源投影机制重写,移除 init-agent.sh 和 CLAUDE.md 引用 - .agents/docs/README.md:移除 roadmap.md 引用 - 删除 .agents/docs/roadmap.md(规划已过时,内容与 architecture.md 重复) ### 四、default-skills 增强 - SKILL.md:场景化拆分(补装缺失 / 强制更新两种场景) - install-default-skills.sh:新增 --force 参数,默认跳过已存在 skill ### 五、hooks 改进 - subagent_stop.py:新增 cleanup_stale_counters(),懒清理 /tmp 下超过 48 小时的计数文件 ## 如何测试 1. Linux/macOS(symlink 正常):git clone 后直接进入项目目录,Claude Code / OpenCode 自动加载所有 skills 2. Windows: - OpenCode 无需额外操作,原生扫描 .agents/skills/ - Claude Code 需管理员终端执行 git config core.symlinks true && git checkout HEAD -- .claude 后自动加载 3. 验证 settings.json 权限完整性:确认 amct-ops-dev、install-default-skills、planning-with-files、skill-creator 均在 allow 列表中 4. 确认 scripts/init-agent.sh 已删除,CLAUDE.md 不存在 ## 文档更新 - .agents/README.md:全面重写,新增内置技能清单与 Windows 修复指引 - .agents/docs/architecture.md:§3 投影机制描述更新 - .agents/docs/README.md:移除 roadmap 引用 - .agents/docs/roadmap.md:已删除 - AGENTS.md:新增 Agent Skills 段落,修正 gitcode skill 路径 ## 类型标签 - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 代码重构 - [ ] 其他,请描述: See merge request: cann/amct!190 | 1 个月前 | |
feat(agents): tracked symlink 自动加载,兼容 Windows 客户端 Co-authored-by: xieyajun<xieyajun1@huawei.com> # message auto-generated for no-merge-commit merge: !190 merge feat/agent-symlink-autoload into master feat(agents): tracked symlink 自动加载,兼容 Windows 客户端 Created-by: xieyajun Commit-by: xieyajun Merged-by: cann-robot Description: ## 描述 将 Agent 配置的分发机制从「手动执行脚本生成」改为「git-tracked 符号链接自动加载」,并配套 Windows 兼容修复与文档完善。 ### 一、结构改造(tracked symlink) - 新增 7 个 mode 120000 git-tracked symlink:.claude/{skills,agents,hooks,docs} 和 .opencode/{skills,agents,docs} 指向 .agents/ 对应路径,clone 后即可直接使用,无需手动执行安装脚本 - 删除 scripts/init-agent.sh(115 行),该脚本在 symlink 机制下完全冗余 - .gitignore 移除对 /.claude/、/.opencode/、/CLAUDE.md 的忽略规则(已改为 tracked) - AGENTS.md 新增「Agent Skills」段落,说明自动加载机制并修正 gitcode skill 引用路径 ### 二、配置文件迁移与 Windows 兼容 - .agents/settings.json → .claude/settings.json(R100,真实文件 100644) - .agents/opencode.json → .opencode/opencode.json(R100,真实文件 100644) - 配置文件改为真实文件后,Windows 下 core.symlinks=false 时客户端仍可正常启动 - settings.json 完整保留 45 项权限(含 amct-ops-dev、install-default-skills 等),与 master 一致 ### 三、文档完善 - .agents/README.md:重写标题与定位描述,补充内置技能清单;新增 Windows symlink 修复指引(3 种方式:管理员终端 / 开发者模式 / mklink /J) - .agents/docs/architecture.md:§3 单一源投影机制重写,移除 init-agent.sh 和 CLAUDE.md 引用 - .agents/docs/README.md:移除 roadmap.md 引用 - 删除 .agents/docs/roadmap.md(规划已过时,内容与 architecture.md 重复) ### 四、default-skills 增强 - SKILL.md:场景化拆分(补装缺失 / 强制更新两种场景) - install-default-skills.sh:新增 --force 参数,默认跳过已存在 skill ### 五、hooks 改进 - subagent_stop.py:新增 cleanup_stale_counters(),懒清理 /tmp 下超过 48 小时的计数文件 ## 如何测试 1. Linux/macOS(symlink 正常):git clone 后直接进入项目目录,Claude Code / OpenCode 自动加载所有 skills 2. Windows: - OpenCode 无需额外操作,原生扫描 .agents/skills/ - Claude Code 需管理员终端执行 git config core.symlinks true && git checkout HEAD -- .claude 后自动加载 3. 验证 settings.json 权限完整性:确认 amct-ops-dev、install-default-skills、planning-with-files、skill-creator 均在 allow 列表中 4. 确认 scripts/init-agent.sh 已删除,CLAUDE.md 不存在 ## 文档更新 - .agents/README.md:全面重写,新增内置技能清单与 Windows 修复指引 - .agents/docs/architecture.md:§3 投影机制描述更新 - .agents/docs/README.md:移除 roadmap 引用 - .agents/docs/roadmap.md:已删除 - AGENTS.md:新增 Agent Skills 段落,修正 gitcode skill 路径 ## 类型标签 - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [x] 文档更新 - [ ] 代码重构 - [ ] 其他,请描述: See merge request: cann/amct!190 | 1 个月前 | |
feat: 量化agent引入 Co-authored-by: xieyajun<xieyajun1@huawei.com> # message auto-generated for no-merge-commit merge: !148 merge feat/quant-agent-migration into master feat: 量化agent引入 Created-by: xieyajun Commit-by: xieyajun Merged-by: cann-robot Description: ## 描述 引入「昇腾 NPU 大模型量化压缩」的 Agent Skills 框架( .agents/),把 amct(amct_pytorch)的 LLM 量化全流程(eval / extract_ptq_data / ptq / deploy + blockwise PTQ)封装为可用自然语言驱动的 agent 能力,同时适配 Claude Code 与 OpenCode。 1. **单源双视图**:.agents/ 为唯一 git-tracked 源;scripts/init-agent.sh 投影生成 .claude/ 与 .opencode/ 客户端视图(gitignored)。原 .claude/ 下 skills 迁为 .agents/ 源;CLAUDE.md 改由脚本生成的仓根 symlink → AGENTS.md。 2. **单编排入口 quant-workflow** + 3 专职子代理(quant-analyzer 分析 / quant-implementer 实施 / quant-reviewer 审查,硬边界隔离)+ 叶子技能(quant-tools/:方案推荐 / 直转评测 / 算法推荐 / 算法验证 / 部署导出;model-adapter)+ 通用协作(gitcode-pr / gitcode-issue / default-skills)+ 共享输入模板。 3. **casebook 三层经验库**:L1 跨网络 common-pitfalls.md / L2 结构家族 family-pitfalls.md(含触发信号)/ L3 各厂商系列个案(qwen ×5、deepseek v3.2·v4、glm-5.1、longcat),按源码 common/models/llm/<vendor>/ 对齐;只沉淀可复用 hard bug + 适配重点 + 精度。 4. **多 agent 集成契约**:quant-workflow 为唯一入口(黑盒),progress.md 顶部机读状态块(STAGE/STATUS/DELTA/ARTIFACTS/BLOCKED)供轮询;前置不满足 fail-fast 写 BLOCKED;human-in-the-loop 四确认门;architecture.md §8 给出集成契约,README 含前置声明与自然语言示例。 ## 如何测试 1. **量化 agent 功能**:bash scripts/init-agent.sh 后用 opencode 启动 agent,给「为 Qwen3-8B 推荐量化方案(只分析不跑 NPU)」→ 正确路由到 scheme-recommendation,复用 casebook(Qwen3-4B/8B 实测值)给出 W8A8 直转首推 + 升级/回退路径,未触发评测命令。 2. **脚手架**:init-agent.sh 生成 .claude/{skills,agents,hooks,settings.json} + .opencode/{skills,agents} + CLAUDE.md;生成的 settings.json 无 SessionStart hook、无 install-default-skills.ts(自动安装已移除、按需保留)。 3. **量化主流程冒烟**:按 direct-quant-eval / deploy-export 技能跑一遍 eval/deploy,产物正常。 ## 文档更新 - 新增 .agents/**、scripts/init-agent.sh。 - 更新 .gitignore。 ## 类型标签 - [ ] Bug修复 - [x] 新特性 - [ ] 性能优化 - [x] 文档更新 - [x] 代码重构 - [ ] 其他,请描述: See merge request: cann/amct!148 | 2 个月前 |
Agent Docs
.agents/docs/ 用来保存仓库里相对稳定、适合长期复用的知识,不直接承担执行型约束。
内容组成
repo-map.md- 记录代码结构、关键模块和锚点文件
casebook/- 记录模型适配经验、量化经验和典型问题
使用原则
- 这里放稳定知识,不放一次性的实验过程
- 执行型规则、步骤和分流逻辑放在
skills/ - 如果某类经验已经足够稳定,适合长期复用,再从
skills/quant-tools/references/沉淀到这里
文档写回触发
agent 完成一轮工作后据此维护本 docs(执行型流程在 skills/,这里只放稳定知识与维护策略):
repo-map.md:register_llm_models()注册集 / solver 主注册链 / workflow 主路径语义 /BaseModel·PtqUnit·quant_apply·quant_base复用边界变化,或现状已与代码不一致。- 系列
casebook/<vendor>/README.md:某模型首次拿到稳定闭环(BF16 baseline + 关闭量化等价 + 最小 PTQ smoke),或系列默认起点/敏感模块/升级策略/常见问题需补订,或新结果推翻系列默认经验。 - 个案
casebook/<vendor>/<case>.md:新结构模式 / 新量化或 PTQ 路线 / 代表性可复用问题 / 明显偏离系列经验 / 已有个案需按新结论修订;仅本模型独有、不可迁移的坑留这层。 - 经验库
casebook/{cross-model,structure-family}-pitfalls.md:跨网络通用 / 结构家族通用的可复用坑写回;三层晋升护栏见 casebook/README.md 维护规则(单例先 L3、同家族 ≥2 升 L2、跨家族升 L1,防过度泛化)。 README.md(本文件):docs 层级 / 职责边界变化,或目录结构与真实不一致。- 默认不写:单次失败 / 不稳定结果;BF16 baseline 自身不稳;只修局部 wrapper bug 不重写 repo-map;本轮无新增可复用信息(需说明无需更新)。