已合并
【docs】:链接有效性修改 #827
zzm30创建于 15 天前
【docs】:链接有效性修改 #827
已合并
zzm30创建于 15 天前
3 个文件变更+3-3
Mdocs/zh/user_guide/traditional_quantization_v0/mindspeed_adapter.md+1-1
@@ -31,7 +31,7 @@ pip3 install tqdm==4.66.1
31 31 
32## 5. 量化步骤(以llama2-7b legacy为例)32## 5. 量化步骤(以llama2-7b legacy为例)
33 33 
34-1.获取开源权重,转化为MindSpeed-LLM支持的模型,可以使用MindSpeed-LLM的权重[转化脚本](https://gitcode.com/Ascend/MindSpeed-LLM/blob/master/convert_ckpt.py),[此处有转化脚本使用教程](https://gitcode.com/Ascend/MindSpeed-LLM/blob/master/docs/zh/pytorch/tools/checkpoint_convert_hf_mcore_large_params.md)34+1.获取开源权重,转化为MindSpeed-LLM支持的模型,可以使用MindSpeed-LLM的权重[转化脚本](https://gitcode.com/Ascend/MindSpeed-LLM/blob/master/mindspeed_llm/mindspore/convert_ckpt.py),[此处有转化脚本使用教程](https://gitcode.com/Ascend/MindSpeed-LLM/blob/master/docs/zh/pytorch/tools/checkpoint_convert_hf_mcore_large_params.md)
35 35 
36```bash36```bash
37python convert_ckpt.py \37python convert_ckpt.py \
Mexample/Hy3/README.md+1-1
@@ -2,7 +2,7 @@
2 2 
3## 模型介绍3## 模型介绍
4 4 
5-- [腾讯混元 Hy3](https://www.tencent.com.cn/zh-cn/articles/2202386.html) 于 2026 年正式发布,是混元团队在 Hy3 preview 之后推出的正式版本。相比 preview,Hy3 在智能水平、稳定性与成本效益上均有显著提升,智能水平强于同尺寸模型,并可比肩参数规模为 2~5 倍的旗舰模型。5+- [腾讯混元 Hy3](https://www.tencent.com/zh-cn/tencent-hunyuan-officially-releases-hy3-advancing-agent-capabilities-and-deeper-product-integration) 于 2026 年正式发布,是混元团队在 Hy3 preview 之后推出的正式版本。相比 preview,Hy3 在智能水平、稳定性与成本效益上均有显著提升,智能水平强于同尺寸模型,并可比肩参数规模为 2~5 倍的旗舰模型。
6 6 
7- Hy3 是一款**快慢思考融合**的大语言模型,采用 **混合专家(MoE)** 架构,总参数量约 295B、激活参数量约 21B,支持 256K 上下文长度。模型在复杂推理、指令遵循、上下文学习、代码生成与 Agent 能力上表现突出,尤其适用于软件开发、办公生产、金融建模、前端设计、游戏制作等生产力场景。7- Hy3 是一款**快慢思考融合**的大语言模型,采用 **混合专家(MoE)** 架构,总参数量约 295B、激活参数量约 21B,支持 256K 上下文长度。模型在复杂推理、指令遵循、上下文学习、代码生成与 Agent 能力上表现突出,尤其适用于软件开发、办公生产、金融建模、前端设计、游戏制作等生产力场景。
8 8 
Mexample/multimodal_vlm/Gemma4-MoE/README.md+1-1
@@ -36,7 +36,7 @@
36 36 
37## 校准数据说明37## 校准数据说明
38 38 
39-校准数据支持的方式,详见《[dataset 配置说明](../../../docs/zh/user_guide/usage_quick_quantization.md#dataset---校准数据路径配置)》。39+校准数据支持的方式,详见《[dataset 配置说明](../../../docs/zh/user_guide/usage_quick_quantization.md#526-dataset---校准数据配置)》。
40 40 
41- **当前 W8A8 动态实践(`gemma4_moe_w8a8.yaml`)**:data-free,可不依赖校准前向。41- **当前 W8A8 动态实践(`gemma4_moe_w8a8.yaml`)**:data-free,可不依赖校准前向。
42- **混合/静态激活量化**:每条样本需同时提供 `image``text`;缺项样本暂不支持。42- **混合/静态激活量化**:每条样本需同时提供 `image``text`;缺项样本暂不支持。