已合并
【docs】:链接有效性修改 #827
zzm30创建于 15 天前
【docs】:链接有效性修改 #827
已合并
共 3 个文件变更+3-3
| @@ -31,7 +31,7 @@ pip3 install tqdm==4.66.1 | |||
| 31 | 31 | ||
| 32 | ## 5. 量化步骤(以llama2-7b legacy为例) | 32 | ## 5. 量化步骤(以llama2-7b legacy为例) |
| 33 | 33 | ||
| 34 | -1.获取开源权重,转化为MindSpeed-LLM支持的模型,可以使用MindSpeed-LLM的权重[转化脚本](https://gitcode.com/Ascend/MindSpeed-LLM/blob/master/convert_ckpt.py),[此处有转化脚本使用教程](https://gitcode.com/Ascend/MindSpeed-LLM/blob/master/docs/zh/pytorch/tools/checkpoint_convert_hf_mcore_large_params.md) | 34 | +1.获取开源权重,转化为MindSpeed-LLM支持的模型,可以使用MindSpeed-LLM的权重[转化脚本](https://gitcode.com/Ascend/MindSpeed-LLM/blob/master/mindspeed_llm/mindspore/convert_ckpt.py),[此处有转化脚本使用教程](https://gitcode.com/Ascend/MindSpeed-LLM/blob/master/docs/zh/pytorch/tools/checkpoint_convert_hf_mcore_large_params.md) |
| 35 | 35 | ||
| 36 | ```bash | 36 | ```bash |
| 37 | python convert_ckpt.py \ | 37 | python convert_ckpt.py \ |
| @@ -2,7 +2,7 @@ | |||
| 2 | 2 | ||
| 3 | ## 模型介绍 | 3 | ## 模型介绍 |
| 4 | 4 | ||
| 5 | -- [腾讯混元 Hy3](https://www.tencent.com.cn/zh-cn/articles/2202386.html) 于 2026 年正式发布,是混元团队在 Hy3 preview 之后推出的正式版本。相比 preview,Hy3 在智能水平、稳定性与成本效益上均有显著提升,智能水平强于同尺寸模型,并可比肩参数规模为 2~5 倍的旗舰模型。 | 5 | +- [腾讯混元 Hy3](https://www.tencent.com/zh-cn/tencent-hunyuan-officially-releases-hy3-advancing-agent-capabilities-and-deeper-product-integration) 于 2026 年正式发布,是混元团队在 Hy3 preview 之后推出的正式版本。相比 preview,Hy3 在智能水平、稳定性与成本效益上均有显著提升,智能水平强于同尺寸模型,并可比肩参数规模为 2~5 倍的旗舰模型。 |
| 6 | 6 | ||
| 7 | - Hy3 是一款**快慢思考融合**的大语言模型,采用 **混合专家(MoE)** 架构,总参数量约 295B、激活参数量约 21B,支持 256K 上下文长度。模型在复杂推理、指令遵循、上下文学习、代码生成与 Agent 能力上表现突出,尤其适用于软件开发、办公生产、金融建模、前端设计、游戏制作等生产力场景。 | 7 | - Hy3 是一款**快慢思考融合**的大语言模型,采用 **混合专家(MoE)** 架构,总参数量约 295B、激活参数量约 21B,支持 256K 上下文长度。模型在复杂推理、指令遵循、上下文学习、代码生成与 Agent 能力上表现突出,尤其适用于软件开发、办公生产、金融建模、前端设计、游戏制作等生产力场景。 |
| 8 | 8 | ||
| @@ -36,7 +36,7 @@ | |||
| 36 | 36 | ||
| 37 | ## 校准数据说明 | 37 | ## 校准数据说明 |
| 38 | 38 | ||
| 39 | -校准数据支持的方式,详见《[dataset 配置说明](../../../docs/zh/user_guide/usage_quick_quantization.md#dataset---校准数据路径配置)》。 | 39 | +校准数据支持的方式,详见《[dataset 配置说明](../../../docs/zh/user_guide/usage_quick_quantization.md#526-dataset---校准数据集配置)》。 |
| 40 | 40 | ||
| 41 | - **当前 W8A8 动态实践(`gemma4_moe_w8a8.yaml`)**:data-free,可不依赖校准前向。 | 41 | - **当前 W8A8 动态实践(`gemma4_moe_w8a8.yaml`)**:data-free,可不依赖校准前向。 |
| 42 | - **混合/静态激活量化**:每条样本需同时提供 `image` 与 `text`;缺项样本暂不支持。 | 42 | - **混合/静态激活量化**:每条样本需同时提供 `image` 与 `text`;缺项样本暂不支持。 |