本文档描述 Dense LLM 场景下自动并行策略调优能力的设计需求。不包含具体代码实现,侧重配置读取、多维估算模块整合、候选策略生成、约束过滤、性能排序、top-k 策略输出、可视化图表与端到端可解释调优能力。
配置读取、DP/TP/PP/CP 等估算模块分别提供了自动并行策略搜索所需的输入和代价模型。对于 Dense LLM 场景,需要进一步将这些模块串联起来,形成端到端可用、可解释的并行策略寻优方案。
该能力需要完成候选策略枚举、约束过滤、内存估算、性能估算、候选排序、top-k 策略输出和可视化展示,使用户可以在给定模型、集群和约束条件下,直接获得可执行或可参考的并行策略,并通过图表理解不同策略之间的显存、性能和可行性差异。
Dense LLM 自动并行策略调优流程包括:
候选策略应至少包含:
策略排序应支持至少一种默认规则,例如:
后续可支持按照用户指定目标排序,例如显存优先、性能优先或综合评分优先。
Dense LLM 自动并行策略调优能力应输出:
可视化图表应至少支持展示以下信息:
可视化结果应辅助用户理解策略差异,并支持用户据此调整约束或搜索空间,例如:
自动并行策略搜索 Dense LLM 调优能力支持
本文档描述 Dense LLM 场景下自动并行策略调优能力的设计需求。不包含具体代码实现,侧重配置读取、多维估算模块整合、候选策略生成、约束过滤、性能排序、top-k 策略输出、可视化图表与端到端可解释调优能力。
1. 背景
配置读取、DP/TP/PP/CP 等估算模块分别提供了自动并行策略搜索所需的输入和代价模型。对于 Dense LLM 场景,需要进一步将这些模块串联起来,形成端到端可用、可解释的并行策略寻优方案。
该能力需要完成候选策略枚举、约束过滤、内存估算、性能估算、候选排序、top-k 策略输出和可视化展示,使用户可以在给定模型、集群和约束条件下,直接获得可执行或可参考的并行策略,并通过图表理解不同策略之间的显存、性能和可行性差异。
2. 目标与非目标
2.1 目标
2.2 非目标
3. 主流程设计
Dense LLM 自动并行策略调优流程包括:
4. 策略表示
候选策略应至少包含:
5. 策略排序
策略排序应支持至少一种默认规则,例如:
后续可支持按照用户指定目标排序,例如显存优先、性能优先或综合评分优先。
6. 输出格式
Dense LLM 自动并行策略调优能力应输出:
7. 可视化与可解释能力
可视化图表应至少支持展示以下信息:
可视化结果应辅助用户理解策略差异,并支持用户据此调整约束或搜索空间,例如:
8. 实现要点
9. 测试设计
10. 验收标准
11. 参考