P节点为NPU, D节点为GPU, 分别单独curl P节点和D节点是可以采集到的
vllm 0.20.2
启动参数: tensor-parallel-size 4 enforce-eager enable-expert-parallel
curl的最大token设置: max_tokens = 10
采集的配置: step[0, 1]
采集到的数据: [root@TENCENT64 rank0]# pwd /data2/data dump/dump_all_yigou_d_1952/step1/rank0 [root@TENCENT64 rank0]# cat dump.json { "task”: "statistics", "level”: "mix", "framework": "pytorch", "dump data dir": null, "data": {} }
P节点为NPU, D节点为GPU, 分别单独curl P节点和D节点是可以采集到的
vllm 0.20.2
启动参数:
tensor-parallel-size 4
enforce-eager
enable-expert-parallel
curl的最大token设置:
max_tokens = 10
采集的配置:
step[0, 1]
采集到的数据:
[root@TENCENT64 rank0]# pwd
/data2/data dump/dump_all_yigou_d_1952/step1/rank0
[root@TENCENT64 rank0]# cat dump.json
{
"task”: "statistics",
"level”: "mix",
"framework": "pytorch",
"dump data dir": null,
"data": {}
}