已合并
fix dpo for 2.2.0 #753
yanzhixiao创建于 2025年11月26日
fix dpo for 2.2.0 #753
已合并
共 2 个文件变更+5-5
| @@ -210,7 +210,7 @@ def initialize_megatron( | |||
| 210 | 210 | ||
| 211 | set_global_variables(args) | 211 | set_global_variables(args) |
| 212 | 212 | ||
| 213 | - if args.npu_deterministic: | 213 | + if args.use_deter_comp: |
| 214 | seed_all(args.seed) | 214 | seed_all(args.seed) |
| 215 | logger.info("deterministic computing is applied for npu.") | 215 | logger.info("deterministic computing is applied for npu.") |
| 216 | 216 | ||
| @@ -218,13 +218,13 @@ def initialize_megatron( | |||
| 218 | def finish_mpu_init(): | 218 | def finish_mpu_init(): |
| 219 | args = get_args() | 219 | args = get_args() |
| 220 | # Pytorch distributed. | 220 | # Pytorch distributed. |
| 221 | - _initialize_distributed(get_embedding_ranks, get_position_embedding_ranks) | 221 | + _initialize_distributed() |
| 222 | 222 | ||
| 223 | # Random seeds for reproducibility. | 223 | # Random seeds for reproducibility. |
| 224 | if args.rank == 0: | 224 | if args.rank == 0: |
| 225 | logger.info("> setting random seeds to {} ...".format(args.seed)) | 225 | logger.info("> setting random seeds to {} ...".format(args.seed)) |
| 226 | _set_random_seed(args.seed, args.data_parallel_random_init) | 226 | _set_random_seed(args.seed, args.data_parallel_random_init) |
| 227 | - if args.use_ascend_mc2: | 227 | + if args.use_mc2: |
| 228 | initialize_cfg_from_args(args) | 228 | initialize_cfg_from_args(args) |
| 229 | 229 | ||
| 230 | if skip_mpu_initialization: | 230 | if skip_mpu_initialization: |
| @@ -50,7 +50,7 @@ megatron_training: | |||
| 50 | use_fused_rmsnorm: true | 50 | use_fused_rmsnorm: true |
| 51 | swap_attention: true | 51 | swap_attention: true |
| 52 | no_shuffle: true | 52 | no_shuffle: true |
| 53 | - attention_mask_type: general | 53 | + cp_attention_mask_type: general |
| 54 | 54 | ||
| 55 | # data_args: | 55 | # data_args: |
| 56 | data_path: ./dataset/dpo | 56 | data_path: ./dataset/dpo |
| @@ -66,7 +66,7 @@ megatron_training: | |||
| 66 | save: ./ckpt | 66 | save: ./ckpt |
| 67 | model: qwen3_30b_a3b | 67 | model: qwen3_30b_a3b |
| 68 | ref_model: ./model_weights/Qwen3-30B-TP2-PP8-EP1/ | 68 | ref_model: ./model_weights/Qwen3-30B-TP2-PP8-EP1/ |
| 69 | - ref_model_iter: 1 | 69 | + refer_model_iter: 1 |
| 70 | 70 | ||
| 71 | # output_args: | 71 | # output_args: |
| 72 | log_interval: 1 | 72 | log_interval: 1 |