已关闭
CCU all_reduce累加算法咨询 #304
物华创建于 7月17日关闭于 7月20日
7月17日 修改了issue 的描述
7月18日 将 Leewis 设为负责人
Leewis
7月20日 评论:
7月20日 评论:
@chuguowei 你好,感谢对于社区的关注与反馈,在CCU通信引擎上,相关规约操作是升到32位的,因此累加误差比较小;


物华
7月20日 评论:
7月20日 评论:
/close


7月20日 issue状态由 进行中 改变为 已完成
7月20日 关闭了 issue
7月20日 添加了label:Accepted
https://gitcode.com/cann/hccl/blob/master/docs/zh/api_ref/comm_op_interface/HcclAllReduce.md
想问下all_reduce 在ccu通信引擎下,针对fp16的数据类型,是否会采用升精度的方式进行累加,实测发现累加误差非常小,几乎和升精度累加没有区别,太强了呀!