已关闭
[Requirement|需求建议]: Reg矢量Add算子可以更简化 #1479
ascendhjh创建于 24 天前关闭于 3 天前
lihuaichao
24 天前 评论:
24 天前 评论:
您好,感谢反馈!
我们将会评估如何简化Reg矢量Add算子的样例,一旦有具体计划或进展,会第一时间在这里同步。


DianaBlessYou
18 天前 评论:
18 天前 评论:
/assign


18 天前 将 lijunjie147 设为负责人
9 天前 关联了pull request:优化Reg矢量Add算子
DianaBlessYou
8 天前 评论:
8 天前 评论:
您好,目前已经对Reg矢量Add算子进行了一版优化,PR如下:https://gitcode.com/cann/asc-devkit/pull/5369。如果还有优化建议,可以检视提出。


DianaBlessYou
3 天前 评论:
3 天前 评论:
您好,PR已经合入,如果暂时没有其他问题,我们先关闭该 Issue,后续有任何疑问,欢迎重新提 Issue 讨论。


3 天前 issue状态由 待办的 改变为 已解决
3 天前 关闭了 issue
3 天前 添加了label:resolved
Thanks for sending an requirement! Please fill in the following template to help quickly solve your problem.
Background(背景信息)
可以跟简化实现Add算子示例:
https://gitcode.com/cann/asc-devkit/blob/master/examples/02_simd_c_api/00_introduction/04_reg_base_add_compute/c_api_simd_add/c_api_add.asc
Origin(信息来源)
Ascend C团队改进需求。
Benefit / Necessity (价值/作用)
Design(设计方案)
simd_vf inline void add_vf(
ubuf float* x_local, ubuf float* y_local, ubuf float* z_local, uint32_t data_len)
{
uint16_t one_rep_size = asc_get_vf_len() / sizeof(float);
uint16_t repeat_time = (data_len + one_rep_size - 1) / one_rep_size;
}
vector global void add_custom(gm float* x, gm float* y, gm float* z)
{
asc_init();
}