Thanks for sending an requirement! Please fill in the following template to help quickly solve your problem.
修改aclnnMultinomialTensor接口,使这个接口可以在A5芯片不同分支下正确调用StatelessRandomUniformV2算子以及后续小算子拼接。 保证精度正常,性能不劣化
确保原有非tensor接口以及现接口不同分支正常调用原有算子或StatelessRandomUniformV2算子。
通过ifelse进行分支处理,针对91095或是其他芯片情况以及不同数据类型引向不同分支,实现同等功能,达到性能最大化。
💡 备注(选填) 进行了静态检查 二级冒烟 构建触发 UT测试 泛化ST测试 跑了ttk xrun测试
/assign @huairuchen
Thanks for sending an requirement! Please fill in the following template to help quickly solve your problem.
一、背景信息 (必填)
修改aclnnMultinomialTensor接口,使这个接口可以在A5芯片不同分支下正确调用StatelessRandomUniformV2算子以及后续小算子拼接。
保证精度正常,性能不劣化
二、价值/作用 (必填)
确保原有非tensor接口以及现接口不同分支正常调用原有算子或StatelessRandomUniformV2算子。
三、设计方案 (必填)
3.1 使能方式(涉及哪些框架:如Aclnn直调、Pytorch训练等)
通过ifelse进行分支处理,针对91095或是其他芯片情况以及不同数据类型引向不同分支,实现同等功能,达到性能最大化。
3.2 总体设计
3.2.1 算子支持的数据类型
3.2.2 host侧设计
3.2.3 kernel侧设计
3.3 支持硬件
3.4 算子约束限制
💡 备注(选填)
进行了静态检查 二级冒烟 构建触发
UT测试
泛化ST测试
跑了ttk xrun测试