已关闭
[Bug]: NPU IVFPQ 训练在超大采样量下会出现 vector::_M_default_append 崩溃 #34
lan_xin创建于  8月5日关闭于  8月6日
lan_xin成员
8月5日 创建

在提交新问题之前,请确保您已经在社区中搜索过相关问题,并使用了社区中提供的资源/工具后,仍未找到满意的解决方式。

⚠️ 安全信息提醒:请仔细检查提供的文本内容,确保其不包含敏感数据信息,包括但不限于:

  • API 令牌或密钥
  • 密码或身份验证凭证
  • 私有网址或接口地址
  • 个人或机密数据
  • ...

在分享配置信息或代码示例时,请将敏感信息脱敏处理,或使用 <TOKEN> 等占位符替代原有内容。

环境信息

例如:
- 操作系统
- 昇腾硬件信息
- CANN软件版本
- 安装的对应软件版本

image.png

🐛 问题描述

IVFPQ(NpuIndexIVFPQ)在训练粗量化器(K-means)时,若训练采样量较大(如将 maxTrainSamples 配置为 2000 万且向量维度较高),train(xb) 会抛出 C++ exception vector::_M_default_append(libstdc++ 的 std::length_error),导致 NPU 训练直接失败。

欢迎加入社区,感谢您对社区的贡献 🎉!

likedislike
Llan_xin成员
8月5日 添加了label:bug
xiangjie10成员
8月5日 评论:

👋 您好,感谢向 faiss 提交 Issue!
🎉 我们已收到您的反馈,感谢你对开源社区的支持!

📅 处理时效 维护团队将在工作日 24 小时内查看并回复您的问题。
🔍 自助排查(推荐优先查看) 在等待回复期间,您可以先查阅仓库README以及历史 Issue 中相似问题的解决方案,多数问题可快速解决。
💡 为了更快定位问题,请您确保 Issue 包含:

  • 清晰的问题描述
  • 可复现的操作步骤
  • 相关日志、截图或环境信息
    我们会尽快跟进,感谢您的理解与配合!
likedislike
xiangjie10成员
8月5日 评论:

/label add triaged

likedislike
ascend-robotascend-robot成员
8月5日 添加了label:triaged
Llan_xin成员
8月5日 关联了pull request:fix: IVFPQ训练在超大采样量下因int溢出导致的崩溃
ascend-robotascend-robot成员
8月6日 关闭了 issue
ascend-robotascend-robot成员
8月6日 添加了label:resolved
Xxiangjie10成员
21 天前 issue状态由 TODO 改变为 DONE