| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
feat: 异构函数化 + 核空间曲面 + auto_alloc 升级 + NRFN v3 序列化(版本 2.0.0) - regionify_hetero:逐叶子区竞优 order(0/1/-1),散状区保留原权重走纯量化,空叶子区登记独立 (0,0) 类型 - kernel_surf:3x3 卷积核图形区固定基曲面编码(P6/P8,coef_bits 4/6/8/16/32)+ 设计文档 - auto_alloc 升级:auto_alloc_model / boundary_probe / signal_recommend / compete_signals / geodesic / multilevel / adapters - NRFN v3 尾结构体序列化:异构叶子区 + kernel_surf;order=-1 编码为 255,from_bytes_v3 同步解码 - 往返测试:异构层含散状区 v3 序列化/反序列化 | 24 天前 | |
feat(examples): GPU cudarc 前向 + 二进制生成物 - examples/rust:合并 GPU 前向(cudarc+cuBLAS+NVRTC),单 crate 含 CPU 零依赖 + GPU,新增 gpu.rs/kernels.rs/bench_k1.py/bench_persist.py - examples/project:生成物改二进制序列化(model.bin/functional.bin,体积省 82%),deploy 手写二进制解析器替代 serde_json,接入 GPU 部署(GpuDeployer) - CUDA kernel 偏移统一 long long(防 Windows 32 位回绕),with_bias_gpu 补 synchronize - 报告同步 CPU/GPU 五维收益 | 1 个月前 |
| 文件 | 最后提交记录 | 最后更新时间 |
|---|---|---|
| 24 天前 | ||
| 1 个月前 |