heat experiment / 2026.08.09

10 万单细胞的邻居图热实验

当单细胞规模由一万扩展到十万时,邻居图构建的时间、内存与参数选择如何共同变化?

data description

从 PBMC 表达矩阵中抽取不同数量的细胞,保留 2,000 个高变基因与 50 个 PCA 分量。

model description

Scanpy neighbors,比较默认 pynndescent 与不同的 n_neighbors 设置。

固定随机种子。每个规模运行三次,记录 wall time、峰值内存和 GPU/CPU 温度快照。

10 万细胞时,邻居数从 15 增到 30 的图构建成本显著上升。较小的 sanity run 能提前发现内存瓶颈。