Flash-GMM: A Memory-Efficient Kernel for Scalable Soft Clustering
arXiv:2606.10896v1 Announce Type: new Abstract: We present extbf{Flash-GMM}, a fused Triton kernel for efficient computation of Gaussian Mixture Models (GMMs) over large-scale data in a single GPU pas