From CUDA to MLX: How K-Search Brings Decades of Kernel Expertise to Apple Silicon
BAIR Blog2573 字 (约 11 分钟)
85
K-Search框架实现CUDA到MLX的自动转换,使Apple Silicon性能接近专家优化水平,Attention和Mamba SSM内核分别提升0.97x和20x。
入选理由:K-Search框架实现CUDA到MLX的自动转换,无需人工重写内核
精选文章#CUDA#MLX#Apple Silicon#K-Search#AI优化英文