Berkeley AI Research·· 2026-07-29精选AI 评分67
K-Search 如何将 CUDA 内核经验迁移到 MLX 并优化 Apple Silicon
From CUDA to MLX: How K-Search Brings Decades of Kernel Expertise to Apple Silicon
AI 导读
IBM Research 将 K-Search 扩展为支持 MLX 的后端,并通过结构化 CUDA-to-MLX 翻译层,把 CUDA 内核优化经验迁移到 Apple Silicon。
推荐理由
文章展示了如何把 CUDA 内核中的优化经验结构化迁移到 MLX,并以 Attention 和 Mamba SSM 实测说明翻译层对 Apple Silicon 性能的影响。
来源:Berkeley AI Research · bair.berkeley.edu