跳到正文
原文
Berkeley AI Research·· 2026-07-29精选AI 评分67

K-Search 如何将 CUDA 内核经验迁移到 MLX 并优化 Apple Silicon

From CUDA to MLX: How K-Search Brings Decades of Kernel Expertise to Apple Silicon

AI 导读

IBM Research 将 K-Search 扩展为支持 MLX 的后端,并通过结构化 CUDA-to-MLX 翻译层,把 CUDA 内核优化经验迁移到 Apple Silicon。

推荐理由

文章展示了如何把 CUDA 内核中的优化经验结构化迁移到 MLX,并以 Attention 和 Mamba SSM 实测说明翻译层对 Apple Silicon 性能的影响。

来源:Berkeley AI Research · bair.berkeley.edu