Berkeley AI Research·· 2026-07-29精选AI 评分83
K-Search 将 CUDA 内核经验迁移到 Apple Silicon 的 MLX
From CUDA to MLX: How K-Search Brings Decades of Kernel Expertise to Apple Silicon
AI 导读
IBM Research 将 K-Search 扩展为支持 MLX 的后端,并通过结构化 CUDA-to-MLX 翻译层,把 CUDA 内核优化经验迁移到 Apple Silicon。
推荐理由
文章展示了如何把 CUDA 内核优化经验转化为 MLX 的架构原生策略,并用 Attention 与 Mamba SSM 实验说明跨硬件迁移的具体收益。
来源:Berkeley AI Research · bair.berkeley.edu