跳到正文
  1. Berkeley AI Research64

    K-Search 如何将 CUDA 内核经验迁移到 Apple Silicon

    IBM Research 将结构化 CUDA-to-MLX 翻译层接入 K-Search,使其能把 CUDA 内核知识迁移为 Apple Silicon 上的 MLX 内核。

    推荐理由:文章展示了 CUDA 优化经验如何通过翻译层迁移到 MLX,并用 Attention 与 Mamba 的实测结果呈现这一路径的效果。

已经到底了