Oossa

llama.cpp、macOS向けMetalのFlash Attentionカーネルを追加

2026年10月9日、Apple Silicon向けに128/96ビットのFlash Attentionをサポートした新しいバイナリが公開されました。

短信著者: Oossa公開日: 1 分で読める

ggml-orgチームは2026年10月9日、llama.cpp(リリース b11518)を更新しました。今回の更新ではMetal向けに128ビットおよび96ビットのFlash Attentionカーネルが追加され、Apple Silicon搭載Macでの推論が高速化します。macOS(arm64)、macOS(Intel)、iOS、および複数のLinux構成向けのビルド済みバイナリをダウンロードできます。

なぜ重要か

Apple Silicon搭載機のユーザーは、GPUハードウェアを追加購入せずにLLMをより高速に実行できます。

この記事は役に立ちましたか?
共有

次に読む

Oossa · ニュースレター

今週のAIを、わかりやすく

毎週月曜日、知っておきたいニュースをやさしい言葉で。無料・スパムなし。