ggml-orgはllama.cppのバージョンb11537を公開した。今回の更新では、埋め込み処理向けにget_rowsのグラフ順序を変更し、Gemma4の埋め込み処理を修正した。LoRA対応に関するTODOの注記を追加し、生の埋め込み処理経路も修正している。macOS Apple Silicon、macOS Intel、iOSに加え、Vulkan対応版を含む各種Ubuntuビルドのコンパイル済みバイナリも利用できる。
なぜ重要か
埋め込み処理が修正され、より多くのプラットフォーム向けバイナリが用意されたことで、開発者はセットアップの手間を減らし、ローカルでllama.cppを実行できる。