ggml-orgチームがllama.cppのリリースb11277を公開した。メモリリークの原因となっていたバッファーリセットの問題を修正している。また、macOS(Apple SiliconおよびIntel)、iOS、複数のUbuntuディストリビューション向けに、VulkanやCUDA GPU対応版を含むビルド済みバイナリも提供する。ファイルはリリースページから直接ダウンロードできる。
なぜ重要か
メモリリークの修正により、ローカルでLLMを動かす開発者にとって安定性が高まる。すぐに使えるバイナリの提供で、より多くのプラットフォームでllama.cppを試しやすくなる。