ggml‑orgはllama.cppのバージョンb11555をリリースした。今回の更新では、F16C命令セットを利用できるにもかかわらず、AVX2 CPUで使われていなかった不具合を修正した。また、macOS Apple Silicon、macOS Intel、iOS向けのほか、VulkanやCUDA 12.8に対応するものを含む複数のUbuntu構成向けに、新しいバイナリパッケージを提供する。
なぜ重要か
互換性のあるCPUでLlamaモデルを実行する開発者は、手動でパッチを当てなくても推論を高速化できる。