ggml-orgチームは2026-10-09、llama.cpp version b11528をリリースしました。今回の更新では、ホストメモリに割り当てられたテンソルのビューを通常のノードとして扱えるようになり、–split-mode tensorオプション使用時に発生していた従来のassertエラーが解消されます。また、K2 Horizonアクセラレーター向けのSMテンソルサポートも復活しました。この変更はGitHubの公式リリースに含まれており、macOSからWindows、Linuxまで、記載されているすべてのプラットフォームが対象です。
なぜ重要か
開発者は、クラッシュを起こさずに、より多くのハードウェアでKVキャッシュを分割するモードを使ってllama.cppを実行できるようになり、ローカルLLM推論で利用できる構成が広がります。