Oossa

llama.cpp v b11499、CUDAのroll処理を改善し新しいバイナリを追加

オープンソースのLLMランタイムllama.cppが2026年10月8日にバージョンb11499を公開。CUDAで非連続データのroll処理を修正し、macOS、iOS、Linux向けの新しいビルド済みバイナリを追加した。

短信著者: Oossa公開日: 1 分で読める

ggml-orgチームは2026年10月8日、llama.cppのリリースb11499を公開した。今回の更新では、CUDAバックエンドのroll処理にバイト単位のストライドを使うよう変更し、GPUで非連続データを正しく扱えるようにした。また、Apple Silicon、Intel搭載Mac、iOS、および複数のUbuntu向けビルド(CPU、Vulkan、CUDA 12)を新たに同梱している。すべてのファイルはGitHubのリリースページからダウンロードできる。

なぜ重要か

開発者は、より多くのGPU環境でエラーを避けてllama.cppを実行できるようになり、デスクトップやサーバーでローカルLLMを活用しやすくなる。

この記事は役に立ちましたか?
共有

次に読む

Oossa · ニュースレター

今週のAIを、わかりやすく

毎週月曜日、知っておきたいニュースをやさしい言葉で。無料・スパムなし。