Oossa

llama.cpp b11510、CUDAで大型テンソルに対応

オープンソースのLLaMA推論ライブラリがb11510を公開。65,535行を超える処理に対応する新しいCUDAカーネルを追加し、macOS、iOS、Linux向けバイナリも提供します。

短信著者: Oossa公開日: 1 分で読める

ggml-orgチームは2026年10月8日、llama.cppのバージョンb11510を公開しました。CUDA向けにループ処理を行うPADカーネルを追加し、65,000行を超えるテンソルやスライスを処理できるようになりました。このリリースには、Apple Silicon、Intel搭載Mac、iOS、およびUbuntu向けの複数のビルド(CPU、Vulkan、CUDA 12.8)のコンパイル済みバイナリも含まれています。コードとアテステーションはGitHubページから確認できます。

なぜ重要か

開発者は、従来の行数上限に阻まれることなく、NVIDIA GPUでより大規模な言語モデルを実行できるようになります。

この記事は役に立ちましたか?
共有

次に読む

Oossa · ニュースレター

今週のAIを、わかりやすく

毎週月曜日、知っておきたいニュースをやさしい言葉で。無料・スパムなし。