# llama.cpp b11510、CUDAで大型テンソルに対応

> オープンソースのLLaMA推論ライブラリがb11510を公開。65,535行を超える処理に対応する新しいCUDAカーネルを追加し、macOS、iOS、Linux向けバイナリも提供します。

Oossa · 2026-10-08 · https://oossa.com/ja/llama-cpp-b11510-adds-cuda-support-for-larger-tensors

ggml-orgチームは2026年10月8日、llama.cppのバージョンb11510を公開しました。CUDA向けにループ処理を行うPADカーネルを追加し、65,000行を超えるテンソルやスライスを処理できるようになりました。このリリースには、Apple Silicon、Intel搭載Mac、iOS、およびUbuntu向けの複数のビルド（CPU、Vulkan、CUDA 12.8）のコンパイル済みバイナリも含まれています。コードとアテステーションはGitHubページから確認できます。

## 事実

- バージョンb11510は2026-10-08にリリース
- 新しいCUDA PADカーネルは65,535行超に対応

## なぜ重要か

開発者は、従来の行数上限に阻まれることなく、NVIDIA GPUでより大規模な言語モデルを実行できるようになります。

## 出典と参考資料

1. [ggml-org/llama.cpp b11510](https://github.com/ggml-org/llama.cpp/releases/tag/b11510) – llama.cpp, 2026-10-08

最終更新: 2026-10-08
