Oossa

llama.cppの先行リリースb11517、CUDAの精度設定を追加

オープンソースのLLaMA推論ライブラリが2026年10月9日にバージョンb11517を公開。ソース1の精度を設定するCUDAフラグが加わりました。

短信著者: Oossa公開日: 1 分で読める

llama.cppプロジェクトは2026年10月9日、新しい先行リリースb11517を公開しました。このアップデートでは、GPUコードの低レベル部分にあたるMMQヘルパーにソース1の精度を渡せるCUDAオプションが追加されています。この変更はNVIDIAのコントリビューターが署名したもので、LinuxおよびWindows向けに掲載されているCUDA 12と13のビルドに適用されます。また、macOSのApple SiliconからAndroidのSnapdragonまで、ほかにも多くのプラットフォーム向けのビルドターゲットが含まれています。

アップデートはプロジェクトのGitHubページとllama.appのウェブサイトから入手できます。

なぜ重要か

開発者はllama.cppでGPUの精度を制御できるようになり、LLaMAモデルの実行時にパフォーマンスやメモリ使用量が改善する可能性があります。

この記事は役に立ちましたか?
共有

次に読む

Oossa · ニュースレター

今週のAIを、わかりやすく

毎週月曜日、知っておきたいニュースをやさしい言葉で。無料・スパムなし。