# llama.cpp v0.2.0, AMD 내장 GPU 속도 저하 문제 수정

> 오픈소스 LLaMA 추론 라이브러리에 AMD 내장 그래픽용 Vulkan 수정 사항이 적용됐으며, macOS·iOS·Linux용 사전 빌드 바이너리도 업데이트됐다.

Oossa · 2026-10-07 · https://oossa.com/ko/llama-cpp-v0-2-0-release-fixes-amd-igpu-slowdown

ggml‑org 팀이 2026-10-07에 llama.cpp 버전 b11461을 출시했다. 이번 업데이트는 AMD 내장 GPU에서 Vulkan을 사용할 때 체크포인트를 느리게 읽던 문제를 수정했다. Apple Silicon, Intel Mac, iOS와 여러 Linux 빌드(CPU, Vulkan, CUDA 12.8)용 새 바이너리 패키지도 제공한다. 사용자는 GitHub 릴리스 페이지에서 해당 아카이브를 내려받을 수 있다.

## 팩트

- 버전 b11461이 2026-10-07에 공개됐다
- Vulkan 수정 사항은 AMD 내장 GPU의 성능 문제를 해결한다

## 왜 중요한가

AMD 노트북 사용자는 이제 이전의 속도 저하 없이 LLaMA 모델을 더 빠르게 실행할 수 있다.

## 출처 및 참고 자료

1. [ggml-org/llama.cpp b11461](https://github.com/ggml-org/llama.cpp/releases/tag/b11461) – llama.cpp, 2026-10-07

최종 업데이트: 2026-10-07
