OossaAI는 빠르게 발전하고 있습니다. 저희가 쉽게 설명해 드립니다.

llama.cpp v0.1.0, GPU 뺄셈 최적화·새 바이너리 추가

오픈소스 llama.cpp 라이브러리가 GPU 뺄셈 최적화와 macOS, iOS, Ubuntu용 사전 빌드 바이너리를 포함한 버전 b11270을 출시했다.

짧은 소식Oossa1 분 읽기

ggml-org 팀은 2026년 9월 30일 llama.cpp 버전 b11270을 공개했다. 이번 버전은 AMD의 HIP 플랫폼에서 사용하는 GPU 연산을 조정해, 느린 바이트 뺄셈 명령어를 더 빠른 명령어로 대체했다. 또한 Apple Silicon 및 Intel용 macOS, iOS, Vulkan을 지원하는 GPU 버전을 포함한 여러 Ubuntu 빌드용 새 바이너리 패키지를 제공한다.

왜 중요한가

이번 GPU 최적화는 AMD 하드웨어에서 추론 속도를 높일 수 있으며, 바로 실행할 수 있는 바이너리를 제공해 개발자가 더 다양한 플랫폼에서 llama.cpp를 쉽게 사용해 볼 수 있다.

이 기사가 도움이 되었나요?
공유

다음 읽을거리

Oossa · 뉴스레터

이번 주 AI, 쉽게 정리

매주 월요일, 알아둘 만한 소식을 쉬운 말로. 무료, 스팸 없음.

출처 및 참고 자료

#출처매체날짜핵심 내용
1ggml-org/llama.cpp b11270 ↗llama.cpp2026. 9. 30.<details open> ggml-cuda: HIP: optimize packed byte subtraction (`__vsubss4` -> `__vsub4`) (#29478) * ggml-cuda: HIP: optimize non-saturatin

1 개 출처

최종 업데이트: ·Markdown·llms.txt