오픈소스 llama.cpp 라이브러리가 2026년 10월 9일 버전 b11523을 공개했습니다. 이번 업데이트는 라이브러리가 WebGPU에서 DUP 연산을 실행하려 할 때 발생하던 충돌을 해결했습니다. 이전에는 다른 작업은 WebGPU에서 처리하면서 DUP는 CPU에서 실행해 버퍼 불일치가 생기고 프로그램이 중단됐습니다. 이제 DUP도 CPY(복사) 및 CONT 연산과 같은 코드 경로를 따라 WebGPU에서 처리됩니다.
왜 중요한가
WebGPU 사용자는 혼합 배치 모델을 실행할 때 llama.cpp가 충돌하는 문제 없이 사용할 수 있습니다.