OossaAI는 빠르게 발전하고 있습니다. 저희가 쉽게 설명해 드립니다.

llama.cpp b11262, AVX512-FP16 내적 지원 추가

오픈소스 llama.cpp 라이브러리가 이제 AVX512-FP16을 사용해 반정밀도 내적을 단정밀도로 계산해 CPU 성능을 높입니다.

짧은 소식Oossa1 분 읽기

ggml-org 팀이 2026년 9월 29일 llama.cpp 버전 b11262를 공개했습니다. 이번 업데이트에는 반정밀도(f16) 내적을 계산하고 단정밀도(f32)로 누적해 정확도를 높이는 AVX512-FP16 지원이 추가됐습니다. AVX512-FP16 명령어 세트를 지원하는 CPU에서 추론 속도를 높이는 저수준 변경입니다. 이번 릴리스에는 macOS, iOS 및 여러 Linux 빌드용 새 바이너리도 포함됐습니다.

왜 중요한가

수치 정확도를 유지하면서 최신 CPU에서 LLM을 더 빠르게 실행할 수 있어 개발자에게 유용합니다.

이 기사가 도움이 되었나요?
공유

다음 읽을거리

Oossa · 뉴스레터

이번 주 AI, 쉽게 정리

매주 월요일, 알아둘 만한 소식을 쉬운 말로. 무료, 스팸 없음.

출처 및 참고 자료

#출처매체날짜핵심 내용
1ggml-org/llama.cpp b11262 ↗llama.cpp2026. 9. 29.<details open> ggml : accumulate f16 dot products in f32 on AVX512-FP16 (#29545) Supersedes #29530 Signed-off-by: Adrien Gallouët <angt@hugg

1 개 출처

최종 업데이트: ·Markdown·llms.txt