Das ggml‑org-Team hat am 2026‑10‑08 llama.cpp in Version b11481 veröffentlicht. Das Update ergänzt die Unterstützung für Cohere2-Visionmodelle und enthält vorgefertigte Binaries für Apple Silicon, Intel-Macs, iOS und mehrere Ubuntu-Konfigurationen. Die Dateien stehen auf der GitHub-Release-Seite zum Download bereit.
Warum es wichtig ist
Entwickler können bildfähige KI-Modelle jetzt lokal auf macOS, iOS und Linux ausführen – ganz ohne Cloud-Dienste.