ggml-org 团队发布了 llama.cpp b11277 版本。该版本修复了一个会导致内存泄漏的缓冲区重置问题,还提供适用于 macOS(Apple Silicon 和 Intel)、iOS 以及多个 Ubuntu 版本的预编译二进制文件,其中包括支持 Vulkan 和 CUDA GPU 的版本。用户可直接从发布页面下载这些文件。
为什么重要
修复内存泄漏有助于提升开发者在本地运行大语言模型时的稳定性,而预编译二进制文件则让用户能更轻松地在更多平台上体验 llama.cpp。
开源大语言模型运行时 llama.cpp 于2026年9月30日发布 b11277,修复缓冲区重置错误,并提供新版 macOS、iOS 和 Ubuntu 构建。
简讯OossaOossa 发布日期: 1 分钟阅读
ggml-org 团队发布了 llama.cpp b11277 版本。该版本修复了一个会导致内存泄漏的缓冲区重置问题,还提供适用于 macOS(Apple Silicon 和 Intel)、iOS 以及多个 Ubuntu 版本的预编译二进制文件,其中包括支持 Vulkan 和 CUDA GPU 的版本。用户可直接从发布页面下载这些文件。
修复内存泄漏有助于提升开发者在本地运行大语言模型时的稳定性,而预编译二进制文件则让用户能更轻松地在更多平台上体验 llama.cpp。
最后更新: ·Markdown
模型
约100家网站因内容被用于 AI Overviews、AI Mode 和 Gemini 而获得报酬,但大多数收入不足1,000美元,也不知道报酬如何计算。
模型
OpenAI称,新版GPT‑6.1 Sol性能更强,但仍维持每百万token 2至10美元的价格,低于Anthropic的Claude和DeepSeek模型。
模型
新款v4和v4 Turbo语音的价格分别为每1,000个字符0.08美元和0.04美元;促销价持续至10月12日,分别降至0.022美元和0.011美元。
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。