llama.cpp库于2026年9月30日发布补丁,阻止大小在填充过程中可能发生溢出的张量。补丁会先检查原始大小与对齐值相加是否溢出,再执行填充,从而提前拒绝不安全的张量。新增测试用例显示,该修复能够拦截一个大小为2⁶⁴−16字节、此前未被检测到的张量。此次更新适用于所有受支持的构建版本,涵盖macOS、Windows和Linux,以及CUDA和Vulkan版本。
为什么重要
避免这种溢出,可防止运行超大型模型时发生崩溃或结果损坏。
9月30日发布的更新修复了大型张量填充时罕见的溢出漏洞,提升了各平台的稳定性。
简讯Oossa1 分钟阅读
llama.cpp库于2026年9月30日发布补丁,阻止大小在填充过程中可能发生溢出的张量。补丁会先检查原始大小与对齐值相加是否溢出,再执行填充,从而提前拒绝不安全的张量。新增测试用例显示,该修复能够拦截一个大小为2⁶⁴−16字节、此前未被检测到的张量。此次更新适用于所有受支持的构建版本,涵盖macOS、Windows和Linux,以及CUDA和Vulkan版本。
避免这种溢出,可防止运行超大型模型时发生崩溃或结果损坏。
模型
OpenAI称,新版GPT‑6.1 Sol性能更强,但仍维持每百万token 2至10美元的价格,低于Anthropic的Claude和DeepSeek模型。
模型
新款v4和v4 Turbo语音的价格分别为每1,000个字符0.08美元和0.04美元;促销价持续至10月12日,分别降至0.022美元和0.011美元。
模型
Oracle推出的Fusion Claw运行时,让其Fusion应用能够处理人员排班、会计等多步骤任务:由AI负责推理,计算则交由模型之外的系统完成。
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。
| # | 来源 | 发布方 | 日期 | 要点 |
|---|---|---|---|---|
| 1 | ggml-org/llama.cpp b11275 ↗ | llama.cpp | 2026年9月30日 | <details open> gguf : reject tensor size that wraps after padding (#26979) GGML_PAD(nbytes, alignment) wraps to 0 when nbytes is within (ali |
| 2 | ggml-org/llama.cpp b11276 ↗ | llama.cpp | 2026年9月30日 | <details open> Hexagon f16 activation ops (#29209) * hexagon: add F16 support for activation ops (SILU/GELU/GELU_QUICK/GEGLU/SWIGLU) Widens |
2 个来源