开源llama.cpp Releases·原文 2026年10月1日

llama.cpp b11301修复ggml/gguf整数溢出漏洞

该版本针对零元素张量增加整数溢出防护,并校验张量元素数量,同时提供覆盖macOS、Linux、Windows、Android与openEuler的预编译包。

AI解读:这个修复针对的是张量元数据在极端情况下可能被错误计算的问题。对于加载来源不明或结构异常的GGUF模型的用户,它降低了因整数溢出导致崩溃或异常行为的风险。

版本同时更新了多平台预编译包,涵盖CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO等后端。不过macOS上启用KleidiAI的Apple Silicon包和openEuler相关包仍处于禁用状态。

如果你的工作流依赖llama.cpp加载模型,升级到b11301可以获得这层校验;若不需要从不可信来源加载模型,影响相对有限。

llama.cpp发布b11301版本,主要改动是修复ggml/gguf的整数溢出问题(PR #29384)。根据发布说明,修复内容包括为零元素张量增加整数溢出防护、校验张量元素数量以防止整数溢出,以及修正错误打印。

该版本同时更新了各平台预编译二进制包,覆盖macOS/iOS、Linux、Android和Windows,涉及CPU、CUDA 12/13、Vulkan、ROCm 10.0、SYCL、OpenVINO等后端。

发布说明显示,macOS Apple Silicon(arm64)启用KleidiAI的构建仍为DISABLED状态,openEuler相关构建也为DISABLED。

整数溢出修复涉及零元素张量与元素数量校验

PR #29384 的提交信息列出了三项改动:为ggml的零元素张量增加整数溢出防护;在张量中校验元素数量以防止整数溢出;修正错误打印。

这些改动位于ggml/gguf层,是llama.cpp处理模型权重和元数据的基础组件。

预编译包覆盖多平台与多后端

b11301的发布资产按平台和后端组织。macOS/iOS提供Apple Silicon(arm64)、Intel(x64)以及iOS XCFramework包;其中启用KleidiAI的macOS Apple Silicon构建标记为DISABLED。

Linux提供Ubuntu x64、arm64、s390x的CPU包,以及Vulkan、CUDA 12.8、CUDA 13.4、ROCm 10.0、OpenVINO 2026.4、SYCL FP32/FP16等后端包,另有Snapdragon平台整合CPU、Adreno GPU和Hexagon NPU的Linux arm64包。

Android提供arm64 CPU包和Snapdragon(CPU、Adreno GPU、Hexagon NPU)包。Windows提供x64、arm64的CPU包,以及CUDA 12.4/13.4、Vulkan、OpenVINO 2026.4、SYCL、ROCm 10.0和OpenCL Adreno等构建。

openEuler的x86 310p、x86 910b(ACL Graph)、aarch64 310p、aarch64 910b(ACL Graph)均标记为DISABLED。UI也提供独立压缩包。

信息来源

llama.cpp Releases原始来源