llama.cpp发布b11181:HIP版fp8最低版本要求上调,避开 6.2 缺失 __hip_fp8_e4m3支持
该版本唯一的代码改动是提高fp8所需的HIP_VERSION,原因是HIP 6.2缺少 __hip_fp8_e4m3支持;同时按惯例发布了macOS、iOS、Linux、Android和Windows各后端预编译包。
AI解读:llama.cpp的b11181版本只改了一件事:把fp8所需的HIP版本要求往上调,规避HIP 6.2中缺少 __hip_fp8_e4m3支持的问题。对用AMD ROCm/HIP后端跑fp8量化模型的人来说,这意味着旧版HIP环境可能不再被接受。
其余内容是常规的预编译包发布。除了macOS/iOS、Ubuntu(CPU、Vulkan、CUDA 12/13、ROCm 10.0、OpenVINO、SYCL)和Windows各后端,这次也提供了Linux arm64与Android arm64的骁龙版本,覆盖CPU、Adreno GPU和Hexagon NPU。
需要注意几处标记为DISABLED的构建:macOS Apple Silicon的KleidiAI版和openEuler系列本次未提供。上述内容来自该版本的发布摘要,未包含更详细的改动说明。
llama.cpp发布b11181版本,本次唯一在发布说明中列出的代码改动是提高fp8所需的HIP_VERSION,以避免HIP 6.2中缺少 __hip_fp8_e4m3支持的问题(对应PR #29231)。
除这一项改动外,该发布按惯例提供各平台预编译产物:macOS/iOS(Apple Silicon arm64、Intel x64、iOS XCFramework)、Linux(Ubuntu x64/arm64/s390x的CPU版本,以及Vulkan、CUDA 12.8、CUDA 13.4、ROCm 10.0、OpenVINO 2026.4、SYCL FP32/FP16版本)、Android arm64(CPU与骁龙版本)、Windows(x64/arm64 CPU、OpenCL Adreno、CUDA 12.4/13.4、Vulkan、OpenVINO 2026.4、SYCL、ROCm 10.0)以及UI包。
被标记为不可用的构建
发布说明中标注为DISABLED的包括:macOS Apple Silicon(arm64,启用KleidiAI)、openEuler的x86(310p)、x86(910b,ACL Graph)、aarch64(310p)和aarch64(910b,ACL Graph)。
这些条目仅标注为DISABLED,发布说明未给出原因。
移动端与骁龙后端
Linux arm64与Android arm64均提供骁龙专用包,覆盖CPU、Adreno GPU和Hexagon NPU,并分别链接到对应的设置指南(Linux文档位于docs/backend/snapdragon/linux.md,Android位于docs/backend/snapdragon/README.md)。