开源llama.cpp Releases·原文 2026年10月5日

llama.cpp发布b11399:CUDA swizzling代码重构并修复模板与循环边界

该版本由GitHub Actions自动发布,提交信息显示本次改动为CUDA swizzling代码重构,并修复了模板与循环边界;发布页同时提供macOS、Linux、Windows、Android等多平台构建包。

AI解读:同一提交信息还写明“fix templates/loop bounds”,即修复模板与循环边界问题;来源未给出性能或正确性验证数据。

发布页由github-actions[bot] 生成,附带各平台预编译产物,涵盖macOS、iOS、Linux、Android、Windows以及UI包。

macOS Apple Silicon的KleidiAI构建和openEuler构建在发布页中被标注为DISABLED,对应的链接仍保留但不可用。

CUDA构建分别针对CUDA 12(Linux 12.8、Windows 12.4)与CUDA 13.4,并单独提供对应版本的runtime库压缩包。

来源没有说明swizzling重构的具体动机、影响范围或性能变化,因此无法据此判断实际效果。

llama.cpp发布b11399版本。发布说明列出的代码改动为CUDA swizzling代码重构(PR #29612),同时修复模板与循环边界。

本次改动内容

版本b11399的发布说明仅包含一条提交记录:“CUDA: refactor swizzling code (#29612)”,其下标注“fix templates/loop bounds”。发布页由github-actions[bot] 生成。

来源未提供该重构的动机说明、受影响的内核范围,也没有附带基准测试或正确性验证数据。

  • CUDA swizzling代码重构,关联PR #29612
  • 同一提交修复模板与循环边界
  • 发布页署名github-actions[bot]
  • 未提供性能或结果数据

可下载的构建产物

发布页列出面向多个平台与后端的预编译包。macOS提供Apple Silicon(arm64)与Intel(x64)版本,另有iOS XCFramework。Linux覆盖Ubuntu x64、arm64、s390x,以及Vulkan、CUDA、ROCm 10.0、OpenVINO、SYCL(FP32/FP16)等后端,并包含Snapdragon平台(CPU、Adreno GPU、Hexagon NPU)构建。Windows覆盖x64与arm64,以及CUDA 12.4、CUDA 13.4、Vulkan、OpenCL Adreno、OpenVINO、SYCL、ROCm 10.0等版本。Android提供arm64通用版本与Snapdragon版本,另有单独的UI包。

  • macOS:Apple Silicon arm64、Intel x64、iOS XCFramework
  • Linux:Ubuntu x64/arm64/s390x,Vulkan、CUDA 12.8、CUDA 13.4、ROCm 10.0、OpenVINO、SYCL
  • Windows:x64/arm64,CUDA 12.4、CUDA 13.4、Vulkan、OpenCL Adreno、OpenVINO、SYCL、ROCm 10.0
  • Android:arm64通用版与Snapdragon版
  • CUDA包附带单独的runtime库压缩包
  • 提供独立UI包

被标注为不可用的构建

发布页中,macOS Apple Silicon的KleidiAI启用版标注为DISABLED,并链接到PR #23780。openEuler系列构建同样标注为DISABLED,并链接到PR #23705,包含openEuler x86(310p、910b ACL Graph)与aarch64(310p、910b ACL Graph)条目。

  • macOS Apple Silicon KleidiAI版:DISABLED,关联PR #23780
  • openEuler x86与aarch64各版本:DISABLED,关联PR #23705
  • 这些条目的下载链接仍保留在页面中,但状态标注为禁用

信息来源

llama.cpp Releases原始来源