开源llama.cpp Releases·原文 2026年9月18日

llama.cpp b11034发布:新增ufakzeka预分词器

llama.cpp发布b11034版本,主要变更是为词表处理新增ufakzeka预分词器,并同步发布覆盖macOS、Linux、Windows、Android等平台的预编译二进制。

AI解读:llama.cpp的b11034版本只做了一件核心的事:给词表处理加上ufakzeka预分词器。改动来自PR #29033,提交说明里还把它移进了models列表并重新生成了哈希映射。

预分词器决定文本在送入模型前怎么被切分。支持新的预分词方案,意味着使用这类词表的模型可以在llama.cpp上跑起来;普通用户如果不用这类模型,这次更新对日常使用没有可感知的变化。

版本同时照例产出一整套预编译二进制,覆盖macOS、Linux、Windows、Android和iOS,以及CUDA、Vulkan、ROCm、SYCL、OpenVINO等多种后端,另有UI包。需要自己编译的开发者可以省掉这一步,直接取对应平台的包。

llama.cpp发布b11034版本(GitHub仓库ggml-org/llama.cpp),提交说明为「vocab : add ufakzeka pre-tokenizer (#29033)」。

该提交做了两处改动:新增ufakzeka预分词器,以及把ufakzeka移入models列表并重新生成哈希映射。

b11034的改动内容

该版本对应PR #29033,标题为「vocab : add ufakzeka pre-tokenizer」。提交说明列出两点:为词表模块新增ufakzeka预分词器;随后把ufakzeka移到models列表,并重新生成哈希映射。

随版本发布的预编译目标

发布页面按平台列出制品,包括macOS Apple Silicon(arm64)、macOS Intel(x64)、iOS XCFramework、Android arm64(CPU)、UI包,以及Linux和Windows的多组构建。

  • macOS/iOS:Apple Silicon arm64、Intel x64、iOS XCFramework;其中Apple Silicon的KleidiAI启用构建标记为DISABLED。
  • Linux:Ubuntu x64、arm64、s390x的CPU构建,以及Vulkan、CUDA 12(含 12.8 库)、CUDA 13(含 13.3 库)、ROCm 10.0、OpenVINO 2026.4、SYCL FP32、SYCL FP16构建。
  • Windows:x64与arm64的CPU构建,arm64的OpenCL Adreno构建,以及CUDA 12(含 12.4 DLL)、CUDA 13(含 13.4 DLL,含arm64)、Vulkan、OpenVINO 2026.4、SYCL、ROCm 10.0构建。
  • Android:arm64(CPU)。openEuler相关构建(x86 310p、x86 910b ACL Graph、aarch64 310p、aarch64 910b ACL Graph)标记为DISABLED。

信息来源

llama.cpp Releases原始来源