开源llama.cpp Releases·原文 2026年10月3日本站收录 2026年10月4日

llama.cpp b11379修复server端Laya中止问题:将n_batch限制为不超过n_ubatch

该版本由自动化提交(github-actions[bot])发布,改动说明称通过把n_batch限制在n_ubatch以内来修复 #29902 报告的中止问题,并注明Assisted-by: Claude;评审后移除了相关测试与embeddings条件。

AI解读:llama.cpp发布b11379版本,核心改动是server端修复:把n_batch限制为不超过n_ubatch,用以解决 #29902 报告的中止(abort)问题。

这一改动的描述来自发布说明本身,提交者为github-actions[bot],说明中还标注Assisted-by: Claude,表示该修复在辅助下完成。

评审反馈后,改动移除了测试以及embeddings相关条件。

版本同时提供多平台预编译包,覆盖macOS(Apple Silicon、Intel)、iOS XCFramework、Linux(CPU、Vulkan、CUDA 12/13、ROCm 10.0、OpenVINO、SYCL)以及Android、Windows、UI等构建。

发布说明中,macOS Apple Silicon的KleidiAI构建和openEuler构建均标注为DISABLED。

除修复描述与构建列表外,来源未提供该修复的性能数据或更广泛的影响评估。

llama.cpp发布b11379版本,发布说明列出的一项server端修复为:通过将n_batch限制为不超过n_ubatch,修复 #29902 报告的中止问题。该提交由github-actions[bot] 发布,说明中标注Assisted-by: Claude。

发布说明还注明,评审后移除了测试以及embeddings条件。

b11379的server端改动

版本b11379的改动标题为“server : fix laya abort by limiting n_batch to n_ubatch (#29903)”,说明该改动对应修复 #29902。

发布说明中写的处理方式是把n_batch限制在n_ubatch以内;评审后移除了测试与embeddings条件。

  • 改动编号:#29903,修复对象:#29902。
  • 发布者标注为github-actions[bot]。
  • 说明中标注Assisted-by: Claude。

随版本提供的构建产物

b11379同时给出多个平台的预编译包链接,覆盖桌面、移动端与部分加速后端。发布说明中将macOS Apple Silicon的KleidiAI构建与openEuler构建标为DISABLED。

  • macOS/iOS:Apple Silicon(arm64)、Intel(x64)、iOS XCFramework。
  • Linux:Ubuntu x64/arm64/s390x的CPU构建,以及Vulkan、CUDA 12、CUDA 13、ROCm 10.0、OpenVINO、SYCL FP32/FP16构建。
  • Android:arm64(CPU)与arm64(Snapdragon:CPU、Adreno GPU、Hexagon NPU)。
  • Windows:x64/arm64 CPU,OpenCL Adreno(arm64),CUDA 12/13,Vulkan,OpenVINO,SYCL,ROCm 10.0。
  • 另有UI包;openEuler相关构建标注为DISABLED。

信息来源

llama.cpp Releases原始来源