llama.cpp发布b11322:修复hex-workqueue中seqn与读写索引失步的竞态
llama.cpp新版本b11322修复了hex-workqueue中seqn与idx_read/idx_write不同步的竞态条件,并同步放出macOS、Linux、Windows、Android等多平台预编译包。
AI解读:llama.cpp的b11322版本改了一处并发问题:hex-workqueue里seqn会和idx_read、idx_write失去同步,现在按PR #29785 修掉了。对普通用户来说,这不会带来新模型能力,只是让队列在特定并发场景下不再错位。
值得留意的是发布渠道:官方照旧为macOS、iOS、Linux、Windows、Android等多个平台提供预编译二进制,Ubuntu版本覆盖CPU、Vulkan、CUDA 12.8、CUDA 13.4、ROCm 10.0、OpenVINO 2026.4和SYCL。需要哪个后端就直接下对应包。
这份发布说明只有改动标题加下载清单,没有给出复现条件、影响范围或性能数据,所以无法判断普通推理负载会不会真的踩到这个竞态。可以确认的是修复已随b11322进入发布包。
llama.cpp发布了b11322版本,改动条目只有一条:hex-workqueue修复了seqn与idx_read/idx_write失去同步的竞态条件,对应PR #29785。
修复内容与平台构建
发布说明列出的唯一改动是hex-workqueue中的竞态修复,标题为“fix race condition in seqn getting out of sync with idx_read/write (#29785)”。除此之外,说明没有提供复现条件、影响范围或性能数据。
b11322同步提供多平台预编译包:macOS Apple Silicon(arm64)与Intel(x64)、iOS XCFramework;Linux下Ubuntu x64/arm64/s390x CPU、x64与arm64的Vulkan、x64的CUDA 12.8与CUDA 13.4、arm64的CUDA 13.4、x64的ROCm 10.0、OpenVINO 2026.4、SYCL FP32与FP16,以及Linux arm64的Snapdragon(CPU、Adreno GPU、Hexagon NPU)构建;另有Android arm64 CPU和Snapdragon构建、Windows x64/arm64 CPU、Windows arm64 OpenCL Adreno、Windows x64 CUDA 12.4、CUDA 13.4、Vulkan、OpenVINO 2026.4、SYCL、ROCm 10.0等包。
部分构建被标注为DISABLED:macOS Apple Silicon的KleidiAI启用版本(PR #23780)和openEuler相关构建(PR #23705)未提供下载。