llama.cpp b10888为Vulkan后端加入命令缓冲调试标签
llama.cpp新构建b10888的唯一功能改动是在Vulkan后端添加命令缓冲调试标签,方便GPU性能分析器识别队列中的命令来源。
AI解读:这次更新只做了一件事:给llama.cpp的Vulkan后端加上命令缓冲的调试标签。
调试标签的作用是让GPU性能分析器在抓取队列时能直接看出每个命令缓冲对应哪部分代码,而不是面对一堆匿名缓冲区。对用Vulkan跑llama.cpp并做性能调优的人来说,这能省去逐个猜测的时间。
补丁由gabby-zy参与完成,提交信息标注了Claude Code的辅助,并修正了队列调试标签的关闭方式,使其与标签结构体配合。除此之外b10888只是照常发布各平台预编译包,没有其他功能变化。
llama.cpp发布构建版本b10888,本次唯一的代码改动位于Vulkan后端:为命令缓冲添加调试标签,供GPU性能分析器使用(PR #28101)。
该改动由gabby-zy共同完成,提交信息中标注Assisted-by: Claude Code;第一条提交添加标签,第二条提交修正为“用标签结构体关闭队列调试标签”。
除这一改动外,该版本照常提供各平台预编译产物。
标签改了什么
根据发布说明,Vulkan后端的命令缓冲现在带有调试标签,目标用途是配合GPU性能分析器。提交序列显示,第一条补丁加入标签,第二条把队列调试标签的关闭动作改为与标签结构体配合,避免标签在错误位置结束。
发布说明没有给出性能数字,也没有说明哪些profiler已验证支持这些标签。
- 改动范围:仅Vulkan后端(PR #28101)
- 协作信息:Co-authored-by: gabby-zy;Assisted-by: Claude Code
- 无性能数据或验证工具清单
同时提供的构建产物
与以往发布一样,b10888附带macOS/iOS、Linux、Android、Windows、openEuler和UI的预编译包。
macOS提供Apple Silicon(arm64)与Intel(x64)版本,以及iOS XCFramework;其中启用KleidiAI的Apple Silicon构建被标记为DISABLED。Linux覆盖Ubuntu x64、arm64、s390x的CPU构建,以及Vulkan、ROCm 10.0、OpenVINO 2026.3.1、SYCL FP32/FP16变体。
Windows侧包括CPU x64/arm64、OpenCL Adreno arm64、CUDA 12.4与CUDA 13.3 x64、CUDA 13.4 arm64(preview)、Vulkan x64、OpenVINO 2026.3.1 x64、SYCL x64与ROCm 10.0 x64。Android只有arm64 CPU包。openEuler全部条目标注为DISABLED。
- macOS Apple Silicon的KleidiAI构建:DISABLED(指向PR #23780)
- openEuler全部平台:DISABLED(指向PR #23705)
- Windows arm64 CUDA 13.4:preview
- CUDA安装包另附对应版本的DLL压缩包