llama.cpp发布b11391:CUDA后端将blocks_per_col移到使用位置
llama.cpp在GitHub发布版本b11391,唯一列出的代码改动是CUDA相关:把blocks_per_col移动到它被使用的地方,由贡献者Adrien Gallouët签署。发布同时提供多平台预编译包。
AI解读:这是代码整理性质的位置调整,发布说明未给出性能或正确性数据,无法据此判断实际影响。
该版本按平台提供预编译包:macOS(Apple Silicon arm64、Intel x64)、iOS XCFramework、Linux(Ubuntu x64/arm64/s390x、Vulkan、CUDA 12/CUDA 13、ROCm 10.0、OpenVINO、SYCL FP32/FP16、Snapdragon arm64)、Android arm64、Windows,以及UI包。
两项构建在来源中标注为DISABLED:macOS Apple Silicon的KleidiAI启用版本(关联PR #23780)和openEuler构建(关联PR #23705)。KleidiAI与openEuler用户在选用对应构建时需注意这一状态。
CUDA构建按两条版本线提供独立运行时库:Ubuntu x64的CUDA 12.8与CUDA 13.4;Windows的CUDA 12.4与CUDA 13.4,Windows还额外提供arm64的CUDA 13.4。
llama.cpp发布版本b11391。来源列出的一条代码改动是:cuda : move blocks_per_col to where it is used(#29939),签署者为Adrien Gallouët。
这句话描述的是一次变量作用位置的调整——把blocks_per_col移动到它被使用的地方;发布说明没有提供改动前后行为、性能或修正了哪个具体问题的说明。
b11391的代码改动
该版本在GitHub的发布条目中只列出一条提交信息:cuda : move blocks_per_col to where it is used,对应PR编号 #29939,签署者为Adrien Gallouët。
来源没有说明该调整是否伴随功能变化、性能差异或问题修复,因此不能从这条信息推断对推理速度或显存占用的影响。
- 改动主题:CUDA相关代码整理
- PR编号:#29939
- 签署者:Adrien Gallouët
随版本提供的预编译包
发布页按平台列出了b11391的预编译包。macOS部分提供Apple Silicon(arm64)与Intel(x64)的二进制;Apple Silicon的KleidiAI启用版本在来源中标记为DISABLED,并关联PR #23780。iOS提供XCFramework。
Linux覆盖Ubuntu x64/arm64的CPU版本、Ubuntu s390x CPU、Ubuntu的Vulkan(x64与arm64)、CUDA 12(12.8)与CUDA 13(13.4)的x64包并附各自的运行时库、ROCm 10.0 x64、OpenVINO x64、SYCL FP32与FP16 x64,以及面向Snapdragon的arm64包(CPU、Adreno GPU、Hexagon NPU)。
Android提供arm64 CPU包和Snapdragon变体;Windows提供x64/arm64 CPU、arm64 OpenCL Adreno、CUDA 12.4与CUDA 13.4(含各自DLL)、arm64 CUDA 13.4、Vulkan x64、OpenVINO x64、SYCL x64和ROCm 10.0 x64。UI则单独打包。
- macOS Apple Silicon的KleidiAI启用版本标记为DISABLED(PR #23780)
- openEuler构建(x86/aarch64的 310p与 910b ACL Graph)标记为DISABLED(PR #23705)
- CUDA包按版本线拆分:Ubuntu CUDA 12.8与 13.4;Windows CUDA 12.4与 13.4