llama.cpp发布b11256:调整服务端字符串正则,兼容M2 Ultra测试结果
llama.cpp发布b11256版本,唯一变更来自PR #29648:测试中调整服务端字符串正则,使其也能匹配M2 Ultra的测试结果。
AI解读:所以这不是推理性能或模型格式的更新,而是测试代码对Apple芯片环境的适配。对普通使用者来说,编译好的各平台二进制照旧发布,从macOS、Linux、Windows到Android、iOS都能按原来的方式下载。
真正受益的是在M2 Ultra机器上跑测试或做CI的开发者——此前因正则匹配不上而报错的测试流程,现在能正确识别该硬件的输出。
值得注意的是,KleidiAI的macOS Apple Silicon构建和openEuler构建仍标记为DISABLED。
llama.cpp发布b11256版本,发布说明显示的唯一变更是“tests:调整服务端字符串正则,使其也能匹配M2 Ultra的结果”(PR #29648)。
该版本照常提供各平台预编译包,覆盖macOS/iOS、Linux、Android、Windows和UI,具体包括macOS Apple Silicon(arm64)、macOS Intel(x64)、iOS XCFramework、Ubuntu x64/arm64/s390x(CPU)、Vulkan、CUDA 12.8与CUDA 13.4、ROCm 10.0、OpenVINO 2026.4、SYCL FP32/FP16、Snapdragon等构建。
本次发布包含哪些构建
根据发布页,b11256提供的下载包括:macOS Apple Silicon(arm64)、macOS Intel(x64)、iOS XCFramework;Ubuntu x64/arm64/s390x(CPU)、Ubuntu x64(Vulkan)、Ubuntu arm64(Vulkan);CUDA 12.8与CUDA 13.4的Ubuntu x64、arm64包及对应CUDA运行库;Ubuntu x64(ROCm 10.0)、Ubuntu x64(OpenVINO 2026.4)、Ubuntu x64(SYCL FP32/FP16)。
Windows侧提供x64/arm64(CPU)、arm64(OpenCL Adreno)、CUDA 12.4/13.4(含DLL)、Vulkan、OpenVINO 2026.4、SYCL、ROCm 10.0;Android提供arm64(CPU)和arm64(Snapdragon:CPU、Adreno GPU、Hexagon NPU),Snapdragon版本附有Linux和Android的安装指南链接。
此外还有独立UI包;Linux arm64(Snapdragon)同样提供CPU、Adreno GPU、Hexagon NPU版本。
仍被禁用与未提供的构建
发布页中,macOS Apple Silicon(arm64,启用KleidiAI)标记为DISABLED,并链接到PR #23780;openEuler条目同样标记为DISABLED,链接到PR #23705。
openEuler下此前列出的x86(310p)、x86(910b,ACL Graph)、aarch64(310p)、aarch64(910b,ACL Graph)在本版本中没有可下载链接。