开源llama.cpp Releases·原文 2026年9月29日

llama.cpp将CI的oneAPI工具链升级到 2026.1,SYCL版测试提示处理提速约 3.1 倍

llama.cpp发布b11243版本,CI和发布工作流从oneAPI 2025.3.3迁移到 2026.1 统一工具包,Level Zero SDK同步升级到 1.33.1;发布说明中给出的同代码对比显示Arc B570上提示处理从 434 t/s升到 1331 t/s。

AI解读:这次改动的直接原因是工具包打包方式变了:oneDNN从Intel Deep Learning Essentials中移除,如果CI还留在deep-learning-essentials路径上,升级工具包版本时会静默失去oneDNN支持。所以llama.cpp把Ubuntu和Windows的CI任务都切到新的统一Intel oneAPI Toolkit安装器。

按发布说明的测量,同一份代码b10899分别用oneAPI 2026.1和基于 2025.3 的发布版构建,在Arc B570上提示处理从 434 t/s升到 1331 t/s,约 3.1 倍;token生成从 45.3 到 48.0 t/s升到 50.1 t/s。

对使用SYCL后端、在Intel GPU上跑llama.cpp的人,这属于构建工具链的一次换代:文档要求、发布包依赖和Windows运行时DLL都跟着变了。普通CPU、CUDA、Vulkan用户不受这次改动影响,不必立即行动。

限制也要看清:3.1 倍来自一次在Arc B570上的对比测量,发布说明只给出这一个硬件和一份代码编号,不能直接外推到其他Intel显卡或其他模型。同时一个工具包版本只保证oneDNN支持到 2027.0。

llama.cpp发布b11243版本,其中包含一次CI与发布工作流的工具链升级:从oneAPI 2025.3.3迁移到统一的oneAPI Toolkit 2026.1,Level Zero SDK从 1.28.2 升到 1.33.1。

发布说明解释原因:oneDNN在Intel Deep Learning Essentials 2026.0中被移除,如果继续走deep-learning-essentials路径,升级工具包版本时会静默失去oneDNN支持。因此Ubuntu和Windows两个CI任务改用新的统一Intel oneAPI Toolkit安装器;该安装器仍包含oneDNN,直到 2027.0,Windows安装脚本的组件ID保持不变。

同一份代码(b10899)分别用oneAPI 2026.1和基于 2025.3 的发布版构建,在Arc B570上的测量结果:提示处理 1331 对 434 t/s(3.1 倍),token生成 50.1 对 45.3–48.0 t/s。

文档方面,SYCL后端构建要求已按oneAPI 2026.1更新:2026.0 起Base toolkit和HPC toolkit合并为oneAPI Toolkit,oneDNN从Deep Learning Essentials包中移除,安装说明、已验证版本表和新闻段落同步修改。

发布工作流同步调整:oneAPI工具包 2025.3.3 升到 2026.1,Level Zero SDK 1.28.2升到 1.33.1,Debian包名从level-zero/level-zero-devel改为libze1/libze-dev;Windows DLL复制列表对应 2026.1 运行时改为sycl9.dll和 .6/.3 版本的MKL库。

另一个修复是移除Windows DLL复制列表里已不存在的 .spv回退文件:oneAPI 2026.1不再提供libsycl-fallback-bfloat16.spv和libsycl-native-bfloat16.spv(OpenCL回退机制改变),此前复制步骤会以退出码 1 失败。此外Intel Dockerfile中的oneAPI工具包镜像也已更新。

信息来源

llama.cpp Releases原始来源