llama.cpp b10936发布:改进qwen3-coder复杂类型解析
llama.cpp新构建b10936的聊天功能改进了qwen3-coder的复杂类型解析,增强了qwen3解析器的schema支持并清理了语法。
AI解读:如果你用llama.cpp跑qwen3-coder并依赖结构化输出(比如JSON schema),这次改动可能直接影响解析成功率。
改动同时涉及qwen3解析器的schema支持和语法清理,但发布说明没有给出具体效果数据。
同步放出的多平台二进制覆盖macOS、Linux、Windows、Android以及多种GPU后端,方便直接用现成包升级。
这次更新的实际影响,只有真正用qwen3-coder做工具调用或结构化生成的人能马上感受到。普通用户暂时不必行动。
llama.cpp发布了b10936构建,提交说明为“chat:改进qwen3-coder中复杂类型的解析(#28742)”。
该提交包含两项子改动:改进qwen3解析器中的schema支持,以及对语法做了一些清理。
发布页同时列出了macOS/iOS、Linux、Android、Windows和openEuler等平台的预编译产物,以及UI包。
b10936改了什么
根据llama.cpp Releases页面,b10936的主要变更是chat模块对qwen3-coder复杂类型的解析改进,对应拉取请求 #28742。
提交说明列出两项内容:一是“improve schema support in qwen3 parser”,即改进qwen3解析器中的schema支持;二是“clean up grammar a bit”,对语法做少量清理。
- 提交标题:chat : improve parsing of complex types in qwen3-coder (#28742)
- 子项一:chat : improve schema support in qwen3 parser
- 子项二:cont : clean up grammar a bit
随构建提供的平台产物
发布页列出了各平台下载链接,涵盖macOS Apple Silicon(arm64)和Intel(x64)、iOS XCFramework、Ubuntu x64/arm64/s390x(CPU)以及Ubuntu Vulkan、ROCm 10.0、OpenVINO、SYCL FP32/FP16等变体。
Windows侧提供x64/arm64 CPU、CUDA 12.4与 13.3/13.4、Vulkan、OpenVINO、SYCL、ROCm 10.0以及OpenCL Adreno(arm64)等构建;Android提供arm64 CPU包。
- macOS Apple Silicon(arm64,KleidiAI启用版标记为DISABLED)
- iOS XCFramework
- Ubuntu x64 / arm64 / s390x(CPU),以及Vulkan、ROCm 10.0、OpenVINO 2026.3.1、SYCL FP32/FP16
- Windows x64 CPU、arm64 CPU、OpenCL Adreno arm64、CUDA 12.4/13.3/13.4、Vulkan、OpenVINO、SYCL、ROCm 10.0
- Android arm64(CPU)
- UI包