llama.cpp b11234修复WebGPU后端张量非对齐写入
该版本只包含一个功能性改动:让ggml_backend_webgpu_buffer_set_tensor能处理非对齐写入,并附带了各平台预编译包。
AI解读:这次发布的核心只有一件事:WebGPU后端的张量写入函数以前假定数据是对齐的,现在能处理非对齐的情况。
对齐问题通常不会在正常加载时暴露,但一旦有偏移的数据块走这条路径,就可能写错或直接失败。修复后,走WebGPU后端在浏览器或原生环境里跑模型时,这类写入的兼容性会好一些。
对普通用户,这次更新没有新功能可玩;真正相关的是用WebGPU后端做推理或二次开发的人,以及需要重新拉取对应平台预编译包的人。
llama.cpp发布b11234构建版本,功能性改动是一项WebGPU后端的修复。
根据发布说明,该版本处理了ggml_backend_webgpu_buffer_set_tensor中的非对齐写入问题,对应PR #29471;提交信息还提到随后做了Clang格式化。
发布页同时列出了macOS/iOS、Linux、Android、Windows、openEuler以及UI的预编译产物链接。其中macOS Apple Silicon的KleidiAI启用版本标注为DISABLED,openEuler相关构建同样标注为DISABLED。