llama.cpp b11298发布:新增mimo模型dflash转换与特征提取支持
llama.cpp发布b11298版本,合并PR #29650,为mimo模型增加dflash支持,覆盖转换与特征提取两个环节。
AI解读:这是一次很小的版本更新,但改动点很具体:llama.cpp在b11298中加了mimo模型的dflash支持,分转换和特征提取两步。
对已经在用llama.cpp跑mimo系模型的人来说,这决定了他们此前可能卡住的模型格式能否顺利转换并抽取特征。没有相关需求的人基本可以跳过这次更新。
来源只给了发布说明和提交标题,没有附带精度、速度或兼容性数据,因此这次支持的实际效果、覆盖的模型范围,目前都还没有可核实的公开信息。
llama.cpp发布b11298版本,该版本的改动为mimo模型新增dflash支持,涉及模型转换和特征提取两个环节,对应PR #29650。
提交信息显示,这次改动包含两部分:convert部分更新以支持dflash,随后有一处cont修复。提交由Sigbjørn Skjæret参与署名(官方发布说明以Co-authored-by形式列出)。
b11298同时提供常规的多平台预编译包。根据发布说明,可用平台包括macOS(Apple Silicon arm64、Intel x64)、iOS XCFramework、Ubuntu(x64与arm64的CPU版本,以及Vulkan、CUDA 12、CUDA 13、ROCm 10.0、OpenVINO、SYCL FP32/FP16版本)、Windows(x64与arm64的CPU版本,以及CUDA、Vulkan、OpenVINO、SYCL、ROCm等版本)、Android arm64,以及Linux arm64的Snapdragon版本(支持CPU、Adreno GPU、Hexagon NPU)。
发布说明还列出部分被禁用的构建项:macOS Apple Silicon的KleidiAI启用版本处于DISABLED状态,指向PR #23780;openEuler的构建项同样标注为DISABLED,指向PR #23705。