开源llama.cpp Releases·原文 2026年9月28日

llama.cpp发布b11225:为回滚、保存加载与分片状态恢复测试补上ggml初始化

该版本的核心改动是修复ggml初始化问题,覆盖test-recurrent-state-rollback、test-save-load-state和test-state-restore-fragmented三个测试;多平台预编译包同步发布。

llama.cpp发布b11225,主要改动是修复测试中的ggml初始化问题,对应PR #29554。

改动内容包括:为test-recurrent-state-rollback初始化ggml;对test-save-load-state做同样处理;并为test-state-restore-fragmented补充初始化,同时留下TODO。

该版本同步发布各平台预编译包:macOS Apple Silicon(arm64)、macOS Intel(x64)、iOS XCFramework;Ubuntu x64/arm64/s390x CPU、Vulkan、CUDA 12.8、CUDA 13.4、ROCm 10.0、OpenVINO、SYCL FP32/FP16;Linux arm64 Snapdragon(CPU、Adreno GPU、Hexagon NPU);Android arm64(CPU及Snapdragon版本);Windows x64/arm64的CPU、OpenCL Adreno、CUDA 12.4、CUDA 13.4、Vulkan、OpenVINO、SYCL、ROCm 10.0;以及UI包。

其中macOS Apple Silicon的KleidiAI版本处于DISABLED状态,openEuler平台整体也标记为DISABLED。

这些测试针对的是循环状态回滚、状态保存与加载、分片状态恢复三块功能,本次修复只涉及测试侧的ggml初始化,未说明对运行时行为有其他更改。

信息来源

llama.cpp Releases原始来源