开源llama.cpp Releases·2026年9月5日

llama.cpp b10797发布:修复s390x架构q5_1量化内核未初始化变量问题

llama.cpp发布b10797版本,修复了ggml-cpu(s390x) 上q5_1量化中未初始化v_acc的问题,并同步提供各平台预编译二进制。

AI解读:本次llama.cpp b10797属于一次常规修复版本,核心动作是修正ggml-cpu在IBM s390x架构上执行q5_1量化时一个未初始化变量v_acc的问题。这类bug通常源于内核代码在特定硬件路径下没有正确初始化累加器,可能导致输出结果不确定甚至错误。对普通用户而言,如果不在s390x环境运行,这次更新没有行为变化,不需要立即升级;但如果你在大型机或s390x服务器上部署llama.cpp并使用了q5_1量化模型,建议升级到b10797以消除潜在计算结果不一致的风险。该版本还随附了从macOS、Linux(含x64/arm64/s390x、Vulkan、ROCm、OpenVINO、SYCL)到Windows(含CPU、CUDA、Vulkan等)和Android的预编译包,方便不同环境用户直接替换。

llama.cpp项目于 2025 年发布b10797版本,修复了ggml-cpu在s390x架构上的q5_1量化实现中未初始化v_acc的问题(PR #28332,提交者Aaron Teo)。该版本同步提供了macOS、Linux、Windows、Android及iOS的预编译二进制文件,涵盖CPU、Vulkan、CUDA、ROCm、OpenVINO、SYCL和OpenCL等后端。

信息来源

llama.cpp Releases原始来源