开源llama.cpp Releases·2026年9月5日

llama.cpp b10784发布:修复Metal后端GLU调度在ne00=1 时的错误

llama.cpp发布b10784版本,修复Metal后端在ne00=1 条件下的GLU调度问题,并同步提供多平台预编译二进制。

AI解读:这次llama.cpp的b10784更新直接针对Mac和iPhone用户:当模型某些张量的形状特殊(ne00=1)时,GPU上的GLU激活函数调度会出错,可能导致模型运行错误或结果不对。修复限制在特定边界情况,并禁用了少数定义不清的测试,避免掩盖真实问题。如果你没有遇到相关报错,无需升级;但如果你是Mac/iOS上的本地大模型用户或开发者,建议更新以获得更稳定的GPU推理。

llama.cpp项目发布b10784版本,核心修复是Metal后端中GLU调度在ne00=1 条件下的错误(PR #28306),并禁用了一些定义不清的测试。

修复内容与变更

该版本包含两个主要变更:一是修复Metal后端中GLU调度在ne00=1 时的错误;二是在测试中禁用部分定义不清的测试用例。

  • Metal后端修复GLU dispatch在ne00=1 时的错误(#28306)
  • 测试:禁用ill-defined测试

平台支持与构建状态

本次发布提供了多平台预编译二进制,但部分平台构建状态有调整。macOS Apple Silicon的KleidiAI构建被标记为DISABLED,openEuler的构建也被禁用,具体原因可参考相关PR。

支持的平台包括macOS(Apple Silicon、Intel)、iOS(XCFramework)、Linux(Ubuntu x64/arm64/s390x,支持CPU、Vulkan、ROCm、OpenVINO、SYCL等)、Android(arm64 CPU)以及Windows(x64/arm64,支持CPU、CUDA 12.4/13.3/13.4、Vulkan、OpenVINO等)。此外还提供了UI组件包。

  • macOS Apple Silicon (arm64) 构建提供
  • KleidiAI enabled构建被禁用(#23780)
  • macOS Intel (x64)、iOS XCFramework可用
  • Linux Ubuntu支持GPU后端:Vulkan、ROCm 10.0、OpenVINO 2026.3.1、SYCL FP32/FP16
  • Windows支持CUDA 12.4/13.3/13.4,其中arm64 CUDA为预览版
  • openEuler构建禁用(#23705)

信息来源

llama.cpp Releases原始来源