llama.cpp发布b10733:升级CI缓存并更新各平台预编译包
最新版本将ggml-org/ccache-action升级到v1.2.24,同时更新了macOS、Linux、Windows等平台的预编译二进制文件,但openEuler和KleidiAI构建仍处于禁用状态。
AI解读:llama.cpp本次发版的核心是持续集成(CI)依赖的例行升级——把ccache-action从旧版本提升到v1.2.24,目的是加速编译缓存、减少重复构建耗时,对最终用户没有直接影响。真正的变化在于预编译包的同步更新:如果你依赖官方发布的二进制文件(比如Windows的CUDA 12.4/13.3版本、Ubuntu的Vulkan/ROCm 7.14包),可以直接下载b10733对应版本使用,无需自己从源码编译。但需要注意,两个此前有问题的构建仍被禁用:macOS Apple Silicon的KleidiAI优化版本(相关PR #23780)和openEuler的多个包(PR #23705),这意味着使用这些环境的用户要么等待未来版本修复,要么自行编译或选择其他后端。对于普通用户,这次更新不需要任何操作;对于维护自定义部署的开发者,建议核对自己使用的平台包是否在本次发布列表中,并留意后续版本是否恢复被禁用的构建。
llama.cpp发布b10733版本。该版本由GitHub Actions自动发布,主要变更记录为将CI依赖ggml-org/ccache-action升级至v1.2.24(PR #28083),未包含模型推理功能的代码更新。
各平台预编译包更新
新版本同步发布了各平台的预编译二进制文件:macOS提供Apple Silicon (arm64) 和Intel (x64) 版本,以及iOS XCFramework;Linux提供Ubuntu的x64、arm64、s390x CPU包,以及Vulkan、ROCm 7.14、OpenVINO 2026.3.1、SYCL FP32/FP16等后端版本;Windows提供x64/arm64 CPU包、Vulkan、OpenVINO、SYCL、ROCm 7.14,以及CUDA 12.4和CUDA 13.3版本,并附有对应的CUDA DLL文件;另有Windows arm64 CUDA 13.4预览版。Android提供arm64 CPU包。
部分构建仍被禁用
本次发布中,以下构建继续处于禁用状态:macOS Apple Silicon (arm64) 的KleidiAI启用版本(关联PR #23780),以及openEuler的多个构建,包括x86 (310p)、x86 (910b, ACL Graph)、aarch64 (310p)、aarch64 (910b, ACL Graph)。UI组件包(llama-b10733-ui.tar.gz)也随版本发布。