开源llama.cpp Releases·原文 2026年9月9日

llama.cpp发布b10869:优化测试数据初始化线程使用,更新各平台二进制

本次更新主要重构测试数据初始化逻辑,根据元素数量动态调整线程数以提高测试效率;同时提供覆盖macOS、Linux、Windows、Android等多平台的预编译二进制。

AI解读:这次llama.cpp的b10869版本更新比较常规,核心改动是测试代码的优化:数据初始化阶段改用更少的线程,并且会根据数据量动态调整,目的是让自动化测试跑得更快、更稳定。对普通用户来说,这个版本本身没有新增模型功能,但如果你在用llama.cpp跑本地大模型,可以关注配套发布的各平台二进制文件,它们通常包含最新的构建和修复。

有意思的是,官方同时停用了macOS上启用KleidiAI加速的构建以及openEuler的多个编译目标,理由是相关工程问题尚未解决。这意味着如果你依赖这些特定版本,可能需要暂时停留在旧版本,或者等待后续修复。除此之外,本次更新的实际影响有限,建议不需要立即升级,除非你正好遇到测试相关的问题。

llama.cpp项目发布b10869版本,主要变更集中在测试代码:将数据初始化阶段的线程数改为先使用 1 个线程,再根据数据元素数量进行扩展。该改动旨在减少多线程初始化对测试性能的干扰,相关提交(#28325)已合并。

该版本同时更新了各平台预编译二进制,覆盖macOS(Apple Silicon、Intel)、iOS XCFramework、Linux(Ubuntu多架构及Vulkan/ROCm/OpenVINO/SYCL后端)、Android arm64、Windows(CPU、Vulkan、OpenVINO、SYCL、CUDA 12/13等)以及独立的UI包。

测试改动详情

提交 #28325 对测试代码进行重构:初始时数据初始化使用单线程,之后根据待处理元素数量动态调整线程数。官方发布说明指出,此改动旨在优化测试运行时的资源占用,避免初始化阶段过度竞争线程。

内容还包含对相关调整的进一步修正(“cont : adjust”),但具体实现细节在发布说明中未展开。

构建变更与平台支持

在macOS端,Apple Silicon (arm64) 的KleidiAI启用构建被标记为“DISABLED”,并关联到工程问题 #23780。Linux的openEuler分支也因工程调整(#23705)暂时停止发布,包括x86 310p、910b(ACL Graph)以及aarch64 310p、910b的构建产物。

其余平台提供完整预编译包:Linux支持Ubuntu x64/arm64/s390x CPU、Vulkan、ROCm 10.0、OpenVINO 2026.3.1、SYCL(FP32/FP16);Windows提供x64/arm64 CPU、Vulkan、OpenVINO、SYCL、CUDA 12.4和 13.3(含DLL),以及arm64的CUDA 13(预览版);Android提供arm64 CPU;UI组件单独打包。

信息来源

llama.cpp Releases原始来源