llama.cpp发布b10764:清理CUDA未用变量,同步更新各平台预编译包
新版本主要包含一项ggml-cuda代码清理改动,同时为macOS、Linux、Windows、Android等平台提供预编译产物。
AI解读:这次发布的核心是一次代码清理,不影响功能:开发者Adrien Gallouët移除了ggml-cuda里未使用的变量,属于常规维护,降低代码噪音。对普通用户而言,真正有用的是同步更新的安装包——如果你在用llama.cpp跑本地大模型,且当前版本遇到小问题或想跟进最新代码,可以按平台下载b10764的预编译二进制;如果现有版本稳定,这次更新没有必须升级的理由。注意两点:macOS Apple Silicon的KleidiAI加速版本仍然禁用,openEuler的Ascend相关构建也处于禁用状态,相关用户需继续使用旧版或自行编译。
llama.cpp发布b10764版本。本次更新主要包含一项ggml-cuda代码清理改动:移除未使用的变量(pull request #28235,由Adrien Gallouët提交)。同步发布的还有适用于多个平台和硬件的预编译二进制。
平台与硬件支持范围
新版本为以下平台提供预编译产物:macOS(Apple Silicon arm64、Intel x64)、iOS(XCFramework)、Linux(Ubuntu的x64/arm64/s390x CPU版、Vulkan、ROCm 7.14、OpenVINO 2026.3.1、SYCL FP32/FP16)、Android(arm64 CPU)、Windows(x64/arm64 CPU、OpenCL Adreno、CUDA 12.4/13.3/13.4、Vulkan、OpenVINO、SYCL、ROCm 7.14)。
另有独立的UI压缩包发布。
- macOS Apple Silicon的KleidiAI加速版本标注为DISABLED(关联pull request #23780)。
- openEuler平台的Ascend相关构建(310p、910b ACL Graph)同样标注为DISABLED(关联pull request #23705)。