llama.cpp b10834发布:ggml后端输入不再强制创建额外split
本次更新允许ggml后端输入不创建另一个split,并更新了各平台构建产物。
AI解读:llama.cpp的新版本b10834主要面向开发者,改动集中在ggml底层:允许后端输入省去一次额外的split操作。对普通用户来说,这意味着在Vulkan、CUDA等后端上运行的性能可能有小幅提升,因为它减少了计算图的拆分次数。从发布说明看,这是内部优化,没有引入新功能,也不会改变你已有的模型或使用方式。如果你是自建llama.cpp的用户,可以按需下载对应平台的二进制包,但如果没有遇到问题,不必急着升级。
llama.cpp发布b10834版本,主要变更为ggml允许后端输入不创建额外的split(PR #28387),并更新了各平台预编译二进制与UI包。
构建与下载
本次发布提供macOS(Apple Silicon arm64、Intel x64)、iOS XCFramework、Linux(Ubuntu x64/arm64/s390x CPU、Vulkan、ROCm 10.0、OpenVINO、SYCL FP32/FP16)、Android arm64 CPU、Windows(x64/arm64 CPU、CUDA 12.4/13.3/13.4、Vulkan、OpenVINO、SYCL、ROCm 10.0)等平台构建。
macOS Apple Silicon的KleidiAI版本标注为DISABLED;openEuler各构建同样标注为DISABLED,未提供可下载产物。UI包(llama-b10834-ui.tar.gz)一并发布。