llama.cpp b10828发布:新增Spark 2.5模型架构支持
llama.cpp发布b10828版本,新增对Spark2_5ForCausalLM模型实现的支持,并同步提供各平台预编译二进制下载。
AI解读:llama.cpp这次更新把Spark 3模型支持改名并整合为Spark 2.5,实际上是为腾讯的混元(Hunyuan)Spark 2.5系列模型铺路——这类模型原本难以用GGUF量化格式在本地运行,现在有了官方实现,开发者就能用llama.cpp在消费级硬件上加载和推理。对普通用户来说,影响是间接的:如果你在跑这类模型,升级到b10828就能获得官方支持;如果不用,这次更新没有修复或功能变化,可以暂缓升级。需要留意的是,macOS上默认的KleidiAI加速构建仍被禁用(见PR #23780),openEuler 310p/910b的构建也仍未提供,跑这些平台的人得自己编译或等后续版本。
llama.cpp于 2025 年发布b10828版本,核心变更为新增对Spark2_5ForCausalLM模型实现的支持(PR #27868),该实现最初以Spark 3模型命名,后更名为Spark 2.5,由Sigbjørn Skjæret和dongjiang共同提交。
同期发布的预编译二进制覆盖macOS(Apple Silicon与Intel x64)、iOS、Linux(Ubuntu x64/arm64/s390x CPU,x64/arm64 Vulkan,x64 ROCm、OpenVINO、SYCL)、Windows(x64/arm64 CPU、CUDA 12/13、Vulkan、OpenVINO、SYCL、ROCm)、Android(arm64 CPU)等平台。
模型支持与平台变更
新版本的核心工作集中在模型支持层面:通过PR #27868 加入了Spark2_5ForCausalLM的实现,为后续加载和运行Spark 2.5架构模型提供代码基础。
发布说明同时指出若干平台的构建状态:macOS Apple Silicon上启用了KleidiAI的版本仍被禁用(关联PR #23780),openEuler平台(x86 310p、910b ACL Graph、aarch64 310p与 910b)的构建同样处于DISABLED状态。
- macOS:Apple Silicon (arm64) 与Intel (x64) 提供下载;KleidiAI启用版被禁用。
- Linux:Ubuntu x64/arm64/s390x CPU、x64/arm64 Vulkan、x64 ROCm 10.0、OpenVINO、SYCL FP32/FP16等版本可下载。
- Windows:提供x64 CPU、arm64 CPU、arm64 OpenCL Adreno、x64 CUDA 12/13、arm64 CUDA 13 preview、Vulkan、OpenVINO、SYCL、ROCm等版本。
- Android:提供arm64 CPU版本。
- openEuler:各构建均被禁用。