开源llama.cpp Releases·原文 2026年9月6日

llama.cpp b10821发布:为M2 Max补充剩余fa-vec调优,新增KleidiAI禁用链接等构建

llama.cpp发布b10821,主要改动是为Apple M2 Max芯片的Metal后端补全剩余的fa-vec调优(PR #28458),并同步更新多平台二进制与安装包。

AI解读:这次更新针对的是llama.cpp在Apple M2 Max芯片上的运行性能。维护者通过PR #28458 为Metal后端添加了剩余的fa-vec调优,这类优化通常用于调整矩阵或向量运算的底层实现,目标是让模型推理在特定硬件上跑得更快。如果你正好用M2 Max的Mac跑llama.cpp,这次更新可能带来实际的速度提升,具体幅度要看模型和推理任务,官方没有给出基准数据。另外,这次发布把多个平台的预编译包都刷新了,包括macOS、iOS、Linux、Windows、Android等,并新增了标记为DISABLED的KleidiAI构建链接和独立的openEuler链接,方便不同环境的用户直接下载。如果你用其他芯片或日常只是通过包管理器更新,这次不需要特别操作,等上游版本合并即可。

llama.cpp发布b10821版本,核心改动是为Apple M2 Max芯片的Metal后端添加剩余的fa-vec调优(提交 #28458)。本次更新同步发布了覆盖macOS、iOS、Linux、Windows、Android等平台的预编译二进制文件。

信息来源

llama.cpp Releases原始来源