llama.cpp b10842发布:ggml新增gfx90c HIP支持
新版本为ggml添加面向AMD gfx90c平台的HIP后端并使其符合规范,同时更新了多个平台的预编译二进制。
AI解读:新版llama.cpp的核心变化是给ggml计算内核补上了AMD gfx90c架构的HIP支持,并把这部分实现调整为符合HIP编程规范。gfx90c常见于AMD的笔记本APU,比如部分Ryzen系列内置显卡。此前这类核显用户跑llama.cpp要么依赖CPU推理,要么走Vulkan或OpenCL,性能和兼容性不一定理想。这次后端补齐后,使用该架构的AMD笔记本用户理论上可以直接用HIP路径做GPU加速,让本地大模型推理的启动门槛降低一些。需要注意,发布说明仅提到新增和规范合规,没有给出任何性能对比数据,所以实际能提速多少还无法量化。普通用户如果不清楚自己的APU是否属于gfx90c或并不依赖HIP,本次更新没有立即行动的必要;真正相关的是在AMD核显设备上跑llama.cpp的开发者或进阶用户,他们可以尝试新的HIP后端,验证兼容性和编译时是否顺畅。
llama.cpp发布b10842版本,主要变更为ggml增加gfx90c HIP支持并提出该支持符合规范(PR #26454)。
gfx90c HIP支持
本次发布包含两项提交:为ggml添加gfx90c HIP支持,以及使该支持符合规范。
预编译二进制更新
该版本同步提供了多个平台的预编译二进制:
- macOS:Apple Silicon(arm64)构建;Apple Silicon KleidiAI版本被禁用(相关PR #23780);另有Intel x64和iOS XCFramework。
- Linux:Ubuntu的x64、arm64、s390x CPU版;x64和arm64的Vulkan版;x64的ROCm 10.0、OpenVINO 2026.3.1、SYCL FP32/FP16版。
- Windows:x64和arm64的CPU版;arm64的OpenCL Adreno版;x64的CUDA 12.4和CUDA 13.3版(含对应DLL);arm64的CUDA 13.4预览版(含DLL);以及x64的Vulkan、OpenVINO、SYCL、ROCm 10.0版。
- Android:arm64 CPU版。
- openEuler版本被禁用(相关PR #23705),涉及x86和aarch64的 310p及 910b (ACL Graph) 支持。
- 另有独立的UI包(llama-b10842-ui.tar.gz)。