开源llama.cpp Releases·原文 2026年9月12日

llama.cpp发布b10919:ggml-webgpu升级到新版Dawn

llama.cpp的b10919版本更新了ggml-webgpu后端所依赖的Dawn版本,并同步提供macOS、Linux、Windows、Android等多平台预编译包。

AI解读:这次更新最核心的一点是ggml-webgpu后端跟上了新版Dawn。WebGPU是让llama.cpp能通过浏览器/系统图形接口调用GPU的一条路径,Dawn是Google主导的WebGPU实现,后端依赖它的版本越新,越容易兼容新驱动和修复。

改动的范围看起来很小:主PR标题只写了升级Dawn,附带说明里还提到“不做模块扫描”和按review建议改注释,作者是Masashi Yoshimura。没有更多性能数据或行为说明。

普通用户不需要为此做什么。真正相关的是在WebGPU路径上跑推理、或者自己从源码构建ggml-webgpu后端的人。预编译包方面,注意macOS Apple Silicon的KleidiAI版本仍标记为DISABLED,openEuler相关构建也处于DISABLED状态。

llama.cpp发布b10919版本,主要改动为ggml-webgpu后端更新到较新版本的Dawn(PR #28683)。该PR由Masashi Yoshimura参与合入,提交信息还注明“不做模块扫描(No module scanning)”,并按review建议更新了注释。

多平台预编译包同步更新

b10919随版本发布了各平台的预编译二进制:macOS提供Apple Silicon(arm64)与Intel(x64)版本以及iOS XCFramework;Linux提供Ubuntu x64、arm64、s390x的CPU版,Ubuntu x64/arm64的Vulkan版,Ubuntu x64的ROCm 10.0、OpenVINO 2026.3.1、SYCL FP32与SYCL FP16版;Android提供arm64(CPU)版。

Windows侧提供x64与arm64的CPU版、arm64的OpenCL Adreno版,以及x64的CUDA 12(含CUDA 12.4 DLL)、CUDA 13.3、Vulkan、OpenVINO 2026.3.1、SYCL、ROCm 10.0,另有arm64的CUDA 13.4版与对应DLL。此外还有独立的UI包。

  • macOS Apple Silicon(arm64,启用KleidiAI)的构建仍标记为DISABLED,指向PR #23780
  • openEuler相关构建(x86/aarch64的 310p、910b ACL Graph等)标记为DISABLED,指向PR #23705

信息来源

llama.cpp Releases原始来源