开源llama.cpp Releases·原文 2026年9月12日

llama.cpp发布b10926,改进对不支持tq1_0量化格式的失败处理

llama.cpp新版本b10926由贡献者syscl提交的 #28681 改动,让程序在遇到不支持的tq1_0量化时优雅失败,而不是异常崩溃。

AI解读:这项更新的核心不是新模型能力,而是一个错误处理改动:当llama.cpp遇到它不支持的tq1_0量化格式时,会以可控方式失败,而不是让用户撞上难以理解的报错或崩溃。

受影响的首先是使用非标准或实验性量化格式跑模型的用户——尤其是从别处拿到tq1_0量化文件、直接扔给llama.cpp加载的人。改动只保证失败方式更友好,并不代表llama.cpp从此能运行tq1_0。

换句话说,别指望这次更新能把原本跑不了的模型跑起来。它的价值在于把“跑不通”这件事说清楚,省掉排查时间。

llama.cpp发布构建版本b10926,其中包含一项由贡献者syscl提交的改动(PR #28681):对不支持的tq1_0量化格式做优雅失败处理。

该版本随附macOS/iOS、Linux、Android与Windows的多平台预编译包,覆盖CPU、Vulkan、ROCm 10.0、OpenVINO、SYCL、CUDA 12.4/13.3/13.4等后端。

其中macOS Apple Silicon的KleidiAI启用版本以及openEuler相关构建在本次发布中标记为DISABLED。

b10926改了什么

发布说明中列出的改动标题为“Handle (fail gracefully) unsupported tq1_0 quants (#28681)”,作者为syscl。含义是:当llama.cpp碰到它不支持的tq1_0量化格式时,改为优雅失败,而不是以未处理的方式报错或崩溃。

发布说明没有给出该改动的更多技术细节,也没有说明具体报错文案或受影响版本范围。

  • 改动编号:PR #28681
  • 作者:syscl
  • 改动内容:对不支持的tq1_0量化做优雅失败处理
  • 发布版本:b10926

随附的构建产物

b10926提供覆盖多平台多后端的预编译包,用户可直接下载对应版本而无需自行编译。

  • macOS/iOS:Apple Silicon (arm64)、macOS Intel (x64)、iOS XCFramework;Apple Silicon的KleidiAI启用版标记为DISABLED
  • Linux:Ubuntu x64/arm64/s390x (CPU)、Vulkan (x64/arm64)、ROCm 10.0 (x64)、OpenVINO 2026.3.1 (x64)、SYCL FP32/FP16 (x64)
  • Android:arm64 (CPU)
  • Windows:x64/arm64 (CPU)、arm64 (OpenCL Adreno)、CUDA 12.4与 13.3 (x64)、CUDA 13.4 (arm64)、Vulkan、OpenVINO 2026.3.1、SYCL、ROCm 10.0
  • openEuler:相关构建在本次发布中标记为DISABLED
  • 另有独立UI包可供下载

信息来源

llama.cpp Releases原始来源