llama.cpp b10885修复Granite全家桶参数量统计
Aaron Teo提交的PR #28643 修正llama.cpp中所有Granite系列模型的参数计数,同时补上活跃专家缺失的“A”前缀并删除无用的 40 块分支代码。
AI解读:这条更新很小但很实用:llama.cpp把Granite系列模型的参数量统计算错了,b10885版本把它修回来。影响的是所有需要看模型参数量的场景,比如命令行输出、UI展示,或者你按参数量挑模型、估显存的时候。
参数量算错本身不会让模型跑不起来,但会让展示和判断失真。对普通用户来说,不必为这次更新专门升级;如果你正在用Granite系列,或者依赖llama.cpp输出的参数信息做选择,那这次修复才有直接价值。
llama.cpp发布b10885版本,修复所有Granite系列模型的参数计数问题。该改动由Aaron Teo提交,对应PR #28643。
b10885具体改了什么
根据提交信息,此次改动包含三部分:修复所有Granite系列模型的参数计数;补充一个额外的include;为活跃专家(active experts)补上缺失的“A”前缀;修正代码对齐,并删除未使用的 40 块(40 block)分支代码。
提交由Aaron Teo署名(Signed-off-by: Aaron Teo)。发布页面同时列出了各平台的预编译二进制包下载链接,涵盖macOS、iOS、Linux、Android、Windows等平台与不同后端(CPU、Vulkan、CUDA、ROCm、SYCL、OpenVINO等)。
其中,macOS Apple Silicon(arm64、启用KleidiAI)版本标注为DISABLED,并链接到PR #23780;openEuler相关构建同样标注为DISABLED,链接到PR #23705。