开源项目
llama.cpp修复Adreno A6X后端编译崩溃,恢复OpenCL部署路径
llama.cpp b11533
概述
llama.cpp的OpenCL后端为部分移动和边缘GPU提供本地推理路径。b11533针对A6X编译器限制修复部署失败:在带Adreno 623的设备上,编译器无法处理参数过多的kernel,因此跳过kernel_cpy_f32_f32_pack;同时为GEMV kernel中get_local_size的常量折叠增加规避逻辑,并把Adreno 623纳入A6X识别。 本次价值在于减少该设备族的shader编译崩溃,使原本被编译阶段阻断的推理路径能够继续运行。记录按版本发布而非单个提交计数,不与同日其它后端变化机械合并。使用者需选择相应OpenCL构建,并在实际设备上确认编译和推理行为;发布说明没有提供通用性能数字或覆盖全部Adreno型号的兼容结论。