llama.cpp Releases· github-actions[bot]·2026-10-09 19:00· 3 小时前AI 评分12llama.cpp b11523 修复 WebGPU 后端 DUP 算子支持b11523AI 导读llama.cpp 发布 b11523,为 WebGPU 后端补上 GGML_OP_DUP 支持,修复混合批处理路径崩溃问题。来源:llama.cpp Releases · github.com微调与部署开源生态vLLM开源仓库#开源/仓库#推理引擎#本地部署#vLLM查看事件全部后续