github ggml-org/llama.cpp b11559

pre-releaseone hour ago
Details

opencl: improve fa, allow dk512 for gemma-4, improve dk64 (#30266)

  • opencl: enable Gemma-4 E4B GPU decode

Co-authored-by: Hongqiang Wang wangh@qti.qualcomm.com

  • opencl: extend Gemma-4 GPU decode to E2B

Co-authored-by: Hongqiang Wang wangh@qti.qualcomm.com

  • opencl: optimize DK64 GQA8 decode

Co-authored-by: Hongqiang Wang wangh@qti.qualcomm.com

  • opencl: optimize DK128 GQA4 decode

Co-authored-by: Hongqiang Wang wangh@qti.qualcomm.com


Co-authored-by: Hongqiang Wang wangh@qti.qualcomm.com

Website:

Attestations:

macOS/iOS:

Linux:

Android:

Windows:

openEuler:

  • DISABLED
  • openEuler x86 (310p)
  • openEuler x86 (910b, ACL Graph)
  • openEuler aarch64 (310p)
  • openEuler aarch64 (910b, ACL Graph)

UI:

Don't miss a new llama.cpp release

NewReleases is sending notifications on new releases.