github ggml-org/llama.cpp b9129

latest releases: b10502, b10499, b10488...
3 months ago
Details

ggml-zendnn : adaptive fallback to CPU backend for small batch sizes (#22681)

  • ggml-zendnn : add runtime env var GGML_ZENDNN_ADAPTIVE_FALLBACK to control adaptive fallback (default: enabled)

  • ggml-zendnn : restore original fallback logic when adaptive fallback is disabled

macOS/iOS:

Linux:

Android:

Windows:

openEuler:

Don't miss a new llama.cpp release

NewReleases is sending notifications on new releases.