github ggml-org/llama.cpp b10693

latest release: b10694
pre-releaseone hour ago
Details

hexagon: support for device discovery and create sessions on demand (#27785)

  • hex-devices: add support for lazy session allocation and cleanup dev interfaces

Co-authored-by: Marco Colombo mcolombo@qti.qualcomm.com

  • hex-devices: support for runtime discovery of available NPU cores

Co-authored-by: Alexander Lu alexlu@qti.qualcomm.com
Co-authored-by: Ehsan Bateni ebateni@qti.qualcomm.com

  • hex-devices: reject non-existing devices early during init

Co-authored-by: Marco Colombo mcolombo@qti.qualcomm.com
Co-authored-by: Alexander Lu alexlu@qti.qualcomm.com
Co-authored-by: Ehsan Bateni ebateni@qti.qualcomm.com

Website:

Attestations:

macOS/iOS:

Linux:

Android:

Windows:

openEuler:

  • DISABLED
  • openEuler x86 (310p)
  • openEuler x86 (910b, ACL Graph)
  • openEuler aarch64 (310p)
  • openEuler aarch64 (910b, ACL Graph)

UI:

Don't miss a new llama.cpp release

NewReleases is sending notifications on new releases.