github ggml-org/llama.cpp b10408

2 hours ago
Details

sycl : Add DMMV ESIMD Q3_K kernel (#26251)

  • Add DMMV Q4_K and Q6_K ESIMD kernels

Configure cmake build with -DGGML_SYCL_ESIMD=ON to enable.

Signed-off-by: Todd Malsbary todd.malsbary@intel.com

  • Refactor ESIMD kernels to share common code

Signed-off-by: Todd Malsbary todd.malsbary@intel.com

  • Move control of ESIMD from compile to runtime

Signed-off-by: Todd Malsbary todd.malsbary@intel.com

  • Use ESIMD by default when available

Signed-off-by: Todd Malsbary todd.malsbary@intel.com

  • Fix possible error when using ESIMD by default

While not an issue in the current version, this will become an
issue when additional QK ESIMD kernels are added (such as Q2_K).

Signed-off-by: Todd Malsbary todd.malsbary@intel.com

  • Add explicit unroll to ESIMD kernels

Signed-off-by: Todd Malsbary todd.malsbary@intel.com

  • Tidy up ESIMD kernels a bit

Signed-off-by: Todd Malsbary todd.malsbary@intel.com

  • Add DMMV Q3_K ESIMD kernel

Signed-off-by: Todd Malsbary todd.malsbary@intel.com


Signed-off-by: Todd Malsbary todd.malsbary@intel.com

Website:

macOS/iOS:

Linux:

Android:

Windows:

openEuler:

  • DISABLED
  • openEuler x86 (310p)
  • openEuler x86 (910b, ACL Graph)
  • openEuler aarch64 (310p)
  • openEuler aarch64 (910b, ACL Graph)

UI:

Don't miss a new llama.cpp release

NewReleases is sending notifications on new releases.