 perserkandGitHub
|
02c5b27e91
|
Add AVX acceleration (#617)
* ggml : add AVX quantize_row_q4_0()
* ggml : add AVX ggml_vec_dot_q4_0()
* ggml : refactor AVX part of ggml_vec_dot_q4_0()
https://github.com/ggerganov/llama.cpp/pull/617#issuecomment-1489985645
|
2023-03-31 13:55:44 +02:00 |
|