 Taimur AhmadandGitHub
|
2b86e5cae6
|
ggml-cpu: fix fallback for RVV kernels without zvfh (#21157)
* ggml-cpu: refactor sgemm; fix rvv checks
* ggml-cpu: refactor rvv kernels; set zvfbfwma default to off
|
2026-04-01 11:10:03 +03:00 |
|
 Taimur AhmadandGitHub
|
054d8b0f24
|
ggml-cpu: fix RVV checks in quants and repacking (#20682)
* ggml-cpu: refactor quants.c; add rvv check
* ggml-cpu: refactor; disable generic fallback
|
2026-03-17 16:03:40 +02:00 |
|
 
|
af237f3026
|
ggml-cpu: add RVV repack GEMM and GEMV for quantization types (#19121)
* ggml-cpu: add rvv ggml_quantize_mat_4x8 for q8_0
Co-authored-by: Rehan Qasim <rehan.qasim@10xengineers.ai>
* ggml-cpu: add rvv repacking for iq4_nl
* ggml-cpu: add generic impl for iq4_nl gemm/gemv
* ggml-cpu: add rvv repacking for q8_0
* ggml-cpu: refactor; add rvv repacking for q4_0, q4_K
* ggml-cpu: refactor; add rvv repacking for q2_K
Co-authored-by: Rehan Qasim <rehan.qasim@10xengineers.ai>
* ggml-cpu: refactor rvv repack
---------
Co-authored-by: Rehan Qasim <rehan.qasim@10xengineers.ai>
|
2026-03-10 08:49:52 +02:00 |
|
 
|
b908baf182
|
ggml-cpu: add RVV vec dot kernels for quantization types (#18784)
* ggml-cpu: add rvv vec_dot for iq2_s
Co-authored-by: Rehan Qasim <rehan.qasim@10xengineers.ai>
* ggml-cpu: add rvv vec_dot for iq3_s
Co-authored-by: Rehan Qasim <rehan.qasim@10xengineers.ai>
* ggml-cpu: add rvv vec_dot for tq1_0, tq2_0
Co-authored-by: Rehan Qasim <rehan.qasim@10xengineers.ai>
ggml-cpu: add rvv vec_dot for tq1_0, tq2_0
* ggml-cpu: add rvv vec_dot for iq1_s, iq1_m
Co-authored-by: Rehan Qasim <rehan.qasim@10xengineers.ai>
* ggml-cpu: add vlen switch for rvv vec_dot
---------
Co-authored-by: Rehan Qasim <rehan.qasim@10xengineers.ai>
|
2026-02-20 13:30:07 +02:00 |
|
 
|
d34d5ca1e9
|
llamafile: add rvv support for sgemm kernels (#18199)
Co-authored-by: Rehan Qasim <rehan.qasim@10xengineers.ai>
|
2025-12-22 20:20:23 +02:00 |
|
 
|
f716588e63
|
ggml-cpu: extend support for RVV floating-point kernels (#17318)
* cmake: add BF16 RVV flag for ggml-cpu
* ggml-cpu: add floating-point conversion kernels
* ggml: add floating-point kernels
Co-authored-by: Rehan Qasim <rehan.qasim@10xengineers.ai>
* ggml-cpu: fix lmul in vec_dot_bf16
* ggml-cpu: change redsum to lmul 4, fix leftover
---------
Co-authored-by: Rehan Qasim <rehan.qasim@10xengineers.ai>
|
2025-12-18 16:02:09 +02:00 |
|