 Engininja2andGitHub
|
d233b507cd
|
cuda : add half2 __shfl_xor() for ROCm 5.5 (#7263)
|
2024-05-18 10:05:17 +02:00 |
|
 Engininja2andGitHub
|
ef277de2ad
|
cmake : fix typo in AMDGPU_TARGETS (#7356)
|
2024-05-18 02:39:25 +02:00 |
|
 Engininja2andGitHub
|
c24a2a6e60
|
cuda : replace remaining shfl_xor with calls to warp_reduce functions (#5744)
|
2024-02-27 14:22:45 +01:00 |
|
 Engininja2andGitHub
|
1f30b7a9f1
|
ggml-quants : fix avx2 iq1_s vec_dot when compiled with gcc (#5742)
|
2024-02-27 14:50:18 +02:00 |
|
 Engininja2andGitHub
|
cd4fddb29f
|
cuda : fix 2-bit quants on amd hip (#5105)
* cuda : fix 2-bit quants on amd hip
* use __low2float intrinsic function for new quants
|
2024-01-24 23:18:15 +01:00 |
|
 Engininja2andGitHub
|
7e50d34be6
|
cmake : fix building shared libs for clang (rocm) on windows (#3176)
|
2023-09-15 15:24:30 +03:00 |
|
 Engininja2andGitHub
|
f04d002844
|
cuda : vsubss4 for older versions of ROCm/clang (#2942)
|
2023-09-01 23:33:19 +02:00 |
|