This website requires JavaScript.
Explore
Help
Register
Sign In
wylab
/
llama.cpp-rocm
Watch
1
Star
0
Fork
0
forked from
wylab/llama.cpp
Code
Pull Requests
Actions
27
Packages
Activity
Files
a976ff081b4657b67f48295bbefc030d9d899b17
llama.cpp-rocm
/
docs
/
ops
T
History
Neo Zhang
and
GitHub
213c4a0b81
[SYCL] supprt Flash Attention for fp32/fp16/Q4/Q5/Q8 (
#20190
)
...
* support flash-attention for fp32/fp16/Q4/Q5/Q8 * rm warining * update for JIT
2026-03-08 12:00:07 +08:00
..
BLAS.csv
docs(ggml): update backend ops (
#18734
)
2026-01-10 18:48:17 +08:00
CANN.csv
docs : update ops.md for CANN backend (
#18654
)
2026-01-16 13:32:17 +01:00
CPU.csv
docs : update cpu and cuda ops (
#17890
)
2025-12-09 23:31:29 +01:00
CUDA.csv
docs : update cpu and cuda ops (
#17890
)
2025-12-09 23:31:29 +01:00
Metal.csv
metal : add count_equal op (
#18314
)
2025-12-31 10:39:48 +02:00
OpenCL.csv
docs : update opencl ops (
#17904
)
2025-12-10 15:20:00 +01:00
SYCL.csv
[SYCL] supprt Flash Attention for fp32/fp16/Q4/Q5/Q8 (
#20190
)
2026-03-08 12:00:07 +08:00
Vulkan.csv
ops.md: update vulkan support (
#17661
)
2025-12-01 15:26:21 -06:00
WebGPU.csv
Add concat op to webgpu. (
#20068
)
2026-03-04 11:19:00 -08:00
zDNN.csv
docs(ggml): update backend ops (
#18734
)
2026-01-10 18:48:17 +08:00
ZenDNN.csv
ggml-zendnn : add ZenDNN backend for AMD CPUs (
#17690
)
2025-12-07 00:13:33 +08:00