This website requires JavaScript.
Explore
Help
Register
Sign In
marfrit
/
rk-llama.cpp
Watch
1
Star
0
Fork
0
You've already forked rk-llama.cpp
Code
Issues
Pull Requests
Actions
33
Packages
Projects
Releases
Wiki
Activity
Files
fde69a3607ff48b20bbb73e9a0059d5a142a5cf1
rk-llama.cpp
/
ggml
T
History
Masato Nakasaka
ef93e98d01
vulkan: Fix Windows performance regression on Intel GPU BF16 workloads for Xe2 and newer (
#22461
)
...
* refactor * Use l_warptile only when coopamt is available for BF16
2026-05-12 12:15:34 +02:00
..
cmake
ggml: backend-agnostic tensor parallelism (experimental) (
#19378
)
2026-04-09 16:42:19 +02:00
include
CUDA: lower-case PCI bus id, standardize for ggml (
#22820
)
2026-05-08 10:09:38 +02:00
src
vulkan: Fix Windows performance regression on Intel GPU BF16 workloads for Xe2 and newer (
#22461
)
2026-05-12 12:15:34 +02:00
.gitignore
…
CMakeLists.txt
ggml : bump version to 0.11.1 (ggml/1484)
2026-05-10 17:00:11 +03:00