Logo
Explore Help
Register Sign In
marfrit/rk-llama.cpp
1
0
Fork 0
You've already forked rk-llama.cpp
Code Issues Pull Requests Actions 31 Packages Projects Releases Wiki Activity
Files
59db9a357d9a247009c70fda34050661b17a1a5c
rk-llama.cpp/gguf-py/gguf
T
History
Xuan-Son Nguyen 59db9a357d llama: dynamic head_dim and n_rot for SWA (#20301)
* llama: dynamic head_dim and n_rot for SWA

* also add gguf_writer wrappers

* fix build

* build_rope_shift arg reorder
2026-03-09 22:22:39 +01:00
..
scripts
gguf-py : fix passing non-native endian tensors (editor-gui and new-metadata) (#17553)
2025-11-28 20:53:01 +01:00
__init__.py
convert-*.py: GGUF Naming Convention Refactor and Metadata Override Refactor (#7499)
2024-07-18 20:40:15 +10:00
constants.py
llama: dynamic head_dim and n_rot for SWA (#20301)
2026-03-09 22:22:39 +01:00
gguf_reader.py
ggml/gguf : prevent integer overflows (#19856)
2026-02-24 20:17:11 +02:00
gguf_writer.py
llama: dynamic head_dim and n_rot for SWA (#20301)
2026-03-09 22:22:39 +01:00
gguf.py
…
lazy.py
convert : handle compressed-tensors quant method (#17069)
2025-11-09 09:45:50 -05:00
metadata.py
chore : correct typos [no ci] (#20041)
2026-03-05 08:50:21 +01:00
py.typed
…
quants.py
gguf-py : add Numpy MXFP4 de/quantization support (#15111)
2025-08-08 17:48:26 -04:00
tensor_mapping.py
llama: Add option to merge gate and exp weights (#19139)
2026-02-26 21:01:08 +08:00
utility.py
gguf-py : do not align the data start offset (#18291)
2025-12-22 20:25:16 +01:00
vocab.py
convert : support latest mistral-common (fix conversion with --mistral-format) (#17712)
2025-12-03 21:15:04 +01:00
Powered by Gitea Version: 1.26.2 Page: 1694ms Template: 7ms
GitHub Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API