c121428c58
- llm-proxy.py v4: aggregator with classify/compress endpoints, gemma4 backend - classifier-server.py: Llama 3.2 1B query complexity classifier - compress-server.py: token-budget compression middleware - start-proxy.sh / start.sh: launcher scripts
6 lines
44 B
Plaintext
6 lines
44 B
Plaintext
*.gguf
|
|
*.log
|
|
llamafile
|
|
*.bak-*
|
|
__pycache__/
|