diff --git a/docker-compose.yml b/docker-compose.yml index 705ece5..87bc738 100644 --- a/docker-compose.yml +++ b/docker-compose.yml @@ -99,7 +99,7 @@ services: -m /models/${LLAMA_CLASSIFIER_MODEL_FILE:-Qwen3-4B-Instruct-2507-UD-Q4_K_XL.gguf} --host 0.0.0.0 --port 8080 - --n-gpu-layers 999 + --n-gpu-layers 28 --ctx-size 65536 --parallel 1 --batch-size 512