docker rm -f mcgyvr-quickcheck >/dev/null 2>&1; docker run -d --name mcgyvr-quickcheck --runtime=nvidia --gpus all --network host -v /home/adaramir/models:/home/adaramir/models:ro ghcr.io/ggml-org/llama.cpp:server-cuda-b10644 -m /home/adaramir/models/.incoming/yuxinlu1_gemma-4-12B-coder-fable5-composer2.5-v1-GGUF/gemma4-coding-Q4_K_M.gguf --host 0.0.0.0 --port 8090 --parallel 1 -c 8192 -ngl 99 -t 10 -fa on
