llama-server -m gemma-4-E2B_q4_0-it.gguf --host 127.0.0.1 --port 8080 \ -ngl {0|99} -c 8192 -ctk f16 -ctv f16 -fa 1 -t 6 -tb 12 --parallel 1 --metrics