docker run --gpus all --shm-size 1g -p 8080:80 -v $ volume:/data \ ghcr.io/huggingface/text-generation-inference:3.2.1 --model-id deepseek-ai/DeepSeek-V3-0324