Загрузка данных


docker run --gpus all \
  -v ~/vllm/models/qwen/:/models/qwen \
  -p 8000:8000 \
  --ipc=host \
  vllm/vllm-openai:latest \
  --model /models/qwen \
  --tensor-parallel-size 2