# 激活vLLM环境
source vllm/bin/activate

# 运行benchmark测试
python -m vllm.entrypoints.openai.api_server --tensor-parallel-size 2 \
  --model DeepSeek-R1-Distill-Qwen-7B \
  --port 8000 &
