11#! /bin/bash
2+ HF_CACHE=" /data/users/mserrao/hf-cache"
3+ export CUDA_VISIBLE_DEVICES=7
4+ export HUGGIN
5+ export HF_HOME=$HF_CACHE
6+ export TRANSFORMERS_CACHE=$HF_CACHE
7+ export HF_DATASETS_CACHE=$HF_CACHE
8+ export HUGGINGFACE_HUB_CACHE=$HF_CACHE
9+ # export HF_HUB_OFFLINE=1
210
311# Qwen3-VL Evaluation Script with vLLM Backend
412# This script demonstrates how to evaluate Qwen3-VL models using vLLM for accelerated inference
2331# - Qwen/Qwen3-VL-30B-A3B-Thinking
2432# - Qwen/Qwen3-VL-235B-A22B-Instruct
2533# - Qwen/Qwen3-VL-235B-A22B-Thinking
26- MODEL=" Qwen/Qwen3-VL-30B-A3B -Instruct"
34+ MODEL=" Qwen/Qwen3-VL-2B -Instruct"
2735
2836# Parallelization Settings
2937# Adjust based on your GPU configuration
30- TENSOR_PARALLEL_SIZE=4 # Number of GPUs for tensor parallelism
38+ TENSOR_PARALLEL_SIZE=1 # Number of GPUs for tensor parallelism
3139DATA_PARALLEL_SIZE=1 # Number of GPUs for data parallelism
3240
3341# Memory and Performance Settings
34- GPU_MEMORY_UTILIZATION=0.85 # Fraction of GPU memory to use (0.0 - 1.0)
35- BATCH_SIZE=64 # Batch size for evaluation
36-
42+ GPU_MEMORY_UTILIZATION=0.90 # Fraction of GPU memory to use (0.0 - 1.0)
43+ BATCH_SIZE=16 # Batch size for evaluation
44+ MAX_MODEL_LEN= $(( 2 ** 15 ))
3745# Task Configuration
3846# Common tasks: mmmu_val, mme, mathvista, ai2d, etc.
39- TASKS=" mmmu_val,mme "
47+ TASKS=" manga_vqa_test "
4048
4149# Output Configuration
4250OUTPUT_PATH=" ./logs/qwen3vl_vllm"
@@ -69,12 +77,14 @@ echo "Output Path: $OUTPUT_PATH"
6977echo " =========================================="
7078
7179# Build the command
72- CMD=" uv run python -m lmms_eval \
80+ CMD=" python -m lmms_eval \
7381 --model vllm \
74- --model_args model=${MODEL} ,tensor_parallel_size=${TENSOR_PARALLEL_SIZE} ,data_parallel_size=${DATA_PARALLEL_SIZE} ,gpu_memory_utilization=${GPU_MEMORY_UTILIZATION} \
82+ --model_args model=${MODEL} ,tensor_parallel_size=${TENSOR_PARALLEL_SIZE} ,data_parallel_size=${DATA_PARALLEL_SIZE} ,gpu_memory_utilization=${GPU_MEMORY_UTILIZATION} ,max_model_len= ${MAX_MODEL_LEN} \
7583 --tasks ${TASKS} \
7684 --batch_size ${BATCH_SIZE} \
77- --output_path ${OUTPUT_PATH} "
85+ --output_path ${OUTPUT_PATH} \
86+ --verbosity=DEBUG"
87+
7888
7989# Add optional arguments
8090if [ " $LOG_SAMPLES " = true ]; then
@@ -96,4 +106,4 @@ echo ""
96106echo " =========================================="
97107echo " Evaluation Complete!"
98108echo " Results saved to: $OUTPUT_PATH "
99- echo " =========================================="
109+ echo " =========================================="
0 commit comments