Skip to content

Commit 9e1a8c3

Browse files
Add parameters for Qwen2.5-vl-7b-instruct model
Signed-off-by: prernanookala-ai <prerna.nookala@cloud2labs.com>
1 parent 856deff commit 9e1a8c3

1 file changed

Lines changed: 7 additions & 1 deletion

File tree

core/helm-charts/vllm/xeon-values.yaml

Lines changed: 7 additions & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -243,6 +243,12 @@ modelConfigs:
243243
tensor_parallel_size: "{{ .Values.tensor_parallel_size }}"
244244
pipeline_parallel_size: "{{ .Values.pipeline_parallel_size }}"
245245

246+
"Qwen/Qwen2.5-VL-7B-Instruct":
247+
configMapValues:
248+
VLLM_SKIP_WARMUP: true
249+
extraCmdArgs: ["--max-model-len","33024"]
250+
tensor_parallel_size: "1"
251+
246252
defaultModelConfigs:
247253
configMapValues:
248254
VLLM_CPU_KVCACHE_SPACE: "40"
@@ -270,4 +276,4 @@ defaultModelConfigs:
270276
"256",
271277
]
272278
tensor_parallel_size: "{{ .Values.tensor_parallel_size }}"
273-
pipeline_parallel_size: "{{ .Values.pipeline_parallel_size }}"
279+
pipeline_parallel_size: "{{ .Values.pipeline_parallel_size }}"

0 commit comments

Comments
 (0)