We read every piece of feedback, and take your input very seriously.
To see all available qualifiers, see our documentation.
There was an error while loading. Please reload this page.
1 parent 856deff commit 9e1a8c3Copy full SHA for 9e1a8c3
1 file changed
core/helm-charts/vllm/xeon-values.yaml
@@ -243,6 +243,12 @@ modelConfigs:
243
tensor_parallel_size: "{{ .Values.tensor_parallel_size }}"
244
pipeline_parallel_size: "{{ .Values.pipeline_parallel_size }}"
245
246
+ "Qwen/Qwen2.5-VL-7B-Instruct":
247
+ configMapValues:
248
+ VLLM_SKIP_WARMUP: true
249
+ extraCmdArgs: ["--max-model-len","33024"]
250
+ tensor_parallel_size: "1"
251
+
252
defaultModelConfigs:
253
configMapValues:
254
VLLM_CPU_KVCACHE_SPACE: "40"
@@ -270,4 +276,4 @@ defaultModelConfigs:
270
276
"256",
271
277
]
272
278
273
- pipeline_parallel_size: "{{ .Values.pipeline_parallel_size }}"
279
+ pipeline_parallel_size: "{{ .Values.pipeline_parallel_size }}"
0 commit comments