Skip to content

Commit e464824

Browse files
committed
chore: clean up Gaudi and VLLM variables for SGLang in Xeon deployment templates
Signed-off-by: vinayK34 <vinay3.kumar@intel.com>
1 parent 78c53a5 commit e464824

3 files changed

Lines changed: 25 additions & 42 deletions

File tree

Lines changed: 24 additions & 27 deletions
Original file line numberDiff line numberDiff line change
@@ -1,28 +1,25 @@
1-
# Copyright (C) 2025-2026 Intel Corporation
2-
# SPDX-License-Identifier: Apache-2.0
3-
{{- $modelName := (default .Values.LLM_MODEL_ID .Values.SERVED_MODEL_NAME) }}
4-
apiVersion: v1
5-
kind: ConfigMap
6-
metadata:
7-
name: {{ include "sglang.fullname" . }}-config
8-
labels:
9-
{{- include "sglang.labels" . | nindent 4 }}
10-
data:
11-
{{- if .Values.global.HF_ENDPOINT }}
12-
HF_ENDPOINT: {{ .Values.global.HF_ENDPOINT | quote}}
13-
{{- end }}
14-
http_proxy: {{ .Values.global.http_proxy | quote }}
15-
https_proxy: {{ .Values.global.https_proxy | quote }}
16-
no_proxy: {{ .Values.global.no_proxy | quote }}
17-
TORCHINDUCTOR_CACHE_DIR: "/tmp"
18-
NUMBA_CACHE_DIR: "/tmp"
19-
HF_HOME: "/data"
20-
OUTLINES_CACHE_DIR: "/tmp/.cache/outlines"
21-
{{- if .Values.runtime }}
22-
runtime: {{ .Values.runtime | quote}}
23-
{{- end }}
24-
25-
{{- $modelConfig := (index .Values.modelConfigs $modelName | default dict).configMapValues | default .Values.defaultModelConfigs.configMapValues }}
26-
{{- range $key, $value := $modelConfig }}
27-
{{ $key }}: {{ $value | quote }}
1+
# Copyright (C) 2025-2026 Intel Corporation
2+
# SPDX-License-Identifier: Apache-2.0
3+
{{- $modelName := (default .Values.LLM_MODEL_ID .Values.SERVED_MODEL_NAME) }}
4+
apiVersion: v1
5+
kind: ConfigMap
6+
metadata:
7+
name: {{ include "sglang.fullname" . }}-config
8+
labels:
9+
{{- include "sglang.labels" . | nindent 4 }}
10+
data:
11+
{{- if .Values.global.HF_ENDPOINT }}
12+
HF_ENDPOINT: {{ .Values.global.HF_ENDPOINT | quote}}
13+
{{- end }}
14+
http_proxy: {{ .Values.global.http_proxy | quote }}
15+
https_proxy: {{ .Values.global.https_proxy | quote }}
16+
no_proxy: {{ .Values.global.no_proxy | quote }}
17+
TORCHINDUCTOR_CACHE_DIR: "/tmp"
18+
NUMBA_CACHE_DIR: "/tmp"
19+
HF_HOME: "/data"
20+
OUTLINES_CACHE_DIR: "/tmp/.cache/outlines"
21+
22+
{{- $modelConfig := (index .Values.modelConfigs $modelName | default dict).configMapValues | default .Values.defaultModelConfigs.configMapValues }}
23+
{{- range $key, $value := $modelConfig }}
24+
{{ $key }}: {{ $value | quote }}
2825
{{- end }}

core/helm-charts/sglang/values.yaml

Lines changed: 1 addition & 11 deletions
Original file line numberDiff line numberDiff line change
@@ -160,20 +160,10 @@ LLM_MODEL_ID: Intel/neural-chat-7b-v3-3
160160
SERVED_MODEL_NAME: ""
161161
# Environment variables for sglang (set in configmap):
162162
# https://docs.sglang.ai/en/latest/getting_started/installation.html#environment-variables
163-
sglang_CPU_KVCACHE_SPACE: "40"
164-
sglang_RPC_TIMEOUT: "100000"
165-
sglang_ALLOW_LONG_MAX_MODEL_LEN: "1"
166-
sglang_ENGINE_ITERATION_TIMEOUT_S: "120"
167-
sglang_CPU_NUM_OF_RESERVED_CPU: "0"
168-
sglang_CONFIGURE_LOGGING: 1
169-
sglang_NO_USAGE_STATS: 1
170-
sglang_CPU_SGL_KERNEL: "1"
171-
DO_NOT_TRACK: 1
163+
172164

173165
# CPU optimization settings (can be updated by automation)
174166
cpu_optimization_enabled: false
175-
max_num_batched_tokens: "2048"
176-
max_num_seqs: "256"
177167

178168
# Parallelism configuration (root level for global access)
179169
tensor_parallel_size: "2"

core/helm-charts/sglang/xeon-values.yaml

Lines changed: 0 additions & 4 deletions
Original file line numberDiff line numberDiff line change
@@ -41,13 +41,9 @@ affinity:
4141
values: ["true"]
4242

4343
# vLLM CPU environment variables
44-
SGLANG_CPU_SGL_KERNEL: "1"
45-
SGLANG_NO_USAGE_STATS: 1
46-
DO_NOT_TRACK: 1
4744

4845
LLM_MODEL_ID: ""
4946

50-
5147
modelConfigs:
5248
"meta-llama/Llama-3.1-8B-Instruct":
5349
configMapValues: {}

0 commit comments

Comments
 (0)