We read every piece of feedback, and take your input very seriously.
To see all available qualifiers, see our documentation.
There was an error while loading. Please reload this page.
1 parent 65ccbf4 commit 1c8a044Copy full SHA for 1c8a044
2 files changed
inference/a4/single-host-serving/tensorrt-llm/values.yaml
@@ -37,7 +37,7 @@ service:
37
workload:
38
model:
39
name:
40
- gpus: 4
+ gpus: 8
41
image:
42
framework:
43
configFile: serving-args.yaml
src/helm-charts/a4x/inference-templates/deployment/templates/serving-launcher.yaml
@@ -278,7 +278,5 @@ spec:
278
resources:
279
requests:
280
nvidia.com/gpu: {{ $gpusPerNode }}
281
- memory: "800Gi"
282
limits:
283
- nvidia.com/gpu: {{ $gpusPerNode }}
284
- memory: "1000Gi"
+ nvidia.com/gpu: {{ $gpusPerNode }}
0 commit comments