Skip to content

Commit 99c34b6

Browse files
committed
Fix
1 parent 468ae40 commit 99c34b6

2 files changed

Lines changed: 64 additions & 62 deletions

File tree

.github/workflows/beam_Inference_Python_Benchmarks_Dataflow.yml

Lines changed: 63 additions & 62 deletions
Original file line numberDiff line numberDiff line change
@@ -108,134 +108,135 @@ jobs:
108108
image_tag: ${{ github.sha }}
109109
- name: Run VLLM Gemma Batch Test
110110
uses: ./.github/actions/gradle-command-self-hosted-action
111-
timeout-minutes: 180
111+
timeout-minutes: 270
112112
with:
113113
gradle-command: :sdks:python:apache_beam:testing:load_tests:run
114114
arguments: |
115-
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.vllm_gemma_benchmarks \
116-
-Prunner=DataflowRunner \
117-
-PsdkLocationOverride=false \
118-
-PpythonVersion=3.10 \
119-
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/vllm_tests_requirements.txt '-PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_8 }} --mode=batch --job_name=benchmark-tests-vllm-with-gemma-2b-it-batch-${{env.NOW_UTC}} --sdk_container_image=${{ steps.build_vllm_image.outputs.image_url }}'
115+
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.vllm_gemma_benchmarks
116+
-Prunner=DataflowRunner
117+
-PsdkLocationOverride=false
118+
-PpythonVersion=3.10
119+
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/vllm_tests_requirements.txt
120+
-PloadTest.args="${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_8 }} --mode=batch --job_name=benchmark-tests-vllm-with-gemma-2b-it-batch-${{env.NOW_UTC}} --sdk_container_image=${{ steps.build_vllm_image.outputs.image_url }}"
120121
- name: run Pytorch Sentiment Streaming using Hugging Face distilbert-base-uncased model
121122
uses: ./.github/actions/gradle-command-self-hosted-action
122123
timeout-minutes: 180
123124
with:
124125
gradle-command: :sdks:python:apache_beam:testing:load_tests:run
125126
arguments: |
126-
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_sentiment_benchmarks \
127-
-Prunner=DataflowRunner \
128-
-PpythonVersion=3.10 \
129-
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt \
130-
'-PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_6 }} --mode=streaming --job_name=benchmark-tests-pytorch-sentiment-distilbert-base-uncased-streaming-${{env.NOW_UTC}} --output_table=apache-beam-testing.beam_run_inference.result_sentiment_distilbert_base_uncased' \
127+
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_sentiment_benchmarks
128+
-Prunner=DataflowRunner
129+
-PpythonVersion=3.10
130+
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt
131+
-PloadTest.args="${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_6 }} --mode=streaming --job_name=benchmark-tests-pytorch-sentiment-distilbert-base-uncased-streaming-${{env.NOW_UTC}} --output_table=apache-beam-testing.beam_run_inference.result_sentiment_distilbert_base_uncased"
131132
- name: run Pytorch Sentiment Batch using Hugging Face distilbert-base-uncased model
132133
uses: ./.github/actions/gradle-command-self-hosted-action
133134
timeout-minutes: 180
134135
with:
135136
gradle-command: :sdks:python:apache_beam:testing:load_tests:run
136137
arguments: |
137-
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_sentiment_benchmarks \
138-
-Prunner=DataflowRunner \
139-
-PpythonVersion=3.10 \
140-
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt \
141-
'-PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_7 }} --mode=batch --job_name=benchmark-tests-pytorch-sentiment-distilbert-base-uncased-batch-${{env.NOW_UTC}} --output_table=apache-beam-testing.beam_run_inference.result_sentiment_distilbert_base_uncased' \
138+
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_sentiment_benchmarks
139+
-Prunner=DataflowRunner
140+
-PpythonVersion=3.10
141+
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt
142+
-PloadTest.args="${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_7 }} --mode=batch --job_name=benchmark-tests-pytorch-sentiment-distilbert-base-uncased-batch-${{env.NOW_UTC}} --output_table=apache-beam-testing.beam_run_inference.result_sentiment_distilbert_base_uncased"
142143
- name: run Pytorch Vision Classification with Resnet 101
143144
uses: ./.github/actions/gradle-command-self-hosted-action
144145
timeout-minutes: 180
145146
with:
146147
gradle-command: :sdks:python:apache_beam:testing:load_tests:run
147148
arguments: |
148-
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_image_classification_benchmarks \
149-
-Prunner=DataflowRunner \
150-
-PpythonVersion=3.10 \
151-
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt \
152-
'-PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_1 }} --job_name=benchmark-tests-pytorch-imagenet-python-101-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_resnet101-${{env.NOW_UTC}}.txt' \
149+
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_image_classification_benchmarks
150+
-Prunner=DataflowRunner
151+
-PpythonVersion=3.10
152+
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt
153+
-PloadTest.args="${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_1 }} --job_name=benchmark-tests-pytorch-imagenet-python-101-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_resnet101-${{env.NOW_UTC}}.txt"
153154
- name: run Pytorch Imagenet Classification with Resnet 152
154155
uses: ./.github/actions/gradle-command-self-hosted-action
155156
timeout-minutes: 180
156157
with:
157158
gradle-command: :sdks:python:apache_beam:testing:load_tests:run
158159
arguments: |
159-
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_image_classification_benchmarks \
160-
-Prunner=DataflowRunner \
161-
-PpythonVersion=3.10 \
162-
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt \
163-
'-PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_2 }} --job_name=benchmark-tests-pytorch-imagenet-python-152-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_resnet152-${{env.NOW_UTC}}.txt' \
160+
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_image_classification_benchmarks
161+
-Prunner=DataflowRunner
162+
-PpythonVersion=3.10
163+
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt
164+
-PloadTest.args="${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_2 }} --job_name=benchmark-tests-pytorch-imagenet-python-152-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_resnet152-${{env.NOW_UTC}}.txt"
164165
- name: run Pytorch Language Modeling using Hugging Face bert-base-uncased model
165166
uses: ./.github/actions/gradle-command-self-hosted-action
166167
timeout-minutes: 180
167168
with:
168169
gradle-command: :sdks:python:apache_beam:testing:load_tests:run
169170
arguments: |
170-
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_language_modeling_benchmarks \
171-
-Prunner=DataflowRunner \
172-
-PpythonVersion=3.10 \
173-
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt \
174-
'-PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_3 }} --job_name=benchmark-tests-pytorch-language-modeling-bert-base-uncased-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_bert_base_uncased-${{env.NOW_UTC}}.txt' \
171+
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_language_modeling_benchmarks
172+
-Prunner=DataflowRunner
173+
-PpythonVersion=3.10
174+
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt
175+
-PloadTest.args="${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_3 }} --job_name=benchmark-tests-pytorch-language-modeling-bert-base-uncased-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_bert_base_uncased-${{env.NOW_UTC}}.txt"
175176
- name: run Pytorch Langauge Modeling using Hugging Face bert-large-uncased model
176177
uses: ./.github/actions/gradle-command-self-hosted-action
177178
timeout-minutes: 180
178179
with:
179180
gradle-command: :sdks:python:apache_beam:testing:load_tests:run
180181
arguments: |
181-
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_language_modeling_benchmarks \
182-
-Prunner=DataflowRunner \
183-
-PpythonVersion=3.10 \
184-
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt \
185-
'-PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_4 }} --job_name=benchmark-tests-pytorch-language-modeling-bert-large-uncased-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_bert_large_uncased-${{env.NOW_UTC}}.txt' \
182+
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_language_modeling_benchmarks
183+
-Prunner=DataflowRunner
184+
-PpythonVersion=3.10
185+
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt
186+
-PloadTest.args="${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_4 }} --job_name=benchmark-tests-pytorch-language-modeling-bert-large-uncased-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_bert_large_uncased-${{env.NOW_UTC}}.txt"
186187
- name: run Pytorch Imagenet Classification with Resnet 152 with Tesla T4 GPU
187188
uses: ./.github/actions/gradle-command-self-hosted-action
188189
timeout-minutes: 180
189190
with:
190191
gradle-command: :sdks:python:apache_beam:testing:load_tests:run
191192
arguments: |
192-
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_image_classification_benchmarks \
193-
-Prunner=DataflowRunner \
194-
-PpythonVersion=3.10 \
195-
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt \
196-
'-PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_5 }} --job_name=benchmark-tests-pytorch-imagenet-python-gpu-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_resnet152_gpu-${{env.NOW_UTC}}.txt'
193+
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_image_classification_benchmarks
194+
-Prunner=DataflowRunner
195+
-PpythonVersion=3.10
196+
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt
197+
-PloadTest.args="${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_5 }} --job_name=benchmark-tests-pytorch-imagenet-python-gpu-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_resnet152_gpu-${{env.NOW_UTC}}.txt"
197198
- name: run Table Row Inference Sklearn Batch
198199
uses: ./.github/actions/gradle-command-self-hosted-action
199200
timeout-minutes: 180
200201
with:
201202
gradle-command: :sdks:python:apache_beam:testing:load_tests:run
202203
arguments: |
203-
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.table_row_inference_benchmark \
204-
-Prunner=DataflowRunner \
205-
-PpythonVersion=3.10 \
206-
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/table_row_inference_requirements.txt \
207-
'-PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_9 }} --autoscaling_algorithm=NONE --metrics_table=result_table_row_inference_batch --influx_measurement=result_table_row_inference_batch --mode=batch --input_file=gs://apache-beam-ml/testing/inputs/table_rows_100k_benchmark.jsonl --input_expand_factor=100 --output_table=apache-beam-testing:beam_run_inference.result_table_row_inference_batch_outputs --job_name=benchmark-tests-table-row-inference-batch-${{env.NOW_UTC}}'
204+
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.table_row_inference_benchmark
205+
-Prunner=DataflowRunner
206+
-PpythonVersion=3.10
207+
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/table_row_inference_requirements.txt
208+
-PloadTest.args="${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_9 }} --autoscaling_algorithm=NONE --metrics_table=result_table_row_inference_batch --influx_measurement=result_table_row_inference_batch --mode=batch --input_file=gs://apache-beam-ml/testing/inputs/table_rows_100k_benchmark.jsonl --input_expand_factor=100 --output_table=apache-beam-testing:beam_run_inference.result_table_row_inference_batch_outputs --job_name=benchmark-tests-table-row-inference-batch-${{env.NOW_UTC}}"
208209
- name: run Table Row Inference Sklearn Stream
209210
uses: ./.github/actions/gradle-command-self-hosted-action
210211
timeout-minutes: 180
211212
with:
212213
gradle-command: :sdks:python:apache_beam:testing:load_tests:run
213214
arguments: |
214-
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.table_row_inference_benchmark \
215-
-Prunner=DataflowRunner \
216-
-PpythonVersion=3.10 \
217-
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/table_row_inference_requirements.txt \
218-
'-PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_10 }} --autoscaling_algorithm=THROUGHPUT_BASED --max_num_workers=20 --metrics_table=result_table_row_inference_stream --influx_measurement=result_table_row_inference_stream --mode=streaming --input_subscription=projects/apache-beam-testing/subscriptions/table_row_inference_benchmark --window_size_sec=60 --trigger_interval_sec=30 --timeout_ms=900000 --output_table=apache-beam-testing:beam_run_inference.result_table_row_inference_stream_outputs --job_name=benchmark-tests-table-row-inference-stream-${{env.NOW_UTC}}'
215+
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.table_row_inference_benchmark
216+
-Prunner=DataflowRunner
217+
-PpythonVersion=3.10
218+
-PloadTest.requirementsTxtFile=apache_beam/ml/inference/table_row_inference_requirements.txt
219+
-PloadTest.args="${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_10 }} --autoscaling_algorithm=THROUGHPUT_BASED --max_num_workers=20 --metrics_table=result_table_row_inference_stream --influx_measurement=result_table_row_inference_stream --mode=streaming --input_subscription=projects/apache-beam-testing/subscriptions/table_row_inference_benchmark --window_size_sec=60 --trigger_interval_sec=30 --timeout_ms=900000 --output_table=apache-beam-testing:beam_run_inference.result_table_row_inference_stream_outputs --job_name=benchmark-tests-table-row-inference-stream-${{env.NOW_UTC}}"
219220
- name: run MLTransform Generate Vocab Batch
220221
uses: ./.github/actions/gradle-command-self-hosted-action
221222
timeout-minutes: 180
222223
with:
223224
gradle-command: :sdks:python:apache_beam:testing:load_tests:run
224225
arguments: |
225-
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.mltransform_generate_vocab_benchmark \
226-
-Prunner=DataflowRunner \
227-
-PpythonVersion=3.10 \
228-
-PloadTest.requirementsTxtFile=apache_beam/examples/ml_transform/mltransform_generate_vocab_requirements.txt \
229-
'-PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_11 }} --job_name=benchmark-tests-mltransform-generate-vocab-batch-${{env.NOW_UTC}}'
226+
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.mltransform_generate_vocab_benchmark
227+
-Prunner=DataflowRunner
228+
-PpythonVersion=3.10
229+
-PloadTest.requirementsTxtFile=apache_beam/examples/ml_transform/mltransform_generate_vocab_requirements.txt
230+
-PloadTest.args="${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_11 }} --job_name=benchmark-tests-mltransform-generate-vocab-batch-${{env.NOW_UTC}}"
230231
- name: run MLTransform One-Hot Encoding Batch
231232
uses: ./.github/actions/gradle-command-self-hosted-action
232233
timeout-minutes: 180
233234
with:
234235
gradle-command: :sdks:python:apache_beam:testing:load_tests:run
235236
arguments: |
236-
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.mltransform_one_hot_encoding_benchmark \
237-
-Prunner=DataflowRunner \
238-
-PpythonVersion=3.10 \
239-
-PbeamPythonExtra=ml_test \
240-
-PloadTest.requirementsTxtFile=apache_beam/ml/transforms/mltransform_tests_requirements.txt \
241-
'-PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_12 }} --autoscaling_algorithm=NONE --metrics_table=mltransform_one_hot_encoding_batch --influx_measurement=mltransform_one_hot_encoding_batch --job_name=benchmark-tests-mltransform-one-hot-encoding-batch-${{env.NOW_UTC}} --output_file=gs://temp-storage-for-end-to-end-tests/mltransform/one_hot_output_${{env.NOW_UTC}} --artifact_location=gs://temp-storage-for-end-to-end-tests/mltransform/artifacts_${{env.NOW_UTC}}'
237+
-PloadTest.mainClass=apache_beam.testing.benchmarks.inference.mltransform_one_hot_encoding_benchmark
238+
-Prunner=DataflowRunner
239+
-PpythonVersion=3.10
240+
-PbeamPythonExtra=ml_test
241+
-PloadTest.requirementsTxtFile=apache_beam/ml/transforms/mltransform_tests_requirements.txt
242+
-PloadTest.args="${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_12 }} --autoscaling_algorithm=NONE --metrics_table=mltransform_one_hot_encoding_batch --influx_measurement=mltransform_one_hot_encoding_batch --job_name=benchmark-tests-mltransform-one-hot-encoding-batch-${{env.NOW_UTC}} --output_file=gs://temp-storage-for-end-to-end-tests/mltransform/one_hot_output_${{env.NOW_UTC}} --artifact_location=gs://temp-storage-for-end-to-end-tests/mltransform/artifacts_${{env.NOW_UTC}}"

.github/workflows/load-tests-pipeline-options/beam_Inference_Python_Benchmarks_Dataflow_VLLM_Gemma_Batch.txt

Lines changed: 1 addition & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -35,3 +35,4 @@
3535
--requirements_file=apache_beam/ml/inference/vllm_tests_requirements.txt
3636
--dataflow_service_options=worker_accelerator=type:nvidia-tesla-t4;count:1;install-nvidia-driver
3737
--experiments=use_runner_v2
38+
--timeout_ms=16200000

0 commit comments

Comments
 (0)