@@ -108,134 +108,135 @@ jobs:
108108 image_tag : ${{ github.sha }}
109109 - name : Run VLLM Gemma Batch Test
110110 uses : ./.github/actions/gradle-command-self-hosted-action
111- timeout-minutes : 180
111+ timeout-minutes : 270
112112 with :
113113 gradle-command : :sdks:python:apache_beam:testing:load_tests:run
114114 arguments : |
115- -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.vllm_gemma_benchmarks \
116- -Prunner=DataflowRunner \
117- -PsdkLocationOverride=false \
118- -PpythonVersion=3.10 \
119- -PloadTest.requirementsTxtFile=apache_beam/ml/inference/vllm_tests_requirements.txt '-PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_8 }} --mode=batch --job_name=benchmark-tests-vllm-with-gemma-2b-it-batch-${{env.NOW_UTC}} --sdk_container_image=${{ steps.build_vllm_image.outputs.image_url }}'
115+ -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.vllm_gemma_benchmarks
116+ -Prunner=DataflowRunner
117+ -PsdkLocationOverride=false
118+ -PpythonVersion=3.10
119+ -PloadTest.requirementsTxtFile=apache_beam/ml/inference/vllm_tests_requirements.txt
120+ -PloadTest.args="${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_8 }} --mode=batch --job_name=benchmark-tests-vllm-with-gemma-2b-it-batch-${{env.NOW_UTC}} --sdk_container_image=${{ steps.build_vllm_image.outputs.image_url }}"
120121 - name : run Pytorch Sentiment Streaming using Hugging Face distilbert-base-uncased model
121122 uses : ./.github/actions/gradle-command-self-hosted-action
122123 timeout-minutes : 180
123124 with :
124125 gradle-command : :sdks:python:apache_beam:testing:load_tests:run
125126 arguments : |
126- -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_sentiment_benchmarks \
127- -Prunner=DataflowRunner \
128- -PpythonVersion=3.10 \
129- -PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt \
130- ' -PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_6 }} --mode=streaming --job_name=benchmark-tests-pytorch-sentiment-distilbert-base-uncased-streaming-${{env.NOW_UTC}} --output_table=apache-beam-testing.beam_run_inference.result_sentiment_distilbert_base_uncased' \
127+ -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_sentiment_benchmarks
128+ -Prunner=DataflowRunner
129+ -PpythonVersion=3.10
130+ -PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt
131+ -PloadTest.args=" ${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_6 }} --mode=streaming --job_name=benchmark-tests-pytorch-sentiment-distilbert-base-uncased-streaming-${{env.NOW_UTC}} --output_table=apache-beam-testing.beam_run_inference.result_sentiment_distilbert_base_uncased"
131132 - name : run Pytorch Sentiment Batch using Hugging Face distilbert-base-uncased model
132133 uses : ./.github/actions/gradle-command-self-hosted-action
133134 timeout-minutes : 180
134135 with :
135136 gradle-command : :sdks:python:apache_beam:testing:load_tests:run
136137 arguments : |
137- -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_sentiment_benchmarks \
138- -Prunner=DataflowRunner \
139- -PpythonVersion=3.10 \
140- -PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt \
141- ' -PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_7 }} --mode=batch --job_name=benchmark-tests-pytorch-sentiment-distilbert-base-uncased-batch-${{env.NOW_UTC}} --output_table=apache-beam-testing.beam_run_inference.result_sentiment_distilbert_base_uncased' \
138+ -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_sentiment_benchmarks
139+ -Prunner=DataflowRunner
140+ -PpythonVersion=3.10
141+ -PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt
142+ -PloadTest.args=" ${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_7 }} --mode=batch --job_name=benchmark-tests-pytorch-sentiment-distilbert-base-uncased-batch-${{env.NOW_UTC}} --output_table=apache-beam-testing.beam_run_inference.result_sentiment_distilbert_base_uncased"
142143 - name : run Pytorch Vision Classification with Resnet 101
143144 uses : ./.github/actions/gradle-command-self-hosted-action
144145 timeout-minutes : 180
145146 with :
146147 gradle-command : :sdks:python:apache_beam:testing:load_tests:run
147148 arguments : |
148- -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_image_classification_benchmarks \
149- -Prunner=DataflowRunner \
150- -PpythonVersion=3.10 \
151- -PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt \
152- ' -PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_1 }} --job_name=benchmark-tests-pytorch-imagenet-python-101-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_resnet101-${{env.NOW_UTC}}.txt' \
149+ -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_image_classification_benchmarks
150+ -Prunner=DataflowRunner
151+ -PpythonVersion=3.10
152+ -PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt
153+ -PloadTest.args=" ${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_1 }} --job_name=benchmark-tests-pytorch-imagenet-python-101-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_resnet101-${{env.NOW_UTC}}.txt"
153154 - name : run Pytorch Imagenet Classification with Resnet 152
154155 uses : ./.github/actions/gradle-command-self-hosted-action
155156 timeout-minutes : 180
156157 with :
157158 gradle-command : :sdks:python:apache_beam:testing:load_tests:run
158159 arguments : |
159- -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_image_classification_benchmarks \
160- -Prunner=DataflowRunner \
161- -PpythonVersion=3.10 \
162- -PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt \
163- ' -PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_2 }} --job_name=benchmark-tests-pytorch-imagenet-python-152-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_resnet152-${{env.NOW_UTC}}.txt' \
160+ -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_image_classification_benchmarks
161+ -Prunner=DataflowRunner
162+ -PpythonVersion=3.10
163+ -PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt
164+ -PloadTest.args=" ${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_2 }} --job_name=benchmark-tests-pytorch-imagenet-python-152-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_resnet152-${{env.NOW_UTC}}.txt"
164165 - name : run Pytorch Language Modeling using Hugging Face bert-base-uncased model
165166 uses : ./.github/actions/gradle-command-self-hosted-action
166167 timeout-minutes : 180
167168 with :
168169 gradle-command : :sdks:python:apache_beam:testing:load_tests:run
169170 arguments : |
170- -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_language_modeling_benchmarks \
171- -Prunner=DataflowRunner \
172- -PpythonVersion=3.10 \
173- -PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt \
174- ' -PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_3 }} --job_name=benchmark-tests-pytorch-language-modeling-bert-base-uncased-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_bert_base_uncased-${{env.NOW_UTC}}.txt' \
171+ -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_language_modeling_benchmarks
172+ -Prunner=DataflowRunner
173+ -PpythonVersion=3.10
174+ -PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt
175+ -PloadTest.args=" ${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_3 }} --job_name=benchmark-tests-pytorch-language-modeling-bert-base-uncased-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_bert_base_uncased-${{env.NOW_UTC}}.txt"
175176 - name : run Pytorch Langauge Modeling using Hugging Face bert-large-uncased model
176177 uses : ./.github/actions/gradle-command-self-hosted-action
177178 timeout-minutes : 180
178179 with :
179180 gradle-command : :sdks:python:apache_beam:testing:load_tests:run
180181 arguments : |
181- -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_language_modeling_benchmarks \
182- -Prunner=DataflowRunner \
183- -PpythonVersion=3.10 \
184- -PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt \
185- ' -PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_4 }} --job_name=benchmark-tests-pytorch-language-modeling-bert-large-uncased-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_bert_large_uncased-${{env.NOW_UTC}}.txt' \
182+ -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_language_modeling_benchmarks
183+ -Prunner=DataflowRunner
184+ -PpythonVersion=3.10
185+ -PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt
186+ -PloadTest.args=" ${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_4 }} --job_name=benchmark-tests-pytorch-language-modeling-bert-large-uncased-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_bert_large_uncased-${{env.NOW_UTC}}.txt"
186187 - name : run Pytorch Imagenet Classification with Resnet 152 with Tesla T4 GPU
187188 uses : ./.github/actions/gradle-command-self-hosted-action
188189 timeout-minutes : 180
189190 with :
190191 gradle-command : :sdks:python:apache_beam:testing:load_tests:run
191192 arguments : |
192- -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_image_classification_benchmarks \
193- -Prunner=DataflowRunner \
194- -PpythonVersion=3.10 \
195- -PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt \
196- ' -PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_5 }} --job_name=benchmark-tests-pytorch-imagenet-python-gpu-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_resnet152_gpu-${{env.NOW_UTC}}.txt'
193+ -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.pytorch_image_classification_benchmarks
194+ -Prunner=DataflowRunner
195+ -PpythonVersion=3.10
196+ -PloadTest.requirementsTxtFile=apache_beam/ml/inference/torch_tests_requirements.txt
197+ -PloadTest.args=" ${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_5 }} --job_name=benchmark-tests-pytorch-imagenet-python-gpu-${{env.NOW_UTC}} --output=gs://temp-storage-for-end-to-end-tests/torch/result_resnet152_gpu-${{env.NOW_UTC}}.txt"
197198 - name : run Table Row Inference Sklearn Batch
198199 uses : ./.github/actions/gradle-command-self-hosted-action
199200 timeout-minutes : 180
200201 with :
201202 gradle-command : :sdks:python:apache_beam:testing:load_tests:run
202203 arguments : |
203- -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.table_row_inference_benchmark \
204- -Prunner=DataflowRunner \
205- -PpythonVersion=3.10 \
206- -PloadTest.requirementsTxtFile=apache_beam/ml/inference/table_row_inference_requirements.txt \
207- ' -PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_9 }} --autoscaling_algorithm=NONE --metrics_table=result_table_row_inference_batch --influx_measurement=result_table_row_inference_batch --mode=batch --input_file=gs://apache-beam-ml/testing/inputs/table_rows_100k_benchmark.jsonl --input_expand_factor=100 --output_table=apache-beam-testing:beam_run_inference.result_table_row_inference_batch_outputs --job_name=benchmark-tests-table-row-inference-batch-${{env.NOW_UTC}}'
204+ -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.table_row_inference_benchmark
205+ -Prunner=DataflowRunner
206+ -PpythonVersion=3.10
207+ -PloadTest.requirementsTxtFile=apache_beam/ml/inference/table_row_inference_requirements.txt
208+ -PloadTest.args=" ${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_9 }} --autoscaling_algorithm=NONE --metrics_table=result_table_row_inference_batch --influx_measurement=result_table_row_inference_batch --mode=batch --input_file=gs://apache-beam-ml/testing/inputs/table_rows_100k_benchmark.jsonl --input_expand_factor=100 --output_table=apache-beam-testing:beam_run_inference.result_table_row_inference_batch_outputs --job_name=benchmark-tests-table-row-inference-batch-${{env.NOW_UTC}}"
208209 - name : run Table Row Inference Sklearn Stream
209210 uses : ./.github/actions/gradle-command-self-hosted-action
210211 timeout-minutes : 180
211212 with :
212213 gradle-command : :sdks:python:apache_beam:testing:load_tests:run
213214 arguments : |
214- -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.table_row_inference_benchmark \
215- -Prunner=DataflowRunner \
216- -PpythonVersion=3.10 \
217- -PloadTest.requirementsTxtFile=apache_beam/ml/inference/table_row_inference_requirements.txt \
218- ' -PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_10 }} --autoscaling_algorithm=THROUGHPUT_BASED --max_num_workers=20 --metrics_table=result_table_row_inference_stream --influx_measurement=result_table_row_inference_stream --mode=streaming --input_subscription=projects/apache-beam-testing/subscriptions/table_row_inference_benchmark --window_size_sec=60 --trigger_interval_sec=30 --timeout_ms=900000 --output_table=apache-beam-testing:beam_run_inference.result_table_row_inference_stream_outputs --job_name=benchmark-tests-table-row-inference-stream-${{env.NOW_UTC}}'
215+ -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.table_row_inference_benchmark
216+ -Prunner=DataflowRunner
217+ -PpythonVersion=3.10
218+ -PloadTest.requirementsTxtFile=apache_beam/ml/inference/table_row_inference_requirements.txt
219+ -PloadTest.args=" ${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_10 }} --autoscaling_algorithm=THROUGHPUT_BASED --max_num_workers=20 --metrics_table=result_table_row_inference_stream --influx_measurement=result_table_row_inference_stream --mode=streaming --input_subscription=projects/apache-beam-testing/subscriptions/table_row_inference_benchmark --window_size_sec=60 --trigger_interval_sec=30 --timeout_ms=900000 --output_table=apache-beam-testing:beam_run_inference.result_table_row_inference_stream_outputs --job_name=benchmark-tests-table-row-inference-stream-${{env.NOW_UTC}}"
219220 - name : run MLTransform Generate Vocab Batch
220221 uses : ./.github/actions/gradle-command-self-hosted-action
221222 timeout-minutes : 180
222223 with :
223224 gradle-command : :sdks:python:apache_beam:testing:load_tests:run
224225 arguments : |
225- -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.mltransform_generate_vocab_benchmark \
226- -Prunner=DataflowRunner \
227- -PpythonVersion=3.10 \
228- -PloadTest.requirementsTxtFile=apache_beam/examples/ml_transform/mltransform_generate_vocab_requirements.txt \
229- ' -PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_11 }} --job_name=benchmark-tests-mltransform-generate-vocab-batch-${{env.NOW_UTC}}'
226+ -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.mltransform_generate_vocab_benchmark
227+ -Prunner=DataflowRunner
228+ -PpythonVersion=3.10
229+ -PloadTest.requirementsTxtFile=apache_beam/examples/ml_transform/mltransform_generate_vocab_requirements.txt
230+ -PloadTest.args=" ${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_11 }} --job_name=benchmark-tests-mltransform-generate-vocab-batch-${{env.NOW_UTC}}"
230231 - name : run MLTransform One-Hot Encoding Batch
231232 uses : ./.github/actions/gradle-command-self-hosted-action
232233 timeout-minutes : 180
233234 with :
234235 gradle-command : :sdks:python:apache_beam:testing:load_tests:run
235236 arguments : |
236- -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.mltransform_one_hot_encoding_benchmark \
237- -Prunner=DataflowRunner \
238- -PpythonVersion=3.10 \
239- -PbeamPythonExtra=ml_test \
240- -PloadTest.requirementsTxtFile=apache_beam/ml/transforms/mltransform_tests_requirements.txt \
241- ' -PloadTest.args=${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_12 }} --autoscaling_algorithm=NONE --metrics_table=mltransform_one_hot_encoding_batch --influx_measurement=mltransform_one_hot_encoding_batch --job_name=benchmark-tests-mltransform-one-hot-encoding-batch-${{env.NOW_UTC}} --output_file=gs://temp-storage-for-end-to-end-tests/mltransform/one_hot_output_${{env.NOW_UTC}} --artifact_location=gs://temp-storage-for-end-to-end-tests/mltransform/artifacts_${{env.NOW_UTC}}'
237+ -PloadTest.mainClass=apache_beam.testing.benchmarks.inference.mltransform_one_hot_encoding_benchmark
238+ -Prunner=DataflowRunner
239+ -PpythonVersion=3.10
240+ -PbeamPythonExtra=ml_test
241+ -PloadTest.requirementsTxtFile=apache_beam/ml/transforms/mltransform_tests_requirements.txt
242+ -PloadTest.args=" ${{ env.beam_Inference_Python_Benchmarks_Dataflow_test_arguments_12 }} --autoscaling_algorithm=NONE --metrics_table=mltransform_one_hot_encoding_batch --influx_measurement=mltransform_one_hot_encoding_batch --job_name=benchmark-tests-mltransform-one-hot-encoding-batch-${{env.NOW_UTC}} --output_file=gs://temp-storage-for-end-to-end-tests/mltransform/one_hot_output_${{env.NOW_UTC}} --artifact_location=gs://temp-storage-for-end-to-end-tests/mltransform/artifacts_${{env.NOW_UTC}}"
0 commit comments