@@ -4438,6 +4438,61 @@ def test_run_agent_internal_multi_turn_success(self, mock_run_agent):
44384438 {"turn_index" : 1 , "turn_id" : "t2" , "events" : []},
44394439 ]
44404440
4441+ @mock .patch .object (_evals_common , "_run_agent" )
4442+ def test_run_agent_internal_multi_turn_normalizes_raw_events (self , mock_run_agent ):
4443+ mock_run_agent .return_value = [
4444+ [
4445+ {
4446+ "id" : "event-1" ,
4447+ "author" : "agent" ,
4448+ "content" : {"parts" : [{"text" : "hello" }]},
4449+ "model_version" : "gemini-2.5-flash" ,
4450+ "timestamp" : "2026-01-01T00:00:00Z" ,
4451+ },
4452+ {
4453+ "invocation_id" : "event-2" ,
4454+ "author" : "agent" ,
4455+ "content" : {"parts" : [{"text" : "bye" }]},
4456+ "actions" : {"state_delta" : {}},
4457+ "usage_metadata" : {"total_token_count" : 12 },
4458+ },
4459+ ]
4460+ ]
4461+ prompt_dataset = pd .DataFrame ({"prompt" : ["p1" ], "conversation_plan" : ["plan" ]})
4462+ mock_agent_engine = mock .Mock ()
4463+ mock_api_client = mock .Mock ()
4464+
4465+ result_df = _evals_common ._run_agent_internal (
4466+ api_client = mock_api_client ,
4467+ agent_engine = mock_agent_engine ,
4468+ agent = None ,
4469+ prompt_dataset = prompt_dataset ,
4470+ )
4471+
4472+ agent_data = result_df ["agent_data" ][0 ]
4473+ assert agent_data ["turns" ] == [
4474+ {
4475+ "turn_index" : 0 ,
4476+ "turn_id" : "event-1" ,
4477+ "events" : [
4478+ {
4479+ "author" : "agent" ,
4480+ "content" : {"parts" : [{"text" : "hello" }]},
4481+ }
4482+ ],
4483+ },
4484+ {
4485+ "turn_index" : 1 ,
4486+ "turn_id" : "event-2" ,
4487+ "events" : [
4488+ {
4489+ "author" : "agent" ,
4490+ "content" : {"parts" : [{"text" : "bye" }]},
4491+ }
4492+ ],
4493+ },
4494+ ]
4495+
44414496 @mock .patch .object (_evals_common , "_run_agent" )
44424497 def test_run_agent_internal_multi_turn_with_agent (self , mock_run_agent ):
44434498 mock_run_agent .return_value = [
@@ -6578,9 +6633,7 @@ def test_groundedness_aliases_grounding_v1(self):
65786633 assert lazy_metric ._get_api_metric_spec_name () == "grounding_v1"
65796634
65806635 def test_groundedness_logs_field_difference_warning (self , caplog ):
6581- loader_logger = (
6582- "agentplatform._genai._evals_metric_loaders"
6583- )
6636+ loader_logger = "agentplatform._genai._evals_metric_loaders"
65846637 with caplog .at_level ("WARNING" , logger = loader_logger ):
65856638 _ = agentplatform_genai_types .RubricMetric .GROUNDEDNESS
65866639 messages = [r .getMessage () for r in caplog .records if r .name == loader_logger ]
0 commit comments