Skip to content

Commit d435d32

Browse files
committed
fix(sc): configure vLLM for router_replay before generation build
Signed-off-by: Yuki Huang <yukih@nvidia.com>
1 parent e5f9ffd commit d435d32

1 file changed

Lines changed: 5 additions & 1 deletion

File tree

  • nemo_rl/algorithms/single_controller_utils

nemo_rl/algorithms/single_controller_utils/setup.py

Lines changed: 5 additions & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -44,7 +44,10 @@
4444
from nemo_rl.experience.rollout_manager import RolloutManager
4545
from nemo_rl.models.generation.sglang.sglang_generation import SGLangGeneration
4646
from nemo_rl.models.generation.vllm import VllmGeneration
47-
from nemo_rl.models.megatron.router_replay import router_replay_enabled
47+
from nemo_rl.models.megatron.router_replay import (
48+
configure_vllm_for_router_replay,
49+
router_replay_enabled,
50+
)
4851
from nemo_rl.models.policy.tq_policy import TQPolicy
4952
from nemo_rl.weight_sync import WeightSynchronizer, create_weight_synchronizer
5053

@@ -151,6 +154,7 @@ def _build_generation(
151154
generation_config["vllm_kwargs"]["hf_overrides"] = master_config.policy.get(
152155
"hf_config_overrides", {}
153156
)
157+
configure_vllm_for_router_replay(master_config.policy)
154158
gen = VllmGeneration(cluster=inference_cluster, config=generation_config)
155159
elif backend == "sglang":
156160
generation_config["sglang_cfg"].setdefault(

0 commit comments

Comments
 (0)