@@ -739,15 +739,25 @@ def test_async_nemo_gym_rollout_manager_matches_original(
739739 }
740740 )
741741
742- original_result = run_async_nemo_gym_rollout (
743- policy_generation = nemo_gym_vllm_generation ,
744- input_batch = repeated_batch ,
745- tokenizer = nemo_gym_tokenizer ,
746- task_to_env = {"nemo_gym" : nemo_gym },
747- generation_config = nemo_gym_vllm_generation .cfg ,
748- max_seq_len = nemo_gym_vllm_generation .cfg ["vllm_cfg" ]["max_model_len" ],
749- max_rollout_turns = None ,
750- )
742+ async def _collect_original_results ():
743+ return [
744+ result
745+ async for result in run_async_nemo_gym_rollout (
746+ policy_generation = nemo_gym_vllm_generation ,
747+ input_batch = repeated_batch ,
748+ tokenizer = nemo_gym_tokenizer ,
749+ task_to_env = {"nemo_gym" : nemo_gym },
750+ generation_config = nemo_gym_vllm_generation .cfg ,
751+ num_generations = num_generations ,
752+ log_full_result_tables = False ,
753+ max_seq_len = nemo_gym_vllm_generation .cfg ["vllm_cfg" ]["max_model_len" ],
754+ max_rollout_turns = None ,
755+ )
756+ ]
757+
758+ original_results = asyncio .run (_collect_original_results ())
759+ assert len (original_results ) == 1
760+ original_result = original_results [0 ]
751761
752762 manager = RolloutManager (
753763 use_nemo_gym = True ,
0 commit comments