change default training max_iteration.
This commit is contained in:
@@ -4,7 +4,7 @@ from isaaclab_rl.rsl_rl import RslRlOnPolicyRunnerCfg, RslRlPpoActorCriticCfg, R
|
|||||||
@configclass
|
@configclass
|
||||||
class PPORunnerCfg(RslRlOnPolicyRunnerCfg):
|
class PPORunnerCfg(RslRlOnPolicyRunnerCfg):
|
||||||
num_steps_per_env = 24
|
num_steps_per_env = 24
|
||||||
max_iterations = 150000
|
max_iterations = 300000
|
||||||
save_interval = 500
|
save_interval = 500
|
||||||
experiment_name = "go2_rough"
|
experiment_name = "go2_rough"
|
||||||
|
|
||||||
@@ -73,7 +73,7 @@ class MoECTSRunnerCfg(RslRlOnPolicyRunnerCfg):
|
|||||||
experiment_name = "go2_moe_cts"
|
experiment_name = "go2_moe_cts"
|
||||||
class_name = "OnPolicyRunnerCTS"
|
class_name = "OnPolicyRunnerCTS"
|
||||||
num_steps_per_env = 24
|
num_steps_per_env = 24
|
||||||
max_iterations = 150000
|
max_iterations = 300000
|
||||||
save_interval = 500
|
save_interval = 500
|
||||||
policy = RslRlMoeCtsActorCriticCfg()
|
policy = RslRlMoeCtsActorCriticCfg()
|
||||||
algorithm = RslRlMoeCtsAlgorithmCfg()
|
algorithm = RslRlMoeCtsAlgorithmCfg()
|
||||||
|
|||||||
Reference in New Issue
Block a user