diff --git a/stable_baselines3/cmaes/cmaes.py b/stable_baselines3/cmaes/cmaes.py index e6926e0..027aa80 100644 --- a/stable_baselines3/cmaes/cmaes.py +++ b/stable_baselines3/cmaes/cmaes.py @@ -94,7 +94,7 @@ class CMAES(BaseAlgorithm): if self.es is None: options = {"seed": self.seed} if self.env.num_envs > 1: - options['popsize'] = self.env.num_envs + options["popsize"] = self.env.num_envs self.es = cma.CMAEvolutionStrategy(self.best_individual, self.std_init, options) continue_training = True diff --git a/tests/test_run.py b/tests/test_run.py index 7221117..f2f4e5a 100644 --- a/tests/test_run.py +++ b/tests/test_run.py @@ -82,6 +82,7 @@ def test_n_critics(n_critics): ) model.learn(total_timesteps=1000) + # "CartPole-v1" @pytest.mark.parametrize("env_id", ["MountainCarContinuous-v0"]) def test_cmaes(env_id): @@ -91,7 +92,6 @@ def test_cmaes(env_id): model.learn(total_timesteps=50000, eval_freq=10000) - # def test_crr(tmp_path): # model = TQC( # "MlpPolicy",