mirror of
https://github.com/saymrwulf/stable-baselines3.git
synced 2026-09-15 22:10:25 +00:00
Save last mean reward
This commit is contained in:
parent
75a86881b3
commit
8eb82c86e3
1 changed files with 2 additions and 0 deletions
|
|
@ -232,6 +232,7 @@ class EvalCallback(EventCallback):
|
||||||
self.n_eval_episodes = n_eval_episodes
|
self.n_eval_episodes = n_eval_episodes
|
||||||
self.eval_freq = eval_freq
|
self.eval_freq = eval_freq
|
||||||
self.best_mean_reward = -np.inf
|
self.best_mean_reward = -np.inf
|
||||||
|
self.last_mean_reward = -np.inf
|
||||||
self.deterministic = deterministic
|
self.deterministic = deterministic
|
||||||
self.render = render
|
self.render = render
|
||||||
|
|
||||||
|
|
@ -280,6 +281,7 @@ class EvalCallback(EventCallback):
|
||||||
|
|
||||||
mean_reward, std_reward = np.mean(episode_rewards), np.std(episode_rewards)
|
mean_reward, std_reward = np.mean(episode_rewards), np.std(episode_rewards)
|
||||||
mean_ep_length, std_ep_length = np.mean(episode_lengths), np.std(episode_lengths)
|
mean_ep_length, std_ep_length = np.mean(episode_lengths), np.std(episode_lengths)
|
||||||
|
self.last_mean_reward = mean_reward
|
||||||
|
|
||||||
if self.verbose > 0:
|
if self.verbose > 0:
|
||||||
print(f"Eval num_timesteps={self.num_timesteps}, "
|
print(f"Eval num_timesteps={self.num_timesteps}, "
|
||||||
|
|
|
||||||
Loading…
Reference in a new issue