diff --git a/rllib/tuned_examples/regression_tests/cartpole-ppo-torch.yaml b/rllib/tuned_examples/regression_tests/cartpole-ppo-torch.yaml new file mode 100644 index 000000000..3d3ad4291 --- /dev/null +++ b/rllib/tuned_examples/regression_tests/cartpole-ppo-torch.yaml @@ -0,0 +1,11 @@ +cartpole-ppo-tf: + env: CartPole-v0 + run: PPO + stop: + episode_reward_mean: 150 + timesteps_total: 100000 + config: + num_workers: 1 + batch_mode: complete_episodes + observation_filter: MeanStdFilter + use_pytorch: true