(4 events) Time zone: Conference local time zone
Show all
Toggle Poster Visibility
Oral
Thu Jul 12 02:30 PM -- 02:50 PM (CEST) @ A1
The Mirage of Action-Dependent Baselines in Reinforcement Learning
Oral
Thu Jul 12 02:50 PM -- 03:10 PM (CEST) @ A1
Smoothed Action Value Functions for Learning Gaussian Policies
Oral
Thu Jul 12 03:10 PM -- 03:20 PM (CEST) @ A1
Soft Actor-Critic: Off-Policy Maximum Entropy Deep Reinforcement Learning with a Stochastic Actor
[
PDF]
Oral
Thu Jul 12 03:20 PM -- 03:30 PM (CEST) @ A1
Addressing Function Approximation Error in Actor-Critic Methods
Successful Page Load