Toggle Poster Visibility
Oral
Thu Jul 22 03:00 PM -- 03:20 PM (CEST)
Temporal Difference Learning as Gradient Splitting
[ Paper ]
Spotlight
Thu Jul 22 03:20 PM -- 03:25 PM (CEST)
First-Order Methods for Wasserstein Distributionally Robust MDP
[ Paper ]
Spotlight
Thu Jul 22 03:30 PM -- 03:35 PM (CEST)
Adaptive Sampling for Best Policy Identification in Markov Decision Processes
[ Paper ]
Spotlight
Thu Jul 22 03:35 PM -- 03:40 PM (CEST)
Quantum algorithms for reinforcement learning with a generative model
[ Paper ]
Spotlight
Thu Jul 22 03:40 PM -- 03:45 PM (CEST)
Posterior Value Functions: Hindsight Baselines for Policy Gradient Methods
[ Paper ]
Spotlight
Thu Jul 22 03:45 PM -- 03:50 PM (CEST)
Learning Interaction Kernels for Agent Systems on Riemannian Manifolds
[ Paper ]
Successful Page Load