Skip to yearly menu bar Skip to main content


(12 events)   Time zone: Conference local time zone  
Show all
Toggle Poster Visibility
Oral
Thu Jul 21 01:30 PM -- 01:50 PM (EDT) @ Room 327 - 329
Generalised Policy Improvement with Geometric Policy Composition
Shantanu Thakoor · Mark Rowland · Diana Borsa · Will Dabney · Remi Munos · Andre Barreto
Spotlight
Thu Jul 21 01:50 PM -- 01:55 PM (EDT) @ Room 327 - 329
Offline Meta-Reinforcement Learning with Online Self-Supervision
Vitchyr Pong · Ashvin Nair · Laura Smith · Catherine Huang · Sergey Levine
Spotlight
Thu Jul 21 01:55 PM -- 02:00 PM (EDT) @ Room 327 - 329
Divergence-Regularized Multi-Agent Actor-Critic
Kefan Su · Zongqing Lu
Spotlight
Thu Jul 21 02:00 PM -- 02:05 PM (EDT) @ Room 327 - 329
Understanding Policy Gradient Algorithms: A Sensitivity-Based Approach
Shuang Wu · Ling Shi · Jun Wang · Guangjian Tian
Spotlight
Thu Jul 21 02:05 PM -- 02:10 PM (EDT) @ Room 327 - 329
Off-Policy Reinforcement Learning with Delayed Rewards
Beining Han · Zhizhou Ren · Zuofan Wu · Yuan Zhou · Jian Peng
Spotlight
Thu Jul 21 02:10 PM -- 02:15 PM (EDT) @ Room 327 - 329
Direct Behavior Specification via Constrained Reinforcement Learning
Julien Roy · Roger Girgis · Joshua Romoff · Pierre-Luc Bacon · Christopher Pal
Oral
Thu Jul 21 02:15 PM -- 02:35 PM (EDT) @ Room 327 - 329
Large Batch Experience Replay
Thibault Lahire · Matthieu Geist · Emmanuel Rachelson
Spotlight
Thu Jul 21 02:35 PM -- 02:40 PM (EDT) @ Room 327 - 329
Evolving Curricula with Regret-Based Environment Design
Jack Parker-Holder · Minqi Jiang · Michael Dennis · Mikayel Samvelyan · Jakob Foerster · Edward Grefenstette · Tim Rocktäschel
Spotlight
Thu Jul 21 02:40 PM -- 02:45 PM (EDT) @ Room 327 - 329
Robust Deep Reinforcement Learning through Bootstrapped Opportunistic Curriculum
Junlin Wu · Yevgeniy Vorobeychik
Spotlight
Thu Jul 21 02:45 PM -- 02:50 PM (EDT) @ Room 327 - 329
Transformers are Meta-Reinforcement Learners
Luckeciano Melo
Spotlight
Thu Jul 21 02:50 PM -- 02:55 PM (EDT) @ Room 327 - 329
Reducing Variance in Temporal-Difference Value Estimation via Ensemble of Deep Networks
Litian Liang · Yaosheng Xu · Stephen Mcaleer · Dailin Hu · Alexander Ihler · Pieter Abbeel · Roy Fox
Spotlight
Thu Jul 21 02:55 PM -- 03:00 PM (EDT) @ Room 327 - 329
Constrained Variational Policy Optimization for Safe Reinforcement Learning
Zuxin Liu · Zhepeng Cen · Vladislav Isenbaev · Wei Liu · Steven Wu · Bo Li · Ding Zhao