Browse State-of-the-Art › Offline RL › Papers, page 8
Offline RL
Papers archive 2025-07-28
archive papers tagged: 755 · with a code link: 310 · where Syntology ran a sample: 164 (139 with a run with no instrument failure, 25 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (164 of 755 tagged: 139 with a run with no instrument failure, 25 where every run was a failure of Syntology's instrument)
Page 8 of 8: papers 701 to 755 of 755, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Why so pessimistic? Estimating uncertainties for offline RL through ensembles, and why their independence matters.29 Sep 2021 0 repositories listed
-
Accelerating Offline Reinforcement Learning Application in Real-Time Bidding and Recommendation: Potential Use of Simulation17 Sep 2021 0 repositories listed
-
Conservative Data Sharing for Multi-Task Offline Reinforcement Learning16 Sep 2021 0 repositories listed
-
Policy Gradients Incorporating the Future4 Aug 2021 0 repositories listed
-
Offline Preference-Based Apprenticeship Learning20 Jul 2021 0 repositories listed
-
Constraints Penalized Q-learning for Safe Offline Reinforcement Learning19 Jul 2021 0 repositories listed
-
Pessimistic Model-based Offline Reinforcement Learning under Partial Coverage13 Jul 2021 0 repositories listed
-
Enhancing Video Analytics Accuracy via Real-time Automated Camera Parameter Tuning8 Jul 2021 0 repositories listed
-
The Least Restriction for Offline Reinforcement Learning5 Jul 2021 0 repositories listed
-
Provably Efficient Representation Selection in Low-rank Markov Decision Processes: From Online to Offline RL22 Jun 2021 0 repositories listed
-
Boosting Offline Reinforcement Learning with Residual Generative Modeling19 Jun 2021 0 repositories listed
-
Behavioral Priors and Dynamics Models: Improving Performance and Domain Transfer in Offline RL16 Jun 2021 0 repositories listed
-
On Multi-objective Policy Optimization as a Tool for Reinforcement Learning: Case Studies in Offline RL and Finetuning15 Jun 2021 0 repositories listed
-
Corruption-Robust Offline Reinforcement Learning11 Jun 2021 0 repositories listed
-
Offline Reinforcement Learning as Anti-Exploration11 Jun 2021 0 repositories listed
-
Offline Inverse Reinforcement Learning9 Jun 2021 0 repositories listed
-
Policy Finetuning: Bridging Sample-Efficient Offline and Online Reinforcement Learning9 Jun 2021 0 repositories listed
-
Improving Long-Term Metrics in Recommendation Systems using Short-Horizon Reinforcement Learning1 Jun 2021 0 repositories listed
-
Revisiting Design Choices in Offline Model Based Reinforcement Learning21 May 2021 0 repositories listed
-
Optimal Uniform OPE and Model-based Offline Reinforcement Learning in Time-Homogeneous, Reward-Free and Task-Agnostic Settings13 May 2021 0 repositories listed
-
Interpretable performance analysis towards offline reinforcement learning: A dataset perspective12 May 2021 0 repositories listed
-
InferNet for Delayed Reinforcement Tasks: Addressing the Temporal Credit Assignment Problem2 May 2021 0 repositories listed
-
Bridging Offline Reinforcement Learning and Imitation Learning: A Tale of Pessimism22 Mar 2021 0 repositories listed
-
Regularized Behavior Value Estimation17 Mar 2021 0 repositories listed
-
Sample Complexity of Offline Reinforcement Learning with Deep ReLU Networks11 Mar 2021 0 repositories listed
-
S4RL: Surprisingly Simple Self-Supervision for Offline Reinforcement Learning10 Mar 2021 0 repositories listed
-
Instabilities of Offline RL with Pre-Trained Neural Representation8 Mar 2021 0 repositories listed
-
DeepThermal: Combustion Optimization for Thermal Power Generating Units Using Offline Reinforcement Learning23 Feb 2021 0 repositories listed
-
Uncertainty Estimation Using Riemannian Model Dynamics for Offline Reinforcement Learning22 Feb 2021 0 repositories listed
-
Instrumental Variable Value Iteration for Causal Offline Reinforcement Learning19 Feb 2021 0 repositories listed
-
PerSim: Data-Efficient Offline Reinforcement Learning with Heterogeneous Agents via Personalized Simulators13 Feb 2021 0 repositories listed
-
Representation Matters: Offline Pretraining for Sequential Decision Making11 Feb 2021 0 repositories listed
-
Near-Optimal Offline Reinforcement Learning via Double Variance Reduction2 Feb 2021 0 repositories listed
-
Addressing Distribution Shift in Online Reinforcement Learning with Offline Datasets1 Jan 2021 0 repositories listed
-
Addressing Extrapolation Error in Deep Offline Reinforcement Learning1 Jan 2021 0 repositories listed
-
BRAC+: Going Deeper with Behavior Regularized Offline Reinforcement Learning1 Jan 2021 0 repositories listed
-
Offline Policy Optimization with Variance Regularization1 Jan 2021 0 repositories listed
-
Representation Balancing Offline Model-based Reinforcement Learning1 Jan 2021 0 repositories listed
-
Robust Offline Reinforcement Learning from Low-Quality Data1 Jan 2021 0 repositories listed
-
Uncertainty Weighted Offline Reinforcement Learning1 Jan 2021 0 repositories listed
-
Is Pessimism Provably Efficient for Offline RL?30 Dec 2020 0 repositories listed
-
Batch-Constrained Distributional Reinforcement Learning for Session-based Recommendation16 Dec 2020 0 repositories listed
-
MOReL: Model-Based Offline Reinforcement Learning1 Dec 2020 0 repositories listed
-
Offline Reinforcement Learning Hands-On29 Nov 2020 0 repositories listed
-
OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning26 Oct 2020 0 repositories listed
-
What are the Statistical Limits of Offline RL with Linear Function Approximation?22 Oct 2020 0 repositories listed
-
Learning Dexterous Manipulation from Suboptimal Experts16 Oct 2020 0 repositories listed
-
The reinforcement learning-based multi-agent cooperative approach for the adaptive speed regulation on a metallurgical pickling line16 Aug 2020 0 repositories listed
-
Model-Based Offline Planning12 Aug 2020 0 repositories listed
-
Overcoming Model Bias for Robust Offline Deep Reinforcement Learning12 Aug 2020 0 repositories listed
-
EMaQ: Expected-Max Q-Learning Operator for Simple Yet Effective Offline and Online RL21 Jul 2020 0 repositories listed
-
Hyperparameter Selection for Offline Reinforcement Learning17 Jul 2020 0 repositories listed
-
Near-Optimal Provable Uniform Convergence in Offline Policy Evaluation for Reinforcement Learning7 Jul 2020 0 repositories listed
-
Striving for Simplicity in Off-Policy Deep Reinforcement Learning25 Sep 2019 0 repositories listed
-
End-to-End Offline Goal-Oriented Dialog Policy Learning via Policy Gradient7 Dec 2017 0 repositories listed