Browse State-of-the-Art › Offline RL › Papers, page 6
Offline RL
Papers archive 2025-07-28
archive papers tagged: 755 · with a code link: 310 · where Syntology ran a sample: 164 (139 with a run with no instrument failure, 25 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (164 of 755 tagged: 139 with a run with no instrument failure, 25 where every run was a failure of Syntology's instrument)
Page 6 of 8: papers 501 to 600 of 755, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Self-Driving Telescopes: Autonomous Scheduling of Astronomical Observation Campaigns with Offline Reinforcement Learning29 Nov 2023 0 repositories listed
-
A Fully Data-Driven Approach for Realistic Traffic Signal Control Using Offline Reinforcement Learning27 Nov 2023 0 repositories listed
-
Offline Reinforcement Learning for Wireless Network Optimization with Mixture Datasets19 Nov 2023 0 repositories listed
-
Rethinking Decision Transformer via Hierarchical Reinforcement Learning1 Nov 2023 0 repositories listed
-
A Tractable Inference Perspective of Offline RL31 Oct 2023 0 repositories listed
-
Offline RL with Observation Histories: Analyzing and Improving Sample Complexity31 Oct 2023 0 repositories listed
-
Safety-aware Causal Representation for Trustworthy Offline Reinforcement Learning in Autonomous Driving31 Oct 2023 0 repositories listed
-
Guided Data Augmentation for Offline Reinforcement Learning and Imitation Learning27 Oct 2023 0 repositories listed
-
Model-enhanced Contrastive Reinforcement Learning for Sequential Recommendation25 Oct 2023 0 repositories listed
-
Finetuning Offline World Models in the Real World24 Oct 2023 0 repositories listed
-
Action-Quantized Offline Reinforcement Learning for Robotic Skill Learning18 Oct 2023 0 repositories listed
-
End-to-end Offline Reinforcement Learning for Glycemia Control16 Oct 2023 0 repositories listed
-
Leveraging Optimal Transport for Enhanced Offline Reinforcement Learning in Surgical Robotic Environments13 Oct 2023 0 repositories listed
-
Bi-Level Offline Policy Optimization with Limited Exploration10 Oct 2023 0 repositories listed
-
Planning to Go Out-of-Distribution in Offline-to-Online Reinforcement Learning9 Oct 2023 0 repositories listed
-
Improving Offline-to-Online Reinforcement Learning with Q Conditioned State Entropy Exploration7 Oct 2023 0 repositories listed
-
Self-Confirming Transformer for Belief-Conditioned Adaptation in Offline Multi-Agent Reinforcement Learning6 Oct 2023 0 repositories listed
-
Pessimistic Nonlinear Least-Squares Value Iteration for Offline Reinforcement Learning2 Oct 2023 0 repositories listed
-
Uncertainty-Aware Decision Transformer for Stochastic Driving Environments28 Sep 2023 0 repositories listed
-
Boosting Offline Reinforcement Learning for Autonomous Driving with Hierarchical Latent Skills24 Sep 2023 0 repositories listed
-
H2O+: An Improved Framework for Hybrid Offline-and-Online RL with Dynamics Gaps22 Sep 2023 0 repositories listed
-
Robotic Offline RL from Internet Videos via Value-Function Pre-Training22 Sep 2023 0 repositories listed
-
Q-Transformer: Scalable Offline Reinforcement Learning via Autoregressive Q-Functions18 Sep 2023 0 repositories listed
-
DOMAIN: MilDly COnservative Model-BAsed OfflINe Reinforcement Learning16 Sep 2023 0 repositories listed
-
Equivariant Data Augmentation for Generalization in Offline Reinforcement Learning14 Sep 2023 0 repositories listed
-
Hundreds Guide Millions: Adaptive Offline Reinforcement Learning with Expert Guidance4 Sep 2023 0 repositories listed
-
Multi-Objective Decision Transformers for Offline Reinforcement Learning31 Aug 2023 0 repositories listed
-
Reinforced Self-Training (ReST) for Language Modeling17 Aug 2023 0 repositories listed
-
Real Robot Challenge 2022: Learning Dexterous Manipulation from Offline Data in the Real World15 Aug 2023 0 repositories listed
-
Exploiting Generalization in Offline Reinforcement Learning via Unseen State Augmentations7 Aug 2023 0 repositories listed
-
Integrating Offline Reinforcement Learning with Transformers for Sequential Recommendation26 Jul 2023 0 repositories listed
-
PASTA: Pretrained Action-State Transformer Agents20 Jul 2023 0 repositories listed
-
Budgeting Counterfactual for Offline RL12 Jul 2023 0 repositories listed
-
Diffusion Policies for Out-of-Distribution Generalization in Offline Reinforcement Learning10 Jul 2023 0 repositories listed
-
Goal-Conditioned Predictive Coding for Offline Reinforcement Learning7 Jul 2023 0 repositories listed
-
Offline Reinforcement Learning with Imbalanced Datasets6 Jul 2023 0 repositories listed
-
LLQL: Logistic Likelihood Q-Learning for Reinforcement Learning5 Jul 2023 0 repositories listed
-
Prioritized Trajectory Replay: A Replay Memory for Data-driven Reinforcement Learning27 Jun 2023 0 repositories listed
-
ChiPFormer: Transferable Chip Placement via Offline Decision Transformer26 Jun 2023 0 repositories listed
-
Design from Policies: Conservative Test-Time Adaptation for Offline Policy Optimization26 Jun 2023 0 repositories listed
-
Fighting Uncertainty with Gradients: Offline Reinforcement Learning via Diffusion Score Matching24 Jun 2023 0 repositories listed
-
Offline Policy Evaluation for Reinforcement Learning with Adaptively Collected Data24 Jun 2023 0 repositories listed
-
CLUE: Calibrated Latent Guidance for Offline Reinforcement Learning23 Jun 2023 0 repositories listed
-
Warm-Start Actor-Critic: From Approximation Error to Sub-optimality Gap20 Jun 2023 0 repositories listed
-
Automatic Trade-off Adaptation in Offline RL16 Jun 2023 0 repositories listed
-
π2vec: Policy Representations with Successor Features16 Jun 2023 0 repositories listed
-
Offline Multi-Agent Reinforcement Learning with Coupled Value Factorization15 Jun 2023 0 repositories listed
-
Provably Efficient Offline Reinforcement Learning with Perturbed Data Sources14 Jun 2023 0 repositories listed
-
A Simple Unified Uncertainty-Guided Framework for Offline-to-Online Reinforcement Learning13 Jun 2023 0 repositories listed
-
Pruning the Way to Reliable Policies: A Multi-Objective Deep Q-Learning Approach to Critical Care13 Jun 2023 0 repositories listed
-
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles12 Jun 2023 0 repositories listed
-
Iteratively Refined Behavior Regularization for Offline Reinforcement Learning9 Jun 2023 0 repositories listed
-
Instructed Diffuser with Temporal Condition Guidance for Offline Reinforcement Learning8 Jun 2023 0 repositories listed
-
State Regularized Policy Optimization on Data with Dynamics Shift6 Jun 2023 0 repositories listed
-
PEARL: Zero-shot Cross-task Preference Alignment and Robust Reward Learning for Robotic Manipulation6 Jun 2023 0 repositories listed
-
Survival Instinct in Offline Reinforcement Learning5 Jun 2023 0 repositories listed
-
Achieving Fairness in Multi-Agent Markov Decision Processes Using Reinforcement Learning1 Jun 2023 0 repositories listed
-
Delphic Offline Reinforcement Learning under Nonidentifiable Hidden Confounding1 Jun 2023 0 repositories listed
-
Improving Offline RL by Blending Heuristics1 Jun 2023 0 repositories listed
-
IQL-TD-MPC: Implicit Q-Learning for Hierarchical Model Predictive Control1 Jun 2023 0 repositories listed
-
Reinforcement Learning with Human Feedback: Learning Dynamic Choices via Pessimism29 May 2023 0 repositories listed
-
Offline Primal-Dual Reinforcement Learning for Linear MDPs22 May 2023 0 repositories listed
-
Offline Reinforcement Learning with Additional Covering Distributions22 May 2023 0 repositories listed
-
Bayesian Reparameterization of Reward-Conditioned Reinforcement Learning with Energy-based Models18 May 2023 0 repositories listed
-
Reward-agnostic Fine-tuning: Provable Statistical Benefits of Hybrid Reinforcement Learning17 May 2023 0 repositories listed
-
SLiC-HF: Sequence Likelihood Calibration with Human Feedback17 May 2023 0 repositories listed
-
Double Pessimism is Provably Efficient for Distributionally Robust Offline Reinforcement Learning: Generic Algorithm and Robust Partial Coverage16 May 2023 0 repositories listed
-
12 May 2023 0 repositories listed Syntology 1 ran (of which 1 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified; the one sample that ran constructed an object rather than computing a result (of 1 harvested sample) · 1 pointer-only (licence)
-
What can online reinforcement learning with function approximation benefit from general coverage conditions?25 Apr 2023 0 repositories listed
-
Minimax-Optimal Reward-Agnostic Exploration in Reinforcement Learning14 Apr 2023 0 repositories listed
-
Enabling A Network AI Gym for Autonomous Cyber Agents3 Apr 2023 0 repositories listed
-
Unified Emulation-Simulation Training Environment for Autonomous Cyber Agents3 Apr 2023 0 repositories listed
-
Understanding Reinforcement Learning Algorithms: The Progress from Basic Q-learning to Proximal Policy Optimization31 Mar 2023 0 repositories listed
-
Finetuning from Offline Reinforcement Learning: Challenges, Trade-offs and Practical Solutions30 Mar 2023 0 repositories listed
-
Deep RL with Hierarchical Action Exploration for Dialogue Generation22 Mar 2023 0 repositories listed
-
Adaptive Policy Learning for Offline-to-Online Reinforcement Learning14 Mar 2023 0 repositories listed
-
Deploying Offline Reinforcement Learning with Human Feedback13 Mar 2023 0 repositories listed
-
Environment Transformer and Policy Optimization for Model-Based Offline Reinforcement Learning7 Mar 2023 0 repositories listed
-
Graph Decision Transformer7 Mar 2023 0 repositories listed
-
On the Sample Complexity of Vanilla Model-Based Offline Reinforcement Learning with Dependent Samples7 Mar 2023 0 repositories listed
-
Learning to Influence Human Behavior with Offline Reinforcement Learning3 Mar 2023 0 repositories listed
-
The Provable Benefits of Unsupervised Data Sharing for Offline Reinforcement Learning27 Feb 2023 0 repositories listed
-
Gauss-Newton Temporal Difference Learning with Nonlinear Function Approximation25 Feb 2023 0 repositories listed
-
Deep Offline Reinforcement Learning for Real-world Treatment Optimization Applications15 Feb 2023 0 repositories listed
-
Language Decision Transformers with Exponential Tilt for Interactive Text Environments10 Feb 2023 0 repositories listed
-
A Strong Baseline for Batch Imitation Learning6 Feb 2023 0 repositories listed
-
Offline Minimax Soft-Q-learning Under Realizability and Partial Coverage5 Feb 2023 0 repositories listed
-
Selective Uncertainty Propagation in Offline RL1 Feb 2023 0 repositories listed
-
Skill Decision Transformer31 Jan 2023 0 repositories listed
-
Learning to View: Decision Transformers for Active Object Detection23 Jan 2023 0 repositories listed
-
Benchmarks and Algorithms for Offline Preference-Based Reward Learning3 Jan 2023 0 repositories listed
-
Offline Evaluation for Reinforcement Learning-based Recommendation: A Critical Issue and Some Alternatives3 Jan 2023 0 repositories listed
-
Offline Policy Optimization in RL with Variance Regularizaton29 Dec 2022 0 repositories listed
-
Representation Learning in Deep RL via Discrete Information Bottleneck28 Dec 2022 0 repositories listed
-
Offline Reinforcement Learning via Linear-Programming with Error-Bound Induced Constraints28 Dec 2022 0 repositories listed
-
Bridging the Gap Between Offline and Online Reinforcement Learning Evaluation Methodologies15 Dec 2022 0 repositories listed
-
Confidence-Conditioned Value Functions for Offline Reinforcement Learning8 Dec 2022 0 repositories listed
-
Benchmarking Offline Reinforcement Learning Algorithms for E-Commerce Order Fraud Evaluation5 Dec 2022 0 repositories listed
-
Launchpad: Learning to Schedule Using Offline and Online RL Methods1 Dec 2022 0 repositories listed
-
Offline Policy Evaluation and Optimization under Confounding29 Nov 2022 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.