Browse State-of-the-Art › Offline RL › Papers, page 5
Offline RL
Papers archive 2025-07-28
archive papers tagged: 755 · with a code link: 310 · where Syntology ran a sample: 164 (139 with a run with no instrument failure, 25 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (164 of 755 tagged: 139 with a run with no instrument failure, 25 where every run was a failure of Syntology's instrument)
Page 5 of 8: papers 401 to 500 of 755, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Optimization Solution Functions as Deterministic Policies for Offline Reinforcement Learning27 Aug 2024 0 repositories listed
-
Unsupervised-to-Online Reinforcement Learning27 Aug 2024 0 repositories listed
-
SUMO: Search-Based Uncertainty Estimation for Model-Based Offline Reinforcement Learning23 Aug 2024 0 repositories listed
-
Domain Adaptation for Offline Reinforcement Learning with Limited Samples22 Aug 2024 0 repositories listed
-
Integrating Multi-Modal Input Token Mixer Into Mamba-Based Decision Models: Decision MetaMamba20 Aug 2024 0 repositories listed
-
Offline Model-Based Reinforcement Learning with Anti-Exploration20 Aug 2024 0 repositories listed
-
Enhancing Reinforcement Learning Through Guided Search19 Aug 2024 0 repositories listed
-
Model-based RL as a Minimalist Approach to Horizon-Free and Second-Order Bounds16 Aug 2024 0 repositories listed
-
D5RL: Diverse Datasets for Data-Driven Deep Reinforcement Learning15 Aug 2024 0 repositories listed
-
Hybrid Reinforcement Learning Breaks Sample Size Barriers in Linear MDPs8 Aug 2024 0 repositories listed
-
Consistent time travel for realistic interactions with historical data: reinforcement learning for market making5 Aug 2024 0 repositories listed
-
Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning29 Jul 2024 0 repositories listed
-
Language-Conditioned Offline RL for Multi-Robot Navigation29 Jul 2024 0 repositories listed
-
Sparsity-based Safety Conservatism for Constrained Offline Reinforcement Learning17 Jul 2024 0 repositories listed
-
BECAUSE: Bilinear Causal Representation for Generalizable Offline Model-based Reinforcement Learning15 Jul 2024 0 repositories listed
-
Pessimism Meets Risk: Risk-Sensitive Offline Reinforcement Learning10 Jul 2024 0 repositories listed
-
FOSP: Fine-tuning Offline Safe Policy through World Models6 Jul 2024 0 repositories listed
-
Robust Decision Transformer: Tackling Data Corruption in Offline RL via Sequence Modeling5 Jul 2024 0 repositories listed
-
To Switch or Not to Switch? Balanced Policy Switching in Offline Reinforcement Learning1 Jul 2024 0 repositories listed
-
Benchmarks for Reinforcement Learning with Biased Offline Data and Imperfect Simulators30 Jun 2024 0 repositories listed
-
Model-based Offline Reinforcement Learning with Lower Expectile Q-Learning30 Jun 2024 0 repositories listed
-
Preference Elicitation for Offline Reinforcement Learning26 Jun 2024 0 repositories listed
-
Equivariant Offline Reinforcement Learning20 Jun 2024 0 repositories listed
-
Urban-Focused Multi-Task Offline Reinforcement Learning with Contrastive Data Sharing20 Jun 2024 0 repositories listed
-
Order-Optimal Instance-Dependent Bounds for Offline Reinforcement Learning with Preference Feedback18 Jun 2024 0 repositories listed
-
The Role of Inherent Bellman Error in Offline Reinforcement Learning with Linear Function Approximation17 Jun 2024 0 repositories listed
-
Binary Reward Labeling: Bridging Offline Preference and Reward-Based Reinforcement Learning14 Jun 2024 0 repositories listed
-
A Dual Approach to Imitation Learning from Observations with Offline Datasets13 Jun 2024 0 repositories listed
-
DiffPoGAN: Diffusion Policies with Generative Adversarial Networks for Offline Reinforcement Learning13 Jun 2024 0 repositories listed
-
SeMOPO: Learning High-quality Model and Policy from Low-quality Offline Visual Datasets13 Jun 2024 0 repositories listed
-
Augmenting Offline RL with Unlabeled Data11 Jun 2024 0 repositories listed
-
CDSA: Conservative Denoising Score-based Algorithm for Offline Reinforcement Learning11 Jun 2024 0 repositories listed
-
Integrating Domain Knowledge for handling Limited Data in Offline RL11 Jun 2024 0 repositories listed
-
Discovering Multiple Solutions from a Single Task in Offline Reinforcement Learning10 Jun 2024 0 repositories listed
-
Self-Play with Adversarial Critic: Provable and Scalable Offline Alignment for Language Models6 Jun 2024 0 repositories listed
-
UDQL: Bridging The Gap between MSE Loss and The Optimal Value Function in Offline Reinforcement Learning5 Jun 2024 0 repositories listed
-
A Fast Convergence Theory for Offline Decision Making3 Jun 2024 0 repositories listed
-
Causal prompting model-based offline reinforcement learning3 Jun 2024 0 repositories listed
-
Inverse Concave-Utility Reinforcement Learning is Inverse Game Theory29 May 2024 0 repositories listed
-
Preferred-Action-Optimized Diffusion Policies for Offline Reinforcement Learning29 May 2024 0 repositories listed
-
Unified Preference Optimization: Language Model Alignment Beyond the Preference Frontier28 May 2024 0 repositories listed
-
OPERA: Automatic Offline Policy Evaluation with Re-weighted Aggregates of Multiple Estimators27 May 2024 0 repositories listed
-
Trajectory Data Suffices for Statistically Efficient Learning in Offline RL with Linear q^π-Realizability and Concentrability27 May 2024 0 repositories listed
-
Exclusively Penalized Q-learning for Offline Reinforcement Learning23 May 2024 0 repositories listed
-
Offline RL via Feature-Occupancy Gradient Ascent22 May 2024 0 repositories listed
-
Efficient Imitation Learning with Conservative World Models21 May 2024 0 repositories listed
-
Towards Robust Policy: Enhancing Offline Reinforcement Learning with Adversarial Attacks and Defenses18 May 2024 0 repositories listed
-
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning12 May 2024 0 repositories listed
-
Improving Offline Reinforcement Learning with Inaccurate Simulators7 May 2024 0 repositories listed
-
Out-of-Distribution Adaptation in Offline RL: Counterfactual Reasoning via Causal Normalizing Flows6 May 2024 0 repositories listed
-
Robot Air Hockey: A Manipulation Testbed for Robot Learning with Reinforcement Learning6 May 2024 0 repositories listed
-
Generalize by Touching: Tactile Ensemble Skill Transfer for Robotic Furniture Assembly26 Apr 2024 0 repositories listed
-
Offline Reinforcement Learning with Behavioral Supervisor Tuning25 Apr 2024 0 repositories listed
-
An Offline Reinforcement Learning Algorithm Customized for Multi-Task Fusion in Large-Scale Recommender Systems19 Apr 2024 0 repositories listed
-
Data-Incremental Continual Offline Reinforcement Learning19 Apr 2024 0 repositories listed
-
Offline Trajectory Generalization for Offline Reinforcement Learning16 Apr 2024 0 repositories listed
-
Empowering Embodied Visual Tracking with Visual Foundation Models and Offline RL15 Apr 2024 0 repositories listed
-
Generative Probabilistic Planning for Optimizing Supply Chain Networks11 Apr 2024 0 repositories listed
-
Leveraging Domain-Unlabeled Data in Offline Reinforcement Learning across Two Domains11 Apr 2024 0 repositories listed
-
CtRL-Sim: Reactive and Controllable Driving Agents with Offline Reinforcement Learning29 Mar 2024 0 repositories listed
-
Scaling Vision-and-Language Navigation With Offline RL27 Mar 2024 0 repositories listed
-
Uncertainty-aware Distributional Offline Reinforcement Learning26 Mar 2024 0 repositories listed
-
Reinforcement Learning-based Recommender Systems with Large Language Models for State Reward and Action Modeling25 Mar 2024 0 repositories listed
-
The Value of Reward Lookahead in Reinforcement Learning18 Mar 2024 0 repositories listed
-
Minimax Optimal and Computationally Efficient Algorithms for Distributionally Robust Offline Reinforcement Learning14 Mar 2024 0 repositories listed
-
Towards Optimizing Human-Centric Objectives in AI-Assisted Decision-Making With Offline Reinforcement Learning9 Mar 2024 0 repositories listed
-
Why Online Reinforcement Learning is Causal7 Mar 2024 0 repositories listed
-
Offline Fictitious Self-Play for Competitive Games29 Feb 2024 0 repositories listed
-
Trajectory-wise Iterative Reinforcement Learning Framework for Auto-bidding23 Feb 2024 0 repositories listed
-
Align Your Intents: Offline Imitation Learning via Optimal Transport20 Feb 2024 0 repositories listed
-
Offline Multi-task Transfer RL with Representational Penalization19 Feb 2024 0 repositories listed
-
Learning Goal-Conditioned Policies from Sub-Optimal Offline Data via Metric Learning16 Feb 2024 0 repositories listed
-
Universal Black-Box Reward Poisoning Attack against Offline Reinforcement Learning15 Feb 2024 0 repositories listed
-
Measurement Scheduling for ICU Patients with Offline Reinforcement Learning12 Feb 2024 0 repositories listed
-
More Benefits of Being Distributional: Second-Order Bounds for Reinforcement Learning11 Feb 2024 0 repositories listed
-
Federated Offline Reinforcement Learning: Collaborative Single-Policy Coverage Suffices8 Feb 2024 0 repositories listed
-
Offline Actor-Critic Reinforcement Learning Scales to Large Models8 Feb 2024 0 repositories listed
-
Real-World Fluid Directed Rigid Body Control via Deep Reinforcement Learning8 Feb 2024 0 repositories listed
-
A Primal-Dual Algorithm for Offline Constrained Reinforcement Learning with Linear MDPs7 Feb 2024 0 repositories listed
-
Contrastive Diffuser: Planning Towards High Return States via Contrastive Learning5 Feb 2024 0 repositories listed
-
DiffStitch: Boosting Offline Reinforcement Learning with Diffusion-based Trajectory Stitching4 Feb 2024 0 repositories listed
-
The Virtues of Pessimism in Inverse Reinforcement Learning4 Feb 2024 0 repositories listed
-
3 Feb 2024 0 repositories listed Syntology 4 ran (of which 0 constructed an object rather than computing a result; 4 with no instrument failure: 0 honoured, 0 violated, 4 with no contract checked; 0 where Syntology's instrument failed) · 1 unverified (of 5 harvested samples) · 5 pointer-only (licence)
-
Context-Former: Stitching via Latent Conditioned Sequence Modeling29 Jan 2024 0 repositories listed
-
Multi-Object Navigation in real environments using hybrid policies24 Jan 2024 0 repositories listed
-
MoMA: Model-based Mirror Ascent for Offline Reinforcement Learning21 Jan 2024 0 repositories listed
-
Harnessing Density Ratios for Online Reinforcement Learning18 Jan 2024 0 repositories listed
-
Solving Continual Offline Reinforcement Learning with Decision Transformer16 Jan 2024 0 repositories listed
-
Optimistic Model Rollouts for Pessimistic Offline Policy Optimization11 Jan 2024 0 repositories listed
-
MOTO: Offline Pre-training to Online Fine-tuning for Model-based Robot Learning6 Jan 2024 0 repositories listed
-
On Sample-Efficient Offline Reinforcement Learning: Data Diversity, Posterior Sampling, and Beyond6 Jan 2024 0 repositories listed
-
Adversarially Trained Weighted Actor-Critic for Safe Offline Reinforcement Learning1 Jan 2024 0 repositories listed
-
CUDC: A Curiosity-Driven Unsupervised Data Collection Method with Adaptive Temporal Distances for Offline Reinforcement Learning19 Dec 2023 0 repositories listed
-
Neural Network Approximation for Pessimistic Offline Reinforcement Learning19 Dec 2023 0 repositories listed
-
Advancing RAN Slicing with Offline Reinforcement Learning16 Dec 2023 0 repositories listed
-
Model-Based Epistemic Variance of Values for Risk-Aware Policy Optimization7 Dec 2023 0 repositories listed
-
Diffused Task-Agnostic Milestone Planner6 Dec 2023 0 repositories listed
-
Evaluation of Active Feature Acquisition Methods for Static Feature Settings6 Dec 2023 0 repositories listed
-
H-GAP: Humanoid Control with a Generalist Planner5 Dec 2023 0 repositories listed
-
Is Inverse Reinforcement Learning Harder than Standard Reinforcement Learning? A Theoretical Perspective29 Nov 2023 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.