Browse State-of-the-Art › D4RL › Papers, page 2
D4RL
Papers archive 2025-07-28
archive papers tagged: 226 · with a code link: 108 · where Syntology ran a sample: 68 (59 with a run with no instrument failure, 9 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (68 of 226 tagged: 59 with a run with no instrument failure, 9 where every run was a failure of Syntology's instrument)
Page 2 of 3: papers 101 to 200 of 226, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
23 Feb 2022 1 repository listed
-
13 Feb 2022 1 repository listed Syntology official (archive's flag): 6 ran · 6 ran (of which 0 constructed an object rather than computing a result; 4 with no instrument failure: 1 honoured, 0 violated, 3 with no contract checked; 2 where Syntology's instrument failed) · 0 unverified (of 6 harvested samples) · 2 pointer-only (licence)
-
24 Oct 2021 1 repository listed
-
19 Oct 2021 1 repository listed
-
29 Sep 2021 1 repository listed
-
4 Aug 2021 1 repository listed
-
12 Jul 2021 1 repository listed Syntology official (archive's flag): 4 ran · 4 ran (of which 2 constructed an object rather than computing a result; 3 with no instrument failure: 0 honoured, 0 violated, 3 with no contract checked; 1 where Syntology's instrument failed) · 1 unverified (of 5 harvested samples) · 5 pointer-only (licence)
-
16 Jun 2021 1 repository listed
-
From Novelty to Imitation: Self-Distilled Rewards for Offline Reinforcement Learning17 Jul 2025 0 repositories listed
-
Accelerating Residual Reinforcement Learning with Uncertainty Estimation21 Jun 2025 0 repositories listed
-
MOORL: A Framework for Integrating Offline-Online Reinforcement Learning11 Jun 2025 0 repositories listed
-
Policy-Based Trajectory Clustering in Offline Reinforcement Learning10 Jun 2025 0 repositories listed
-
STITCH-OPE: Trajectory Stitching with Guided Diffusion for Off-Policy Evaluation27 May 2025 0 repositories listed
-
Policy-Driven World Model Adaptation for Robust Offline Model-based Reinforcement Learning19 May 2025 0 repositories listed
-
Temporal Distance-aware Transition Augmentation for Offline Model-based Reinforcement Learning19 May 2025 0 repositories listed
-
Imagination-Limited Q-Learning for Offline Reinforcement Learning18 May 2025 0 repositories listed
-
Pretraining a Shared Q-Network for Data-Efficient Offline Reinforcement Learning9 May 2025 0 repositories listed
-
Taming OOD Actions for Offline Reinforcement Learning: An Advantage-Based Approach8 May 2025 0 repositories listed
-
Analytic Energy-Guided Policy Optimization for Offline Reinforcement Learning3 May 2025 0 repositories listed
-
An Optimal Discriminator Weighted Imitation Perspective for Reinforcement Learning17 Apr 2025 0 repositories listed
-
16 Apr 2025 0 repositories listed Syntology 10 ran (of which 9 constructed an object rather than computing a result; 9 with no instrument failure: 0 honoured, 0 violated, 9 with no contract checked; 1 where Syntology's instrument failed) · 4 unverified (of 14 harvested samples) · 14 pointer-only (licence)
-
Decision SpikeFormer: Spike-Driven Transformer for Decision Making4 Apr 2025 0 repositories listed
-
Model-Based Offline Reinforcement Learning with Adversarial Data Augmentation26 Mar 2025 0 repositories listed
-
Diverse Transformer Decoding for Offline Reinforcement Learning Using Financial Algorithmic Approaches13 Feb 2025 0 repositories listed
-
Behavior-Regularized Diffusion Policy Optimization for Offline Reinforcement Learning7 Feb 2025 0 repositories listed
-
Learning from Suboptimal Data in Continuous Control via Auto-Regressive Soft Q-Network1 Feb 2025 0 repositories listed
-
Projection Implicit Q-Learning with Support Constraint for Offline Reinforcement Learning15 Jan 2025 0 repositories listed
-
DRDT3: Diffusion-Refined Decision Test-Time Training Model12 Jan 2025 0 repositories listed
-
SALE-Based Offline Reinforcement Learning with Ensemble Q-Networks7 Jan 2025 0 repositories listed
-
SR-Reward: Taking The Path More Traveled4 Jan 2025 0 repositories listed
-
Goal-Conditioned Data Augmentation for Offline Reinforcement Learning29 Dec 2024 0 repositories listed
-
ACL-QL: Adaptive Conservative Level in Q-Learning for Offline Reinforcement Learning22 Dec 2024 0 repositories listed
-
Finer Behavioral Foundation Models via Auto-Regressive Features and Advantage Weighting5 Dec 2024 0 repositories listed
-
Enhancing Decision Transformer with Diffusion-Based Trajectory Branch Generation18 Nov 2024 0 repositories listed
-
Return Augmented Decision Transformer for Off-Dynamics Reinforcement Learning30 Oct 2024 0 repositories listed
-
SAMG: State-Action-Aware Offline-to-Online Reinforcement Learning with Offline Model Guidance24 Oct 2024 0 repositories listed
-
RGMDT: Return-Gap-Minimizing Decision Tree Extraction in Non-Euclidean Metric Space21 Oct 2024 0 repositories listed
-
Rethinking Optimal Transport in Offline Reinforcement Learning17 Oct 2024 0 repositories listed
-
Diffusion Model Predictive Control7 Oct 2024 0 repositories listed
-
KAN v.s. MLP for Offline Reinforcement Learning15 Sep 2024 0 repositories listed
-
Planning Transformer: Long-Horizon Offline Reinforcement Learning with Planning Tokens14 Sep 2024 0 repositories listed
-
Q-value Regularized Decision ConvFormer for Offline Reinforcement Learning12 Sep 2024 0 repositories listed
-
Forward KL Regularized Preference Optimization for Aligning Diffusion Policies9 Sep 2024 0 repositories listed
-
SUMO: Search-Based Uncertainty Estimation for Model-Based Offline Reinforcement Learning23 Aug 2024 0 repositories listed
-
Offline Model-Based Reinforcement Learning with Anti-Exploration20 Aug 2024 0 repositories listed
-
SelfBC: Self Behavior Cloning for Offline Reinforcement Learning4 Aug 2024 0 repositories listed
-
Offline Reinforcement Learning with Imputed Rewards15 Jul 2024 0 repositories listed
-
Model-based Offline Reinforcement Learning with Lower Expectile Q-Learning30 Jun 2024 0 repositories listed
-
Binary Reward Labeling: Bridging Offline Preference and Reward-Based Reinforcement Learning14 Jun 2024 0 repositories listed
-
DiffPoGAN: Diffusion Policies with Generative Adversarial Networks for Offline Reinforcement Learning13 Jun 2024 0 repositories listed
-
SeMOPO: Learning High-quality Model and Policy from Low-quality Offline Visual Datasets13 Jun 2024 0 repositories listed
-
CDSA: Conservative Denoising Score-based Algorithm for Offline Reinforcement Learning11 Jun 2024 0 repositories listed
-
UDQL: Bridging The Gap between MSE Loss and The Optimal Value Function in Offline Reinforcement Learning5 Jun 2024 0 repositories listed
-
Decision Mamba: Reinforcement Learning via Hybrid Selective Sequence Modeling31 May 2024 0 repositories listed
-
Fourier Controller Networks for Real-Time Decision-Making in Embodied Learning30 May 2024 0 repositories listed
-
Learning from Random Demonstrations: Offline Reinforcement Learning with Importance-Sampled Diffusion Models30 May 2024 0 repositories listed
-
State-Constrained Offline Reinforcement Learning23 May 2024 0 repositories listed
-
Task-agnostic Decision Transformer for Multi-type Agent Control with Federated Split Training22 May 2024 0 repositories listed
-
Towards Robust Policy: Enhancing Offline Reinforcement Learning with Adversarial Attacks and Defenses18 May 2024 0 repositories listed
-
Improving Offline Reinforcement Learning with Inaccurate Simulators7 May 2024 0 repositories listed
-
Offline Trajectory Generalization for Offline Reinforcement Learning16 Apr 2024 0 repositories listed
-
Regularized Conditional Diffusion Model for Multi-Task Preference Alignment7 Apr 2024 0 repositories listed
-
Simple Ingredients for Offline Reinforcement Learning19 Mar 2024 0 repositories listed
-
Align Your Intents: Offline Imitation Learning via Optimal Transport20 Feb 2024 0 repositories listed
-
Contrastive Diffuser: Planning Towards High Return States via Contrastive Learning5 Feb 2024 0 repositories listed
-
Deep autoregressive density nets vs neural ensembles for model-based offline reinforcement learning5 Feb 2024 0 repositories listed
-
Diffusion World Model: Future Modeling Beyond Step-by-Step Rollout for Offline Reinforcement Learning5 Feb 2024 0 repositories listed
-
DiffStitch: Boosting Offline Reinforcement Learning with Diffusion-based Trajectory Stitching4 Feb 2024 0 repositories listed
-
Augmenting Offline Reinforcement Learning with State-only Interactions1 Feb 2024 0 repositories listed
-
Context-Former: Stitching via Latent Conditioned Sequence Modeling29 Jan 2024 0 repositories listed
-
DiffuserLite: Towards Real-time Diffusion Planning27 Jan 2024 0 repositories listed
-
Guided Data Augmentation for Offline Reinforcement Learning and Imitation Learning27 Oct 2023 0 repositories listed
-
Reward-Consistent Dynamics Models are Strongly Generalizable for Offline Reinforcement Learning9 Oct 2023 0 repositories listed
-
DOMAIN: MilDly COnservative Model-BAsed OfflINe Reinforcement Learning16 Sep 2023 0 repositories listed
-
Multi-Objective Decision Transformers for Offline Reinforcement Learning31 Aug 2023 0 repositories listed
-
Statistically Efficient Variance Reduction with Double Policy Estimation for Off-Policy Evaluation in Sequence-Modeled Reinforcement Learning28 Aug 2023 0 repositories listed
-
Learning Computational Efficient Bots with Costly Features18 Aug 2023 0 repositories listed
-
Offline Reinforcement Learning with On-Policy Q-Function Regularization25 Jul 2023 0 repositories listed
-
Offline Diversity Maximization Under Imitation Constraints21 Jul 2023 0 repositories listed
-
Budgeting Counterfactual for Offline RL12 Jul 2023 0 repositories listed
-
Diffusion Policies for Out-of-Distribution Generalization in Offline Reinforcement Learning10 Jul 2023 0 repositories listed
-
Offline Reinforcement Learning with Imbalanced Datasets6 Jul 2023 0 repositories listed
-
Elastic Decision Transformer5 Jul 2023 0 repositories listed
-
Prioritized Trajectory Replay: A Replay Memory for Data-driven Reinforcement Learning27 Jun 2023 0 repositories listed
-
CEIL: Generalized Contextual Imitation Learning26 Jun 2023 0 repositories listed
-
A Simple Unified Uncertainty-Guided Framework for Offline-to-Online Reinforcement Learning13 Jun 2023 0 repositories listed
-
HIPODE: Enhancing Offline Reinforcement Learning with High-Quality Synthetic Data from a Policy-Decoupled Approach10 Jun 2023 0 repositories listed
-
Iteratively Refined Behavior Regularization for Offline Reinforcement Learning9 Jun 2023 0 repositories listed
-
Boosting Offline Reinforcement Learning with Action Preference Query6 Jun 2023 0 repositories listed
-
Improving Offline RL by Blending Heuristics1 Jun 2023 0 repositories listed
-
IQL-TD-MPC: Implicit Q-Learning for Hierarchical Model Predictive Control1 Jun 2023 0 repositories listed
-
Emergent Agentic Transformer from Chain of Hindsight Experience26 May 2023 0 repositories listed
-
Skill Decision Transformer31 Jan 2023 0 repositories listed
-
Improving Behavioural Cloning with Positive Unlabeled Learning27 Jan 2023 0 repositories listed
-
Model-based Offline Reinforcement Learning with Local Misspecification26 Jan 2023 0 repositories listed
-
Model-based trajectory stitching for improved behavioural cloning and its applications8 Dec 2022 0 repositories listed
-
Flow to Control: Offline Reinforcement Learning with Lossless Primitive Discovery2 Dec 2022 0 repositories listed
-
Offline Reinforcement Learning with Closed-Form Policy Improvement Operators29 Nov 2022 0 repositories listed
-
Contextual Transformer for Offline Meta Reinforcement Learning15 Nov 2022 0 repositories listed
-
Offline Reinforcement Learning with Adaptive Behavior Regularization15 Nov 2022 0 repositories listed
Syntology lines on 3 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.