Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 70
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 70 of 152: papers 6,901 to 7,000 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Learning Multi-Agent Intention-Aware Communication for Optimal Multi-Order Execution in Finance6 Jul 2023 0 repositories listed
-
Offline Reinforcement Learning with Imbalanced Datasets6 Jul 2023 0 repositories listed
-
Provably Efficient Iterated CVaR Reinforcement Learning with Function Approximation and Human Feedback6 Jul 2023 0 repositories listed
-
Generative Job Recommendations with Large Language Model5 Jul 2023 0 repositories listed
-
LLQL: Logistic Likelihood Q-Learning for Reinforcement Learning5 Jul 2023 0 repositories listed
-
A Scalable Reinforcement Learning-based System Using On-Chain Data for Cryptocurrency Portfolio Management4 Jul 2023 0 repositories listed
-
Comparing Reinforcement Learning and Human Learning using the Game of Hidden Rules30 Jun 2023 0 repositories listed
-
Decentralized Motor Skill Learning for Complex Robotic Systems30 Jun 2023 0 repositories listed
-
Navigation of micro-robot swarms for targeted delivery using reinforcement learning30 Jun 2023 0 repositories listed
-
ArrayBot: Reinforcement Learning for Generalizable Distributed Manipulation through Touch29 Jun 2023 0 repositories listed
-
Eigensubspace of Temporal-Difference Dynamics and How It Improves Value Approximation in Reinforcement Learning29 Jun 2023 0 repositories listed
-
Laxity-Aware Scalable Reinforcement Learning for HVAC Control29 Jun 2023 0 repositories listed
-
Probabilistic Constraint for Safety-Critical Reinforcement Learning29 Jun 2023 0 repositories listed
-
Safety-Aware Task Composition for Discrete and Continuous Reinforcement Learning29 Jun 2023 0 repositories listed
-
Action and Trajectory Planning for Urban Autonomous Driving with Hierarchical Reinforcement Learning28 Jun 2023 0 repositories listed
-
Sharper Model-free Reinforcement Learning for Average-reward Markov Decision Processes28 Jun 2023 0 repositories listed
-
Structure in Deep Reinforcement Learning: A Survey and Open Problems28 Jun 2023 0 repositories listed
-
Learning to Sail Dynamic Networks: The MARLIN Reinforcement Learning Framework for Congestion Control in Tactical Environments27 Jun 2023 0 repositories listed
-
Machine-learning based noise characterization and correction on neutral atoms NISQ devices27 Jun 2023 0 repositories listed
-
Prioritized Trajectory Replay: A Replay Memory for Data-driven Reinforcement Learning27 Jun 2023 0 repositories listed
-
Augmenting Control over Exploration Space in Molecular Dynamics Simulators to Streamline De Novo Analysis through Generative Control Policies26 Jun 2023 0 repositories listed
-
ChiPFormer: Transferable Chip Placement via Offline Decision Transformer26 Jun 2023 0 repositories listed
-
Decentralized Multi-Robot Formation Control Using Reinforcement Learning26 Jun 2023 0 repositories listed
-
Estimating player completion rate in mobile puzzle games using reinforcement learning26 Jun 2023 0 repositories listed
-
Supervised Pretraining Can Learn In-Context Reinforcement Learning26 Jun 2023 0 repositories listed
-
A Framework for dynamically meeting performance objectives on a service mesh25 Jun 2023 0 repositories listed
-
Is RLHF More Difficult than Standard RL?25 Jun 2023 0 repositories listed
-
PolicyClusterGCN: Identifying Efficient Clusters for Training Graph Convolutional Networks25 Jun 2023 0 repositories listed
-
Fighting Uncertainty with Gradients: Offline Reinforcement Learning via Diffusion Score Matching24 Jun 2023 0 repositories listed
-
Towards Optimal Pricing of Demand Response -- A Nonparametric Constrained Policy Optimization Approach24 Jun 2023 0 repositories listed
-
Active Coverage for PAC Reinforcement Learning23 Jun 2023 0 repositories listed
-
CLUE: Calibrated Latent Guidance for Offline Reinforcement Learning23 Jun 2023 0 repositories listed
-
Reinforcement Learning with Temporal-Logic-Based Causal Diagrams23 Jun 2023 0 repositories listed
-
MP3: Movement Primitive-Based (Re-)Planning Policy22 Jun 2023 0 repositories listed
-
Transferable Curricula through Difficulty Conditioned Generators22 Jun 2023 0 repositories listed
-
Autonomous Driving with Deep Reinforcement Learning in CARLA Simulation20 Jun 2023 0 repositories listed
-
Efficient Dynamics Modeling in Interactive Environments with Koopman Theory20 Jun 2023 0 repositories listed
-
Int-HRL: Towards Intention-based Hierarchical Reinforcement Learning20 Jun 2023 0 repositories listed
-
Reward Shaping via Diffusion Process in Reinforcement Learning20 Jun 2023 0 repositories listed
-
Warm-Start Actor-Critic: From Approximation Error to Sub-optimality Gap20 Jun 2023 0 repositories listed
-
On the Model-Misspecification in Reinforcement Learning19 Jun 2023 0 repositories listed
-
Acceleration in Policy Optimization18 Jun 2023 0 repositories listed
-
Do as I can, not as I get17 Jun 2023 0 repositories listed
-
The RL Perceptron: Generalisation Dynamics of Policy Learning in High Dimensions17 Jun 2023 0 repositories listed
-
Bootstrapped Representations in Reinforcement Learning16 Jun 2023 0 repositories listed
-
Temporal Difference Learning with Experience Replay16 Jun 2023 0 repositories listed
-
The False Dawn: Reevaluating Google's Reinforcement Learning for Chip Macro Placement16 Jun 2023 0 repositories listed
-
Granger Causal Interaction Skill Chains15 Jun 2023 0 repositories listed
-
Langevin Thompson Sampling with Logarithmic Communication: Bandits and Reinforcement Learning15 Jun 2023 0 repositories listed
-
Low-Switching Policy Gradient with Exploration via Online Sensitivity Sampling15 Jun 2023 0 repositories listed
-
Offline Multi-Agent Reinforcement Learning with Coupled Value Factorization15 Jun 2023 0 repositories listed
-
Predictive Maneuver Planning with Deep Reinforcement Learning (PMP-DRL) for comfortable and safe autonomous driving15 Jun 2023 0 repositories listed
-
Real-Time Network-Level Traffic Signal Control: An Explicit Multiagent Coordination Method15 Jun 2023 0 repositories listed
-
A reinforcement learning strategy for p-adaptation in high order solvers14 Jun 2023 0 repositories listed
-
Provably Efficient Offline Reinforcement Learning with Perturbed Data Sources14 Jun 2023 0 repositories listed
-
Simple Embodied Language Learning as a Byproduct of Meta-Reinforcement Learning14 Jun 2023 0 repositories listed
-
Skill-Critic: Refining Learned Skills for Hierarchical Reinforcement Learning14 Jun 2023 0 repositories listed
-
A Primal-Dual-Critic Algorithm for Offline Constrained Reinforcement Learning13 Jun 2023 0 repositories listed
-
A Simple Unified Uncertainty-Guided Framework for Offline-to-Online Reinforcement Learning13 Jun 2023 0 repositories listed
-
Kernelized Reinforcement Learning with Order Optimal Regret Bounds13 Jun 2023 0 repositories listed
-
Multi-market Energy Optimization with Renewables via Reinforcement Learning13 Jun 2023 0 repositories listed
-
Pruning the Way to Reliable Policies: A Multi-Objective Deep Q-Learning Approach to Critical Care13 Jun 2023 0 repositories listed
-
Combining Reinforcement Learning and Barrier Functions for Adaptive Risk Management in Portfolio Optimization12 Jun 2023 0 repositories listed
-
Diverse Projection Ensembles for Distributional Reinforcement Learning12 Jun 2023 0 repositories listed
-
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles12 Jun 2023 0 repositories listed
-
Robust Reinforcement Learning through Efficient Adversarial Herding12 Jun 2023 0 repositories listed
-
Tackling Heavy-Tailed Rewards in Reinforcement Learning with Function Approximation: Minimax Optimal and Instance-Dependent Regret Bounds12 Jun 2023 0 repositories listed
-
Reinforcement Learning in Robotic Motion Planning by Combined Experience-based Planning and Self-Imitation Learning11 Jun 2023 0 repositories listed
-
PEAR: Primitive enabled Adaptive Relabeling for boosting Hierarchical Reinforcement Learning10 Jun 2023 0 repositories listed
-
Confidence-Controlled Exploration: Efficient Sparse-Reward Policy Learning for Robot Navigation9 Jun 2023 0 repositories listed
-
Approximate information state based convergence analysis of recurrent Q-learning9 Jun 2023 0 repositories listed
-
Iteratively Refined Behavior Regularization for Offline Reinforcement Learning9 Jun 2023 0 repositories listed
-
Learning Not to Spoof9 Jun 2023 0 repositories listed
-
Bring Your Own (Non-Robust) Algorithm to Solve Robust MDPs by Estimating The Worst Kernel9 Jun 2023 0 repositories listed
-
The Role of Diverse Replay for Generalisation in Reinforcement Learning9 Jun 2023 0 repositories listed
-
Instructed Diffuser with Temporal Condition Guidance for Offline Reinforcement Learning8 Jun 2023 0 repositories listed
-
Timing Process Interventions with Causal Inference and Reinforcement Learning7 Jun 2023 0 repositories listed
-
CAVEN: An Embodied Conversational Agent for Efficient Audio-Visual Navigation in Noisy Environments6 Jun 2023 0 repositories listed
-
Boosting Offline Reinforcement Learning with Action Preference Query6 Jun 2023 0 repositories listed
-
State Regularized Policy Optimization on Data with Dynamics Shift6 Jun 2023 0 repositories listed
-
PEARL: Zero-shot Cross-task Preference Alignment and Robust Reward Learning for Robotic Manipulation6 Jun 2023 0 repositories listed
-
A General Perspective on Objectives of Reinforcement Learning5 Jun 2023 0 repositories listed
-
A Novel Multi-Agent Deep RL Approach for Traffic Signal Control5 Jun 2023 0 repositories listed
-
Action-Evolution Petri Nets: a Framework for Modeling and Solving Dynamic Task Assignment Problems5 Jun 2023 0 repositories listed
-
Survival Instinct in Offline Reinforcement Learning5 Jun 2023 0 repositories listed
-
Cycle Consistency Driven Object Discovery3 Jun 2023 0 repositories listed
-
A Modular Test Bed for Reinforcement Learning Incorporation into Industrial Applications2 Jun 2023 0 repositories listed
-
An Architecture for Deploying Reinforcement Learning in Industrial Environments2 Jun 2023 0 repositories listed
-
Deep Q-Learning versus Proximal Policy Optimization: Performance Comparison in a Material Sorting Task2 Jun 2023 0 repositories listed
-
Efficient Reinforcement Learning with Impaired Observability: Learning to Act with Delayed and Missing State Observations2 Jun 2023 0 repositories listed
-
Improving the generalizability and robustness of large-scale traffic signal control2 Jun 2023 0 repositories listed
-
Interpretable and Explainable Logical Policies via Neurally Guided Symbolic Abstraction2 Jun 2023 0 repositories listed
-
Reinforcement Learning with General Utilities: Simpler Variance Reduction and Large State-Action Space2 Jun 2023 0 repositories listed
-
Achieving Fairness in Multi-Agent Markov Decision Processes Using Reinforcement Learning1 Jun 2023 0 repositories listed
-
Heterogeneous Knowledge for Augmented Modular Reinforcement Learning1 Jun 2023 0 repositories listed
-
Delphic Offline Reinforcement Learning under Nonidentifiable Hidden Confounding1 Jun 2023 0 repositories listed
-
IQL-TD-MPC: Implicit Q-Learning for Hierarchical Model Predictive Control1 Jun 2023 0 repositories listed
-
Non-stationary Reinforcement Learning under General Function Approximation1 Jun 2023 0 repositories listed
-
MetaDiffuser: Diffusion Model as Conditional Planner for Offline Meta-RL31 May 2023 0 repositories listed
-
Replicability in Reinforcement Learning31 May 2023 0 repositories listed