Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 69
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 69 of 152: papers 6,801 to 6,900 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Marginalized Importance Sampling for Off-Environment Policy Evaluation4 Sep 2023 0 repositories listed
-
Deception Game: Closing the Safety-Learning Loop in Interactive Robot Autonomy3 Sep 2023 0 repositories listed
-
Neurosymbolic Reinforcement Learning and Planning: A Survey2 Sep 2023 0 repositories listed
-
Sequential Dexterity: Chaining Dexterous Policies for Long-Horizon Manipulation2 Sep 2023 0 repositories listed
-
End-to-end Lidar-Driven Reinforcement Learning for Autonomous Racing1 Sep 2023 0 repositories listed
-
Multi-Objective Decision Transformers for Offline Reinforcement Learning31 Aug 2023 0 repositories listed
-
A reinforcement learning based construction material supply strategy using robotic crane and computer vision for building reconstruction after an earthquake30 Aug 2023 0 repositories listed
-
Benchmarking Robustness and Generalization in Multi-Agent Systems: A Case Study on Neural MMO30 Aug 2023 0 repositories listed
-
On the improvement of model-predictive controllers29 Aug 2023 0 repositories listed
-
Recent Progress in Energy Management of Connected Hybrid Electric Vehicles Using Reinforcement Learning28 Aug 2023 0 repositories listed
-
Target-independent XLA optimization using Reinforcement Learning28 Aug 2023 0 repositories listed
-
Reinforcement Learning-based Optimal Control and Software Rejuvenation for Safe and Efficient UAV Navigation27 Aug 2023 0 repositories listed
-
JAX-LOB: A GPU-Accelerated limit order book simulator to unlock large scale reinforcement learning for trading25 Aug 2023 0 repositories listed
-
Joint Band Assignment and Beam Management using Hierarchical Reinforcement Learning for Multi-Band Communication25 Aug 2023 0 repositories listed
-
Reinforcement Learning-assisted Evolutionary Algorithm: A Survey and Research Opportunities25 Aug 2023 0 repositories listed
-
Bayesian Exploration Networks24 Aug 2023 0 repositories listed
-
Conditional Kernel Imitation Learning for Continuous State Environments24 Aug 2023 0 repositories listed
-
Continuous Reinforcement Learning-based Dynamic Difficulty Adjustment in a Visual Working Memory Game24 Aug 2023 0 repositories listed
-
Extreme Risk Mitigation in Reinforcement Learning using Extreme Value Theory24 Aug 2023 0 repositories listed
-
Racing Towards Reinforcement Learning based control of an Autonomous Formula SAE Car24 Aug 2023 0 repositories listed
-
Reinforcement learning informed evolutionary search for autonomous systems testing24 Aug 2023 0 repositories listed
-
Towards Validating Long-Term User Feedbacks in Interactive Recommendation Systems22 Aug 2023 0 repositories listed
-
A Homogenization Approach for Gradient-Dominated Stochastic Optimization21 Aug 2023 0 repositories listed
-
Soft Decomposed Policy-Critic: Bridging the Gap for Effective Continuous Control with Discrete RL20 Aug 2023 0 repositories listed
-
Accelerating Exact Combinatorial Optimization via RL-based Initialization -- A Case Study in Scheduling19 Aug 2023 0 repositories listed
-
UAV-assisted Semantic Communication with Hybrid Action Reinforcement Learning18 Aug 2023 0 repositories listed
-
Data-driven Integrated Sensing and Communication: Recent Advances, Challenges, and Future Prospects17 Aug 2023 0 repositories listed
-
IMM: An Imitative Reinforcement Learning Approach with Predictive Representation Learning for Automatic Market Making17 Aug 2023 0 repositories listed
-
Improving Sample Efficiency of Model-Free Algorithms for Zero-Sum Markov Games17 Aug 2023 0 repositories listed
-
Reinforced Self-Training (ReST) for Language Modeling17 Aug 2023 0 repositories listed
-
ReProHRL: Towards Multi-Goal Navigation in the Real World using Hierarchical Agents17 Aug 2023 0 repositories listed
-
Partially Observable Multi-Agent Reinforcement Learning with Information Sharing16 Aug 2023 0 repositories listed
-
Real Robot Challenge 2022: Learning Dexterous Manipulation from Offline Data in the Real World15 Aug 2023 0 repositories listed
-
On-demand Cold Start Frequency Reduction with Off-Policy Reinforcement Learning in Serverless Computing15 Aug 2023 0 repositories listed
-
Insurance pricing on price comparison websites via reinforcement learning14 Aug 2023 0 repositories listed
-
IOB: Integrating Optimization Transfer and Behavior Transfer for Multi-Policy Reuse14 Aug 2023 0 repositories listed
-
Learning to Optimize LSM-trees: Towards A Reinforcement Learning based Key-Value Store for Dynamic Workloads14 Aug 2023 0 repositories listed
-
Neural Categorical Priors for Physics-Based Character Control14 Aug 2023 0 repositories listed
-
Omega-Regular Reward Machines14 Aug 2023 0 repositories listed
-
InTune: Reinforcement Learning-based Data Pipeline Optimization for Deep Recommendation Models13 Aug 2023 0 repositories listed
-
CyberForce: A Federated Reinforcement Learning Framework for Malware Mitigation11 Aug 2023 0 repositories listed
-
A Comparison of Classical and Deep Reinforcement Learning Methods for HVAC Control10 Aug 2023 0 repositories listed
-
Provably Efficient Algorithm for Nonstationary Low-Rank MDPs10 Aug 2023 0 repositories listed
-
Collaborative Wideband Spectrum Sensing and Scheduling for Networked UAVs in UTM Systems9 Aug 2023 0 repositories listed
-
Actor-Critic with variable time discretization via sustained actions8 Aug 2023 0 repositories listed
-
Characterization of Human Balance through a Reinforcement Learning-based Muscle Controller8 Aug 2023 0 repositories listed
-
A Reinforcement Learning-Based Approach to Graph Discovery in D2D-Enabled Federated Learning7 Aug 2023 0 repositories listed
-
Exploiting Generalization in Offline Reinforcement Learning via Unseen State Augmentations7 Aug 2023 0 repositories listed
-
Nonprehensile Planar Manipulation through Reinforcement Learning with Multimodal Categorical Exploration4 Aug 2023 0 repositories listed
-
PARL: A Unified Framework for Policy Alignment in Reinforcement Learning from Human Feedback3 Aug 2023 0 repositories listed
-
Bag of Policies for Distributional Deep Exploration3 Aug 2023 0 repositories listed
-
Revisiting a Design Choice in Gradient Temporal Difference Learning2 Aug 2023 0 repositories listed
-
Follow the Soldiers with Optimized Single-Shot Multibox Detection and Reinforcement Learning2 Aug 2023 0 repositories listed
-
Reinforcement Learning for Generative AI: State of the Art, Opportunities and Open Research Challenges31 Jul 2023 0 repositories listed
-
Reinforcement Learning Under Probabilistic Spatio-Temporal Constraints with Time Windows29 Jul 2023 0 repositories listed
-
Using Implicit Behavior Cloning and Dynamic Movement Primitive to Facilitate Reinforcement Learning for Robot Motion Planning29 Jul 2023 0 repositories listed
-
Dialogue Shaping: Empowering Agents through NPC Interaction28 Jul 2023 0 repositories listed
-
ETHER: Aligning Emergent Communication for Hindsight Experience Replay28 Jul 2023 0 repositories listed
-
Primitive Skill-based Robot Learning from Human Evaluative Feedback28 Jul 2023 0 repositories listed
-
TrackAgent: 6D Object Tracking via Reinforcement Learning28 Jul 2023 0 repositories listed
-
Actions Speak What You Want: Provably Sample-Efficient Reinforcement Learning of the Quantal Stackelberg Equilibrium from Strategic Feedbacks26 Jul 2023 0 repositories listed
-
Controlling the Latent Space of GANs through Reinforcement Learning: A Case Study on Task-based Image-to-Image Translation26 Jul 2023 0 repositories listed
-
Reinforcement Learning by Guided Safe Exploration26 Jul 2023 0 repositories listed
-
Communication-Efficient Orchestrations for URLLC Service via Hierarchical Reinforcement Learning25 Jul 2023 0 repositories listed
-
Counterfactual Explanation Policies in RL25 Jul 2023 0 repositories listed
-
Offline Reinforcement Learning with On-Policy Q-Function Regularization25 Jul 2023 0 repositories listed
-
Settling the Sample Complexity of Online Reinforcement Learning25 Jul 2023 0 repositories listed
-
Structural Credit Assignment with Coordinated Exploration25 Jul 2023 0 repositories listed
-
The Optimal Approximation Factors in Misspecified Off-Policy Value Function Estimation25 Jul 2023 0 repositories listed
-
Unbiased Weight Maximization25 Jul 2023 0 repositories listed
-
ExWarp: Extrapolation and Warping-based Temporal Supersampling for High-frequency Displays24 Jul 2023 0 repositories listed
-
Theoretically Guaranteed Policy Improvement Distilled from Model-Based Planning24 Jul 2023 0 repositories listed
-
DIP-RL: Demonstration-Inferred Preference Learning in Minecraft22 Jul 2023 0 repositories listed
-
Game-Theoretic Robust Reinforcement Learning Handles Temporally-Coupled Perturbations22 Jul 2023 0 repositories listed
-
Bridging the Reality Gap of Reinforcement Learning based Traffic Signal Control using Domain Randomization and Meta Learning21 Jul 2023 0 repositories listed
-
Towards practical reinforcement learning for tokamak magnetic control21 Jul 2023 0 repositories listed
-
Reparameterized Policy Learning for Multimodal Trajectory Optimization20 Jul 2023 0 repositories listed
-
A reinforcement learning approach for VQA validation: an application to diabetic macular edema grading19 Jul 2023 0 repositories listed
-
Continuous-Time Reinforcement Learning: New Design Algorithms with Theoretical Insights and Performance Guarantees18 Jul 2023 0 repositories listed
-
Data Cross-Segmentation for Improved Generalization in Reinforcement Learning Based Algorithmic Trading18 Jul 2023 0 repositories listed
-
Distributed 3D-Beam Reforming for Hovering-Tolerant UAVs Communication over Coexistence: A Deep-Q Learning for Intelligent Space-Air-Ground Integrated Networks18 Jul 2023 0 repositories listed
-
REX: Rapid Exploration and eXploitation for AI Agents18 Jul 2023 0 repositories listed
-
Towards A Unified Agent with Foundation Models18 Jul 2023 0 repositories listed
-
An Alternative to Variance: Gini Deviation for Risk-averse Policy Gradient17 Jul 2023 0 repositories listed
-
Basal-Bolus Advisor for Type 1 Diabetes (T1D) Patients Using Multi-Agent Reinforcement Learning (RL) Methodology17 Jul 2023 0 repositories listed
-
Quarl: A Learning-Based Quantum Circuit Optimizer17 Jul 2023 0 repositories listed
-
Discovering User Types: Mapping User Traits by Task-Specific Behaviors in Reinforcement Learning16 Jul 2023 0 repositories listed
-
Magnetic Field-Based Reward Shaping for Goal-Conditioned Reinforcement Learning16 Jul 2023 0 repositories listed
-
An Empirical Study of the Effectiveness of Using a Replay Buffer on Mode Discovery in GFlowNets15 Jul 2023 0 repositories listed
-
Combining model-predictive control and predictive reinforcement learning for stable quadrupedal robot locomotion15 Jul 2023 0 repositories listed
-
Efficient Action Robust Reinforcement Learning with Probabilistic Policy Execution Uncertainty15 Jul 2023 0 repositories listed
-
Seeing is not Believing: Robust Reinforcement Learning against Spurious Correlation15 Jul 2023 0 repositories listed
-
Why Guided Dialog Policy Learning performs well? Understanding the role of adversarial learning and its alternative13 Jul 2023 0 repositories listed
-
Learning Decentralized Partially Observable Mean Field Control for Artificial Collective Behavior12 Jul 2023 0 repositories listed
-
Transformers in Reinforcement Learning: A Survey12 Jul 2023 0 repositories listed
-
Scaling Distributed Multi-task Reinforcement Learning with Experience Sharing11 Jul 2023 0 repositories listed
-
Diffusion Policies for Out-of-Distribution Generalization in Offline Reinforcement Learning10 Jul 2023 0 repositories listed
-
A User Study on Explainable Online Reinforcement Learning for Adaptive Systems9 Jul 2023 0 repositories listed
-
Investigating the Edge of Stability Phenomenon in Reinforcement Learning9 Jul 2023 0 repositories listed
-
A Neuromorphic Architecture for Reinforcement Learning from Real-Valued Observations6 Jul 2023 0 repositories listed