Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 111
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 111 of 152: papers 11,001 to 11,100 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Learning to Dynamically Select Between Reward Shaping Signals1 Jan 2021 0 repositories listed
-
Learning to Explore with Pleasure1 Jan 2021 0 repositories listed
-
Learning to Observe with Reinforcement Learning1 Jan 2021 0 repositories listed
-
Meta-Reinforcement Learning With Informed Policy Regularization1 Jan 2021 0 repositories listed
-
Monte-Carlo Planning and Learning with Language Action Value Estimates1 Jan 2021 0 repositories listed
-
MQES: Max-Q Entropy Search for Efficient Exploration in Continuous Reinforcement Learning1 Jan 2021 0 repositories listed
-
Offline Policy Optimization with Variance Regularization1 Jan 2021 0 repositories listed
-
On Trade-offs of Image Prediction in Visual Model-Based Reinforcement Learning1 Jan 2021 0 repositories listed
-
Optimistic Exploration with Backward Bootstrapped Bonus for Deep Reinforcement Learning1 Jan 2021 0 repositories listed
-
Optimistic Policy Optimization with General Function Approximations1 Jan 2021 0 repositories listed
-
Optimizing Information Bottleneck in Reinforcement Learning: A Stein Variational Approach1 Jan 2021 0 repositories listed
-
PAC-Bayesian Randomized Value Function with Informative Prior1 Jan 2021 0 repositories listed
-
Partial Off-Policy Learning: Balance Accuracy and Diversity for Human-Oriented Image Captioning1 Jan 2021 0 repositories listed
-
PERIL: Probabilistic Embeddings for hybrid Meta-Reinforcement and Imitation Learning1 Jan 2021 0 repositories listed
-
Plan-Based Asymptotically Equivalent Reward Shaping1 Jan 2021 0 repositories listed
-
Playing Atari with Capsule Networks: A systematic comparison of CNN and CapsNets-based agents.1 Jan 2021 0 repositories listed
-
PODS: Policy Optimization via Differentiable Simulation1 Jan 2021 0 repositories listed
-
Practical Marginalized Importance Sampling with the Successor Representation1 Jan 2021 0 repositories listed
-
Prior Preference Learning From Experts: Designing A Reward with Active Inference1 Jan 2021 0 repositories listed
-
Provable Rich Observation Reinforcement Learning with Combinatorial Latent States1 Jan 2021 0 repositories listed
-
R-LAtte: Attention Module for Visual Control via Reinforcement Learning1 Jan 2021 0 repositories listed
-
Re-examining Routing Networks for Multi-task Learning1 Jan 2021 0 repositories listed
-
RECONNAISSANCE FOR REINFORCEMENT LEARNING WITH SAFETY CONSTRAINTS1 Jan 2021 0 repositories listed
-
Regioned Episodic Reinforcement Learning1 Jan 2021 0 repositories listed
-
Reinforcement Learning Based Asymmetrical DNN Modularization for Optimal Loading1 Jan 2021 0 repositories listed
-
Reinforcement Learning for Control with Probabilistic Stability Guarantee1 Jan 2021 0 repositories listed
-
Reinforcement Learning with Bayesian Classifiers: Efficient Skill Learning from Outcome Examples1 Jan 2021 0 repositories listed
-
Representation Balancing Offline Model-based Reinforcement Learning1 Jan 2021 0 repositories listed
-
RMIX: Risk-Sensitive Multi-Agent Reinforcement Learning1 Jan 2021 0 repositories listed
-
Robust Imitation via Decision-Time Planning1 Jan 2021 0 repositories listed
-
Robust Multi-Agent Reinforcement Learning Driven by Correlated Equilibrium1 Jan 2021 0 repositories listed
-
Robust Offline Reinforcement Learning from Low-Quality Data1 Jan 2021 0 repositories listed
-
Sample efficient Quality Diversity for neural continuous control1 Jan 2021 0 repositories listed
-
Scalable Bayesian Inverse Reinforcement Learning by Auto-Encoding Reward1 Jan 2021 0 repositories listed
-
ScheduleNet: Learn to Solve MinMax mTSP Using Reinforcement Learning with Delayed Reward1 Jan 2021 0 repositories listed
-
Self-Supervised Continuous Control without Policy Gradient1 Jan 2021 0 repositories listed
-
Simple Augmentation Goes a Long Way: ADRL for DNN Quantization1 Jan 2021 0 repositories listed
-
Success-Rate Targeted Reinforcement Learning by Disorientation Penalty1 Jan 2021 0 repositories listed
-
The Skill-Action Architecture: Learning Abstract Action Embeddings for Reinforcement Learning1 Jan 2021 0 repositories listed
-
Unbiased learning with State-Conditioned Rewards in Adversarial Imitation Learning1 Jan 2021 0 repositories listed
-
Uncertainty Weighted Offline Reinforcement Learning1 Jan 2021 0 repositories listed
-
Understanding and Leveraging Causal Relations in Deep Reinforcement Learning1 Jan 2021 0 repositories listed
-
Unsupervised Active Pre-Training for Reinforcement Learning1 Jan 2021 0 repositories listed
-
UPDeT: Universal Multi-agent RL via Policy Decoupling with Transformers1 Jan 2021 0 repositories listed
-
Visual Imitation with Reinforcement Learning using Recurrent Siamese Networks1 Jan 2021 0 repositories listed
-
Weighted Bellman Backups for Improved Signal-to-Noise in Q-Updates1 Jan 2021 0 repositories listed
-
What are the Statistical Limits of Batch RL with Linear Function Approximation?1 Jan 2021 0 repositories listed
-
What Matters for On-Policy Deep Actor-Critic Methods? A Large-Scale Study1 Jan 2021 0 repositories listed
-
When Is Generalizable Reinforcement Learning Tractable?1 Jan 2021 0 repositories listed
-
Winning the L2RPN Challenge: Power Grid Management via Semi-Markov Afterstate Actor-Critic1 Jan 2021 0 repositories listed
-
Towards Understanding Asynchronous Advantage Actor-critic: Convergence and Linear Speedup31 Dec 2020 0 repositories listed
-
Autonomous Maintenance in IoT Networks via AoI-driven Deep Reinforcement Learning31 Dec 2020 0 repositories listed
-
Curriculum-based Deep Reinforcement Learning for Quantum Control31 Dec 2020 0 repositories listed
-
Model Free Reinforcement Learning Algorithm for Stationary Mean field Equilibrium for Multiple Types of Agents31 Dec 2020 0 repositories listed
-
Refine and Imitate: Reducing Repetition and Inconsistency in Persuasion Dialogues via Reinforcement Learning and Human Demonstration31 Dec 2020 0 repositories listed
-
Relational Deep Reinforcement Learning for Routing in Wireless Networks31 Dec 2020 0 repositories listed
-
Toward Reliable Designs of Data-Driven Reinforcement Learning Tracking Control for Euler-Lagrange Systems31 Dec 2020 0 repositories listed
-
Is Pessimism Provably Efficient for Offline RL?30 Dec 2020 0 repositories listed
-
Fairness-Oriented User Scheduling for Bursty Downlink Transmission Using Multi-Agent Reinforcement Learning30 Dec 2020 0 repositories listed
-
LISPR: An Options Framework for Policy Reuse with Reinforcement Learning29 Dec 2020 0 repositories listed
-
Federated Multi-Agent Actor-Critic Learning for Age Sensitive Mobile Edge Computing28 Dec 2020 0 repositories listed
-
Risk-Sensitive Deep RL: Variance-Constrained Actor-Critic Provably Finds Globally Optimal Policy28 Dec 2020 0 repositories listed
-
Portfolio Optimization with 2D Relative-Attentional Gated Transformer27 Dec 2020 0 repositories listed
-
Achieving Real-Time LiDAR 3D Object Detection on a Mobile Device26 Dec 2020 0 repositories listed
-
Stability-Certified Reinforcement Learning via Spectral Normalization26 Dec 2020 0 repositories listed
-
Towards sample-efficient episodic control with DAC-ML26 Dec 2020 0 repositories listed
-
Towards Continual Reinforcement Learning: A Review and Perspectives25 Dec 2020 0 repositories listed
-
A State Representation Dueling Network for Deep Reinforcement Learning24 Dec 2020 0 repositories listed
-
Assured RL: Reinforcement Learning with Almost Sure Constraints24 Dec 2020 0 repositories listed
-
Auto-Agent-Distiller: Towards Efficient Deep Reinforcement Learning Agents via Neural Architecture Search24 Dec 2020 0 repositories listed
-
Learning Vehicle Routing Problems using Policy Optimisation24 Dec 2020 0 repositories listed
-
SCC: an efficient deep reinforcement learning agent mastering the game of StarCraft II24 Dec 2020 0 repositories listed
-
SPOTTER: Extending Symbolic Planning Operators through Targeted Reinforcement Learning24 Dec 2020 0 repositories listed
-
Unsupervised deep clustering and reinforcement learning can accurately segment MRI brain tumors with very small training sets24 Dec 2020 0 repositories listed
-
Deep Stock Trading: A Hierarchical Reinforcement Learning Framework for Portfolio Optimization and Order Execution23 Dec 2020 0 repositories listed
-
Intelligent Reflecting Surface Assisted Anti-Jamming Communications Based on Reinforcement Learning23 Dec 2020 0 repositories listed
-
Rethink AI-based Power Grid Control: Diving Into Algorithm Design23 Dec 2020 0 repositories listed
-
A Dynamic Penalty Function Approach for Constraints-Handling in Reinforcement Learning22 Dec 2020 0 repositories listed
-
Intelligent Resource Allocation in Dense LoRa Networks using Deep Reinforcement Learning22 Dec 2020 0 repositories listed
-
Scalable Deep Reinforcement Learning for Routing and Spectrum Access in Physical Layer22 Dec 2020 0 repositories listed
-
Self-Imitation Advantage Learning22 Dec 2020 0 repositories listed
-
myGym: Modular Toolkit for Visuomotor Robotic Tasks21 Dec 2020 0 repositories listed
-
Difference Rewards Policy Gradients21 Dec 2020 0 repositories listed
-
Mobile Robot Planner with Low-cost Cameras Using Deep Reinforcement Learning21 Dec 2020 0 repositories listed
-
Reinforcement Learning-based Product Delivery Frequency Control20 Dec 2020 0 repositories listed
-
Minimax Strikes Back19 Dec 2020 0 repositories listed
-
Model-Based Actor-Critic with Chance Constraint for Stochastic System19 Dec 2020 0 repositories listed
-
Quantum reinforcement learning in continuous action space19 Dec 2020 0 repositories listed
-
Exact Reduction of Huge Action Spaces in General Reinforcement Learning18 Dec 2020 0 repositories listed
-
Exploring Fluent Query Reformulations with Text-to-Text Transformers and Reinforcement Learning18 Dec 2020 0 repositories listed
-
Hierarchical principles of embodied reinforcement learning: A review18 Dec 2020 0 repositories listed
-
Reinforcement Learning for Test Case Prioritization18 Dec 2020 0 repositories listed
-
Curiosity in exploring chemical space: Intrinsic rewards for deep molecular reinforcement learning17 Dec 2020 0 repositories listed
-
Interactive Question Clarification in Dialogue via Reinforcement Learning17 Dec 2020 0 repositories listed
-
Autotelic Agents with Intrinsically Motivated Goal-Conditioned Reinforcement Learning: a Short Survey17 Dec 2020 0 repositories listed
-
MAGNet: Multi-agent Graph Network for Deep Multi-agent Reinforcement Learning17 Dec 2020 0 repositories listed
-
Towards Optimal District Heating Temperature Control in China with Deep Reinforcement Learning17 Dec 2020 0 repositories listed
-
ViNG: Learning Open-World Navigation with Visual Goals17 Dec 2020 0 repositories listed
-
A comparative evaluation of machine learning methods for robot navigation through human crowds16 Dec 2020 0 repositories listed
-
Batch-Constrained Distributional Reinforcement Learning for Session-based Recommendation16 Dec 2020 0 repositories listed