Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 124
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 124 of 152: papers 12,301 to 12,400 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Q* Approximation Schemes for Batch Reinforcement Learning: A Theoretical Comparison9 Mar 2020 0 repositories listed
-
Transfer Reinforcement Learning under Unobserved Contextual Information9 Mar 2020 0 repositories listed
-
Zooming for Efficient Model-Free Reinforcement Learning in Metric Spaces9 Mar 2020 0 repositories listed
-
Deep Adversarial Reinforcement Learning for Object Disentangling8 Mar 2020 0 repositories listed
-
Generative Adversarial Imitation Learning with Neural Networks: Global Optimality and Convergence Rate8 Mar 2020 0 repositories listed
-
Reinforcement Learning Based Cooperative Coded Caching under Dynamic Popularities in Ultra-Dense Networks8 Mar 2020 0 repositories listed
-
Convergence of Q-value in case of Gaussian rewards7 Mar 2020 0 repositories listed
-
Reinforcement Learning for Combinatorial Optimization: A Survey7 Mar 2020 0 repositories listed
-
Cost-Sensitive Portfolio Selection via Deep Reinforcement Learning6 Mar 2020 0 repositories listed
-
Lane-Merging Using Policy-based Reinforcement Learning and Post-Optimization6 Mar 2020 0 repositories listed
-
Smart Train Operation Algorithms based on Expert Knowledge and Reinforcement Learning6 Mar 2020 0 repositories listed
-
A Geometric Perspective on Visual Imitation Learning5 Mar 2020 0 repositories listed
-
Deep Reinforcement Learning-BasedRobust Protection in DER-Rich Distribution Grids5 Mar 2020 0 repositories listed
-
Distributional Robustness and Regularization in Reinforcement Learning5 Mar 2020 0 repositories listed
-
Efficient and Effective Similar Subtrajectory Search with Deep Reinforcement Learning5 Mar 2020 0 repositories listed
-
Reward Design in Cooperative Multi-agent Reinforcement Learning for Packet Routing5 Mar 2020 0 repositories listed
-
Dynamic Experience Replay4 Mar 2020 0 repositories listed
-
Efficient statistical validation with edge cases to evaluate Highly Automated Vehicles4 Mar 2020 0 repositories listed
-
Neural-Network Heuristics for Adaptive Bayesian Quantum Estimation4 Mar 2020 0 repositories listed
-
Privacy-Aware Time-Series Data Sharing with Deep Reinforcement Learning4 Mar 2020 0 repositories listed
-
Deep Reinforcement Learning for QoS-Constrained Resource Allocation in Multiservice Networks3 Mar 2020 0 repositories listed
-
Efficient Exploration in Constrained Environments with Goal-Oriented Reference Path3 Mar 2020 0 repositories listed
-
Learning Context-aware Task Reasoning for Efficient Meta-reinforcement Learning3 Mar 2020 0 repositories listed
-
Safe Reinforcement Learning for Autonomous Vehicles through Parallel Constrained Policy Optimization3 Mar 2020 0 repositories listed
-
Relevance-Guided Modeling of Object Dynamics for Reinforcement Learning3 Mar 2020 0 repositories listed
-
Adaptive Structural Hyper-Parameter Configuration by Q-Learning2 Mar 2020 0 repositories listed
-
Cluster-Based Social Reinforcement Learning2 Mar 2020 0 repositories listed
-
Formal Controller Synthesis for Continuous-Space MDPs via Model-Free Reinforcement Learning2 Mar 2020 0 repositories listed
-
Gaussian Process Policy Optimization2 Mar 2020 0 repositories listed
-
Learning Force Control for Contact-rich Manipulation Tasks with Rigid Position-controlled Robots2 Mar 2020 0 repositories listed
-
Real-World Human-Robot Collaborative Reinforcement Learning2 Mar 2020 0 repositories listed
-
Risk-Averse Learning by Temporal Difference Methods2 Mar 2020 0 repositories listed
-
Scaling Up Multiagent Reinforcement Learning for Robotic Systems: Learn an Adaptive Sparse Communication Graph2 Mar 2020 0 repositories listed
-
Upper Confidence Primal-Dual Reinforcement Learning for CMDP with Adversarial Loss2 Mar 2020 0 repositories listed
-
Dynamic Queue-Jump Lane for Emergency Vehicles under Partially Connected Settings: A Multi-Agent Deep Reinforcement Learning Approach2 Mar 2020 0 repositories listed
-
Fully Asynchronous Policy Evaluation in Distributed Reinforcement Learning over Networks1 Mar 2020 0 repositories listed
-
Contextual Policy Transfer in Reinforcement Learning Domains via Deep Mixtures-of-Experts29 Feb 2020 0 repositories listed
-
Learning Near Optimal Policies with Low Inherent Bellman Error29 Feb 2020 0 repositories listed
-
Mixed Reinforcement Learning with Additive Stochastic Uncertainty28 Feb 2020 0 repositories listed
-
Deep Reinforcement Learning for FlipIt Security Game28 Feb 2020 0 repositories listed
-
Reinforcement Learning through Active Inference28 Feb 2020 0 repositories listed
-
A Self-Tuning Actor-Critic Algorithm28 Feb 2020 0 repositories listed
-
A Visual Communication Map for Multi-Agent Deep Reinforcement Learning27 Feb 2020 0 repositories listed
-
Acceleration of Actor-Critic Deep Reinforcement Learning for Visual Grasping in Clutter by State Representation Learning Based on Disentanglement of a Raw Input Image27 Feb 2020 0 repositories listed
-
Assembly robots with optimized control stiffness through reinforcement learning27 Feb 2020 0 repositories listed
-
Cautious Reinforcement Learning via Distributional Risk in the Dual Domain27 Feb 2020 0 repositories listed
-
Deep Reinforcement Learning Based Intelligent Reflecting Surface for Secure Wireless Communications27 Feb 2020 0 repositories listed
-
Learning in Markov Decision Processes under Constraints27 Feb 2020 0 repositories listed
-
Learning to Resolve Alliance Dilemmas in Many-Player Zero-Sum Games27 Feb 2020 0 repositories listed
-
Review, Analysis and Design of a Comprehensive Deep Reinforcement Learning Framework27 Feb 2020 0 repositories listed
-
Sub-Goal Trees -- a Framework for Goal-Based Reinforcement Learning27 Feb 2020 0 repositories listed
-
Towards Modular Algorithm Induction27 Feb 2020 0 repositories listed
-
Cautious Reinforcement Learning with Logical Constraints26 Feb 2020 0 repositories listed
-
Generalized Hindsight for Reinforcement Learning26 Feb 2020 0 repositories listed
-
Neural Ordinary Differential Equation Value Networks for Parametrized Action Spaces26 Feb 2020 0 repositories listed
-
When Do Drivers Concentrate? Attention-based Driver Behavior Modeling With Deep Reinforcement Learning26 Feb 2020 0 repositories listed
-
G-Learner and GIRL: Goal Based Wealth Management with Reinforcement Learning25 Feb 2020 0 repositories listed
-
Model-Based Reinforcement Learning for Physical Systems Without Velocity and Acceleration Measurements25 Feb 2020 0 repositories listed
-
On Reinforcement Learning for Turn-based Zero-sum Markov Games25 Feb 2020 0 repositories listed
-
Scalable Multi-Task Imitation Learning with Autonomous Improvement25 Feb 2020 0 repositories listed
-
Simultaneously Evolving Deep Reinforcement Learning Models using Multifactorial Optimization25 Feb 2020 0 repositories listed
-
Backpropamine: training self-modifying neural networks with differentiable neuromodulated plasticity24 Feb 2020 0 repositories listed
-
Millimeter Wave Communications with an Intelligent Reflector: Performance Optimization and Distributional Reinforcement Learning24 Feb 2020 0 repositories listed
-
Scalable Multi-Agent Inverse Reinforcement Learning via Actor-Attention-Critic24 Feb 2020 0 repositories listed
-
Deep Reinforcement Learning with Linear Quadratic Regulator Regions23 Feb 2020 0 repositories listed
-
Near-optimal Regret Bounds for Stochastic Shortest Path23 Feb 2020 0 repositories listed
-
Optimizing Traffic Lights with Multi-agent Deep Reinforcement Learning and V2X communication23 Feb 2020 0 repositories listed
-
Rapidly Personalizing Mobile Health Treatment Policies with Limited Data23 Feb 2020 0 repositories listed
-
Wireless 2.0: Towards an Intelligent Radio Environment Empowered by Reconfigurable Meta-Surfaces and Artificial Intelligence23 Feb 2020 0 repositories listed
-
Adversarial Radar Inference. From Inverse Tracking to Inverse Reinforcement Learning of Cognitive Radar22 Feb 2020 0 repositories listed
-
Automatic Data Augmentation via Deep Reinforcement Learning for Effective Kidney Tumor Segmentation22 Feb 2020 0 repositories listed
-
Guided Constrained Policy Optimization for Dynamic Quadrupedal Robot Locomotion22 Feb 2020 0 repositories listed
-
Vehicle Tracking in Wireless Sensor Networks via Deep Reinforcement Learning22 Feb 2020 0 repositories listed
-
Accelerating Reinforcement Learning with a Directional-Gaussian-Smoothing Evolution Strategy21 Feb 2020 0 repositories listed
-
Data Freshness and Energy-Efficient UAV Navigation Optimization: A Deep Reinforcement Learning Approach21 Feb 2020 0 repositories listed
-
Disentangling Controllable Object through Video Prediction Improves Visual Reinforcement Learning21 Feb 2020 0 repositories listed
-
On the Search for Feedback in Reinforcement Learning21 Feb 2020 0 repositories listed
-
Adaptive Temporal Difference Learning with Linear Function Approximation20 Feb 2020 0 repositories listed
-
20 Feb 2020 0 repositories listed
-
Enhanced Adversarial Strategically-Timed Attacks against Deep Reinforcement Learning20 Feb 2020 0 repositories listed
-
Multi-Agent Meta-Reinforcement Learning for Self-Powered and Sustainable Edge Computing Systems20 Feb 2020 0 repositories listed
-
Multi-Agent Reinforcement Learning as a Computational Tool for Language Evolution Research: Historical Context and Future Challenges20 Feb 2020 0 repositories listed
-
oIRL: Robust Adversarial Inverse Reinforcement Learning with Temporally Extended Actions20 Feb 2020 0 repositories listed
-
Debiased Off-Policy Evaluation for Recommendation Systems20 Feb 2020 0 repositories listed
-
Curriculum in Gradient-Based Meta-Reinforcement Learning19 Feb 2020 0 repositories listed
-
Keep Doing What Worked: Behavioral Modelling Priors for Offline Reinforcement Learning19 Feb 2020 0 repositories listed
-
Optimistic Policy Optimization with Bandit Feedback19 Feb 2020 0 repositories listed
-
UAV Aided Search and Rescue Operation Using Reinforcement Learning19 Feb 2020 0 repositories listed
-
Value-driven Hindsight Modelling19 Feb 2020 0 repositories listed
-
Empirical Policy Evaluation with Supergraphs18 Feb 2020 0 repositories listed
-
KoGuN: Accelerating Deep Reinforcement Learning via Integrating Human Suboptimal Knowledge18 Feb 2020 0 repositories listed
-
MoTiAC: Multi-Objective Actor-Critics for Real-Time Bidding18 Feb 2020 0 repositories listed
-
Multi-Issue Bargaining With Deep Reinforcement Learning18 Feb 2020 0 repositories listed
-
Adaptive Experience Selection for Policy Gradient17 Feb 2020 0 repositories listed
-
Reinforcement learning for the privacy preservation and manipulation of eye tracking data17 Feb 2020 0 repositories listed
-
Reward Design for Driver Repositioning Using Multi-Agent Reinforcement Learning17 Feb 2020 0 repositories listed
-
Investigating Simple Object Representations in Model-Free Deep Reinforcement Learning16 Feb 2020 0 repositories listed
-
Non-asymptotic Convergence of Adam-type Reinforcement Learning Algorithms under Markovian Sampling15 Feb 2020 0 repositories listed
-
The Archimedean trap: Why traditional reinforcement learning will probably not yield AGI15 Feb 2020 0 repositories listed
-
Resource Management in Wireless Networks via Multi-Agent Deep Reinforcement Learning14 Feb 2020 0 repositories listed