Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 114
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 114 of 152: papers 11,301 to 11,400 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Hierarchical reinforcement learning for efficient exploration and transfer12 Nov 2020 0 repositories listed
-
Imposing Robust Structured Control Constraint on Reinforcement Learning of Linear Quadratic Regulator12 Nov 2020 0 repositories listed
-
Self-supervised reinforcement learning for speaker localisation with the iCub humanoid robot12 Nov 2020 0 repositories listed
-
Steady State Analysis of Episodic Reinforcement Learning12 Nov 2020 0 repositories listed
-
CRPO: A New Approach for Safe Reinforcement Learning with Convergence Guarantee11 Nov 2020 0 repositories listed
-
Adaptive Neural Architectures for Recommender Systems11 Nov 2020 0 repositories listed
-
Behaviorally Diverse Traffic Simulation via Reinforcement Learning11 Nov 2020 0 repositories listed
-
On Using Hamiltonian Monte Carlo Sampling for Reinforcement Learning Problems in High-dimension11 Nov 2020 0 repositories listed
-
Non-local Optimization: Imposing Structure on Optimization Problems by Relaxation11 Nov 2020 0 repositories listed
-
Offline Learning of Counterfactual Predictions for Real-World Robotic Reinforcement Learning11 Nov 2020 0 repositories listed
-
Proximal Policy Optimization via Enhanced Exploration Efficiency11 Nov 2020 0 repositories listed
-
Reinforcement Learning with Time-dependent Goals for Robotic Musicians11 Nov 2020 0 repositories listed
-
Dirichlet policies for reinforced factor portfolios10 Nov 2020 0 repositories listed
-
Hierarchical Reinforcement Learning for Relay Selection and Power Optimization in Two-Hop Cooperative Relay Network10 Nov 2020 0 repositories listed
-
Kinematics-Guided Reinforcement Learning for Object-Aware 3D Ego-Pose Estimation10 Nov 2020 0 repositories listed
-
Model-based Reinforcement Learning from Signal Temporal Logic Specifications10 Nov 2020 0 repositories listed
-
Perturbation-based exploration methods in deep reinforcement learning10 Nov 2020 0 repositories listed
-
Sample Complexity Bounds for Two Timescale Value-based Reinforcement Learning Algorithms10 Nov 2020 0 repositories listed
-
Automated Adversary Emulation for Cyber-Physical Systems via Reinforcement Learning9 Nov 2020 0 repositories listed
-
Behavior Planning at Urban Intersections through Hierarchical Reinforcement Learning9 Nov 2020 0 repositories listed
-
On Function Approximation in Reinforcement Learning: Optimism in the Face of Large State Spaces9 Nov 2020 0 repositories listed
-
Challenges of Applying Deep Reinforcement Learning in Dynamic Dispatching9 Nov 2020 0 repositories listed
-
Combining Propositional Logic Based Decision Diagrams with Decision Making in Urban Systems9 Nov 2020 0 repositories listed
-
Deep Reinforcement Learning for Navigation in AAA Video Games9 Nov 2020 0 repositories listed
-
Deep reinforcement learning for RAN optimization and control9 Nov 2020 0 repositories listed
-
Learning to Compose Hierarchical Object-Centric Controllers for Robotic Manipulation9 Nov 2020 0 repositories listed
-
Multi-Agent Reinforcement Learning for Channel Assignment and Power Allocation in Platoon-Based C-V2X Systems9 Nov 2020 0 repositories listed
-
Optimizing Age of Information Through Aerial Reconfigurable Intelligent Surfaces: A Deep Reinforcement Learning Approach9 Nov 2020 0 repositories listed
-
Reinforcement Learning for Autonomous Driving with Latent State Inference and Spatial-Temporal Relationships9 Nov 2020 0 repositories listed
-
Safe Trajectory Planning Using Reinforcement Learning for Self Driving9 Nov 2020 0 repositories listed
-
Exploring market power using deep reinforcement learning for intelligent bidding strategies8 Nov 2020 0 repositories listed
-
On the role of planning in model-based deep reinforcement learning8 Nov 2020 0 repositories listed
-
Online Sparse Reinforcement Learning8 Nov 2020 0 repositories listed
-
Reinforcement Learning for Assignment problem8 Nov 2020 0 repositories listed
-
Reliable Off-policy Evaluation for Reinforcement Learning8 Nov 2020 0 repositories listed
-
Sparse Feature Selection Makes Batch Reinforcement Learning More Sample Efficient8 Nov 2020 0 repositories listed
-
Universal Activation Function For Machine Learning7 Nov 2020 0 repositories listed
-
Motion Prediction on Self-driving Cars: A Review6 Nov 2020 0 repositories listed
-
Sample-efficient Reinforcement Learning in Robotic Table Tennis6 Nov 2020 0 repositories listed
-
Single and Multi-Agent Deep Reinforcement Learning for AI-Enabled Wireless Networks: A Tutorial6 Nov 2020 0 repositories listed
-
The Value Equivalence Principle for Model-Based Reinforcement Learning6 Nov 2020 0 repositories listed
-
A Hysteretic Q-learning Coordination Framework for Emerging Mobility Systems in Smart Cities5 Nov 2020 0 repositories listed
-
LBGP: Learning Based Goal Planning for Autonomous Following in Front5 Nov 2020 0 repositories listed
-
Learning to Utilize Shaping Rewards: A New Approach of Reward Shaping5 Nov 2020 0 repositories listed
-
Playing optical tweezers with deep reinforcement learning: in virtual, physical and augmented environments5 Nov 2020 0 repositories listed
-
Generative Inverse Deep Reinforcement Learning for Online Recommendation4 Nov 2020 0 repositories listed
-
Offline Reinforcement Learning from Human Feedback in Real-World Sequence-to-Sequence Tasks4 Nov 2020 0 repositories listed
-
Optimal Control-Based Baseline for Guided Exploration in Policy Gradient Methods4 Nov 2020 0 repositories listed
-
Deep Reinforcement Learning Based Dynamic Route Planning for Minimizing Travel Time3 Nov 2020 0 repositories listed
-
Differentiable Physics Models for Real-world Offline Model-based Reinforcement Learning3 Nov 2020 0 repositories listed
-
Distributional Reinforcement Learning for mmWave Communications with Intelligent Reflectors on a UAV3 Nov 2020 0 repositories listed
-
Online Observer-Based Inverse Reinforcement Learning3 Nov 2020 0 repositories listed
-
A Variant of the Wang-Foster-Kakade Lower Bound for the Discounted Setting2 Nov 2020 0 repositories listed
-
Cooperative Heterogeneous Deep Reinforcement Learning2 Nov 2020 0 repositories listed
-
Fast Reinforcement Learning with Incremental Gaussian Mixture Models2 Nov 2020 0 repositories listed
-
Incorporating Rivalry in Reinforcement Learning for a Competitive Game2 Nov 2020 0 repositories listed
-
Information-theoretic Task Selection for Meta-Reinforcement Learning2 Nov 2020 0 repositories listed
-
Interpreting Graph Drawing with Multi-Agent Reinforcement Learning2 Nov 2020 0 repositories listed
-
NEARL: Non-Explicit Action Reinforcement Learning for Robotic Control2 Nov 2020 0 repositories listed
-
Reinforcement Learning of Structured Control for Linear Systems with Unknown State Matrix2 Nov 2020 0 repositories listed
-
Reinforcement Learning with Efficient Active Feature Acquisition2 Nov 2020 0 repositories listed
-
Sample-efficient reinforcement learning using deep Gaussian processes2 Nov 2020 0 repositories listed
-
Shaping Rewards for Reinforcement Learning with Imperfect Demonstrations using Generative Models2 Nov 2020 0 repositories listed
-
Few-Shot Multi-Hop Relation Reasoning over Knowledge Bases1 Nov 2020 0 repositories listed
-
Production-based Cognitive Models as a Test Suite for Reinforcement Learning Algorithms1 Nov 2020 0 repositories listed
-
Reinforcement Learning with Imbalanced Dataset for Data-to-Text Medical Report Generation1 Nov 2020 0 repositories listed
-
Task-Completion Dialogue Policy Learning via Monte Carlo Tree Search with Dueling Network1 Nov 2020 0 repositories listed
-
Topic-Preserving Synthetic News Generation: An Adversarial Deep Reinforcement Learning Approach30 Oct 2020 0 repositories listed
-
Abstract Value Iteration for Hierarchical Reinforcement Learning29 Oct 2020 0 repositories listed
-
Reinforcement Learning of Causal Variables Using Mediation Analysis29 Oct 2020 0 repositories listed
-
How do Offline Measures for Exploration in Reinforcement Learning behave?29 Oct 2020 0 repositories listed
-
Machine versus Human Attention in Deep Reinforcement Learning Tasks29 Oct 2020 0 repositories listed
-
Learning Personalized Discretionary Lane-Change Initiation for Fully Autonomous Driving Based on Reinforcement Learning29 Oct 2020 0 repositories listed
-
DeepFoldit -- A Deep Reinforcement Learning Neural Network Folding Proteins28 Oct 2020 0 repositories listed
-
Designing Interpretable Approximations to Deep Reinforcement Learning28 Oct 2020 0 repositories listed
-
Learning to Unknot28 Oct 2020 0 repositories listed
-
Reinforcement Learning for Sparse-Reward Object-Interaction Tasks in a First-person Simulated 3D Environment28 Oct 2020 0 repositories listed
-
Understanding the Pathologies of Approximate Policy Evaluation when Combined with Greedification in Reinforcement Learning28 Oct 2020 0 repositories listed
-
Affordance as general value function: A computational model27 Oct 2020 0 repositories listed
-
Batch Reinforcement Learning with a Nonparametric Off-Policy Policy Gradient27 Oct 2020 0 repositories listed
-
Behavior Priors for Efficient Reinforcement Learning27 Oct 2020 0 repositories listed
-
Can Reinforcement Learning for Continuous Control Generalize Across Physics Engines?27 Oct 2020 0 repositories listed
-
Conservative Safety Critics for Exploration27 Oct 2020 0 repositories listed
-
Learning Time Reduction Using Warm Start Methods for a Reinforcement Learning Based Supervisory Control in Hybrid Electric Vehicle Applications27 Oct 2020 0 repositories listed
-
Learning to be Safe: Deep RL with a Safety Critic27 Oct 2020 0 repositories listed
-
Multi-Agent Safe Policy Learning for Power Management of Networked Microgrids27 Oct 2020 0 repositories listed
-
Behavioral decision-making for urban autonomous driving in the presence of pedestrians using Deep Recurrent Q-Network26 Oct 2020 0 repositories listed
-
Contextual Latent-Movements Off-Policy Optimization for Robotic Manipulation Skills26 Oct 2020 0 repositories listed
-
Forethought and Hindsight in Credit Assignment26 Oct 2020 0 repositories listed
-
High Acceleration Reinforcement Learning for Real-World Juggling with Binary Rewards26 Oct 2020 0 repositories listed
-
Lyapunov-Based Reinforcement Learning State Estimator26 Oct 2020 0 repositories listed
-
OPAL: Offline Primitive Discovery for Accelerating Offline Reinforcement Learning26 Oct 2020 0 repositories listed
-
Pairwise heuristic sequence alignment algorithm based on deep reinforcement learning26 Oct 2020 0 repositories listed
-
Track-Assignment Detailed Routing Using Attention-based Policy Model With Supervision26 Oct 2020 0 repositories listed
-
VisualHints: A Visual-Lingual Environment for Multimodal Reinforcement Learning26 Oct 2020 0 repositories listed
-
Adaptive Federated Learning and Digital Twin for Industrial Internet of Things25 Oct 2020 0 repositories listed
-
Enhancing reinforcement learning by a finite reward response filter with a case study in intelligent structural control25 Oct 2020 0 repositories listed
-
Improving the Exploration of Deep Reinforcement Learning in Continuous Domains using Planning for Policy Search24 Oct 2020 0 repositories listed
-
Planning with Exploration: Addressing Dynamics Bottleneck in Model-based Reinforcement Learning24 Oct 2020 0 repositories listed
-
Improved Worst-Case Regret Bounds for Randomized Least-Squares Value Iteration23 Oct 2020 0 repositories listed