Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 104
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 104 of 152: papers 10,301 to 10,400 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Grounding Complex Navigational Instructions Using Scene Graphs3 Jun 2021 0 repositories listed
-
Hyperbolically-Discounted Reinforcement Learning on Reward-Punishment Framework3 Jun 2021 0 repositories listed
-
LiMIIRL: Lightweight Multiple-Intent Inverse Reinforcement Learning3 Jun 2021 0 repositories listed
-
Safe RAN control: A Symbolic Reinforcement Learning Approach3 Jun 2021 0 repositories listed
-
Design and Comparison of Reward Functions in Reinforcement Learning for Energy Management of Sensor Nodes2 Jun 2021 0 repositories listed
-
Expected Scalarised Returns Dominance: A New Solution Concept for Multi-Objective Decision Making2 Jun 2021 0 repositories listed
-
Learning to schedule job-shop problems: Representation and policy learning using graph neural network and reinforcement learning2 Jun 2021 0 repositories listed
-
Robot in a China Shop: Using Reinforcement Learning for Location-Specific Navigation Behaviour2 Jun 2021 0 repositories listed
-
Towards Deeper Deep Reinforcement Learning with Spectral Normalization2 Jun 2021 0 repositories listed
-
Variational Empowerment as Representation Learning for Goal-Based Reinforcement Learning2 Jun 2021 0 repositories listed
-
A Coarse to Fine Question Answering System based on Reinforcement Learning1 Jun 2021 0 repositories listed
-
Ad Headline Generation using Self-Critical Masked Language Model1 Jun 2021 0 repositories listed
-
An Entropy Regularization Free Mechanism for Policy-based Reinforcement Learning1 Jun 2021 0 repositories listed
-
Improving Long-Term Metrics in Recommendation Systems using Short-Horizon Reinforcement Learning1 Jun 2021 0 repositories listed
-
Quantitative Day Trading from Natural Language using Reinforcement Learning1 Jun 2021 0 repositories listed
-
Reinforce Security: A Model-Free Approach Towards Secure Wiretap Coding1 Jun 2021 0 repositories listed
-
Reward is enough for convex MDPs1 Jun 2021 0 repositories listed
-
Search from History and Reason for Future: Two-stage Reasoning on Temporal Knowledge Graphs1 Jun 2021 0 repositories listed
-
Shapley Counterfactual Credits for Multi-Agent Reinforcement Learning1 Jun 2021 0 repositories listed
-
AppBuddy: Learning to Accomplish Tasks in Mobile Apps via Reinforcement Learning31 May 2021 0 repositories listed
-
Multi-Objective SPIBB: Seldonian Offline Policy Improvement with Safety Constraints in Finite MDPs31 May 2021 0 repositories listed
-
Procedural Content Generation: Better Benchmarks for Transfer Reinforcement Learning31 May 2021 0 repositories listed
-
Reinforcement Learning-based Dynamic Service Placement in Vehicular Networks31 May 2021 0 repositories listed
-
Tesseract: Tensorised Actors for Multi-Agent Reinforcement Learning31 May 2021 0 repositories listed
-
Reducing the Deployment-Time Inference Control Costs of Deep Reinforcement Learning Agents via an Asymmetric Architecture30 May 2021 0 repositories listed
-
Shaped Policy Search for Evolutionary Strategies using Waypoints30 May 2021 0 repositories listed
-
A Survey of Deep Reinforcement Learning Algorithms for Motion Planning and Control of Autonomous Vehicles29 May 2021 0 repositories listed
-
Gradient-Free Neural Network Training via Synaptic-Level Reinforcement Learning29 May 2021 0 repositories listed
-
On the Theory of Reinforcement Learning with Once-per-Episode Feedback29 May 2021 0 repositories listed
-
Predictive Representation Learning for Language Modeling29 May 2021 0 repositories listed
-
Reconfigurable Intelligent Surface-assisted Multi-UAV Networks: Efficient Resource Allocation with Deep Reinforcement Learning28 May 2021 0 repositories listed
-
Joint Optimization of Multi-Objective Reinforcement Learning with Policy Gradient Based Algorithm28 May 2021 0 repositories listed
-
Learning Approximate and Exact Numeral Systems via Reinforcement Learning28 May 2021 0 repositories listed
-
Reinforcement Learning for on-line Sequence Transformation28 May 2021 0 repositories listed
-
Reinforcement Learning reveals fundamental limits on the mixing of active particles28 May 2021 0 repositories listed
-
Risk-Aware Transfer in Reinforcement Learning using Successor Features28 May 2021 0 repositories listed
-
Sample-Efficient Reinforcement Learning for Linearly-Parameterized MDPs with a Generative Model28 May 2021 0 repositories listed
-
Stochastic Intervention for Causal Inference via Reinforcement Learning28 May 2021 0 repositories listed
-
Task-Guided Inverse Reinforcement Learning Under Partial Information28 May 2021 0 repositories listed
-
Transferable Deep Reinforcement Learning Framework for Autonomous Vehicles with Joint Radar-Data Communications28 May 2021 0 repositories listed
-
A Modular and Transferable Reinforcement Learning Framework for the Fleet Rebalancing Problem27 May 2021 0 repositories listed
-
Branching Dueling Q-Network Based Online Scheduling of a Microgrid With Distributed Energy Storage Systems27 May 2021 0 repositories listed
-
Optimistic Reinforcement Learning by Forward Kullback-Leibler Divergence Optimization27 May 2021 0 repositories listed
-
Pattern Transfer Learning for Reinforcement Learning in Order Dispatching27 May 2021 0 repositories listed
-
Context-aware taxi dispatching at city-scale using deep reinforcement learning26 May 2021 0 repositories listed
-
A Generalised Inverse Reinforcement Learning Framework25 May 2021 0 repositories listed
-
Bayesian Nonparametric Reinforcement Learning in LTE and Wi-Fi Coexistence25 May 2021 0 repositories listed
-
FNAS: Uncertainty-Aware Fast Neural Architecture Search25 May 2021 0 repositories listed
-
IGO-QNN: Quantum Neural Network Architecture for Inductive Grover Oracularization25 May 2021 0 repositories listed
-
Interpretable UAV Collision Avoidance using Deep Reinforcement Learning25 May 2021 0 repositories listed
-
KnowSR: Knowledge Sharing among Homogeneous Agents in Multi-agent Reinforcement Learning25 May 2021 0 repositories listed
-
Safe Model-based Off-policy Reinforcement Learning for Eco-Driving in Connected and Automated Hybrid Electric Vehicles25 May 2021 0 repositories listed
-
Trajectory Modeling via Random Utility Inverse Reinforcement Learning25 May 2021 0 repositories listed
-
Transfer Learning and Curriculum Learning in Sokoban25 May 2021 0 repositories listed
-
Unbiased Asymmetric Reinforcement Learning under Partial Observability25 May 2021 0 repositories listed
-
Policy Mirror Descent for Regularized Reinforcement Learning: A Generalized Framework with Linear Convergence24 May 2021 0 repositories listed
-
Room Clearance with Feudal Hierarchical Reinforcement Learning24 May 2021 0 repositories listed
-
Verification of Dissipativity and Evaluation of Storage Function in Economic Nonlinear MPC using Q-Learning24 May 2021 0 repositories listed
-
Attention-based Reinforcement Learning for Real-Time UAV Semantic Communication22 May 2021 0 repositories listed
-
An Exponential Lower Bound for Linearly Realizable MDP with Constant Suboptimality Gap21 May 2021 0 repositories listed
-
De-Biased Modelling of Search Click Behavior with Reinforcement Learning21 May 2021 0 repositories listed
-
Learning MDPs from Features: Predict-Then-Optimize for Sequential Decision Making by Reinforcement Learning21 May 2021 0 repositories listed
-
Meta Reinforcement Learning for Fast Adaptation of Hierarchical Policies21 May 2021 0 repositories listed
-
Multi-Agent Deep Reinforcement Learning using Attentive Graph Neural Architectures for Real-Time Strategy Games21 May 2021 0 repositories listed
-
On the use of feature-maps and parameter control for improved quality-diversity meta-evolution21 May 2021 0 repositories listed
-
Reinforcement Learning based Disease Progression Model for Alzheimer’s Disease21 May 2021 0 repositories listed
-
Reinforcement learning for instance segmentation with high-level priors21 May 2021 0 repositories listed
-
Revisiting Design Choices in Offline Model Based Reinforcement Learning21 May 2021 0 repositories listed
-
RLIRank: Learning to Rank with Reinforcement Learning for Dynamic Search21 May 2021 0 repositories listed
-
Stochastic Approximation of Gaussian Free Energy for Risk-Sensitive Reinforcement Learning21 May 2021 0 repositories listed
-
Techniques Toward Optimizing Viewability in RTB Ad Campaigns Using Reinforcement Learning21 May 2021 0 repositories listed
-
A Stochastic Composite Augmented Lagrangian Method For Reinforcement Learning20 May 2021 0 repositories listed
-
Objective-aware Traffic Simulation via Inverse Reinforcement Learning20 May 2021 0 repositories listed
-
Towards a Sample Efficient Reinforcement Learning Pipeline for Vision Based Robotics20 May 2021 0 repositories listed
-
Unified Conversational Recommendation Policy Learning via Graph-based Reinforcement Learning20 May 2021 0 repositories listed
-
Learn Fine-grained Adaptive Loss for Multiple Anatomical Landmark Detection in Medical Images19 May 2021 0 repositories listed
-
Online Adaptive Optimal Control Algorithm Based on Synchronous Integral Reinforcement Learning With Explorations19 May 2021 0 repositories listed
-
Reinforcement Learning Assisted Oxygen Therapy for COVID-19 Patients Under Intensive Care19 May 2021 0 repositories listed
-
Robo-Advising: Enhancing Investment with Inverse Optimization and Deep Reinforcement Learning19 May 2021 0 repositories listed
-
Adaptive ABAC Policy Learning: A Reinforcement Learning Approach18 May 2021 0 repositories listed
-
Application of deep reinforcement learning for Indian stock trading automation18 May 2021 0 repositories listed
-
Gym-ANM: Open-source software to leverage reinforcement learning for power system management in research and education18 May 2021 0 repositories listed
-
Learning and Information in Stochastic Networks and Queues18 May 2021 0 repositories listed
-
Online Multimodal Transportation Planning using Deep Reinforcement Learning18 May 2021 0 repositories listed
-
PoBRL: Optimizing Multi-Document Summarization by Blending Reinforcement Learning Policies18 May 2021 0 repositories listed
-
Reinforcement Learning for Adaptive Video Compressive Sensing18 May 2021 0 repositories listed
-
Reinforcement Learning With Sparse-Executing Actions via Sparsity Regularization18 May 2021 0 repositories listed
-
Sublinear Least-Squares Value Iteration via Locality Sensitive Hashing18 May 2021 0 repositories listed
-
Mean Field Games Flock! The Reinforcement Learning Way17 May 2021 0 repositories listed
-
RAIDER: Reinforcement-aided Spear Phishing Detector17 May 2021 0 repositories listed
-
RL-GRIT: Reinforcement Learning for Grammar Inference17 May 2021 0 repositories listed
-
Sample-Efficient Reinforcement Learning Is Feasible for Linearly Realizable MDPs with Limited Revisiting17 May 2021 0 repositories listed
-
DRAS-CQSim: A Reinforcement Learning based Framework for HPC Cluster Scheduling16 May 2021 0 repositories listed
-
A Heuristically Assisted Deep Reinforcement Learning Approach for Network Slice Placement14 May 2021 0 repositories listed
-
Efficient PAC Reinforcement Learning in Regular Decision Processes14 May 2021 0 repositories listed
-
Feature-Based Interpretable Reinforcement Learning based on State-Transition Models14 May 2021 0 repositories listed
-
Non-decreasing Quantile Function Network with Efficient Exploration for Distributional Reinforcement Learning14 May 2021 0 repositories listed
-
Adaptive Warm-Start MCTS in AlphaZero-like Deep Reinforcement Learning13 May 2021 0 repositories listed
-
Intelligence and Unambitiousness Using Algorithmic Information Theory13 May 2021 0 repositories listed
-
Online Algorithms and Policies Using Adaptive and Machine Learning Approaches13 May 2021 0 repositories listed