Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 93
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 93 of 152: papers 9,201 to 9,300 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
CGIBNet: Bandwidth-constrained Communication with Graph Information Bottleneck in Multi-Agent Reinforcement Learning20 Dec 2021 0 repositories listed
-
Safe multi-agent deep reinforcement learning for joint bidding and maintenance scheduling of generation units20 Dec 2021 0 repositories listed
-
Exploration-exploitation trade-off for continuous-time episodic reinforcement learning with linear-convex models19 Dec 2021 0 repositories listed
-
Masked Deep Q-Recommender for Effective Question Scheduling19 Dec 2021 0 repositories listed
-
RoboAssembly: Learning Generalizable Furniture Assembly Policy in a Novel Multi-robot Contact-rich Simulation Environment19 Dec 2021 0 repositories listed
-
Creativity of AI: Hierarchical Planning Model Learning for Facilitating Deep Reinforcement Learning18 Dec 2021 0 repositories listed
-
Curriculum Based Reinforcement Learning of Grid Topology Controllers to Prevent Thermal Cascading18 Dec 2021 0 repositories listed
-
Model-Based Safe Reinforcement Learning with Time-Varying State and Control Constraints: An Application to Intelligent Vehicles18 Dec 2021 0 repositories listed
-
Contrastive Explanations for Comparing Preferences of Reinforcement Learning Agents17 Dec 2021 0 repositories listed
-
Deep Reinforcement Learning-based Authentic Dialogue Generation To Protect Youth From Cybergrooming17 Dec 2021 0 repositories listed
-
Learning Reward Machines: A Study in Partially Observable Reinforcement Learning17 Dec 2021 0 repositories listed
-
Personalized Lane Change Decision Algorithm Using Deep Reinforcement Learning Approach17 Dec 2021 0 repositories listed
-
Symmetry-aware Neural Architecture for Embodied Visual Navigation17 Dec 2021 0 repositories listed
-
Unsupervised Compressive Text Summarisation with Reinforcement Learning17 Dec 2021 0 repositories listed
-
Benchmarking Safe Deep Reinforcement Learning in Aquatic Navigation16 Dec 2021 0 repositories listed
-
Centralizing State-Values in Dueling Networks for Multi-Robot Reinforcement Learning Mapless Navigation16 Dec 2021 0 repositories listed
-
CONQRR: Conversational Query Rewriting for Retrieval with Reinforcement Learning16 Dec 2021 0 repositories listed
-
Deep Reinforcement Learning Policies Learn Shared Adversarial Features Across MDPs16 Dec 2021 0 repositories listed
-
Goal-Directed Story Generation: Augmenting Generative Language Models with Reinforcement Learning16 Dec 2021 0 repositories listed
-
Automatic tuning of hyper-parameters of reinforcement learning algorithms using Bayesian optimization with behavioral cloning15 Dec 2021 0 repositories listed
-
DeepScalper: A Risk-Aware Reinforcement Learning Framework to Capture Fleeting Intraday Trading Opportunities15 Dec 2021 0 repositories listed
-
Assessing Human Interaction in Virtual Reality With Continually Learning Prediction Agents Based on Reinforcement Learning Algorithms: A Pilot Study14 Dec 2021 0 repositories listed
-
Biased Gradient Estimate with Drastic Variance Reduction for Meta Reinforcement Learning14 Dec 2021 0 repositories listed
-
Meta-CPR: Generalize to Unseen Large Number of Agents with Communication Pattern Recognition Module14 Dec 2021 0 repositories listed
-
Programmatic Reward Design by Example14 Dec 2021 0 repositories listed
-
Quantifying Multimodality in World Models14 Dec 2021 0 repositories listed
-
Reinforcing Semantic-Symmetry for Document Summarization14 Dec 2021 0 repositories listed
-
Representation and Invariance in Reinforcement Learning14 Dec 2021 0 repositories listed
-
Scientific Discovery and the Cost of Measurement -- Balancing Information and Cost in Reinforcement Learning14 Dec 2021 0 repositories listed
-
A Benchmark for Low-Switching-Cost Reinforcement Learning13 Dec 2021 0 repositories listed
-
Contextual Exploration Using a Linear Approximation Method Based on Satisficing13 Dec 2021 0 repositories listed
-
Teaching a Robot to Walk Using Reinforcement Learning13 Dec 2021 0 repositories listed
-
Control-Tutored Reinforcement Learning: Towards the Integration of Data-Driven and Model-Based Control11 Dec 2021 0 repositories listed
-
Federated Reinforcement Learning at the Edge11 Dec 2021 0 repositories listed
-
Formalising the Foundations of Discrete Reinforcement Learning in Isabelle/HOL11 Dec 2021 0 repositories listed
-
MedAttacker: Exploring Black-Box Adversarial Attacks on Risk Prediction Models in Healthcare11 Dec 2021 0 repositories listed
-
A Validation Tool for Designing Reinforcement Learning Environments10 Dec 2021 0 repositories listed
-
Edge-Compatible Reinforcement Learning for Recommendations10 Dec 2021 0 repositories listed
-
Encoding priors in the brain: a reinforcement learning model for mouse decision making10 Dec 2021 0 repositories listed
-
Quantum Architecture Search via Continual Reinforcement Learning10 Dec 2021 0 repositories listed
-
Zero-Shot Uncertainty-Aware Deployment of Simulation Trained Policies on Real-World Robots10 Dec 2021 0 repositories listed
-
DR3: Value-Based Deep Reinforcement Learning Requires Explicit Regularization9 Dec 2021 0 repositories listed
-
High-Dimensional Stock Portfolio Trading with Deep Reinforcement Learning9 Dec 2021 0 repositories listed
-
Reinforcement Learning with Almost Sure Constraints9 Dec 2021 0 repositories listed
-
A Review for Deep Reinforcement Learning in Atari:Benchmarks, Challenges, and Solutions8 Dec 2021 0 repositories listed
-
Ambiguous Dynamic Treatment Regimes: A Reinforcement Learning Approach8 Dec 2021 0 repositories listed
-
Application of Deep Reinforcement Learning to Payment Fraud8 Dec 2021 0 repositories listed
-
CoMPS: Continual Meta Policy Search8 Dec 2021 0 repositories listed
-
Deep Q-Learning Market Makers in a Multi-Agent Simulated Stock Market8 Dec 2021 0 repositories listed
-
Hyper-parameter optimization based on soft actor critic and hierarchical mixture regularization8 Dec 2021 0 repositories listed
-
Learning over All Stabilizing Nonlinear Controllers for a Partially-Observed Linear System8 Dec 2021 0 repositories listed
-
Learning to Select the Next Reasonable Mention for Entity Linking8 Dec 2021 0 repositories listed
-
Recent Advances in Reinforcement Learning in Finance8 Dec 2021 0 repositories listed
-
Suboptimal and trait-like reinforcement learning strategies correlate with midbrain encoding of prediction errors8 Dec 2021 0 repositories listed
-
A Transferable Approach for Partitioning Machine Learning Models on Multi-Chip-Modules7 Dec 2021 0 repositories listed
-
First-Order Regret in Reinforcement Learning with Linear Function Approximation: A Robust Estimation Approach7 Dec 2021 0 repositories listed
-
JueWu-MC: Playing Minecraft with Sample-efficient Hierarchical Reinforcement Learning7 Dec 2021 0 repositories listed
-
MESA: Offline Meta-RL for Safe Adaptation and Fault Tolerance7 Dec 2021 0 repositories listed
-
Model-free Nearly Optimal Control of Constrained-Input Nonlinear Systems Based on Synchronous Reinforcement Learning7 Dec 2021 0 repositories listed
-
QKSA: Quantum Knowledge Seeking Agent -- resource-optimized reinforcement learning using quantum process tomography7 Dec 2021 0 repositories listed
-
Synthetic Acute Hypotension and Sepsis Datasets Based on MIMIC-III and Published as Part of the Health Gym Project7 Dec 2021 0 repositories listed
-
Deep differentiable reinforcement learning and optimal trading6 Dec 2021 0 repositories listed
-
Distilled Domain Randomization6 Dec 2021 0 repositories listed
-
Lecture Notes on Partially Known MDPs6 Dec 2021 0 repositories listed
-
MDPFuzz: Testing Models Solving Markov Decision Processes6 Dec 2021 0 repositories listed
-
Organ localisation using supervised and semi supervised approaches combining reinforcement learning with imitation learning6 Dec 2021 0 repositories listed
-
Temporal-Spatial Causal Interpretations for Vision-Based Reinforcement Learning6 Dec 2021 0 repositories listed
-
Benchmark for Out-of-Distribution Detection in Deep Reinforcement Learning5 Dec 2021 0 repositories listed
-
Deep Policy Iteration with Integer Programming for Inventory Management4 Dec 2021 0 repositories listed
-
An Analytical Update Rule for General Policy Optimization3 Dec 2021 0 repositories listed
-
Divergent representations of ethological visual inputs emerge from supervised, unsupervised, and reinforcement learning3 Dec 2021 0 repositories listed
-
Reinforcement learning for options on target volatility funds3 Dec 2021 0 repositories listed
-
Adversarial Robustness of Deep Reinforcement Learning based Dynamic Recommender Systems2 Dec 2021 0 repositories listed
-
Architecting and Visualizing Deep Reinforcement Learning Models2 Dec 2021 0 repositories listed
-
Convergence Guarantees for Deep Epsilon Greedy Policy Learning2 Dec 2021 0 repositories listed
-
Differentially Private Exploration in Reinforcement Learning with Linear Representation2 Dec 2021 0 repositories listed
-
Maximum Entropy Model-based Reinforcement Learning2 Dec 2021 0 repositories listed
-
Towards Personalization of User Preferences in Partially Observable Smart Home Environments2 Dec 2021 0 repositories listed
-
Reward-Free Attacks in Multi-Agent Reinforcement Learning2 Dec 2021 0 repositories listed
-
Safe Reinforcement Learning for Grid Voltage Control2 Dec 2021 0 repositories listed
-
Towards Interactive Reinforcement Learning with Intrinsic Feedback2 Dec 2021 0 repositories listed
-
BooVI: Provably Efficient Bootstrapped Value Iteration1 Dec 2021 0 repositories listed
-
Curriculum Offline Imitating Learning1 Dec 2021 0 repositories listed
-
Design and Development of Spoken Dialogue System in Indic Languages1 Dec 2021 0 repositories listed
-
Distributionally Robust Imitation Learning1 Dec 2021 0 repositories listed
-
Fast Algorithms for L_∞-constrained S-rectangular Robust MDPs1 Dec 2021 0 repositories listed
-
Homotopy Based Reinforcement Learning with Maximum Entropy for Autonomous Air Combat1 Dec 2021 0 repositories listed
-
Improving gearshift controllers for electric vehicles with reinforcement learning1 Dec 2021 0 repositories listed
-
Learning Tree Interpretation from Object Representation for Deep Reinforcement Learning1 Dec 2021 0 repositories listed
-
Model-Based Reinforcement Learning via Imagination with Derived Memory1 Dec 2021 0 repositories listed
-
Multi-Agent Transfer Learning in Reinforcement Learning-Based Ride-Sharing Systems1 Dec 2021 0 repositories listed
-
Offline Constrained Multi-Objective Reinforcement Learning via Pessimistic Dual Value Iteration1 Dec 2021 0 repositories listed
-
On the Practical Consistency of Meta-Reinforcement Learning Algorithms1 Dec 2021 0 repositories listed
-
Reinforcement Learning Enhanced Explainer for Graph Neural Networks1 Dec 2021 0 repositories listed
-
Reinforcement Learning in Newcomblike Environments1 Dec 2021 0 repositories listed
-
RMIX: Learning Risk-Sensitive Policies forCooperative Reinforcement Learning Agents1 Dec 2021 0 repositories listed
-
Structural Credit Assignment in Neural Networks using Reinforcement Learning1 Dec 2021 0 repositories listed
-
Taming Communication and Sample Complexities in Decentralized Policy Evaluation for Cooperative Multi-Agent Reinforcement Learning1 Dec 2021 0 repositories listed
-
Understanding End-to-End Model-Based Reinforcement Learning Methods as Implicit Parameterization1 Dec 2021 0 repositories listed
-
Weighted model estimation for offline model-based reinforcement learning1 Dec 2021 0 repositories listed