Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 81
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 81 of 152: papers 8,001 to 8,100 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
An information-theoretic perspective on intrinsic motivation in reinforcement learning: a survey19 Sep 2022 0 repositories listed
-
Enforcing the consensus between Trajectory Optimization and Policy Learning for precise robot control19 Sep 2022 0 repositories listed
-
"Guess what I'm doing": Extending legibility to sequential decision tasks19 Sep 2022 0 repositories listed
-
Meta-Reinforcement Learning for Adaptive Control of Second Order Systems19 Sep 2022 0 repositories listed
-
MSVIPER: Improved Policy Distillation for Reinforcement-Learning-Based Robot Navigation19 Sep 2022 0 repositories listed
-
Rewarding Episodic Visitation Discrepancy for Exploration in Reinforcement Learning19 Sep 2022 0 repositories listed
-
Safe reinforcement learning control for continuous-time nonlinear systems without a backup controller19 Sep 2022 0 repositories listed
-
Transferring Knowledge for Reinforcement Learning in Contact-Rich Manipulation19 Sep 2022 0 repositories listed
-
Evolutionary Deep Reinforcement Learning Using Elite Buffer: A Novel Approach Towards DRL Combined with EA in Continuous Control Tasks18 Sep 2022 0 repositories listed
-
Multi-level Explanation of Deep Reinforcement Learning-based Scheduling18 Sep 2022 0 repositories listed
-
Offline Reinforcement Learning with Instrumental Variables in Confounded Markov Decision Processes18 Sep 2022 0 repositories listed
-
Simplifying Model-based RL: Learning Representations, Latent-space Models, and Policies with One Objective18 Sep 2022 0 repositories listed
-
A Robust and Constrained Multi-Agent Reinforcement Learning Electric Vehicle Rebalancing Method in AMoD Systems17 Sep 2022 0 repositories listed
-
Intrinsically Motivated Reinforcement Learning based Recommendation with Counterfactual Data Augmentation17 Sep 2022 0 repositories listed
-
MA2QL: A Minimalist Approach to Fully Decentralized Multi-Agent Reinforcement Learning17 Sep 2022 0 repositories listed
-
Sample-Efficient Multi-Agent Reinforcement Learning with Demonstrations for Flocking Control17 Sep 2022 0 repositories listed
-
Sub-optimal Policy Aided Multi-Agent Reinforcement Learning for Flocking Control17 Sep 2022 0 repositories listed
-
Conservative Dual Policy Optimization for Efficient Model-Based Reinforcement Learning16 Sep 2022 0 repositories listed
-
Model Inversion Attacks against Graph Neural Networks16 Sep 2022 0 repositories listed
-
Neuromuscular Reinforcement Learning to Actuate Human Limbs through FES16 Sep 2022 0 repositories listed
-
Optimizing Industrial HVAC Systems with Hierarchical Reinforcement Learning16 Sep 2022 0 repositories listed
-
Reinforcement Learning-Based Cooperative P2P Power Trading between DC Nanogrid Clusters with Wind and PV Energy Resources16 Sep 2022 0 repositories listed
-
Trustworthy Reinforcement Learning Against Intrinsic Vulnerabilities: Robustness, Safety, and Generalizability16 Sep 2022 0 repositories listed
-
Value Summation: A Novel Scoring Function for MPC-based Model-based Reinforcement Learning16 Sep 2022 0 repositories listed
-
Can Offline Reinforcement Learning Help Natural Language Understanding?15 Sep 2022 0 repositories listed
-
Deep Reinforcement Learning for Task Offloading in UAV-Aided Smart Farm Networks15 Sep 2022 0 repositories listed
-
IoT-Aerial Base Station Task Offloading with Risk-Sensitive Reinforcement Learning for Smart Agriculture15 Sep 2022 0 repositories listed
-
Mean-Field Approximation of Cooperative Constrained Multi-Agent Reinforcement Learning (CMARL)15 Sep 2022 0 repositories listed
-
MIXRTs: Toward Interpretable Multi-Agent Reinforcement Learning via Mixing Recurrent Soft Decision Trees15 Sep 2022 0 repositories listed
-
ProAPT: Projection of APT Threats with Deep Reinforcement Learning15 Sep 2022 0 repositories listed
-
Scalable Task-Driven Robotic Swarm Control via Collision Avoidance and Learning Mean-Field Control15 Sep 2022 0 repositories listed
-
Understanding Deep Neural Function Approximation in Reinforcement Learning via ε-Greedy Exploration15 Sep 2022 0 repositories listed
-
Analysis of Reinforcement Learning for determining task replication in workflows14 Sep 2022 0 repositories listed
-
Distributionally Robust Offline Reinforcement Learning with Linear Function Approximation14 Sep 2022 0 repositories listed
-
Feature-Rich Long-term Bitcoin Trading Assistant14 Sep 2022 0 repositories listed
-
Robust Constrained Reinforcement Learning14 Sep 2022 0 repositories listed
-
A new Reinforcement Learning framework to discover natural flavor molecules13 Sep 2022 0 repositories listed
-
Active Perception Applied To Unmanned Aerial Vehicles Through Deep Reinforcement Learning13 Sep 2022 0 repositories listed
-
Data efficient reinforcement learning and adaptive optimal perimeter control of network traffic dynamics13 Sep 2022 0 repositories listed
-
Designing Biological Sequences via Meta-Reinforcement Learning and Bayesian Optimization13 Sep 2022 0 repositories listed
-
Skip Training for Multi-Agent Reinforcement Learning Controller for Industrial Wave Energy Converters13 Sep 2022 0 repositories listed
-
Unifying Causal Inference and Reinforcement Learning using Higher-Order Category Theory13 Sep 2022 0 repositories listed
-
Checklist Models for Improved Output Fluency in Piano Fingering Prediction12 Sep 2022 0 repositories listed
-
Deterministic Sequencing of Exploration and Exploitation for Reinforcement Learning12 Sep 2022 0 repositories listed
-
Self-supervised Sequential Information Bottleneck for Robust Exploration in Deep Reinforcement Learning12 Sep 2022 0 repositories listed
-
Pathfinding in Random Partially Observable Environments with Vision-Informed Deep Reinforcement Learning11 Sep 2022 0 repositories listed
-
Performance-Driven Controller Tuning via Derivative-Free Reinforcement Learning11 Sep 2022 0 repositories listed
-
Cooperation and Competition: Flocking with Evolutionary Multi-Agent Reinforcement Learning10 Sep 2022 0 repositories listed
-
Safe Reinforcement Learning with Contrastive Risk Prediction10 Sep 2022 0 repositories listed
-
Task-Agnostic Learning to Accomplish New Tasks9 Sep 2022 0 repositories listed
-
An Analysis of Deep Reinforcement Learning Agents for Text-based Games9 Sep 2022 0 repositories listed
-
Robust Policy Optimization in Continuous-time Mixed ℋ₂/ℋ_∞ Stochastic Control9 Sep 2022 0 repositories listed
-
RASR: Risk-Averse Soft-Robust MDPs with EVaR and Entropic Risk9 Sep 2022 0 repositories listed
-
A Survey on Large-Population Systems and Scalable Multi-Agent Reinforcement Learning8 Sep 2022 0 repositories listed
-
Hybrid Supervised and Reinforcement Learning for the Design and Optimization of Nanophotonic Structures8 Sep 2022 0 repositories listed
-
Non-iterative generation of an optimal mesh for a blade passage using deep reinforcement learning8 Sep 2022 0 repositories listed
-
A Deep Reinforcement Learning Strategy for UAV Autonomous Landing on a Platform7 Sep 2022 0 repositories listed
-
A SUMO Framework for Deep Reinforcement Learning Experiments Solving Electric Vehicle Charging Dispatching Problem7 Sep 2022 0 repositories listed
-
Concept-modulated model-based offline reinforcement learning for rapid generalization7 Sep 2022 0 repositories listed
-
DC-MRTA: Decentralized Multi-Robot Task Allocation and Navigation in Complex Environments7 Sep 2022 0 repositories listed
-
Distilling Deep RL Models Into Interpretable Neuro-Fuzzy Systems7 Sep 2022 0 repositories listed
-
Energy Optimization of Wind Turbines via a Neural Control Policy Based on Reinforcement Learning Markov Chain Monte Carlo Algorithm7 Sep 2022 0 repositories listed
-
On the Near-Optimality of Local Policies in Large Cooperative Multi-Agent Reinforcement Learning7 Sep 2022 0 repositories listed
-
Finite-Time Error Bounds for Greedy-GQ6 Sep 2022 0 repositories listed
-
Improving Assistive Robotics with Deep Reinforcement Learning5 Sep 2022 0 repositories listed
-
Natural Policy Gradients In Reinforcement Learning Explained5 Sep 2022 0 repositories listed
-
Prediction Based Decision Making for Autonomous Highway Driving5 Sep 2022 0 repositories listed
-
Reinforcement learning-based optimised control for tracking of nonlinear systems with adversarial attacks5 Sep 2022 0 repositories listed
-
SlateFree: a Model-Free Decomposition for Reinforcement Learning with Slate Actions5 Sep 2022 0 repositories listed
-
Variational Inference for Model-Free and Model-Based Reinforcement Learning4 Sep 2022 0 repositories listed
-
Model-Free Deep Reinforcement Learning in Software-Defined Networks3 Sep 2022 0 repositories listed
-
Statistical CSI-based Beamforming for RIS-Aided Multiuser MISO Systems using Deep Reinforcement Learning3 Sep 2022 0 repositories listed
-
Dialogue Evaluation with Offline Reinforcement Learning2 Sep 2022 0 repositories listed
-
Learning Practical Communication Strategies in Cooperative Multi-Agent Reinforcement Learning2 Sep 2022 0 repositories listed
-
Taming Multi-Agent Reinforcement Learning with Estimator Variance Reduction2 Sep 2022 0 repositories listed
-
TarGF: Learning Target Gradient Field to Rearrange Objects without Explicit Goal Specification2 Sep 2022 0 repositories listed
-
A Technique to Create Weaker Abstract Board Game Agents via Reinforcement Learning1 Sep 2022 0 repositories listed
-
Deep reinforcement learning for quantum multiparameter estimation1 Sep 2022 0 repositories listed
-
Dynamics-Adaptive Continual Reinforcement Learning via Progressive Contextualization1 Sep 2022 0 repositories listed
-
MetaTrader: An Reinforcement Learning Approach Integrating Diverse Policies for Portfolio Optimization1 Sep 2022 0 repositories listed
-
Systems Theoretic Process Analysis of a Run Time Assured Neural Network Control System1 Sep 2022 0 repositories listed
-
A stabilizing reinforcement learning approach for sampled systems with partially unknown models31 Aug 2022 0 repositories listed
-
Deep Anomaly Detection and Search via Reinforcement Learning31 Aug 2022 0 repositories listed
-
Transmit Power Control for Indoor Small Cells: A Method Based on Federated Reinforcement Learning31 Aug 2022 0 repositories listed
-
A further exploration of deep Multi-Agent Reinforcement Learning with Hybrid Action Space30 Aug 2022 0 repositories listed
-
An Analysis of Model-Based Reinforcement Learning From Abstracted Observations30 Aug 2022 0 repositories listed
-
Beyond Supervised Continual Learning: a Review30 Aug 2022 0 repositories listed
-
Digital Twin Assisted Risk-Aware Sleep Mode Management Using Deep Q-Networks30 Aug 2022 0 repositories listed
-
Distributed Ensembles of Reinforcement Learning Agents for Electricity Control30 Aug 2022 0 repositories listed
-
Evolutionary Deep Reinforcement Learning for Dynamic Slice Management in O-RAN30 Aug 2022 0 repositories listed
-
Model-Based Reinforcement Learning with SINDy30 Aug 2022 0 repositories listed
-
Categorical semantics of compositional reinforcement learning29 Aug 2022 0 repositories listed
-
Reinforcement Learning for Hardware Security: Opportunities, Developments, and Challenges29 Aug 2022 0 repositories listed
-
Understanding the Limits of Poisoning Attacks in Episodic Reinforcement Learning29 Aug 2022 0 repositories listed
-
Normality-Guided Distributional Reinforcement Learning for Continuous Control28 Aug 2022 0 repositories listed
-
RL-DistPrivacy: Privacy-Aware Distributed Deep Inference for low latency IoT systems27 Aug 2022 0 repositories listed
-
SupervisorBot: NLP-Annotated Real-Time Recommendations of Psychotherapy Treatment Strategies with Deep Reinforcement Learning27 Aug 2022 0 repositories listed
-
An approach to implement Reinforcement Learning for Heterogeneous Vehicular Networks26 Aug 2022 0 repositories listed
-
ATTRITION: Attacking Static Hardware Trojan Detection Techniques Using Reinforcement Learning26 Aug 2022 0 repositories listed
-
CH-MARL: A Multimodal Benchmark for Cooperative, Heterogeneous Multi-Agent Reinforcement Learning26 Aug 2022 0 repositories listed