Browse State-of-the-Art › reinforcement-learning › Papers, page 91
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 91 of 135: papers 9,001 to 9,100 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
ACReL: Adversarial Conditional value-at-risk Reinforcement Learning20 Sep 2021 0 repositories listed
-
Learning Natural Language Generation from Scratch20 Sep 2021 0 repositories listed
-
Reinforcement Learning for Finite-Horizon Restless Multi-Armed Multi-Action Bandits20 Sep 2021 0 repositories listed
-
Two Approaches to Building Collaborative, Task-Oriented Dialog Agents through Self-Play20 Sep 2021 0 repositories listed
-
Dual Behavior Regularized Reinforcement Learning19 Sep 2021 0 repositories listed
-
Greedy UnMixing for Q-Learning in Multi-Agent Reinforcement Learning19 Sep 2021 0 repositories listed
-
Lifelong Robotic Reinforcement Learning by Retaining Experiences19 Sep 2021 0 repositories listed
-
Regularize! Don't Mix: Multi-Agent Reinforcement Learning without Explicit Centralized Structures19 Sep 2021 0 repositories listed
-
Accelerating Offline Reinforcement Learning Application in Real-Time Bidding and Recommendation: Potential Use of Simulation17 Sep 2021 0 repositories listed
-
Coordinated Random Access for Industrial IoT With Correlated Traffic By Reinforcement-Learning17 Sep 2021 0 repositories listed
-
Decentralized Global Connectivity Maintenance for Multi-Robot Navigation: A Reinforcement Learning Approach17 Sep 2021 0 repositories listed
-
Deep Reinforcement Learning Based Multidimensional Resource Management for Energy Harvesting Cognitive NOMA Communications17 Sep 2021 0 repositories listed
-
Soft Actor-Critic With Integer Actions17 Sep 2021 0 repositories listed
-
Reinforcement Learning Policies in Continuous-Time Linear Systems16 Sep 2021 0 repositories listed
-
Comparison and Unification of Three Regularization Methods in Batch Reinforcement Learning16 Sep 2021 0 repositories listed
-
Conservative Data Sharing for Multi-Task Offline Reinforcement Learning16 Sep 2021 0 repositories listed
-
Enabling risk-aware Reinforcement Learning for medical interventions through uncertainty decomposition16 Sep 2021 0 repositories listed
-
Learning from Peers: Deep Transfer Reinforcement Learning for Joint Radio and Cache Resource Allocation in 5G RAN Slicing16 Sep 2021 0 repositories listed
-
RAPID-RL: A Reconfigurable Architecture with Preemptive-Exits for Efficient Deep-Reinforcement Learning16 Sep 2021 0 repositories listed
-
Reinforcement Learning on Encrypted Data16 Sep 2021 0 repositories listed
-
Convergence of a Human-in-the-Loop Policy-Gradient Algorithm With Eligibility Trace Under Reward, Policy, and Advantage Feedback15 Sep 2021 0 repositories listed
-
Optimal Cycling of a Heterogenous Battery Bank via Reinforcement Learning15 Sep 2021 0 repositories listed
-
Short Quantum Circuits in Reinforcement Learning Policies for the Vehicle Routing Problem15 Sep 2021 0 repositories listed
-
Continuous Homeostatic Reinforcement Learning for Self-Regulated Autonomous Agents14 Sep 2021 0 repositories listed
-
DSDF: An approach to handle stochastic agents in collaborative multi-agent reinforcement learning14 Sep 2021 0 repositories listed
-
Exploration in Deep Reinforcement Learning: From Single-Agent to Multiagent Domain14 Sep 2021 0 repositories listed
-
ROMAX: Certifiably Robust Deep Multiagent Reinforcement Learning via Convex Relaxation14 Sep 2021 0 repositories listed
-
Achieving Zero Constraint Violation for Constrained Reinforcement Learning via Primal-Dual Approach13 Sep 2021 0 repositories listed
-
RADARS: Memory Efficient Reinforcement Learning Aided Differentiable Neural Architecture Search13 Sep 2021 0 repositories listed
-
Reinforcement Learning for Load-balanced Parallel Particle Tracing13 Sep 2021 0 repositories listed
-
Theoretical Guarantees of Fictitious Discount Algorithms for Episodic Reinforcement Learning and Global Convergence of Policy Gradient Methods13 Sep 2021 0 repositories listed
-
A Socially Aware Reinforcement Learning Agent for The Single Track Road Problem12 Sep 2021 0 repositories listed
-
Concave Utility Reinforcement Learning with Zero-Constraint Violations12 Sep 2021 0 repositories listed
-
EMVLight: A Decentralized Reinforcement Learning Framework for Efficient Passage of Emergency Vehicles12 Sep 2021 0 repositories listed
-
Federated Ensemble Model-based Reinforcement Learning in Edge Computing12 Sep 2021 0 repositories listed
-
Financial Trading with Feature Preprocessing and Recurrent Reinforcement Learning11 Sep 2021 0 repositories listed
-
Data Generation Method for Learning a Low-dimensional Safe Region in Safe Reinforcement Learning10 Sep 2021 0 repositories listed
-
Multi-agent deep reinforcement learning (MADRL) meets multi-user MIMO systems10 Sep 2021 0 repositories listed
-
Optimizing a domestic battery and solar photovoltaic system with deep reinforcement learning10 Sep 2021 0 repositories listed
-
Projected State-action Balancing Weights for Offline Reinforcement Learning10 Sep 2021 0 repositories listed
-
Incentivizing an Unknown Crowd9 Sep 2021 0 repositories listed
-
Self-supervised Reinforcement Learning with Independently Controllable Subgoals9 Sep 2021 0 repositories listed
-
User Tampering in Reinforcement Learning Recommender Systems9 Sep 2021 0 repositories listed
-
A Deep Reinforcement Learning Approach for Online Parcel Assignment8 Sep 2021 0 repositories listed
-
A Survey of Deep Reinforcement Learning in Recommender Systems: A Systematic Review and Future Directions8 Sep 2021 0 repositories listed
-
Convergence of Batch Asynchronous Stochastic Approximation With Applications to Reinforcement Learning8 Sep 2021 0 repositories listed
-
Integrated and Adaptive Guidance and Control for Endoatmospheric Missiles via Reinforcement Learning8 Sep 2021 0 repositories listed
-
Membership Inference Attacks Against Temporally Correlated Data in Deep Reinforcement Learning8 Sep 2021 0 repositories listed
-
On the impact of MDP design for Reinforcement Learning agents in Resource Management7 Sep 2021 0 repositories listed
-
Delving into Macro Placement with Reinforcement Learning6 Sep 2021 0 repositories listed
-
Guiding Global Placement With Reinforcement Learning6 Sep 2021 0 repositories listed
-
Hindsight Reward Tweaking via Conditional Deep Reinforcement Learning6 Sep 2021 0 repositories listed
-
Method for making multi-attribute decisions in wargames by combining intuitionistic fuzzy numbers with reinforcement learning6 Sep 2021 0 repositories listed
-
Recommendation Fairness: From Static to Dynamic5 Sep 2021 0 repositories listed
-
Eden: A Unified Environment Framework for Booming Reinforcement Learning Algorithms4 Sep 2021 0 repositories listed
-
On the Complexity of Computing Markov Perfect Equilibrium in General-Sum Stochastic Games4 Sep 2021 0 repositories listed
-
Multi-agent Natural Actor-critic Reinforcement Learning Algorithms3 Sep 2021 0 repositories listed
-
Provably Safe Model-Based Meta Reinforcement Learning: An Abstraction-Based Approach3 Sep 2021 0 repositories listed
-
An Oracle and Observations for the OpenAI Gym / ALE Freeway Environment2 Sep 2021 0 repositories listed
-
Multi-Agent Inverse Reinforcement Learning: Suboptimal Demonstrations and Alternative Solution Concepts2 Sep 2021 0 repositories listed
-
Reinforcement Learning for Battery Energy Storage Dispatch augmented with Model-based Optimizer2 Sep 2021 0 repositories listed
-
A Survey of Exploration Methods in Reinforcement Learning1 Sep 2021 0 repositories listed
-
Variational Quantum Reinforcement Learning via Evolutionary Optimization1 Sep 2021 0 repositories listed
-
Incorporating Deception into CyberBattleSim for Autonomous Defense31 Aug 2021 0 repositories listed
-
Informing Autonomous Deception Systems with Cyber Expert Performance Data31 Aug 2021 0 repositories listed
-
Adaptive perturbation adversarial training: based on reinforcement learning30 Aug 2021 0 repositories listed
-
Investigating Vulnerabilities of Deep Neural Policies30 Aug 2021 0 repositories listed
-
Learning Meta Representations for Agents in Multi-Agent Reinforcement Learning30 Aug 2021 0 repositories listed
-
A Policy Efficient Reduction Approach to Convex Constrained Deep Reinforcement Learning29 Aug 2021 0 repositories listed
-
Reinforcement Learning Based Sparse Black-box Adversarial Attack on Video Recognition Models29 Aug 2021 0 repositories listed
-
Influence-Based Reinforcement Learning for Intrinsically-Motivated Agents28 Aug 2021 0 repositories listed
-
Deep Reinforcement Learning for Wireless Resource Allocation Using Buffer State Information27 Aug 2021 0 repositories listed
-
WAD: A Deep Reinforcement Learning Agent for Urban Autonomous Driving27 Aug 2021 0 repositories listed
-
Deep Reinforcement Learning for Dynamic Band Switch in Cellular-Connected UAV26 Aug 2021 0 repositories listed
-
Federated Reinforcement Learning: Techniques, Applications, and Open Challenges26 Aug 2021 0 repositories listed
-
Model-based Chance-Constrained Reinforcement Learning via Separated Proportional-Integral Lagrangian26 Aug 2021 0 repositories listed
-
Robust Model-based Reinforcement Learning for Autonomous Greenhouse Control26 Aug 2021 0 repositories listed
-
Adversary agent reinforcement learning for pursuit-evasion25 Aug 2021 0 repositories listed
-
Deep Reinforcement Learning in Computer Vision: A Comprehensive Survey25 Aug 2021 0 repositories listed
-
Entropy-Aware Model Initialization for Effective Exploration in Deep Reinforcement Learning24 Aug 2021 0 repositories listed
-
Self-optimizing adaptive optics control with Reinforcement Learning for high-contrast imaging24 Aug 2021 0 repositories listed
-
Collect & Infer -- a fresh look at data-efficient Reinforcement Learning23 Aug 2021 0 repositories listed
-
Power Grid Cascading Failure Mitigation by Reinforcement Learning23 Aug 2021 0 repositories listed
-
A Boosting Approach to Reinforcement Learning22 Aug 2021 0 repositories listed
-
MimicBot: Combining Imitation and Reinforcement Learning to win in Bot Bowl21 Aug 2021 0 repositories listed
-
An Independent Study of Reinforcement Learning and Autonomous Driving20 Aug 2021 0 repositories listed
-
Crown Jewels Analysis using Reinforcement Learning with Attack Graphs20 Aug 2021 0 repositories listed
-
Explainable Reinforcement Learning for Broad-XAI: A Conceptual Framework and Survey20 Aug 2021 0 repositories listed
-
Plug and Play, Model-Based Reinforcement Learning20 Aug 2021 0 repositories listed
-
Reinforcement Learning to Optimize Lifetime Value in Cold-Start Recommendation20 Aug 2021 0 repositories listed
-
A Reinforcement Learning Approach for GNSS Spoofing Attack Detection of Autonomous Vehicles19 Aug 2021 0 repositories listed
-
Cooperative Localization Utilizing Reinforcement Learning for 5G Networks19 Aug 2021 0 repositories listed
-
Global Convergence of the ODE Limit for Online Actor-Critic Algorithms in Reinforcement Learning19 Aug 2021 0 repositories listed
-
Improving Human Sequential Decision-Making with Reinforcement Learning19 Aug 2021 0 repositories listed
-
Provable Benefits of Actor-Critic Methods for Offline Reinforcement Learning19 Aug 2021 0 repositories listed
-
Trends in Neural Architecture Search: Towards the Acceleration of Search19 Aug 2021 0 repositories listed
-
Explainable Deep Reinforcement Learning Using Introspection in a Non-episodic Task18 Aug 2021 0 repositories listed
-
Optimal Placement of Public Electric Vehicle Charging Stations Using Deep Reinforcement Learning17 Aug 2021 0 repositories listed
-
Reinforce Attack: Adversarial Attack against BERT with Reinforcement Learning17 Aug 2021 0 repositories listed
-
Heterotic String Model Building with Monad Bundles and Reinforcement Learning16 Aug 2021 0 repositories listed