Browse State-of-the-Art › Reinforcement Learning › Papers, page 77
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 77 of 132: papers 7,601 to 7,700 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Learning Two-Step Hybrid Policy for Graph-Based Interpretable Reinforcement Learning21 Jan 2022 0 repositories listed
-
Reinforcement Learning for Personalized Drug Discovery and Design for Complex Diseases: A Systems Pharmacology Perspective21 Jan 2022 0 repositories listed
-
Reinforcement Learning Your Way: Agent Characterization through Policy Regularization21 Jan 2022 0 repositories listed
-
A Prescriptive Dirichlet Power Allocation Policy with Deep Reinforcement Learning20 Jan 2022 0 repositories listed
-
Recursive Constraints to Prevent Instability in Constrained Reinforcement Learning20 Jan 2022 0 repositories listed
-
Resource allocation algorithm for MEC based on Deep Reinforcement Learning20 Jan 2022 0 repositories listed
-
Safety-Aware Multi-Agent Apprenticeship Learning20 Jan 2022 0 repositories listed
-
Anytime PSRO for Two-Player Zero-Sum Games19 Jan 2022 0 repositories listed
-
Online POI Recommendation: Learning Dynamic Geo-Human Interactions in Streams19 Jan 2022 0 repositories listed
-
Conservative Distributional Reinforcement Learning with Safety Constraints18 Jan 2022 0 repositories listed
-
Differentially Private Reinforcement Learning with Linear Function Approximation18 Jan 2022 0 repositories listed
-
K-nearest Multi-agent Deep Reinforcement Learning for Collaborative Tasks with a Variable Number of Agents18 Jan 2022 0 repositories listed
-
11 Summaries of Papers on Explainable Reinforcement Learning With Some Commentary17 Jan 2022 0 repositories listed
-
An Improved Reinforcement Learning Algorithm for Learning to Branch17 Jan 2022 0 repositories listed
-
Exploration by Random Network Distillation17 Jan 2022 0 repositories listed
-
Implementations that Matter in Cooperative Multi-Agent Reinforcement Learning17 Jan 2022 0 repositories listed
-
Railway Operation Rescheduling System via Dynamic Simulation and Reinforcement Learning17 Jan 2022 0 repositories listed
-
Spatiotemporal Costmap Inference for MPC via Deep Inverse Reinforcement Learning17 Jan 2022 0 repositories listed
-
State of the Art of Reinforcement Learning17 Jan 2022 0 repositories listed
-
A Family of Cognitively Realistic Parsing Environments for Deep Reinforcement Learning16 Jan 2022 0 repositories listed
-
CONQRR: Conversational Query Rewriting for Retrieval with Reinforcement Learning16 Jan 2022 0 repositories listed
-
Inherently Explainable Reinforcement Learning in Natural Language16 Jan 2022 0 repositories listed
-
Jointly Reinforced User Simulator and Task-oriented Dialog System with Simplified Generative Architecture16 Jan 2022 0 repositories listed
-
Reinforcement Learning with Large Action Spaces for Neural Machine Translation16 Jan 2022 0 repositories listed
-
Deep Reinforcement Learning for Shared Autonomous Vehicles (SAV) Fleet Management15 Jan 2022 0 repositories listed
-
Reinforcement Learning based Air Combat Maneuver Generation14 Jan 2022 0 repositories listed
-
Demystifying Reinforcement Learning in Time-Varying Systems14 Jan 2022 0 repositories listed
-
Automated Reinforcement Learning: An Overview13 Jan 2022 0 repositories listed
-
Criticality-Based Varying Step-Number Algorithm for Reinforcement Learning13 Jan 2022 0 repositories listed
-
The Recurrent Reinforcement Learning Crypto Agent12 Jan 2022 0 repositories listed
-
Active Reinforcement Learning -- A Roadmap Towards Curious Classifier Systems for Self-Adaptation11 Jan 2022 0 repositories listed
-
Automated Reinforcement Learning (AutoRL): A Survey and Open Problems11 Jan 2022 0 repositories listed
-
Benchmarking Deep Reinforcement Learning Algorithms for Vision-based Robotics11 Jan 2022 0 repositories listed
-
Task Independent Capsule-Based Agents for Deep Q-Learning11 Jan 2022 0 repositories listed
-
Distributed Cooperative Multi-Agent Reinforcement Learning with Directed Coordination Graph10 Jan 2022 0 repositories listed
-
State of the Art of User Simulation approaches for conversational information retrieval10 Jan 2022 0 repositories listed
-
Assessing Policy, Loss and Planning Combinations in Reinforcement Learning using a New Modular Architecture8 Jan 2022 0 repositories listed
-
Neural Network Optimization for Reinforcement Learning Tasks Using Sparse Computations7 Jan 2022 0 repositories listed
-
Offline Reinforcement Learning for Road Traffic Control7 Jan 2022 0 repositories listed
-
Combining Reinforcement Learning and Inverse Reinforcement Learning for Asset Allocation Recommendations6 Jan 2022 0 repositories listed
-
Deep Reinforcement Learning, a textbook4 Jan 2022 0 repositories listed
-
Execute Order 66: Targeted Data Poisoning for Reinforcement Learning3 Jan 2022 0 repositories listed
-
Reinforcement Learning for Task Specifications with Action-Constraints2 Jan 2022 0 repositories listed
-
A Surrogate-Assisted Controller for Expensive Evolutionary Reinforcement Learning1 Jan 2022 0 repositories listed
-
Operator Deep Q-Learning: Zero-Shot Reward Transferring in Reinforcement Learning1 Jan 2022 0 repositories listed
-
Importance of Empirical Sample Complexity Analysis for Offline Reinforcement Learning31 Dec 2021 0 repositories listed
-
Single-Shot Pruning for Offline Reinforcement Learning31 Dec 2021 0 repositories listed
-
Stochastic convex optimization for provably efficient apprenticeship learning31 Dec 2021 0 repositories listed
-
Using Graph-Aware Reinforcement Learning to Identify Winning Strategies in Diplomacy Games (Student Abstract)31 Dec 2021 0 repositories listed
-
Reversible Upper Confidence Bound Algorithm to Generate Diverse Optimized Candidates30 Dec 2021 0 repositories listed
-
Stability-Preserving Automatic Tuning of PID Control with Reinforcement Learning30 Dec 2021 0 repositories listed
-
Control Theoretic Analysis of Temporal Difference Learning29 Dec 2021 0 repositories listed
-
Efficient Performance Bounds for Primal-Dual Reinforcement Learning from Demonstrations28 Dec 2021 0 repositories listed
-
Robustness and risk management via distributional dynamic programming28 Dec 2021 0 repositories listed
-
Multiagent Model-based Credit Assignment for Continuous Control27 Dec 2021 0 repositories listed
-
RELDEC: Reinforcement Learning-Based Decoding of Moderate Length LDPC Codes27 Dec 2021 0 repositories listed
-
Safe Reinforcement Learning with Chance-constrained Model Predictive Control27 Dec 2021 0 repositories listed
-
Abstractions of General Reinforcement Learning26 Dec 2021 0 repositories listed
-
A Survey on Interpretable Reinforcement Learning24 Dec 2021 0 repositories listed
-
Dynamic Channel Access via Meta-Reinforcement Learning24 Dec 2021 0 repositories listed
-
Rediscovering Affordance: A Reinforcement Learning Perspective24 Dec 2021 0 repositories listed
-
Local Advantage Networks for Cooperative Multi-Agent Reinforcement Learning23 Dec 2021 0 repositories listed
-
Graph augmented Deep Reinforcement Learning in the GameRLand3D environment22 Dec 2021 0 repositories listed
-
Do Androids Dream of Electric Fences? Safety-Aware Reinforcement Learning with Latent Shielding21 Dec 2021 0 repositories listed
-
Interpretable Preference-based Reinforcement Learning with Tree-Structured Reward Functions20 Dec 2021 0 repositories listed
-
Safe multi-agent deep reinforcement learning for joint bidding and maintenance scheduling of generation units20 Dec 2021 0 repositories listed
-
Creativity of AI: Hierarchical Planning Model Learning for Facilitating Deep Reinforcement Learning18 Dec 2021 0 repositories listed
-
Contrastive Explanations for Comparing Preferences of Reinforcement Learning Agents17 Dec 2021 0 repositories listed
-
Learning Reward Machines: A Study in Partially Observable Reinforcement Learning17 Dec 2021 0 repositories listed
-
Personalized Lane Change Decision Algorithm Using Deep Reinforcement Learning Approach17 Dec 2021 0 repositories listed
-
Unsupervised Compressive Text Summarisation with Reinforcement Learning17 Dec 2021 0 repositories listed
-
Benchmarking Safe Deep Reinforcement Learning in Aquatic Navigation16 Dec 2021 0 repositories listed
-
CONQRR: Conversational Query Rewriting for Retrieval with Reinforcement Learning16 Dec 2021 0 repositories listed
-
Deep Reinforcement Learning Policies Learn Shared Adversarial Features Across MDPs16 Dec 2021 0 repositories listed
-
Automatic tuning of hyper-parameters of reinforcement learning algorithms using Bayesian optimization with behavioral cloning15 Dec 2021 0 repositories listed
-
Meta-CPR: Generalize to Unseen Large Number of Agents with Communication Pattern Recognition Module14 Dec 2021 0 repositories listed
-
Representation and Invariance in Reinforcement Learning14 Dec 2021 0 repositories listed
-
A Benchmark for Low-Switching-Cost Reinforcement Learning13 Dec 2021 0 repositories listed
-
Contextual Exploration Using a Linear Approximation Method Based on Satisficing13 Dec 2021 0 repositories listed
-
Teaching a Robot to Walk Using Reinforcement Learning13 Dec 2021 0 repositories listed
-
Federated Reinforcement Learning at the Edge11 Dec 2021 0 repositories listed
-
Formalising the Foundations of Discrete Reinforcement Learning in Isabelle/HOL11 Dec 2021 0 repositories listed
-
A Validation Tool for Designing Reinforcement Learning Environments10 Dec 2021 0 repositories listed
-
Edge-Compatible Reinforcement Learning for Recommendations10 Dec 2021 0 repositories listed
-
Quantum Architecture Search via Continual Reinforcement Learning10 Dec 2021 0 repositories listed
-
DR3: Value-Based Deep Reinforcement Learning Requires Explicit Regularization9 Dec 2021 0 repositories listed
-
High-Dimensional Stock Portfolio Trading with Deep Reinforcement Learning9 Dec 2021 0 repositories listed
-
Reinforcement Learning with Almost Sure Constraints9 Dec 2021 0 repositories listed
-
Ambiguous Dynamic Treatment Regimes: A Reinforcement Learning Approach8 Dec 2021 0 repositories listed
-
Application of Deep Reinforcement Learning to Payment Fraud8 Dec 2021 0 repositories listed
-
CoMPS: Continual Meta Policy Search8 Dec 2021 0 repositories listed
-
Learning to Select the Next Reasonable Mention for Entity Linking8 Dec 2021 0 repositories listed
-
Recent Advances in Reinforcement Learning in Finance8 Dec 2021 0 repositories listed
-
First-Order Regret in Reinforcement Learning with Linear Function Approximation: A Robust Estimation Approach7 Dec 2021 0 repositories listed
-
JueWu-MC: Playing Minecraft with Sample-efficient Hierarchical Reinforcement Learning7 Dec 2021 0 repositories listed
-
Deep differentiable reinforcement learning and optimal trading6 Dec 2021 0 repositories listed
-
Distilled Domain Randomization6 Dec 2021 0 repositories listed
-
Lecture Notes on Partially Known MDPs6 Dec 2021 0 repositories listed
-
Temporal-Spatial Causal Interpretations for Vision-Based Reinforcement Learning6 Dec 2021 0 repositories listed
-
Benchmark for Out-of-Distribution Detection in Deep Reinforcement Learning5 Dec 2021 0 repositories listed