Browse State-of-the-Art › reinforcement-learning › Papers, page 86
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 86 of 135: papers 8,501 to 8,600 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Unsupervised Compressive Text Summarisation with Reinforcement Learning17 Dec 2021 0 repositories listed
-
Benchmarking Safe Deep Reinforcement Learning in Aquatic Navigation16 Dec 2021 0 repositories listed
-
Centralizing State-Values in Dueling Networks for Multi-Robot Reinforcement Learning Mapless Navigation16 Dec 2021 0 repositories listed
-
CONQRR: Conversational Query Rewriting for Retrieval with Reinforcement Learning16 Dec 2021 0 repositories listed
-
Deep Reinforcement Learning Policies Learn Shared Adversarial Features Across MDPs16 Dec 2021 0 repositories listed
-
Goal-Directed Story Generation: Augmenting Generative Language Models with Reinforcement Learning16 Dec 2021 0 repositories listed
-
Automatic tuning of hyper-parameters of reinforcement learning algorithms using Bayesian optimization with behavioral cloning15 Dec 2021 0 repositories listed
-
DeepScalper: A Risk-Aware Reinforcement Learning Framework to Capture Fleeting Intraday Trading Opportunities15 Dec 2021 0 repositories listed
-
Biased Gradient Estimate with Drastic Variance Reduction for Meta Reinforcement Learning14 Dec 2021 0 repositories listed
-
Meta-CPR: Generalize to Unseen Large Number of Agents with Communication Pattern Recognition Module14 Dec 2021 0 repositories listed
-
Reinforcing Semantic-Symmetry for Document Summarization14 Dec 2021 0 repositories listed
-
Representation and Invariance in Reinforcement Learning14 Dec 2021 0 repositories listed
-
A Benchmark for Low-Switching-Cost Reinforcement Learning13 Dec 2021 0 repositories listed
-
Contextual Exploration Using a Linear Approximation Method Based on Satisficing13 Dec 2021 0 repositories listed
-
Teaching a Robot to Walk Using Reinforcement Learning13 Dec 2021 0 repositories listed
-
Federated Reinforcement Learning at the Edge11 Dec 2021 0 repositories listed
-
Formalising the Foundations of Discrete Reinforcement Learning in Isabelle/HOL11 Dec 2021 0 repositories listed
-
A Validation Tool for Designing Reinforcement Learning Environments10 Dec 2021 0 repositories listed
-
Edge-Compatible Reinforcement Learning for Recommendations10 Dec 2021 0 repositories listed
-
Encoding priors in the brain: a reinforcement learning model for mouse decision making10 Dec 2021 0 repositories listed
-
Quantum Architecture Search via Continual Reinforcement Learning10 Dec 2021 0 repositories listed
-
DR3: Value-Based Deep Reinforcement Learning Requires Explicit Regularization9 Dec 2021 0 repositories listed
-
High-Dimensional Stock Portfolio Trading with Deep Reinforcement Learning9 Dec 2021 0 repositories listed
-
Reinforcement Learning with Almost Sure Constraints9 Dec 2021 0 repositories listed
-
A Review for Deep Reinforcement Learning in Atari:Benchmarks, Challenges, and Solutions8 Dec 2021 0 repositories listed
-
Ambiguous Dynamic Treatment Regimes: A Reinforcement Learning Approach8 Dec 2021 0 repositories listed
-
Application of Deep Reinforcement Learning to Payment Fraud8 Dec 2021 0 repositories listed
-
CoMPS: Continual Meta Policy Search8 Dec 2021 0 repositories listed
-
Hyper-parameter optimization based on soft actor critic and hierarchical mixture regularization8 Dec 2021 0 repositories listed
-
Learning to Select the Next Reasonable Mention for Entity Linking8 Dec 2021 0 repositories listed
-
Recent Advances in Reinforcement Learning in Finance8 Dec 2021 0 repositories listed
-
First-Order Regret in Reinforcement Learning with Linear Function Approximation: A Robust Estimation Approach7 Dec 2021 0 repositories listed
-
JueWu-MC: Playing Minecraft with Sample-efficient Hierarchical Reinforcement Learning7 Dec 2021 0 repositories listed
-
QKSA: Quantum Knowledge Seeking Agent -- resource-optimized reinforcement learning using quantum process tomography7 Dec 2021 0 repositories listed
-
Synthetic Acute Hypotension and Sepsis Datasets Based on MIMIC-III and Published as Part of the Health Gym Project7 Dec 2021 0 repositories listed
-
Deep differentiable reinforcement learning and optimal trading6 Dec 2021 0 repositories listed
-
Distilled Domain Randomization6 Dec 2021 0 repositories listed
-
Lecture Notes on Partially Known MDPs6 Dec 2021 0 repositories listed
-
Temporal-Spatial Causal Interpretations for Vision-Based Reinforcement Learning6 Dec 2021 0 repositories listed
-
Benchmark for Out-of-Distribution Detection in Deep Reinforcement Learning5 Dec 2021 0 repositories listed
-
Deep Policy Iteration with Integer Programming for Inventory Management4 Dec 2021 0 repositories listed
-
An Analytical Update Rule for General Policy Optimization3 Dec 2021 0 repositories listed
-
Divergent representations of ethological visual inputs emerge from supervised, unsupervised, and reinforcement learning3 Dec 2021 0 repositories listed
-
Reinforcement learning for options on target volatility funds3 Dec 2021 0 repositories listed
-
Adversarial Robustness of Deep Reinforcement Learning based Dynamic Recommender Systems2 Dec 2021 0 repositories listed
-
Architecting and Visualizing Deep Reinforcement Learning Models2 Dec 2021 0 repositories listed
-
Convergence Guarantees for Deep Epsilon Greedy Policy Learning2 Dec 2021 0 repositories listed
-
Differentially Private Exploration in Reinforcement Learning with Linear Representation2 Dec 2021 0 repositories listed
-
Maximum Entropy Model-based Reinforcement Learning2 Dec 2021 0 repositories listed
-
Towards Personalization of User Preferences in Partially Observable Smart Home Environments2 Dec 2021 0 repositories listed
-
Reward-Free Attacks in Multi-Agent Reinforcement Learning2 Dec 2021 0 repositories listed
-
Safe Reinforcement Learning for Grid Voltage Control2 Dec 2021 0 repositories listed
-
Towards Interactive Reinforcement Learning with Intrinsic Feedback2 Dec 2021 0 repositories listed
-
Distributionally Robust Imitation Learning1 Dec 2021 0 repositories listed
-
Fast Algorithms for L_∞-constrained S-rectangular Robust MDPs1 Dec 2021 0 repositories listed
-
Homotopy Based Reinforcement Learning with Maximum Entropy for Autonomous Air Combat1 Dec 2021 0 repositories listed
-
Improving gearshift controllers for electric vehicles with reinforcement learning1 Dec 2021 0 repositories listed
-
Learning Tree Interpretation from Object Representation for Deep Reinforcement Learning1 Dec 2021 0 repositories listed
-
Model-Based Reinforcement Learning via Imagination with Derived Memory1 Dec 2021 0 repositories listed
-
Multi-Agent Transfer Learning in Reinforcement Learning-Based Ride-Sharing Systems1 Dec 2021 0 repositories listed
-
Offline Constrained Multi-Objective Reinforcement Learning via Pessimistic Dual Value Iteration1 Dec 2021 0 repositories listed
-
On the Practical Consistency of Meta-Reinforcement Learning Algorithms1 Dec 2021 0 repositories listed
-
Reinforcement Learning Enhanced Explainer for Graph Neural Networks1 Dec 2021 0 repositories listed
-
Reinforcement Learning in Newcomblike Environments1 Dec 2021 0 repositories listed
-
RMIX: Learning Risk-Sensitive Policies forCooperative Reinforcement Learning Agents1 Dec 2021 0 repositories listed
-
Structural Credit Assignment in Neural Networks using Reinforcement Learning1 Dec 2021 0 repositories listed
-
Understanding End-to-End Model-Based Reinforcement Learning Methods as Implicit Parameterization1 Dec 2021 0 repositories listed
-
Weighted model estimation for offline model-based reinforcement learning1 Dec 2021 0 repositories listed
-
MAMRL: Exploiting Multi-agent Meta Reinforcement Learning in WAN Traffic Engineering30 Nov 2021 0 repositories listed
-
Model-Free μ Synthesis via Adversarial Reinforcement Learning30 Nov 2021 0 repositories listed
-
Risk-based implementation of COLREGs for autonomous surface vehicles using deep reinforcement learning30 Nov 2021 0 repositories listed
-
The Power of Communication in a Distributed Multi-Agent System30 Nov 2021 0 repositories listed
-
Final Adaptation Reinforcement Learning for N-Player Games29 Nov 2021 0 repositories listed
-
How Can Creativity Occur in Multi-Agent Systems?29 Nov 2021 0 repositories listed
-
Improving Zero-shot Generalization in Offline Reinforcement Learning using Generalized Similarity Functions29 Nov 2021 0 repositories listed
-
Multi-UAV Conflict Resolution with Graph Convolutional Reinforcement Learning29 Nov 2021 0 repositories listed
-
Pessimistic Model Selection for Offline Deep Reinforcement Learning29 Nov 2021 0 repositories listed
-
Reinforcement Learning Algorithm for Traffic Steering in Heterogeneous Network29 Nov 2021 0 repositories listed
-
Count-Based Temperature Scheduling for Maximum Entropy Reinforcement Learning28 Nov 2021 0 repositories listed
-
Measuring Data Quality for Dataset Selection in Offline Reinforcement Learning26 Nov 2021 0 repositories listed
-
A Comparative Analysis of Machine Learning Techniques for IoT Intrusion Detection25 Nov 2021 0 repositories listed
-
Distributed Policy Gradient with Variance Reduction in Multi-Agent Reinforcement Learning25 Nov 2021 0 repositories listed
-
Real-world challenges for multi-agent reinforcement learning in grid-interactive buildings25 Nov 2021 0 repositories listed
-
Towards Modularity Optimization Using Reinforcement Learning to Community Detection in Dynamic Social Networks25 Nov 2021 0 repositories listed
-
A note on stabilizing reinforcement learning24 Nov 2021 0 repositories listed
-
A Review for Deep Reinforcement Learning in Atari: Benchmarks, Challenges, and Solutions24 Nov 2021 0 repositories listed
-
Application of Multi-Agent Reinforcement Learning for Battery Management in Renewable Mini-Grids24 Nov 2021 0 repositories listed
-
24 Nov 2021 0 repositories listed
-
Reinforcement Learning based Path Exploration for Sequential Explainable Recommendation24 Nov 2021 0 repositories listed
-
On the (In)Tractability of Reinforcement Learning for LTL Objectives24 Nov 2021 0 repositories listed
-
Fixed Points in Cyber Space: Rethinking Optimal Evasion Attacks in the Age of AI-NIDS23 Nov 2021 0 repositories listed
-
Generating GPU Compiler Heuristics using Reinforcement Learning23 Nov 2021 0 repositories listed
-
Inducing Functions through Reinforcement Learning without Task Specification23 Nov 2021 0 repositories listed
-
Reinforcement Learning for Volt-Var Control: A Novel Two-stage Progressive Training Strategy23 Nov 2021 0 repositories listed
-
Semantic-Aware Collaborative Deep Reinforcement Learning Over Wireless Cellular Networks23 Nov 2021 0 repositories listed
-
Symbol-Based Over-the-Air Digital Predistortion Using Reinforcement Learning23 Nov 2021 0 repositories listed
-
An application of reinforcement learning to residential energy storage under real-time pricing22 Nov 2021 0 repositories listed
-
Efficient Bayesian Inverse Reinforcement Learning via Conditional Kernel Density Estimation22 Nov 2021 0 repositories listed
-
Multi-agent Bayesian Deep Reinforcement Learning for Microgrid Energy Management under Communication Failures22 Nov 2021 0 repositories listed
-
UMBRELLA: Uncertainty-Aware Model-Based Offline Reinforcement Learning Leveraging Planning22 Nov 2021 0 repositories listed