Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 85
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 85 of 152: papers 8,401 to 8,500 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Deep Reinforcement Learning for Optimal Investment and Saving Strategy Selection in Heterogeneous Profiles: Intelligent Agents working towards retirement12 Jun 2022 0 repositories listed
-
Matching options to tasks using Option-Indexed Hierarchical Reinforcement Learning12 Jun 2022 0 repositories listed
-
RL-GA: A Reinforcement Learning-Based Genetic Algorithm for Electromagnetic Detection Satellite Scheduling Problem12 Jun 2022 0 repositories listed
-
Federated Offline Reinforcement Learning11 Jun 2022 0 repositories listed
-
An application of neural networks to a problem in knot theory and group theory (untangling braids)10 Jun 2022 0 repositories listed
-
Deep Multi-Agent Reinforcement Learning with Hybrid Action Spaces based on Maximum Entropy10 Jun 2022 0 repositories listed
-
Large-Scale Retrieval for Reinforcement Learning10 Jun 2022 0 repositories listed
-
Multifidelity Reinforcement Learning with Control Variates10 Jun 2022 0 repositories listed
-
Policy Gradient Reinforcement Learning for Uncertain Polytopic LPV Systems based on MHE-MPC10 Jun 2022 0 repositories listed
-
Social Network Structure Shapes Innovation: Experience-sharing in RL with SAPIENS10 Jun 2022 0 repositories listed
-
An Optimization Method-Assisted Ensemble Deep Reinforcement Learning Algorithm to Solve Unit Commitment Problems9 Jun 2022 0 repositories listed
-
Deep Surrogate Assisted Generation of Environments9 Jun 2022 0 repositories listed
-
Overcoming the Spectral Bias of Neural Value Approximation9 Jun 2022 0 repositories listed
-
Quantum Policy Iteration via Amplitude Estimation and Grover Search -- Towards Quantum Advantage for Reinforcement Learning9 Jun 2022 0 repositories listed
-
Receding Horizon Inverse Reinforcement Learning9 Jun 2022 0 repositories listed
-
Regret Analysis of Certainty Equivalence Policies in Continuous-Time Linear-Quadratic Systems9 Jun 2022 0 repositories listed
-
Regret Bounds for Information-Directed Reinforcement Learning9 Jun 2022 0 repositories listed
-
Sample-Efficient Reinforcement Learning in the Presence of Exogenous Information9 Jun 2022 0 repositories listed
-
There is no Accuracy-Interpretability Tradeoff in Reinforcement Learning for Mazes9 Jun 2022 0 repositories listed
-
A Study of Continual Learning Methods for Q-Learning8 Jun 2022 0 repositories listed
-
Action Noise in Off-Policy Deep Reinforcement Learning: Impact on Exploration and Performance8 Jun 2022 0 repositories listed
-
Learning to Generate Prompts for Dialogue Generation through Reinforcement Learning8 Jun 2022 0 repositories listed
-
Model-Based Reinforcement Learning for Offline Zero-Sum Markov Games8 Jun 2022 0 repositories listed
-
Reinforced Inverse Scattering8 Jun 2022 0 repositories listed
-
Scalable Joint Learning of Wireless Multiple-Access Policies and their Signaling8 Jun 2022 0 repositories listed
-
Scalable Online Disease Diagnosis via Multi-Model-Fused Actor-Critic Reinforcement Learning8 Jun 2022 0 repositories listed
-
Sim2real for Reinforcement Learning Driven Next Generation Networks8 Jun 2022 0 repositories listed
-
Solving the Spike Feature Information Vanishing Problem in Spiking Deep Q Network with Potential Based Normalization8 Jun 2022 0 repositories listed
-
A Model-Based Reinforcement Learning Approach for PID Design7 Jun 2022 0 repositories listed
-
Driving in Real Life with Inverse Reinforcement Learning7 Jun 2022 0 repositories listed
-
Imitating Past Successes can be Very Suboptimal7 Jun 2022 0 repositories listed
-
Learning in Observable POMDPs, without Computationally Intractable Oracles7 Jun 2022 0 repositories listed
-
MIX-MAB: Reinforcement Learning-based Resource Allocation Algorithm for LoRaWAN7 Jun 2022 0 repositories listed
-
On the Effectiveness of Fine-tuning Versus Meta-reinforcement Learning7 Jun 2022 0 repositories listed
-
On the Role of Discount Factor in Offline Reinforcement Learning7 Jun 2022 0 repositories listed
-
Variational Meta Reinforcement Learning for Social Robotics7 Jun 2022 0 repositories listed
-
Adaptive Rollout Length for Model-Based RL Using Model-Free Deep RL6 Jun 2022 0 repositories listed
-
Asymptotic Instance-Optimal Algorithms for Interactive Decision Making6 Jun 2022 0 repositories listed
-
Balancing Profit, Risk, and Sustainability for Portfolio Management6 Jun 2022 0 repositories listed
-
Consensus Learning for Cooperative Multi-Agent Reinforcement Learning6 Jun 2022 0 repositories listed
-
Deep Reinforcement Learning for Cybersecurity Threat Detection and Protection: A Review6 Jun 2022 0 repositories listed
-
Efficient entity-based reinforcement learning6 Jun 2022 0 repositories listed
-
Goal-Space Planning with Subgoal Models6 Jun 2022 0 repositories listed
-
Learning Generalized Wireless MAC Communication Protocols via Abstraction6 Jun 2022 0 repositories listed
-
Markovian Interference in Experiments6 Jun 2022 0 repositories listed
-
Real2Sim or Sim2Real: Robotics Visual Insertion using Deep Reinforcement Learning and Real2Sim Policy Adaptation6 Jun 2022 0 repositories listed
-
Provably Efficient Risk-Sensitive Reinforcement Learning: Iterated CVaR and Worst Path6 Jun 2022 0 repositories listed
-
Robust Adversarial Attacks Detection based on Explainable Deep Reinforcement Learning For UAV Guidance and Planning6 Jun 2022 0 repositories listed
-
Specification-Guided Learning of Nash Equilibria with High Social Welfare6 Jun 2022 0 repositories listed
-
ARC -- Actor Residual Critic for Adversarial Imitation Learning5 Jun 2022 0 repositories listed
-
DDPG based on multi-scale strokes for financial time series trading strategy5 Jun 2022 0 repositories listed
-
Learning Dynamics and Generalization in Reinforcement Learning5 Jun 2022 0 repositories listed
-
Rapid Learning of Spatial Representations for Goal-Directed Navigation Based on a Novel Model of Hippocampal Place Fields5 Jun 2022 0 repositories listed
-
Adaptive Tree Backup Algorithms for Temporal-Difference Reinforcement Learning4 Jun 2022 0 repositories listed
-
Between Rate-Distortion Theory & Value Equivalence in Model-Based Reinforcement Learning4 Jun 2022 0 repositories listed
-
Beyond Value: CHECKLIST for Testing Inferences in Planning-Based RL4 Jun 2022 0 repositories listed
-
Deciding What to Model: Value-Equivalent Sampling for Reinforcement Learning4 Jun 2022 0 repositories listed
-
Hybrid Value Estimation for Off-policy Evaluation and Offline Reinforcement Learning4 Jun 2022 0 repositories listed
-
MACC: Cross-Layer Multi-Agent Congestion Control with Deep Reinforcement Learning4 Jun 2022 0 repositories listed
-
Reward Poisoning Attacks on Offline Multi-Agent Reinforcement Learning4 Jun 2022 0 repositories listed
-
A Deep Reinforcement Learning Framework For Column Generation3 Jun 2022 0 repositories listed
-
Disentangling Epistemic and Aleatoric Uncertainty in Reinforcement Learning3 Jun 2022 0 repositories listed
-
Joint Energy Dispatch and Unit Commitment in Microgrids Based on Deep Reinforcement Learning3 Jun 2022 0 repositories listed
-
KCRL: Krasovskii-Constrained Reinforcement Learning with Guaranteed Stability in Nonlinear Dynamical Systems3 Jun 2022 0 repositories listed
-
Offline Reinforcement Learning with Causal Structured World Models3 Jun 2022 0 repositories listed
-
Reinforcement Learning with Neural Radiance Fields3 Jun 2022 0 repositories listed
-
Equivariant Reinforcement Learning for Quadrotor UAV2 Jun 2022 0 repositories listed
-
HEX: Human-in-the-loop Explainability via Deep Reinforcement Learning2 Jun 2022 0 repositories listed
-
Incorporating Explicit Uncertainty Estimates into Deep Offline Reinforcement Learning2 Jun 2022 0 repositories listed
-
Incrementality Bidding via Reinforcement Learning under Mixed and Delayed Rewards2 Jun 2022 0 repositories listed
-
Offline Reinforcement Learning with Differential Privacy2 Jun 2022 0 repositories listed
-
Policy Gradient Algorithms with Monte Carlo Tree Learning for Non-Markov Decision Processes2 Jun 2022 0 repositories listed
-
Posterior Coreset Construction with Kernelized Stein Discrepancy for Model-Based Reinforcement Learning2 Jun 2022 0 repositories listed
-
RACA: Relation-Aware Credit Assignment for Ad-Hoc Cooperation in Multi-Agent Deep Reinforcement Learning2 Jun 2022 0 repositories listed
-
Reinforcement learning based parameters adaption method for particle swarm optimization2 Jun 2022 0 repositories listed
-
Sample-Efficient Reinforcement Learning of Partially Observable Markov Games2 Jun 2022 0 repositories listed
-
A Database of Multimodal Data to Construct a Simulated Dialogue Partner with Varying Degrees of Cognitive Health1 Jun 2022 0 repositories listed
-
Byzantine-Robust Online and Offline Distributed Reinforcement Learning1 Jun 2022 0 repositories listed
-
Efficient Scheduling of Data Augmentation for Deep Reinforcement Learning1 Jun 2022 0 repositories listed
-
Know Your Boundaries: The Necessity of Explicit Behavioral Cloning in Offline RL1 Jun 2022 0 repositories listed
-
Model Generation with Provable Coverability for Offline Reinforcement Learning1 Jun 2022 0 repositories listed
-
On Gap-dependent Bounds for Offline Reinforcement Learning1 Jun 2022 0 repositories listed
-
Predecessor Features1 Jun 2022 0 repositories listed
-
Provably Efficient Lifelong Reinforcement Learning with Linear Function Approximation1 Jun 2022 0 repositories listed
-
Provably Efficient Offline Multi-agent Reinforcement Learning via Strategy-wise Bonus1 Jun 2022 0 repositories listed
-
RLSS: A Deep Reinforcement Learning Algorithm for Sequential Scene Generation1 Jun 2022 0 repositories listed
-
The Phenomenon of Policy Churn1 Jun 2022 0 repositories listed
-
A Mixture-of-Expert Approach to RL-based Dialogue Management31 May 2022 0 repositories listed
-
k-Means Maximum Entropy Exploration31 May 2022 0 repositories listed
-
Lessons Learned from Data-Driven Building Control Experiments: Contrasting Gaussian Process-based MPC, Bilevel DeePC, and Deep Reinforcement Learning31 May 2022 0 repositories listed
-
Multi-Agent Learning of Numerical Methods for Hyperbolic PDEs with Factored Dec-MDP31 May 2022 0 repositories listed
-
Nearly Minimax Optimal Offline Reinforcement Learning with Linear Function Approximation: Single-Agent MDP and Markov Game31 May 2022 0 repositories listed
-
One Policy is Enough: Parallel Exploration with a Single Policy is Near-Optimal for Reward-Free Reinforcement Learning31 May 2022 0 repositories listed
-
Provable General Function Class Representation Learning in Multitask Bandits and MDPs31 May 2022 0 repositories listed
-
Robust Longitudinal Control for Vehicular Autonomous Platoons Using Deep Reinforcement Learning31 May 2022 0 repositories listed
-
Sample-Efficient, Exploration-Based Policy Optimisation for Routing Problems31 May 2022 0 repositories listed
-
Timing is Everything: Learning to Act Selectively with Costly Actions and Budgetary Constraints31 May 2022 0 repositories listed
-
Designing Rewards for Fast Learning30 May 2022 0 repositories listed
-
A Simulation Environment and Reinforcement Learning Method for Waste Reduction30 May 2022 0 repositories listed
-
GraMeR: Graph Meta Reinforcement Learning for Multi-Objective Influence Maximization30 May 2022 0 repositories listed