Browse State-of-the-Art › Reinforcement Learning › Papers, page 68
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 68 of 132: papers 6,701 to 6,800 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Markov Chain Concentration with an Application in Reinforcement Learning7 Jan 2023 0 repositories listed
-
Provable Reset-free Reinforcement Learning by No-Regret Reduction6 Jan 2023 0 repositories listed
-
Reinforcement Learning-Based Air Traffic Deconfliction5 Jan 2023 0 repositories listed
-
Value Enhancement of Reinforcement Learning via Efficient and Robust Trust Region Optimization5 Jan 2023 0 repositories listed
-
Learning-based MPC from Big Data Using Reinforcement Learning4 Jan 2023 0 repositories listed
-
UAV aided Metaverse over Wireless Communications: A Reinforcement Learning Approach4 Jan 2023 0 repositories listed
-
A Succinct Summary of Reinforcement Learning3 Jan 2023 0 repositories listed
-
Contextual Conservative Q-Learning for Offline Reinforcement Learning3 Jan 2023 0 repositories listed
-
Faster Reinforcement Learning by Freezing Slow States3 Jan 2023 0 repositories listed
-
Offline Evaluation for Reinforcement Learning-based Recommendation: A Critical Issue and Some Alternatives3 Jan 2023 0 repositories listed
-
Safe Reinforcement Learning for an Energy-Efficient Driver Assistance System3 Jan 2023 0 repositories listed
-
Towards Deployable RL - What's Broken with RL Research and a Potential Fix3 Jan 2023 0 repositories listed
-
Deep Reinforcement Learning for Asset Allocation: Reward Clipping2 Jan 2023 0 repositories listed
-
Safety Filtering for Reinforcement Learning-based Adaptive Cruise Control2 Jan 2023 0 repositories listed
-
GAIT: Generating Aesthetic Indoor Tours with Deep Reinforcement Learning1 Jan 2023 0 repositories listed
-
Local-Guided Global: Paired Similarity Representation for Visual Reinforcement Learning1 Jan 2023 0 repositories listed
-
PolicyCleanse: Backdoor Detection and Mitigation for Competitive Reinforcement Learning1 Jan 2023 0 repositories listed
-
ReLeaPS : Reinforcement Learning-based Illumination Planning for Generalized Photometric Stereo1 Jan 2023 0 repositories listed
-
Stabilizing Visual Reinforcement Learning via Asymmetric Interactive Cooperation1 Jan 2023 0 repositories listed
-
New Challenges in Reinforcement Learning: A Survey of Security and Privacy31 Dec 2022 0 repositories listed
-
A Novel Experts Advice Aggregation Framework Using Deep Reinforcement Learning for Portfolio Management29 Dec 2022 0 repositories listed
-
Backward Curriculum Reinforcement Learning29 Dec 2022 0 repositories listed
-
On Transforming Reinforcement Learning by Transformer: The Development Trajectory29 Dec 2022 0 repositories listed
-
Certifying Safety in Reinforcement Learning under Adversarial Perturbation Attacks28 Dec 2022 0 repositories listed
-
Don't do it: Safer Reinforcement Learning With Rule-based Guidance28 Dec 2022 0 repositories listed
-
Improving a sequence-to-sequence nlp model using a reinforcement learning policy algorithm28 Dec 2022 0 repositories listed
-
Towards automating Codenames spymasters with deep reinforcement learning28 Dec 2022 0 repositories listed
-
Towards Learning Abstractions via Reinforcement Learning28 Dec 2022 0 repositories listed
-
Model-Based Reinforcement Learning with Multinomial Logistic Function Approximation27 Dec 2022 0 repositories listed
-
Optimal scheduling of island integrated energy systems considering multi-uncertainties and hydrothermal simultaneous transmission: A deep reinforcement learning approach27 Dec 2022 0 repositories listed
-
Deep Reinforcement Learning for Heat Pump Control24 Dec 2022 0 repositories listed
-
SHIRO: Soft Hierarchical Reinforcement Learning24 Dec 2022 0 repositories listed
-
Streaming Traffic Flow Prediction Based on Continuous Reinforcement Learning24 Dec 2022 0 repositories listed
-
Coordinated Multi-Agent Reinforcement Learning for Unmanned Aerial Vehicle Swarms in Autonomous Mobile Access Applications23 Dec 2022 0 repositories listed
-
A Memetic Algorithm with Reinforcement Learning for Sociotechnical Production Scheduling21 Dec 2022 0 repositories listed
-
Imitation Is Not Enough: Robustifying Imitation with Reinforcement Learning for Challenging Driving Scenarios21 Dec 2022 0 repositories listed
-
AdverSAR: Adversarial Search and Rescue via Multi-Agent Reinforcement Learning20 Dec 2022 0 repositories listed
-
Bandit approach to conflict-free multi-agent Q-learning in view of photonic implementation20 Dec 2022 0 repositories listed
-
Variational Quantum Soft Actor-Critic for Robotic Arm Control20 Dec 2022 0 repositories listed
-
Dexterous Manipulation from Images: Autonomous Real-World RL via Substep Guidance19 Dec 2022 0 repositories listed
-
Inverse Reinforcement Learning for Text Summarization19 Dec 2022 0 repositories listed
-
Near-optimal Policy Identification in Active Reinforcement Learning19 Dec 2022 0 repositories listed
-
Quantum policy gradient algorithms19 Dec 2022 0 repositories listed
-
Taming Lagrangian Chaos with Multi-Objective Reinforcement Learning19 Dec 2022 0 repositories listed
-
Neural Coreference Resolution based on Reinforcement Learning18 Dec 2022 0 repositories listed
-
Risk-Sensitive Reinforcement Learning with Exponential Criteria18 Dec 2022 0 repositories listed
-
Enhancing Cyber Resilience of Networked Microgrids using Vertical Federated Reinforcement Learning17 Dec 2022 0 repositories listed
-
Latent Variable Representation for Reinforcement Learning17 Dec 2022 0 repositories listed
-
Cognitive Level-k Meta-Learning for Safe and Pedestrian-Aware Autonomous Driving17 Dec 2022 0 repositories listed
-
Pre-Trained Image Encoder for Generalizable Visual Reinforcement Learning17 Dec 2022 0 repositories listed
-
Offline Robot Reinforcement Learning with Uncertainty-Guided Human Expert Sampling16 Dec 2022 0 repositories listed
-
Reinforcement Learning for Agile Active Target Sensing with a UAV16 Dec 2022 0 repositories listed
-
Multi-Agent Reinforcement Learning with Shared Resources for Inventory Management15 Dec 2022 0 repositories listed
-
Reinforcement Learning in Credit Scoring and Underwriting15 Dec 2022 0 repositories listed
-
Efficient Exploration in Resource-Restricted Reinforcement Learning14 Dec 2022 0 repositories listed
-
Explaining Agent's Decision-making in a Hierarchical Reinforcement Learning Scenario14 Dec 2022 0 repositories listed
-
Hierarchical Strategies for Cooperative Multi-Agent Reinforcement Learning14 Dec 2022 0 repositories listed
-
Quantum Control based on Deep Reinforcement Learning14 Dec 2022 0 repositories listed
-
Reinforcement Learning in System Identification14 Dec 2022 0 repositories listed
-
A Review of Off-Policy Evaluation in Reinforcement Learning13 Dec 2022 0 repositories listed
-
Improving generalization in reinforcement learning through forked agents13 Dec 2022 0 repositories listed
-
Model-Free Approach to Fair Solar PV Curtailment Using Reinforcement Learning13 Dec 2022 0 repositories listed
-
Scalable and Sample Efficient Distributed Policy Gradient Algorithms in Multi-Agent Networked Systems13 Dec 2022 0 repositories listed
-
A Survey on Reinforcement Learning Security with Application to Autonomous Driving12 Dec 2022 0 repositories listed
-
Evaluating Model-free Reinforcement Learning toward Safety-critical Tasks12 Dec 2022 0 repositories listed
-
Nearly Minimax Optimal Reinforcement Learning for Linear Markov Decision Processes12 Dec 2022 0 repositories listed
-
Generalization Through the Lens of Learning Dynamics11 Dec 2022 0 repositories listed
-
Hierarchical Deep Reinforcement Learning for VWAP Strategy Optimization11 Dec 2022 0 repositories listed
-
Off-Policy Deep Reinforcement Learning Algorithms for Handling Various Robotic Manipulator Tasks11 Dec 2022 0 repositories listed
-
Near-Optimal Differentially Private Reinforcement Learning9 Dec 2022 0 repositories listed
-
Reinforcement Learning for Predicting Traffic Accidents9 Dec 2022 0 repositories listed
-
Confidence-Conditioned Value Functions for Offline Reinforcement Learning8 Dec 2022 0 repositories listed
-
Reinforcement Learning for Resilient Power Grids8 Dec 2022 0 repositories listed
-
Accelerating Self-Imitation Learning from Demonstrations via Policy Constraints and Q-Ensemble7 Dec 2022 0 repositories listed
-
A Learned Simulation Environment to Model Plant Growth in Indoor Farming6 Dec 2022 0 repositories listed
-
A Novel Deep Reinforcement Learning Based Automated Stock Trading System Using Cascaded LSTM Networks6 Dec 2022 0 repositories listed
-
Misspecification in Inverse Reinforcement Learning6 Dec 2022 0 repositories listed
-
Reinforcement Learning for UAV control with Policy and Reward Shaping6 Dec 2022 0 repositories listed
-
Safe Inverse Reinforcement Learning via Control Barrier Function6 Dec 2022 0 repositories listed
-
Understanding Self-Predictive Learning for Reinforcement Learning6 Dec 2022 0 repositories listed
-
Robust Reinforcement Learning for Risk-Sensitive Linear Quadratic Gaussian Control5 Dec 2022 0 repositories listed
-
Differentiated Federated Reinforcement Learning Based Traffic Offloading on Space-Air-Ground Integrated Networks5 Dec 2022 0 repositories listed
-
E-MAPP: Efficient Multi-Agent Reinforcement Learning with Parallel Program Guidance5 Dec 2022 0 repositories listed
-
Online Shielding for Reinforcement Learning4 Dec 2022 0 repositories listed
-
Constrained Reinforcement Learning via Dissipative Saddle Flow Dynamics3 Dec 2022 0 repositories listed
-
DACOM: Learning Delay-Aware Communication for Multi-Agent Reinforcement Learning3 Dec 2022 0 repositories listed
-
Reinforcement learning with Demonstrations from Mismatched Task under Sparse Reward3 Dec 2022 0 repositories listed
-
CT-DQN: Control-Tutored Deep Reinforcement Learning2 Dec 2022 0 repositories listed
-
Flow to Control: Offline Reinforcement Learning with Lossless Primitive Discovery2 Dec 2022 0 repositories listed
-
Selecting Mechanical Parameters of a Monopode Jumping System with Reinforcement Learning2 Dec 2022 0 repositories listed
-
Distributed Deep Reinforcement Learning: A Survey and A Multi-Player Multi-Agent Learning Toolbox1 Dec 2022 0 repositories listed
-
Launchpad: Learning to Schedule Using Offline and Online RL Methods1 Dec 2022 0 repositories listed
-
Modeling Mobile Health Users as Reinforcement Learning Agents1 Dec 2022 0 repositories listed
-
Safe Reinforcement Learning with Probabilistic Control Barrier Functions for Ramp Merging1 Dec 2022 0 repositories listed
-
Automatic Discovery of Multi-perspective Process Model using Reinforcement Learning30 Nov 2022 0 repositories listed
-
Computationally Efficient Reinforcement Learning: Targeted Exploration leveraging Simple Rules30 Nov 2022 0 repositories listed
-
Random Copolymer inverse design system orienting on Accurate discovering of Antimicrobial peptide-mimetic copolymers30 Nov 2022 0 repositories listed
-
Reinforcement Learning for Multi-Truck Vehicle Routing Problems30 Nov 2022 0 repositories listed
-
Funnel-based Reward Shaping for Signal Temporal Logic Tasks in Reinforcement Learning30 Nov 2022 0 repositories listed
-
Targets in Reinforcement Learning to solve Stackelberg Security Games30 Nov 2022 0 repositories listed