Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 76
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 76 of 152: papers 7,501 to 7,600 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Representation Learning in Deep RL via Discrete Information Bottleneck28 Dec 2022 0 repositories listed
-
Offline Reinforcement Learning via Linear-Programming with Error-Bound Induced Constraints28 Dec 2022 0 repositories listed
-
Towards automating Codenames spymasters with deep reinforcement learning28 Dec 2022 0 repositories listed
-
Towards Learning Abstractions via Reinforcement Learning28 Dec 2022 0 repositories listed
-
Data-driven control of COVID-19 in buildings: a reinforcement-learning approach27 Dec 2022 0 repositories listed
-
Model-Based Reinforcement Learning with Multinomial Logistic Function Approximation27 Dec 2022 0 repositories listed
-
Optimal scheduling of island integrated energy systems considering multi-uncertainties and hydrothermal simultaneous transmission: A deep reinforcement learning approach27 Dec 2022 0 repositories listed
-
Off-Policy Reinforcement Learning with Loss Function Weighted by Temporal Difference Error26 Dec 2022 0 repositories listed
-
Novel Reinforcement Learning Algorithm for Suppressing Synchronization in Closed Loop Deep Brain Stimulators25 Dec 2022 0 repositories listed
-
Deep Reinforcement Learning for Heat Pump Control24 Dec 2022 0 repositories listed
-
SHIRO: Soft Hierarchical Reinforcement Learning24 Dec 2022 0 repositories listed
-
Streaming Traffic Flow Prediction Based on Continuous Reinforcement Learning24 Dec 2022 0 repositories listed
-
Understanding the Complexity Gains of Single-Task RL with a Curriculum24 Dec 2022 0 repositories listed
-
Investigation of reinforcement learning for shape optimization of profile extrusion dies23 Dec 2022 0 repositories listed
-
Offline Reinforcement Learning for Human-Guided Human-Machine Interaction with Private Information23 Dec 2022 0 repositories listed
-
A Learned Simulation Environment to Model Student Engagement and Retention in Automated Online Courses22 Dec 2022 0 repositories listed
-
Decoding surface codes with deep reinforcement learning and probabilistic policy reuse22 Dec 2022 0 repositories listed
-
Reinforcement Learning Based Approaches to Adaptive Context Caching in Distributed Context Management Systems22 Dec 2022 0 repositories listed
-
A Memetic Algorithm with Reinforcement Learning for Sociotechnical Production Scheduling21 Dec 2022 0 repositories listed
-
Imitation Is Not Enough: Robustifying Imitation with Reinforcement Learning for Challenging Driving Scenarios21 Dec 2022 0 repositories listed
-
Neighboring state-based RL Exploration21 Dec 2022 0 repositories listed
-
Robust Path Selection in Software-defined WANs using Deep Reinforcement Learning21 Dec 2022 0 repositories listed
-
Adapting the Exploration Rate for Value-of-Information-Based Reinforcement Learning20 Dec 2022 0 repositories listed
-
AdverSAR: Adversarial Search and Rescue via Multi-Agent Reinforcement Learning20 Dec 2022 0 repositories listed
-
I Cast Detect Thoughts: Learning to Converse and Guide with Intents and Theory-of-Mind in Dungeons and Dragons20 Dec 2022 0 repositories listed
-
Bandit approach to conflict-free multi-agent Q-learning in view of photonic implementation20 Dec 2022 0 repositories listed
-
Variational Quantum Soft Actor-Critic for Robotic Arm Control20 Dec 2022 0 repositories listed
-
Dexterous Manipulation from Images: Autonomous Real-World RL via Substep Guidance19 Dec 2022 0 repositories listed
-
Inverse Reinforcement Learning for Text Summarization19 Dec 2022 0 repositories listed
-
Near-optimal Policy Identification in Active Reinforcement Learning19 Dec 2022 0 repositories listed
-
Quantum policy gradient algorithms19 Dec 2022 0 repositories listed
-
Taming Lagrangian Chaos with Multi-Objective Reinforcement Learning19 Dec 2022 0 repositories listed
-
Neural Coreference Resolution based on Reinforcement Learning18 Dec 2022 0 repositories listed
-
Risk-Sensitive Reinforcement Learning with Exponential Criteria18 Dec 2022 0 repositories listed
-
Enhancing Cyber Resilience of Networked Microgrids using Vertical Federated Reinforcement Learning17 Dec 2022 0 repositories listed
-
Latent Variable Representation for Reinforcement Learning17 Dec 2022 0 repositories listed
-
Cognitive Level-k Meta-Learning for Safe and Pedestrian-Aware Autonomous Driving17 Dec 2022 0 repositories listed
-
Managing Temporal Resolution in Continuous Value Estimation: A Fundamental Trade-off17 Dec 2022 0 repositories listed
-
Pre-Trained Image Encoder for Generalizable Visual Reinforcement Learning17 Dec 2022 0 repositories listed
-
An Energy-aware and Fault-tolerant Deep Reinforcement Learning based approach for Multi-agent Patrolling Problems16 Dec 2022 0 repositories listed
-
Offline Robot Reinforcement Learning with Uncertainty-Guided Human Expert Sampling16 Dec 2022 0 repositories listed
-
Reinforcement Learning for Agile Active Target Sensing with a UAV16 Dec 2022 0 repositories listed
-
Safe Evaluation For Offline Learning: Are We Ready To Deploy?16 Dec 2022 0 repositories listed
-
Bridging the Gap Between Offline and Online Reinforcement Learning Evaluation Methodologies15 Dec 2022 0 repositories listed
-
Active Inference and Reinforcement Learning: A unified inference on continuous state and action spaces under partial observability15 Dec 2022 0 repositories listed
-
Driver Assistance Eco-driving and Transmission Control with Deep Reinforcement Learning15 Dec 2022 0 repositories listed
-
Emergent Behaviors in Multi-Agent Target Acquisition15 Dec 2022 0 repositories listed
-
Multi-Agent Reinforcement Learning with Shared Resources for Inventory Management15 Dec 2022 0 repositories listed
-
Residual Policy Learning for Powertrain Control15 Dec 2022 0 repositories listed
-
Towards Hardware-Specific Automatic Compression of Neural Networks15 Dec 2022 0 repositories listed
-
Reinforcement Learning in Credit Scoring and Underwriting15 Dec 2022 0 repositories listed
-
Cross-Domain Transfer via Semantic Skill Imitation14 Dec 2022 0 repositories listed
-
Efficient Exploration in Resource-Restricted Reinforcement Learning14 Dec 2022 0 repositories listed
-
Explaining Agent's Decision-making in a Hierarchical Reinforcement Learning Scenario14 Dec 2022 0 repositories listed
-
Hierarchical Strategies for Cooperative Multi-Agent Reinforcement Learning14 Dec 2022 0 repositories listed
-
Quantum Control based on Deep Reinforcement Learning14 Dec 2022 0 repositories listed
-
Reinforcement Learning in System Identification14 Dec 2022 0 repositories listed
-
Safety Correction from Baseline: Towards the Risk-aware Policy in Robotics via Dual-agent Reinforcement Learning14 Dec 2022 0 repositories listed
-
Scaling Marginalized Importance Sampling to High-Dimensional State-Spaces via State Abstraction14 Dec 2022 0 repositories listed
-
A Review of Off-Policy Evaluation in Reinforcement Learning13 Dec 2022 0 repositories listed
-
Improving generalization in reinforcement learning through forked agents13 Dec 2022 0 repositories listed
-
Model-Free Approach to Fair Solar PV Curtailment Using Reinforcement Learning13 Dec 2022 0 repositories listed
-
PPO-UE: Proximal Policy Optimization via Uncertainty-Aware Exploration13 Dec 2022 0 repositories listed
-
Scalable and Sample Efficient Distributed Policy Gradient Algorithms in Multi-Agent Networked Systems13 Dec 2022 0 repositories listed
-
Single Cell Training on Architecture Search for Image Denoising13 Dec 2022 0 repositories listed
-
A Survey on Reinforcement Learning Security with Application to Autonomous Driving12 Dec 2022 0 repositories listed
-
Corruption-Robust Algorithms with Uncertainty Weighting for Nonlinear Contextual Bandits and Markov Decision Processes12 Dec 2022 0 repositories listed
-
Evaluating Model-free Reinforcement Learning toward Safety-critical Tasks12 Dec 2022 0 repositories listed
-
Nearly Minimax Optimal Reinforcement Learning for Linear Markov Decision Processes12 Dec 2022 0 repositories listed
-
Variance-Reduced Conservative Policy Iteration12 Dec 2022 0 repositories listed
-
VOQL: Towards Optimal Regret in Model-free RL with Nonlinear Function Approximation12 Dec 2022 0 repositories listed
-
Generalization Through the Lens of Learning Dynamics11 Dec 2022 0 repositories listed
-
Hierarchical Deep Reinforcement Learning for VWAP Strategy Optimization11 Dec 2022 0 repositories listed
-
Off-Policy Deep Reinforcement Learning Algorithms for Handling Various Robotic Manipulator Tasks11 Dec 2022 0 repositories listed
-
Leveraging Modality-specific Representations for Audio-visual Speech Recognition via Reinforcement Learning10 Dec 2022 0 repositories listed
-
Relate to Predict: Towards Task-Independent Knowledge Representations for Reinforcement Learning10 Dec 2022 0 repositories listed
-
Near-Optimal Differentially Private Reinforcement Learning9 Dec 2022 0 repositories listed
-
Reinforcement Learning and Mixed-Integer Programming for Power Plant Scheduling in Low Carbon Systems: Comparison and Hybridisation9 Dec 2022 0 repositories listed
-
Reinforcement Learning for Predicting Traffic Accidents9 Dec 2022 0 repositories listed
-
A Novel Stochastic Gradient Descent Algorithm for Learning Principal Subspaces8 Dec 2022 0 repositories listed
-
Confidence-Conditioned Value Functions for Offline Reinforcement Learning8 Dec 2022 0 repositories listed
-
Design and Planning of Flexible Mobile Micro-Grids Using Deep Reinforcement Learning8 Dec 2022 0 repositories listed
-
Enhanced method for reinforcement learning based dynamic obstacle avoidance by assessment of collision risk8 Dec 2022 0 repositories listed
-
Reinforcement Learning for Resilient Power Grids8 Dec 2022 0 repositories listed
-
System Design for an Integrated Lifelong Reinforcement Learning Agent for Real-Time Strategy Games8 Dec 2022 0 repositories listed
-
Accelerating Self-Imitation Learning from Demonstrations via Policy Constraints and Q-Ensemble7 Dec 2022 0 repositories listed
-
Selector-Enhancer: Learning Dynamic Selection of Local and Non-local Attention Operation for Speech Enhancement7 Dec 2022 0 repositories listed
-
A Learned Simulation Environment to Model Plant Growth in Indoor Farming6 Dec 2022 0 repositories listed
-
A Novel Deep Reinforcement Learning Based Automated Stock Trading System Using Cascaded LSTM Networks6 Dec 2022 0 repositories listed
-
Active Classification of Moving Targets with Learned Control Policies6 Dec 2022 0 repositories listed
-
Efficient Learning of Voltage Control Strategies via Model-based Deep Reinforcement Learning6 Dec 2022 0 repositories listed
-
Few-Shot Preference Learning for Human-in-the-Loop RL6 Dec 2022 0 repositories listed
-
First Go, then Post-Explore: the Benefits of Post-Exploration in Intrinsic Motivation6 Dec 2022 0 repositories listed
-
Misspecification in Inverse Reinforcement Learning6 Dec 2022 0 repositories listed
-
Reinforcement Learning for UAV control with Policy and Reward Shaping6 Dec 2022 0 repositories listed
-
Safe Inverse Reinforcement Learning via Control Barrier Function6 Dec 2022 0 repositories listed
-
Scalable Planning and Learning Framework Development for Swarm-to-Swarm Engagement Problems6 Dec 2022 0 repositories listed
-
Understanding Self-Predictive Learning for Reinforcement Learning6 Dec 2022 0 repositories listed
-
A Hierarchical Deep Reinforcement Learning Framework for 6-DOF UCAV Air-to-Air Combat5 Dec 2022 0 repositories listed
-
Robust Reinforcement Learning for Risk-Sensitive Linear Quadratic Gaussian Control5 Dec 2022 0 repositories listed