Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 105
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 105 of 152: papers 10,401 to 10,500 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Reinforcement Learning Based Safe Decision Making for Highway Autonomous Driving13 May 2021 0 repositories listed
-
SIDE: State Inference for Partially Observable Cooperative Multi-Agent Reinforcement Learning13 May 2021 0 repositories listed
-
A Survey on Reinforcement Learning-Aided Caching in Mobile Edge Networks12 May 2021 0 repositories listed
-
Acting upon Imagination: when to trust imagined trajectories in model based reinforcement learning12 May 2021 0 repositories listed
-
Adversarial Reinforcement Learning in Dynamic Channel Access and Power Control12 May 2021 0 repositories listed
-
Interpretable performance analysis towards offline reinforcement learning: A dataset perspective12 May 2021 0 repositories listed
-
Composable Energy Policies for Reactive Motion Generation and Reinforcement Learning11 May 2021 0 repositories listed
-
Hierarchical RNNs-Based Transformers MADDPG for Mixed Cooperative-Competitive Environments11 May 2021 0 repositories listed
-
Return-based Scaling: Yet Another Normalisation Trick for Deep RL11 May 2021 0 repositories listed
-
Zero-Shot Reinforcement Learning on Graphs for Autonomous Exploration Under Uncertainty11 May 2021 0 repositories listed
-
Adaptive Policy Transfer in Reinforcement Learning10 May 2021 0 repositories listed
-
Age of Information Aware VNF Scheduling in Industrial IoT Using Deep Reinforcement Learning10 May 2021 0 repositories listed
-
Dynamic Multichannel Access via Multi-agent Reinforcement Learning: Throughput and Fairness Guarantees10 May 2021 0 repositories listed
-
Efficient Self-Supervised Data Collection for Offline Robot Learning10 May 2021 0 repositories listed
-
Parameter-free Gradient Temporal Difference Learning10 May 2021 0 repositories listed
-
PEARL: Parallelized Expert-Assisted Reinforcement Learning for Scene Rearrangement Planning10 May 2021 0 repositories listed
-
Reinforcement learning of rare diffusive dynamics10 May 2021 0 repositories listed
-
Improving Cost Learning for JPEG Steganography by Exploiting JPEG Domain Knowledge9 May 2021 0 repositories listed
-
Reinforcement Learning with Expert Trajectory For Quantitative Trading9 May 2021 0 repositories listed
-
A parallel-network continuous quantitative trading model with GARCH and PPO8 May 2021 0 repositories listed
-
RAIL: A modular framework for Reinforcement-learning-based Adversarial Imitation Learning8 May 2021 0 repositories listed
-
Scalable, Decentralized Multi-Agent Reinforcement Learning Methods Inspired by Stigmergy and Ant Colonies8 May 2021 0 repositories listed
-
Reward prediction for representation learning and reward shaping7 May 2021 0 repositories listed
-
Using reinforcement learning to design an AI assistantfor a satisfying co-op experience7 May 2021 0 repositories listed
-
Utilizing Skipped Frames in Action Repeats via Pseudo-Actions7 May 2021 0 repositories listed
-
A Reinforcement Learning-based Economic Model Predictive Control Framework for Autonomous Operation of Chemical Reactors6 May 2021 0 repositories listed
-
Deep Graph Convolutional Reinforcement Learning for Financial Portfolio Management -- DeepPocket6 May 2021 0 repositories listed
-
Time-Aware Q-Networks: Resolving Temporal Irregularity for Deep Reinforcement Learning6 May 2021 0 repositories listed
-
Learning Algorithms for Regenerative Stopping Problems with Applications to Shipping Consolidation in Logistics5 May 2021 0 repositories listed
-
Safety Enhancement for Deep Reinforcement Learning in Autonomous Separation Assurance5 May 2021 0 repositories listed
-
Solving Sokoban with forward-backward reinforcement learning5 May 2021 0 repositories listed
-
Survey on Multi-Agent Q-Learning frameworks for resource management in wireless sensor network5 May 2021 0 repositories listed
-
Data-Efficient Reinforcement Learning for Malaria Control4 May 2021 0 repositories listed
-
On Lottery Tickets and Minimal Task Representations in Deep Reinforcement Learning4 May 2021 0 repositories listed
-
On the Linear convergence of Natural Policy Gradient Algorithm4 May 2021 0 repositories listed
-
Reinforcement Learning for Scalable Logic Optimization with Graph Neural Networks4 May 2021 0 repositories listed
-
Generative Adversarial Reward Learning for Generalized Behavior Tendency Inference3 May 2021 0 repositories listed
-
Hierarchical Reinforcement Learning for Air-to-Air Combat3 May 2021 0 repositories listed
-
Learning swimming escape patterns for larval fish under energy constraints3 May 2021 0 repositories listed
-
Reinforcement Learning for Ridesharing: An Extended Survey3 May 2021 0 repositories listed
-
BACKDOORL: Backdoor Attack against Competitive Reinforcement Learning2 May 2021 0 repositories listed
-
CARL-DTN: Context Adaptive Reinforcement Learning based Routing Algorithm in Delay Tolerant Network2 May 2021 0 repositories listed
-
InferNet for Delayed Reinforcement Tasks: Addressing the Temporal Credit Assignment Problem2 May 2021 0 repositories listed
-
Reducing Bus Bunching with Asynchronous Multi-Agent Reinforcement Learning2 May 2021 0 repositories listed
-
Better than the Best: Gradient-based Improper Reinforcement Learning for Network Scheduling1 May 2021 0 repositories listed
-
Nearest-Neighbor-based Collision Avoidance for Quadrotors via Reinforcement Learning30 Apr 2021 0 repositories listed
-
Discrete-Time Mean Field Control with Environment States30 Apr 2021 0 repositories listed
-
Mean Field MARL Based Bandwidth Negotiation Method for Massive Devices Spectrum Sharing30 Apr 2021 0 repositories listed
-
Mitigating Political Bias in Language Models Through Reinforced Calibration30 Apr 2021 0 repositories listed
-
Emotional Contagion-Aware Deep Reinforcement Learning for Antagonistic Crowd Simulation29 Apr 2021 0 repositories listed
-
Hypernetwork Dismantling via Deep Reinforcement Learning29 Apr 2021 0 repositories listed
-
Adversarial Inverse Reinforcement Learning for Mean Field Games29 Apr 2021 0 repositories listed
-
Medium Access using Distributed Reinforcement Learning for IoTs with Low-Complexity Wireless Transceivers29 Apr 2021 0 repositories listed
-
Pre-training of Deep RL Agents for Improved Learning under Domain Randomization29 Apr 2021 0 repositories listed
-
Using Meta Reinforcement Learning to Bridge the Gap between Simulation and Experiment in Energy Demand Response29 Apr 2021 0 repositories listed
-
What is Going on Inside Recurrent Meta Reinforcement Learning Agents?29 Apr 2021 0 repositories listed
-
A Generalized Projected Bellman Error for Off-policy Value Estimation in Reinforcement Learning28 Apr 2021 0 repositories listed
-
A Reinforcement Learning Environment for Polyhedral Optimizations28 Apr 2021 0 repositories listed
-
End-to-End Intersection Handling using Multi-Agent Deep Reinforcement Learning28 Apr 2021 0 repositories listed
-
Reward (Mis)design for Autonomous Driving28 Apr 2021 0 repositories listed
-
Adaptive Adversarial Training for Meta Reinforcement Learning27 Apr 2021 0 repositories listed
-
Controlling earthquake-like instabilities using artificial intelligence27 Apr 2021 0 repositories listed
-
Implementing Reinforcement Learning Algorithms in Retail Supply Chains with OpenAI Gym Toolkit27 Apr 2021 0 repositories listed
-
Semi-On-Policy Training for Sample Efficient Multi-Agent Policy Gradients27 Apr 2021 0 repositories listed
-
ANT: Learning Accurate Network Throughput for Better Adaptive Video Streaming26 Apr 2021 0 repositories listed
-
A Deep Reinforcement Learning Approach for the Meal Delivery Problem24 Apr 2021 0 repositories listed
-
DisCo RL: Distribution-Conditioned Reinforcement Learning for General-Purpose Policies23 Apr 2021 0 repositories listed
-
Formula RL: Deep Reinforcement Learning for Autonomous Racing using Telemetry Data22 Apr 2021 0 repositories listed
-
Reinforcement Learning using Guided Observability22 Apr 2021 0 repositories listed
-
Reset-Free Reinforcement Learning via Multi-Task Learning: Learning Dexterous Manipulation Behaviors without Human Intervention22 Apr 2021 0 repositories listed
-
CVLight: Decentralized Learning for Adaptive Traffic Signal Control with Connected Vehicles21 Apr 2021 0 repositories listed
-
Model-aided Deep Reinforcement Learning for Sample-efficient UAV Trajectory Design in IoT Networks21 Apr 2021 0 repositories listed
-
Policy Fusion for Adaptive and Customizable Reinforcement Learning Agents21 Apr 2021 0 repositories listed
-
Reinforcement Learning for Traffic Signal Control: Comparison with Commercial Systems21 Apr 2021 0 repositories listed
-
Tackling Variabilities in Autonomous Driving21 Apr 2021 0 repositories listed
-
Discovering an Aid Policy to Minimize Student Evasion Using Offline Reinforcement Learning20 Apr 2021 0 repositories listed
-
DRL: Deep Reinforcement Learning for Intelligent Robot Control -- Concept, Literature, and Future20 Apr 2021 0 repositories listed
-
GLiDE: Generalizable Quadrupedal Locomotion in Diverse Environments with a Centroidal Model20 Apr 2021 0 repositories listed
-
Model-predictive control and reinforcement learning in multi-energy system case studies20 Apr 2021 0 repositories listed
-
Network Defense is Not a Game20 Apr 2021 0 repositories listed
-
Network-wide traffic signal control optimization using a multi-agent deep reinforcement learning20 Apr 2021 0 repositories listed
-
Outcome-Driven Reinforcement Learning via Variational Inference20 Apr 2021 0 repositories listed
-
Prospective Artificial Intelligence Approaches for Active Cyber Defence20 Apr 2021 0 repositories listed
-
Scalable Synthesis of Verified Controllers in Deep Reinforcement Learning20 Apr 2021 0 repositories listed
-
Adaptive learning for financial markets mixing model-based and model-free RL for volatility targeting19 Apr 2021 0 repositories listed
-
Agent-Centric Representations for Multi-Agent Reinforcement Learning19 Apr 2021 0 repositories listed
-
Approximated Multi-Agent Fitted Q Iteration19 Apr 2021 0 repositories listed
-
Constraints Satisfiability Driven Reinforcement Learning for Autonomous Cyber Defense19 Apr 2021 0 repositories listed
-
Deep Reinforcement Learning in a Monetary Model19 Apr 2021 0 repositories listed
-
Reinforcement learning for linear-convex models with jumps via stability analysis of feedback controls19 Apr 2021 0 repositories listed
-
Singular Perturbation-based Reinforcement Learning of Two-Point Boundary Optimal Control Systems19 Apr 2021 0 repositories listed
-
Training Value-Aligned Reinforcement Learning Agents Using a Normative Prior19 Apr 2021 0 repositories listed
-
MT-Opt: Continuous Multi-Task Robotic Reinforcement Learning at Scale16 Apr 2021 0 repositories listed
-
Safe Exploration in Model-based Reinforcement Learning using Control Barrier Functions16 Apr 2021 0 repositories listed
-
Actionable Models: Unsupervised Offline Reinforcement Learning of Robotic Skills15 Apr 2021 0 repositories listed
-
An L² Analysis of Reinforcement Learning in High Dimensions with Kernel and Neural Network Approximation15 Apr 2021 0 repositories listed
-
Discover the Hidden Attack Path in Multi-domain Cyberspace Based on Reinforcement Learning15 Apr 2021 0 repositories listed
-
Joint Attention for Multi-Agent Coordination and Social Learning15 Apr 2021 0 repositories listed
-
Multi-Agent Reinforcement Learning Based Coded Computation for Mobile Ad Hoc Computing15 Apr 2021 0 repositories listed
-
Predictor-Corrector(PC) Temporal Difference(TD) Learning (PCTD)15 Apr 2021 0 repositories listed