Browse State-of-the-Art › reinforcement-learning › Papers, page 95
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 95 of 135: papers 9,401 to 9,500 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Learning Approximate and Exact Numeral Systems via Reinforcement Learning28 May 2021 0 repositories listed
-
Reinforcement Learning for on-line Sequence Transformation28 May 2021 0 repositories listed
-
Reinforcement Learning reveals fundamental limits on the mixing of active particles28 May 2021 0 repositories listed
-
Risk-Aware Transfer in Reinforcement Learning using Successor Features28 May 2021 0 repositories listed
-
Sample-Efficient Reinforcement Learning for Linearly-Parameterized MDPs with a Generative Model28 May 2021 0 repositories listed
-
Stochastic Intervention for Causal Inference via Reinforcement Learning28 May 2021 0 repositories listed
-
Task-Guided Inverse Reinforcement Learning Under Partial Information28 May 2021 0 repositories listed
-
Transferable Deep Reinforcement Learning Framework for Autonomous Vehicles with Joint Radar-Data Communications28 May 2021 0 repositories listed
-
A Modular and Transferable Reinforcement Learning Framework for the Fleet Rebalancing Problem27 May 2021 0 repositories listed
-
Branching Dueling Q-Network Based Online Scheduling of a Microgrid With Distributed Energy Storage Systems27 May 2021 0 repositories listed
-
Optimistic Reinforcement Learning by Forward Kullback-Leibler Divergence Optimization27 May 2021 0 repositories listed
-
Pattern Transfer Learning for Reinforcement Learning in Order Dispatching27 May 2021 0 repositories listed
-
Context-aware taxi dispatching at city-scale using deep reinforcement learning26 May 2021 0 repositories listed
-
A Generalised Inverse Reinforcement Learning Framework25 May 2021 0 repositories listed
-
Bayesian Nonparametric Reinforcement Learning in LTE and Wi-Fi Coexistence25 May 2021 0 repositories listed
-
Interpretable UAV Collision Avoidance using Deep Reinforcement Learning25 May 2021 0 repositories listed
-
KnowSR: Knowledge Sharing among Homogeneous Agents in Multi-agent Reinforcement Learning25 May 2021 0 repositories listed
-
Safe Model-based Off-policy Reinforcement Learning for Eco-Driving in Connected and Automated Hybrid Electric Vehicles25 May 2021 0 repositories listed
-
Trajectory Modeling via Random Utility Inverse Reinforcement Learning25 May 2021 0 repositories listed
-
Transfer Learning and Curriculum Learning in Sokoban25 May 2021 0 repositories listed
-
Unbiased Asymmetric Reinforcement Learning under Partial Observability25 May 2021 0 repositories listed
-
Room Clearance with Feudal Hierarchical Reinforcement Learning24 May 2021 0 repositories listed
-
Attention-based Reinforcement Learning for Real-Time UAV Semantic Communication22 May 2021 0 repositories listed
-
An Exponential Lower Bound for Linearly Realizable MDP with Constant Suboptimality Gap21 May 2021 0 repositories listed
-
De-Biased Modelling of Search Click Behavior with Reinforcement Learning21 May 2021 0 repositories listed
-
Meta Reinforcement Learning for Fast Adaptation of Hierarchical Policies21 May 2021 0 repositories listed
-
On the use of feature-maps and parameter control for improved quality-diversity meta-evolution21 May 2021 0 repositories listed
-
Reinforcement Learning based Disease Progression Model for Alzheimer’s Disease21 May 2021 0 repositories listed
-
Reinforcement learning for instance segmentation with high-level priors21 May 2021 0 repositories listed
-
Revisiting Design Choices in Offline Model Based Reinforcement Learning21 May 2021 0 repositories listed
-
RLIRank: Learning to Rank with Reinforcement Learning for Dynamic Search21 May 2021 0 repositories listed
-
Stochastic Approximation of Gaussian Free Energy for Risk-Sensitive Reinforcement Learning21 May 2021 0 repositories listed
-
Techniques Toward Optimizing Viewability in RTB Ad Campaigns Using Reinforcement Learning21 May 2021 0 repositories listed
-
A Stochastic Composite Augmented Lagrangian Method For Reinforcement Learning20 May 2021 0 repositories listed
-
Objective-aware Traffic Simulation via Inverse Reinforcement Learning20 May 2021 0 repositories listed
-
Towards a Sample Efficient Reinforcement Learning Pipeline for Vision Based Robotics20 May 2021 0 repositories listed
-
Unified Conversational Recommendation Policy Learning via Graph-based Reinforcement Learning20 May 2021 0 repositories listed
-
Online Adaptive Optimal Control Algorithm Based on Synchronous Integral Reinforcement Learning With Explorations19 May 2021 0 repositories listed
-
Reinforcement Learning Assisted Oxygen Therapy for COVID-19 Patients Under Intensive Care19 May 2021 0 repositories listed
-
Robo-Advising: Enhancing Investment with Inverse Optimization and Deep Reinforcement Learning19 May 2021 0 repositories listed
-
Adaptive ABAC Policy Learning: A Reinforcement Learning Approach18 May 2021 0 repositories listed
-
Application of deep reinforcement learning for Indian stock trading automation18 May 2021 0 repositories listed
-
Gym-ANM: Open-source software to leverage reinforcement learning for power system management in research and education18 May 2021 0 repositories listed
-
Learning and Information in Stochastic Networks and Queues18 May 2021 0 repositories listed
-
Online Multimodal Transportation Planning using Deep Reinforcement Learning18 May 2021 0 repositories listed
-
PoBRL: Optimizing Multi-Document Summarization by Blending Reinforcement Learning Policies18 May 2021 0 repositories listed
-
Reinforcement Learning for Adaptive Video Compressive Sensing18 May 2021 0 repositories listed
-
Reinforcement Learning With Sparse-Executing Actions via Sparsity Regularization18 May 2021 0 repositories listed
-
Sublinear Least-Squares Value Iteration via Locality Sensitive Hashing18 May 2021 0 repositories listed
-
Mean Field Games Flock! The Reinforcement Learning Way17 May 2021 0 repositories listed
-
RAIDER: Reinforcement-aided Spear Phishing Detector17 May 2021 0 repositories listed
-
RL-GRIT: Reinforcement Learning for Grammar Inference17 May 2021 0 repositories listed
-
Sample-Efficient Reinforcement Learning Is Feasible for Linearly Realizable MDPs with Limited Revisiting17 May 2021 0 repositories listed
-
DRAS-CQSim: A Reinforcement Learning based Framework for HPC Cluster Scheduling16 May 2021 0 repositories listed
-
A Heuristically Assisted Deep Reinforcement Learning Approach for Network Slice Placement14 May 2021 0 repositories listed
-
Efficient PAC Reinforcement Learning in Regular Decision Processes14 May 2021 0 repositories listed
-
Feature-Based Interpretable Reinforcement Learning based on State-Transition Models14 May 2021 0 repositories listed
-
Non-decreasing Quantile Function Network with Efficient Exploration for Distributional Reinforcement Learning14 May 2021 0 repositories listed
-
Adaptive Warm-Start MCTS in AlphaZero-like Deep Reinforcement Learning13 May 2021 0 repositories listed
-
Reinforcement Learning Based Safe Decision Making for Highway Autonomous Driving13 May 2021 0 repositories listed
-
SIDE: State Inference for Partially Observable Cooperative Multi-Agent Reinforcement Learning13 May 2021 0 repositories listed
-
A Survey on Reinforcement Learning-Aided Caching in Mobile Edge Networks12 May 2021 0 repositories listed
-
Acting upon Imagination: when to trust imagined trajectories in model based reinforcement learning12 May 2021 0 repositories listed
-
Adversarial Reinforcement Learning in Dynamic Channel Access and Power Control12 May 2021 0 repositories listed
-
Interpretable performance analysis towards offline reinforcement learning: A dataset perspective12 May 2021 0 repositories listed
-
Composable Energy Policies for Reactive Motion Generation and Reinforcement Learning11 May 2021 0 repositories listed
-
Hierarchical RNNs-Based Transformers MADDPG for Mixed Cooperative-Competitive Environments11 May 2021 0 repositories listed
-
Return-based Scaling: Yet Another Normalisation Trick for Deep RL11 May 2021 0 repositories listed
-
Zero-Shot Reinforcement Learning on Graphs for Autonomous Exploration Under Uncertainty11 May 2021 0 repositories listed
-
Adaptive Policy Transfer in Reinforcement Learning10 May 2021 0 repositories listed
-
Age of Information Aware VNF Scheduling in Industrial IoT Using Deep Reinforcement Learning10 May 2021 0 repositories listed
-
Dynamic Multichannel Access via Multi-agent Reinforcement Learning: Throughput and Fairness Guarantees10 May 2021 0 repositories listed
-
Efficient Self-Supervised Data Collection for Offline Robot Learning10 May 2021 0 repositories listed
-
Parameter-free Gradient Temporal Difference Learning10 May 2021 0 repositories listed
-
PEARL: Parallelized Expert-Assisted Reinforcement Learning for Scene Rearrangement Planning10 May 2021 0 repositories listed
-
Reinforcement learning of rare diffusive dynamics10 May 2021 0 repositories listed
-
Improving Cost Learning for JPEG Steganography by Exploiting JPEG Domain Knowledge9 May 2021 0 repositories listed
-
Reinforcement Learning with Expert Trajectory For Quantitative Trading9 May 2021 0 repositories listed
-
A parallel-network continuous quantitative trading model with GARCH and PPO8 May 2021 0 repositories listed
-
RAIL: A modular framework for Reinforcement-learning-based Adversarial Imitation Learning8 May 2021 0 repositories listed
-
Scalable, Decentralized Multi-Agent Reinforcement Learning Methods Inspired by Stigmergy and Ant Colonies8 May 2021 0 repositories listed
-
Using reinforcement learning to design an AI assistantfor a satisfying co-op experience7 May 2021 0 repositories listed
-
Utilizing Skipped Frames in Action Repeats via Pseudo-Actions7 May 2021 0 repositories listed
-
Deep Graph Convolutional Reinforcement Learning for Financial Portfolio Management -- DeepPocket6 May 2021 0 repositories listed
-
Time-Aware Q-Networks: Resolving Temporal Irregularity for Deep Reinforcement Learning6 May 2021 0 repositories listed
-
Learning Algorithms for Regenerative Stopping Problems with Applications to Shipping Consolidation in Logistics5 May 2021 0 repositories listed
-
Safety Enhancement for Deep Reinforcement Learning in Autonomous Separation Assurance5 May 2021 0 repositories listed
-
Solving Sokoban with forward-backward reinforcement learning5 May 2021 0 repositories listed
-
Data-Efficient Reinforcement Learning for Malaria Control4 May 2021 0 repositories listed
-
On Lottery Tickets and Minimal Task Representations in Deep Reinforcement Learning4 May 2021 0 repositories listed
-
On the Linear convergence of Natural Policy Gradient Algorithm4 May 2021 0 repositories listed
-
Reinforcement Learning for Scalable Logic Optimization with Graph Neural Networks4 May 2021 0 repositories listed
-
Generative Adversarial Reward Learning for Generalized Behavior Tendency Inference3 May 2021 0 repositories listed
-
Hierarchical Reinforcement Learning for Air-to-Air Combat3 May 2021 0 repositories listed
-
Learning swimming escape patterns for larval fish under energy constraints3 May 2021 0 repositories listed
-
Reinforcement Learning for Ridesharing: An Extended Survey3 May 2021 0 repositories listed
-
BACKDOORL: Backdoor Attack against Competitive Reinforcement Learning2 May 2021 0 repositories listed
-
CARL-DTN: Context Adaptive Reinforcement Learning based Routing Algorithm in Delay Tolerant Network2 May 2021 0 repositories listed
-
Reducing Bus Bunching with Asynchronous Multi-Agent Reinforcement Learning2 May 2021 0 repositories listed
-
Better than the Best: Gradient-based Improper Reinforcement Learning for Network Scheduling1 May 2021 0 repositories listed