Browse State-of-the-Art › Reinforcement Learning › Papers, page 101
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 101 of 132: papers 10,001 to 10,100 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Regret Bounds for Learning State Representations in Reinforcement Learning1 Dec 2019 0 repositories listed
-
Text-Based Interactive Recommendation via Constraint-Augmented Reinforcement Learning1 Dec 2019 0 repositories listed
-
Value Function in Frequency Domain and the Characteristic Value Iteration Algorithm1 Dec 2019 0 repositories listed
-
Variance Reduced Policy Evaluation with Smooth Function Approximation1 Dec 2019 0 repositories listed
-
IMPACT: Importance Weighted Asynchronous Architectures with Clipped Target Networks30 Nov 2019 0 repositories listed
-
Mix and Match: Markov Chains & Mixing Times for Matching in Rideshare30 Nov 2019 0 repositories listed
-
Transferable Force-Torque Dynamics Model for Peg-in-hole Task30 Nov 2019 0 repositories listed
-
Bimodal Speech Emotion Recognition Using Pre-Trained Language Models29 Nov 2019 0 repositories listed
-
Induction of Subgoal Automata for Reinforcement Learning29 Nov 2019 0 repositories listed
-
Quadratic Q-network for Learning Continuous Control for Autonomous Vehicles29 Nov 2019 0 repositories listed
-
Safety Guarantees for Planning Based on Iterative Gaussian Processes29 Nov 2019 0 repositories listed
-
Algorithmic Improvements for Deep Reinforcement Learning applied to Interactive Fiction28 Nov 2019 0 repositories listed
-
Augmented Random Search for Quadcopter Control: An alternative to Reinforcement Learning28 Nov 2019 0 repositories listed
-
Data-Driven Compression of Convolutional Neural Networks28 Nov 2019 0 repositories listed
-
Improving Neural Relation Extraction with Positive and Unlabeled Learning28 Nov 2019 0 repositories listed
-
Multi-Agent Deep Reinforcement Learning with Adaptive Policies28 Nov 2019 0 repositories listed
-
Stigmergic Independent Reinforcement Learning for Multi-Agent Collaboration28 Nov 2019 0 repositories listed
-
Adversarial Deep Reinforcement Learning based Adaptive Moving Target Defense27 Nov 2019 0 repositories listed
-
GRIm-RePR: Prioritising Generating Important Features for Pseudo-Rehearsal27 Nov 2019 0 repositories listed
-
Improving Fictitious Play Reinforcement Learning with Expanding Models27 Nov 2019 0 repositories listed
-
Restoring Chaos Using Deep Reinforcement Learning27 Nov 2019 0 repositories listed
-
Control-Tutored Reinforcement Learning: an application to the Herding Problem26 Nov 2019 0 repositories listed
-
A General Framework on Enhancing Portfolio Management with Reinforcement Learning26 Nov 2019 0 repositories listed
-
Multi-Vehicle Mixed-Reality Reinforcement Learning for Autonomous Multi-Lane Driving26 Nov 2019 0 repositories listed
-
Intelligent Resource Scheduling for Co-located Latency-critical Services: A Multi-Model Collaborative Learning Approach26 Nov 2019 0 repositories listed
-
The problem with DDPG: understanding failures in deterministic environments with sparse rewards26 Nov 2019 0 repositories listed
-
A Deep Reinforcement Learning Architecture for Multi-stage Optimal Control25 Nov 2019 0 repositories listed
-
Adaptive Modulation and Coding based on Reinforcement Learning for 5G Networks25 Nov 2019 0 repositories listed
-
Biologically inspired architectures for sample-efficient deep reinforcement learning25 Nov 2019 0 repositories listed
-
Deep Reinforcement Learning for Multi-Driver Vehicle Dispatching and Repositioning Problem25 Nov 2019 0 repositories listed
-
Disentangled Cumulants Help Successor Representations Transfer to New Tasks25 Nov 2019 0 repositories listed
-
Mitigate Bias in Face Recognition using Skewness-Aware Reinforcement Learning25 Nov 2019 0 repositories listed
-
Multi-Agent Game Abstraction via Graph Attention Neural Network25 Nov 2019 0 repositories listed
-
Theory-based Causal Transfer: Integrating Instance-level Induction and Abstract-level Structure Learning25 Nov 2019 0 repositories listed
-
Merging Deterministic Policy Gradient Estimations with Varied Bias-Variance Tradeoff for Effective Deep Reinforcement Learning24 Nov 2019 0 repositories listed
-
Multi-Agent Reinforcement Learning: A Selective Overview of Theories and Algorithms24 Nov 2019 0 repositories listed
-
Scaling active inference24 Nov 2019 0 repositories listed
-
Which Channel to Ask My Question? Personalized Customer Service RequestStream Routing using DeepReinforcement Learning24 Nov 2019 0 repositories listed
-
From Persistent Homology to Reinforcement Learning with Applications for Retail Banking23 Nov 2019 0 repositories listed
-
Iteratively-Refined Interactive 3D Medical Image Segmentation with Multi-Agent Reinforcement Learning23 Nov 2019 0 repositories listed
-
Analysis of Evolutionary Behavior in Self-Learning Media Search Engines22 Nov 2019 0 repositories listed
-
Deep Reinforcement Learning for Trading22 Nov 2019 0 repositories listed
-
Graph Pruning for Model Compression22 Nov 2019 0 repositories listed
-
Accelerating Reinforcement Learning with Suboptimal Guidance21 Nov 2019 0 repositories listed
-
Agent Probing Interaction Policies21 Nov 2019 0 repositories listed
-
Efficient Drone Mobility Support Using Reinforcement Learning21 Nov 2019 0 repositories listed
-
Information-Theoretic Confidence Bounds for Reinforcement Learning21 Nov 2019 0 repositories listed
-
Quantum Observables for continuous control of the Quantum Approximate Optimization Algorithm via Reinforcement Learning21 Nov 2019 0 repositories listed
-
Reinforcing an Image Caption Generator Using Off-Line Human Feedback21 Nov 2019 0 repositories listed
-
State Alignment-based Imitation Learning21 Nov 2019 0 repositories listed
-
A Tale of Two-Timescale Reinforcement Learning with the Tightest Finite-Time Bound20 Nov 2019 0 repositories listed
-
Avoiding Jammers: A Reinforcement Learning Approach20 Nov 2019 0 repositories listed
-
Corruption-robust exploration in episodic reinforcement learning20 Nov 2019 0 repositories listed
-
Deep Reinforcement Learning in Cryptocurrency Market Making20 Nov 2019 0 repositories listed
-
Hierarchical Average Reward Policy Gradient Algorithms20 Nov 2019 0 repositories listed
-
On Policy Learning Robust to Irreversible Events: An Application to Robotic In-Hand Manipulation20 Nov 2019 0 repositories listed
-
Safe Policies for Reinforcement Learning via Primal-Dual Methods20 Nov 2019 0 repositories listed
-
Solving Online Threat Screening Games using Constrained Action Space Reinforcement Learning20 Nov 2019 0 repositories listed
-
Decision Making for Autonomous Driving via Augmented Adversarial Inverse Reinforcement Learning19 Nov 2019 0 repositories listed
-
Attention-Privileged Reinforcement Learning19 Nov 2019 0 repositories listed
-
Efficient decorrelation of features using Gramian in Reinforcement Learning19 Nov 2019 0 repositories listed
-
Implicit Generative Modeling for Efficient Exploration19 Nov 2019 0 repositories listed
-
MANGA: Method Agnostic Neural-policy Generalization and Adaptation19 Nov 2019 0 repositories listed
-
Placement Optimization of Aerial Base Stations with Deep Reinforcement Learning19 Nov 2019 0 repositories listed
-
Variance Reduced Advantage Estimation with δ Hindsight Credit Assignment19 Nov 2019 0 repositories listed
-
Bias-Aware Heapified Policy for Active Learning18 Nov 2019 0 repositories listed
-
Comments on the Du-Kakade-Wang-Yang Lower Bounds18 Nov 2019 0 repositories listed
-
Efficient Exploration through Intrinsic Motivation Learning for Unsupervised Subgoal Discovery in Model-Free Hierarchical Reinforcement Learning18 Nov 2019 0 repositories listed
-
Gamma-Nets: Generalizing Value Estimation over Timescale18 Nov 2019 0 repositories listed
-
Inducing Cooperation via Team Regret Minimization based Multi-Agent Deep Reinforcement Learning18 Nov 2019 0 repositories listed
-
Learning with Good Feature Representations in Bandits and in RL with a Generative Model18 Nov 2019 0 repositories listed
-
Unsupervised Reinforcement Learning of Transferable Meta-Skills for Embodied Navigation18 Nov 2019 0 repositories listed
-
Hebbian Synaptic Modifications in Spiking Neurons that Learn17 Nov 2019 0 repositories listed
-
Generalized Maximum Causal Entropy for Inverse Reinforcement Learning16 Nov 2019 0 repositories listed
-
Inferring the Optimal Policy using Markov Chain Monte Carlo16 Nov 2019 0 repositories listed
-
Inverse Reinforcement Learning with Missing Data16 Nov 2019 0 repositories listed
-
Learning Efficient Multi-agent Communication: An Information Bottleneck Approach16 Nov 2019 0 repositories listed
-
Off-Policy Policy Gradient Algorithms by Constraining the State Distribution Shift16 Nov 2019 0 repositories listed
-
On Value Discrepancy of Imitation Learning16 Nov 2019 0 repositories listed
-
Reinforcement Learning from Imperfect Demonstrations under Soft Expert Guidance16 Nov 2019 0 repositories listed
-
S2DNAS:Transforming Static CNN Model for Dynamic Inference via Neural Architecture Search16 Nov 2019 0 repositories listed
-
ASCAI: Adaptive Sampling for acquiring Compact AI15 Nov 2019 0 repositories listed
-
Automated Augmentation with Reinforcement Learning and GANs for Robust Identification of Traffic Signs using Front Camera Images15 Nov 2019 0 repositories listed
-
Data-efficient Co-Adaptation of Morphology and Behaviour with Deep Reinforcement Learning15 Nov 2019 0 repositories listed
-
Improved Exploration through Latent Trajectory Optimization in Deep Deterministic Policy Gradient15 Nov 2019 0 repositories listed
-
Towards Personalized Dialog Policies for Conversational Skill Discovery15 Nov 2019 0 repositories listed
-
A Reduction from Reinforcement Learning to No-Regret Online Learning14 Nov 2019 0 repositories listed
-
Gamifying the Vehicle Routing Problem with Stochastic Requests14 Nov 2019 0 repositories listed
-
Deep Reinforcement Learning for Adaptive Traffic Signal Control14 Nov 2019 0 repositories listed
-
Asymptotics of Reinforcement Learning with Neural Networks13 Nov 2019 0 repositories listed
-
Buffer-aware Wireless Scheduling based on Deep Reinforcement Learning13 Nov 2019 0 repositories listed
-
Kinematic State Abstraction and Provably Efficient Rich-Observation Reinforcement Learning13 Nov 2019 0 repositories listed
-
Learning to Communicate in Multi-Agent Reinforcement Learning : A Review13 Nov 2019 0 repositories listed
-
Reinforcement Learning-Driven Test Generation for Android GUI Applications using Formal Specifications13 Nov 2019 0 repositories listed
-
Accelerating Training in Pommerman with Imitation and Reinforcement Learning12 Nov 2019 0 repositories listed
-
Efficient Planning under Partial Observability with Unnormalized Q Functions and Spectral Learning12 Nov 2019 0 repositories listed
-
Learning Representations in Reinforcement Learning:An Information Bottleneck Approach12 Nov 2019 0 repositories listed
-
MSDF: A Deep Reinforcement Learning Framework for Service Function Chain Migration12 Nov 2019 0 repositories listed
-
One-shot learning and behavioral eligibility traces in sequential decision making12 Nov 2019 0 repositories listed
-
Schedule Earth Observation satellites with Deep Reinforcement Learning12 Nov 2019 0 repositories listed