Browse State-of-the-Art › reinforcement-learning › Papers, page 102
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 102 of 135: papers 10,101 to 10,200 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
A Local Temporal Difference Code for Distributional Reinforcement Learning1 Dec 2020 0 repositories listed
-
Almost Optimal Model-Free Reinforcement Learningvia Reference-Advantage Decomposition1 Dec 2020 0 repositories listed
-
Answer-driven Deep Question Generation based on Reinforcement Learning1 Dec 2020 0 repositories listed
-
Assessing and Accelerating Coverage in Deep Reinforcement Learning1 Dec 2020 0 repositories listed
-
Can Temporal-Difference and Q-Learning Learn Representation? A Mean-Field Theory1 Dec 2020 0 repositories listed
-
Combining Cognitive Modeling and Reinforcement Learning for Clarification in Dialogue1 Dec 2020 0 repositories listed
-
EcoLight: Intersection Control in Developing Regions Under Extreme Budget and Network Constraints1 Dec 2020 0 repositories listed
-
ExpanRL: Hierarchical Reinforcement Learning for Course Concept Expansion in MOOCs1 Dec 2020 0 repositories listed
-
Improving Neural Machine Translation for Sanskrit-English1 Dec 2020 0 repositories listed
-
Instance-based Generalization in Reinforcement Learning1 Dec 2020 0 repositories listed
-
Is Long Horizon RL More Difficult Than Short Horizon RL?1 Dec 2020 0 repositories listed
-
Leverage the Average: an Analysis of KL Regularization in Reinforcement Learning1 Dec 2020 0 repositories listed
-
MOReL: Model-Based Offline Reinforcement Learning1 Dec 2020 0 repositories listed
-
Non-Crossing Quantile Regression for Distributional Reinforcement Learning1 Dec 2020 0 repositories listed
-
On Efficiency in Hierarchical Reinforcement Learning1 Dec 2020 0 repositories listed
-
On the Convergence of Smooth Regularized Approximate Value Iteration Schemes1 Dec 2020 0 repositories listed
-
Online Decision Based Visual Tracking via Reinforcement Learning1 Dec 2020 0 repositories listed
-
Promoting Stochasticity for Expressive Policies via a Simple and Efficient Regularization Method1 Dec 2020 0 repositories listed
-
Provably Efficient Reinforcement Learning with Kernel and Neural Function Approximations1 Dec 2020 0 repositories listed
-
Provably Good Batch Off-Policy Reinforcement Learning Without Great Exploration1 Dec 2020 0 repositories listed
-
Reinforcement Learning for Control with Multiple Frequencies1 Dec 2020 0 repositories listed
-
Robust Multi-Agent Reinforcement Learning with Model Uncertainty1 Dec 2020 0 repositories listed
-
Security Analysis of Safe and Seldonian Reinforcement Learning Algorithms1 Dec 2020 0 repositories listed
-
Storage Efficient and Dynamic Flexible Runtime Channel Pruning via Deep Reinforcement Learning1 Dec 2020 0 repositories listed
-
Text Simplification with Reinforcement Learning Using Supervised Rewards on Grammaticality, Meaning Preservation, and Simplicity1 Dec 2020 0 repositories listed
-
Warren at SemEval-2020 Task 4: ALBERT and Multi-Task Learning for Commonsense Validation1 Dec 2020 0 repositories listed
-
Low-Bandwidth Communication Emerges Naturally in Multi-Agent Learning Systems30 Nov 2020 0 repositories listed
-
Soft-Robust Algorithms for Batch Reinforcement Learning30 Nov 2020 0 repositories listed
-
Cluster Based Deep Contextual Reinforcement Learning for top-k Recommendations29 Nov 2020 0 repositories listed
-
Minimax Sample Complexity for Turn-based Stochastic Game29 Nov 2020 0 repositories listed
-
Offline Reinforcement Learning Hands-On29 Nov 2020 0 repositories listed
-
Optimal Mixture Weights for Off-Policy Evaluation with Multiple Behavior Policies29 Nov 2020 0 repositories listed
-
Human-Agent Cooperation in Bridge Bidding28 Nov 2020 0 repositories listed
-
A survey of benchmarking frameworks for reinforcement learning27 Nov 2020 0 repositories listed
-
Adaptable Automation with Modular Deep Reinforcement Learning and Policy Transfer27 Nov 2020 0 repositories listed
-
Deep Reinforcement Learning for Resource Constrained Multiclass Scheduling in Wireless Networks27 Nov 2020 0 repositories listed
-
Real-time Active Vision for a Humanoid Soccer Robot Using Deep Reinforcement Learning27 Nov 2020 0 repositories listed
-
Exploring grid topology reconfiguration using a simple deep reinforcement learning approach26 Nov 2020 0 repositories listed
-
Learning from Simulation, Racing in Reality26 Nov 2020 0 repositories listed
-
Predictive PER: Balancing Priority and Diversity towards Stable Deep Reinforcement Learning26 Nov 2020 0 repositories listed
-
Reinforcement Learning for Robust Missile Autopilot Design26 Nov 2020 0 repositories listed
-
MetaSensing: Intelligent Metasurface Assisted RF 3D Sensing by Deep Reinforcement Learning25 Nov 2020 0 repositories listed
-
Towards Playing Full MOBA Games with Deep Reinforcement Learning25 Nov 2020 0 repositories listed
-
PowerNet: Multi-agent Deep Reinforcement Learning for Scalable Powergrid Control24 Nov 2020 0 repositories listed
-
REPAINT: Knowledge Transfer in Deep Reinforcement Learning24 Nov 2020 0 repositories listed
-
Uncertainty Estimation and Calibration with Finite-State Probabilistic RNNs24 Nov 2020 0 repositories listed
-
Consolidation via Policy Information Regularization in Deep RL for Multi-Agent Games23 Nov 2020 0 repositories listed
-
Generative Adversarial Simulator23 Nov 2020 0 repositories listed
-
Logarithmic Regret for Reinforcement Learning with Linear Function Approximation23 Nov 2020 0 repositories listed
-
Path Design and Resource Management for NOMA enhanced Indoor Intelligent Robots23 Nov 2020 0 repositories listed
-
Distributed Deep Reinforcement Learning: An Overview22 Nov 2020 0 repositories listed
-
Double Meta-Learning for Data Efficient Policy Optimization in Non-Stationary Environments21 Nov 2020 0 repositories listed
-
On the Convergence of Reinforcement Learning in Nonlinear Continuous State Space Problems21 Nov 2020 0 repositories listed
-
Policy Teaching in Reinforcement Learning via Environment Poisoning Attacks21 Nov 2020 0 repositories listed
-
Bridging Scene Understanding and Task Execution with Flexible Simulation Environments20 Nov 2020 0 repositories listed
-
Delay Constrained Buffer-Aided Relay Selection in the Internet of Things with Decision-Assisted Reinforcement Learning20 Nov 2020 0 repositories listed
-
MRAC-RL: A Framework for On-Line Policy Adaptation Under Parametric Model Uncertainty20 Nov 2020 0 repositories listed
-
Energy Aware Deep Reinforcement Learning Scheduling for Sensors Correlated in Time and Space19 Nov 2020 0 repositories listed
-
Online Model Selection for Reinforcement Learning with Function Approximation19 Nov 2020 0 repositories listed
-
Parrot: Data-Driven Behavioral Priors for Reinforcement Learning19 Nov 2020 0 repositories listed
-
Provable Multi-Objective Reinforcement Learning with Generative Models19 Nov 2020 0 repositories listed
-
Counterfactual Credit Assignment in Model-Free Reinforcement Learning18 Nov 2020 0 repositories listed
-
Experimental Study on Reinforcement Learning-based Control of an Acrobot18 Nov 2020 0 repositories listed
-
Indoor Point-to-Point Navigation with Deep Reinforcement Learning and Ultra-wideband18 Nov 2020 0 repositories listed
-
Inverse Reinforcement Learning via Matching of Optimality Profiles18 Nov 2020 0 repositories listed
-
Weighted Entropy Modification for Soft Actor-Critic18 Nov 2020 0 repositories listed
-
Curiosity Based Reinforcement Learning on Robot Manufacturing Cell17 Nov 2020 0 repositories listed
-
Deep Reinforcement Learning for Stochastic Computation Offloading in Digital Twin Networks17 Nov 2020 0 repositories listed
-
Efficient Exploration of Reward Functions in Inverse Reinforcement Learning via Bayesian Optimization17 Nov 2020 0 repositories listed
-
Explaining Conditions for Reinforcement Learning Behaviors from Real and Imagined Data17 Nov 2020 0 repositories listed
-
Fault-Aware Robust Control via Adversarial Reinforcement Learning17 Nov 2020 0 repositories listed
-
Leveraging the Variance of Return Sequences for Exploration Policy17 Nov 2020 0 repositories listed
-
Multi-agent Reinforcement Learning Accelerated MCMC on Multiscale Inversion Problem17 Nov 2020 0 repositories listed
-
Reinforcement Learning of Graph Neural Networks for Service Function Chaining17 Nov 2020 0 repositories listed
-
SeekNet: Improved Human Instance Segmentation and Tracking via Reinforcement Learning Based Optimized Robot Relocation17 Nov 2020 0 repositories listed
-
Analog Circuit Design with Dyna-Style Reinforcement Learning16 Nov 2020 0 repositories listed
-
Blind Decision Making: Reinforcement Learning with Delayed Observations16 Nov 2020 0 repositories listed
-
Constrained Model-Free Reinforcement Learning for Process Optimization16 Nov 2020 0 repositories listed
-
Distilling a Hierarchical Policy for Planning and Control via Representation and Reinforcement Learning16 Nov 2020 0 repositories listed
-
Value Function Approximations via Kernel Embeddings for No-Regret Reinforcement Learning16 Nov 2020 0 repositories listed
-
Reward Biased Maximum Likelihood Estimation for Reinforcement Learning16 Nov 2020 0 repositories listed
-
Towards Learning Controllable Representations of Physical Systems16 Nov 2020 0 repositories listed
-
Placement in Integrated Circuits using Cyclic Reinforcement Learning and Simulated Annealing15 Nov 2020 0 repositories listed
-
RL-QN: A Reinforcement Learning Framework for Optimal Control of Queueing Systems14 Nov 2020 0 repositories listed
-
Data-Efficient Learning for Complex and Real-Time Physical Problem Solving using Augmented Simulation14 Nov 2020 0 repositories listed
-
Active Reinforcement Learning: Observing Rewards at a Cost13 Nov 2020 0 repositories listed
-
Critic PI2: Master Continuous Planning via Policy Improvement with Path Integrals and Deep Actor-Critic Reinforcement Learning13 Nov 2020 0 repositories listed
-
Deep Reinforcement Learning of Transition States13 Nov 2020 0 repositories listed
-
Phoebe: Reuse-Aware Online Caching with Reinforcement Learning for Emerging Storage Models13 Nov 2020 0 repositories listed
-
Reinforcement Learning Control of a Biomechanical Model of the Upper Extremity13 Nov 2020 0 repositories listed
-
Reinforcement Learning Control of Constrained Dynamic Systems with Uniformly Ultimate Boundedness Stability Guarantee13 Nov 2020 0 repositories listed
-
Robotic self-representation improves manipulation skills and transfer learning13 Nov 2020 0 repositories listed
-
Robust Quadruped Jumping via Deep Reinforcement Learning13 Nov 2020 0 repositories listed
-
Scaffolding Reflection in Reinforcement Learning Framework for Confinement Escape Problem13 Nov 2020 0 repositories listed
-
Hierarchical reinforcement learning for efficient exploration and transfer12 Nov 2020 0 repositories listed
-
Imposing Robust Structured Control Constraint on Reinforcement Learning of Linear Quadratic Regulator12 Nov 2020 0 repositories listed
-
Self-supervised reinforcement learning for speaker localisation with the iCub humanoid robot12 Nov 2020 0 repositories listed
-
Steady State Analysis of Episodic Reinforcement Learning12 Nov 2020 0 repositories listed
-
CRPO: A New Approach for Safe Reinforcement Learning with Convergence Guarantee11 Nov 2020 0 repositories listed
-
Adaptive Neural Architectures for Recommender Systems11 Nov 2020 0 repositories listed