Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 113
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 113 of 152: papers 11,201 to 11,300 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
On the Convergence of Smooth Regularized Approximate Value Iteration Schemes1 Dec 2020 0 repositories listed
-
On the Stability and Convergence of Robust Adversarial Reinforcement Learning: A Case Study on Linear Quadratic Systems1 Dec 2020 0 repositories listed
-
Online Decision Based Visual Tracking via Reinforcement Learning1 Dec 2020 0 repositories listed
-
Promoting Stochasticity for Expressive Policies via a Simple and Efficient Regularization Method1 Dec 2020 0 repositories listed
-
Provably Efficient Reinforcement Learning with Kernel and Neural Function Approximations1 Dec 2020 0 repositories listed
-
Provably Good Batch Off-Policy Reinforcement Learning Without Great Exploration1 Dec 2020 0 repositories listed
-
R-learning in actor-critic model offers a biologically relevant mechanism for sequential decision-making1 Dec 2020 0 repositories listed
-
Reinforcement Learning for Control with Multiple Frequencies1 Dec 2020 0 repositories listed
-
Robust Multi-Agent Reinforcement Learning with Model Uncertainty1 Dec 2020 0 repositories listed
-
Security Analysis of Safe and Seldonian Reinforcement Learning Algorithms1 Dec 2020 0 repositories listed
-
Storage Efficient and Dynamic Flexible Runtime Channel Pruning via Deep Reinforcement Learning1 Dec 2020 0 repositories listed
-
Text Simplification with Reinforcement Learning Using Supervised Rewards on Grammaticality, Meaning Preservation, and Simplicity1 Dec 2020 0 repositories listed
-
Warren at SemEval-2020 Task 4: ALBERT and Multi-Task Learning for Commonsense Validation1 Dec 2020 0 repositories listed
-
IV-Posterior: Inverse Value Estimation for Interpretable Policy Certificates30 Nov 2020 0 repositories listed
-
Low-Bandwidth Communication Emerges Naturally in Multi-Agent Learning Systems30 Nov 2020 0 repositories listed
-
Soft-Robust Algorithms for Batch Reinforcement Learning30 Nov 2020 0 repositories listed
-
UniCon: Universal Neural Controller For Physics-based Character Motion30 Nov 2020 0 repositories listed
-
Cluster Based Deep Contextual Reinforcement Learning for top-k Recommendations29 Nov 2020 0 repositories listed
-
Hybrid Imitation Learning for Real-Time Service Restoration in Resilient Distribution Systems29 Nov 2020 0 repositories listed
-
Minimax Sample Complexity for Turn-based Stochastic Game29 Nov 2020 0 repositories listed
-
Offline Reinforcement Learning Hands-On29 Nov 2020 0 repositories listed
-
Optimal Mixture Weights for Off-Policy Evaluation with Multiple Behavior Policies29 Nov 2020 0 repositories listed
-
Human-Agent Cooperation in Bridge Bidding28 Nov 2020 0 repositories listed
-
A survey of benchmarking frameworks for reinforcement learning27 Nov 2020 0 repositories listed
-
Adaptable Automation with Modular Deep Reinforcement Learning and Policy Transfer27 Nov 2020 0 repositories listed
-
Deep Reinforcement Learning for Resource Constrained Multiclass Scheduling in Wireless Networks27 Nov 2020 0 repositories listed
-
Real-time Active Vision for a Humanoid Soccer Robot Using Deep Reinforcement Learning27 Nov 2020 0 repositories listed
-
Reinforcement Learning-based Joint Path and Energy Optimization of Cellular-Connected Unmanned Aerial Vehicles27 Nov 2020 0 repositories listed
-
Exploring grid topology reconfiguration using a simple deep reinforcement learning approach26 Nov 2020 0 repositories listed
-
Learning from Simulation, Racing in Reality26 Nov 2020 0 repositories listed
-
Predictive PER: Balancing Priority and Diversity towards Stable Deep Reinforcement Learning26 Nov 2020 0 repositories listed
-
Reinforcement Learning for Robust Missile Autopilot Design26 Nov 2020 0 repositories listed
-
Auto Graph Encoder-Decoder for Neural Network Pruning25 Nov 2020 0 repositories listed
-
Diluted Near-Optimal Expert Demonstrations for Guiding Dialogue Stochastic Policy Optimisation25 Nov 2020 0 repositories listed
-
MetaSensing: Intelligent Metasurface Assisted RF 3D Sensing by Deep Reinforcement Learning25 Nov 2020 0 repositories listed
-
Towards Playing Full MOBA Games with Deep Reinforcement Learning25 Nov 2020 0 repositories listed
-
A Reusable Framework Based on Reinforcement Learning to Design Antennas for Curved Surfaces24 Nov 2020 0 repositories listed
-
PowerNet: Multi-agent Deep Reinforcement Learning for Scalable Powergrid Control24 Nov 2020 0 repositories listed
-
REPAINT: Knowledge Transfer in Deep Reinforcement Learning24 Nov 2020 0 repositories listed
-
Uncertainty Estimation and Calibration with Finite-State Probabilistic RNNs24 Nov 2020 0 repositories listed
-
COCOI: Contact-aware Online Context Inference for Generalizable Non-planar Pushing23 Nov 2020 0 repositories listed
-
Consolidation via Policy Information Regularization in Deep RL for Multi-Agent Games23 Nov 2020 0 repositories listed
-
Generative Adversarial Simulator23 Nov 2020 0 repositories listed
-
Logarithmic Regret for Reinforcement Learning with Linear Function Approximation23 Nov 2020 0 repositories listed
-
Path Design and Resource Management for NOMA enhanced Indoor Intelligent Robots23 Nov 2020 0 repositories listed
-
Distributed Deep Reinforcement Learning: An Overview22 Nov 2020 0 repositories listed
-
Reinforcement learning with distance-based incentive/penalty (DIP) updates for highly constrained industrial control systems22 Nov 2020 0 repositories listed
-
Double Meta-Learning for Data Efficient Policy Optimization in Non-Stationary Environments21 Nov 2020 0 repositories listed
-
On the Convergence of Reinforcement Learning in Nonlinear Continuous State Space Problems21 Nov 2020 0 repositories listed
-
Policy Teaching in Reinforcement Learning via Environment Poisoning Attacks21 Nov 2020 0 repositories listed
-
Bridging Scene Understanding and Task Execution with Flexible Simulation Environments20 Nov 2020 0 repositories listed
-
Delay Constrained Buffer-Aided Relay Selection in the Internet of Things with Decision-Assisted Reinforcement Learning20 Nov 2020 0 repositories listed
-
MRAC-RL: A Framework for On-Line Policy Adaptation Under Parametric Model Uncertainty20 Nov 2020 0 repositories listed
-
Energy Aware Deep Reinforcement Learning Scheduling for Sensors Correlated in Time and Space19 Nov 2020 0 repositories listed
-
Online Model Selection for Reinforcement Learning with Function Approximation19 Nov 2020 0 repositories listed
-
Parrot: Data-Driven Behavioral Priors for Reinforcement Learning19 Nov 2020 0 repositories listed
-
Provable Multi-Objective Reinforcement Learning with Generative Models19 Nov 2020 0 repositories listed
-
Counterfactual Credit Assignment in Model-Free Reinforcement Learning18 Nov 2020 0 repositories listed
-
Experimental Study on Reinforcement Learning-based Control of an Acrobot18 Nov 2020 0 repositories listed
-
Indoor Point-to-Point Navigation with Deep Reinforcement Learning and Ultra-wideband18 Nov 2020 0 repositories listed
-
Inverse Reinforcement Learning via Matching of Optimality Profiles18 Nov 2020 0 repositories listed
-
Weighted Entropy Modification for Soft Actor-Critic18 Nov 2020 0 repositories listed
-
C-Learning: Learning to Achieve Goals via Recursive Classification17 Nov 2020 0 repositories listed
-
Curiosity Based Reinforcement Learning on Robot Manufacturing Cell17 Nov 2020 0 repositories listed
-
Deep Reinforcement Learning and Permissioned Blockchain for Content Caching in Vehicular Edge Computing and Networks17 Nov 2020 0 repositories listed
-
Deep Reinforcement Learning for Stochastic Computation Offloading in Digital Twin Networks17 Nov 2020 0 repositories listed
-
Efficient Exploration of Reward Functions in Inverse Reinforcement Learning via Bayesian Optimization17 Nov 2020 0 repositories listed
-
Explaining Conditions for Reinforcement Learning Behaviors from Real and Imagined Data17 Nov 2020 0 repositories listed
-
Fault-Aware Robust Control via Adversarial Reinforcement Learning17 Nov 2020 0 repositories listed
-
Leveraging the Variance of Return Sequences for Exploration Policy17 Nov 2020 0 repositories listed
-
Modality-Buffet for Real-Time Object Detection17 Nov 2020 0 repositories listed
-
Multi-agent Reinforcement Learning Accelerated MCMC on Multiscale Inversion Problem17 Nov 2020 0 repositories listed
-
PassGoodPool: Joint Passengers and Goods Fleet Management with Reinforcement Learning aided Pricing, Matching, and Route Planning17 Nov 2020 0 repositories listed
-
REALab: An Embedded Perspective on Tampering17 Nov 2020 0 repositories listed
-
Reinforcement Learning of Graph Neural Networks for Service Function Chaining17 Nov 2020 0 repositories listed
-
SeekNet: Improved Human Instance Segmentation and Tracking via Reinforcement Learning Based Optimized Robot Relocation17 Nov 2020 0 repositories listed
-
ACDER: Augmented Curiosity-Driven Experience Replay16 Nov 2020 0 repositories listed
-
Analog Circuit Design with Dyna-Style Reinforcement Learning16 Nov 2020 0 repositories listed
-
Blind Decision Making: Reinforcement Learning with Delayed Observations16 Nov 2020 0 repositories listed
-
Constrained Model-Free Reinforcement Learning for Process Optimization16 Nov 2020 0 repositories listed
-
Distilling a Hierarchical Policy for Planning and Control via Representation and Reinforcement Learning16 Nov 2020 0 repositories listed
-
Value Function Approximations via Kernel Embeddings for No-Regret Reinforcement Learning16 Nov 2020 0 repositories listed
-
Reward Biased Maximum Likelihood Estimation for Reinforcement Learning16 Nov 2020 0 repositories listed
-
Towards a General Framework for ML-based Self-tuning Databases16 Nov 2020 0 repositories listed
-
Towards Learning Controllable Representations of Physical Systems16 Nov 2020 0 repositories listed
-
Placement in Integrated Circuits using Cyclic Reinforcement Learning and Simulated Annealing15 Nov 2020 0 repositories listed
-
A Geometric Perspective on Self-Supervised Policy Adaptation14 Nov 2020 0 repositories listed
-
RL-QN: A Reinforcement Learning Framework for Optimal Control of Queueing Systems14 Nov 2020 0 repositories listed
-
Data-Efficient Learning for Complex and Real-Time Physical Problem Solving using Augmented Simulation14 Nov 2020 0 repositories listed
-
Active Reinforcement Learning: Observing Rewards at a Cost13 Nov 2020 0 repositories listed
-
Critic PI2: Master Continuous Planning via Policy Improvement with Path Integrals and Deep Actor-Critic Reinforcement Learning13 Nov 2020 0 repositories listed
-
Deep Reinforcement Learning of Transition States13 Nov 2020 0 repositories listed
-
Phoebe: Reuse-Aware Online Caching with Reinforcement Learning for Emerging Storage Models13 Nov 2020 0 repositories listed
-
Reinforcement Learning Control of a Biomechanical Model of the Upper Extremity13 Nov 2020 0 repositories listed
-
Reinforcement Learning Control of Constrained Dynamic Systems with Uniformly Ultimate Boundedness Stability Guarantee13 Nov 2020 0 repositories listed
-
Robotic self-representation improves manipulation skills and transfer learning13 Nov 2020 0 repositories listed
-
Robust Quadruped Jumping via Deep Reinforcement Learning13 Nov 2020 0 repositories listed
-
Scaffolding Reflection in Reinforcement Learning Framework for Confinement Escape Problem13 Nov 2020 0 repositories listed
-
A Review of Uncertainty Quantification in Deep Learning: Techniques, Applications and Challenges12 Nov 2020 0 repositories listed
-
12 Nov 2020 0 repositories listed