Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 146
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 146 of 152: papers 14,501 to 14,600 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
A Simple Reinforcement Learning Mechanism for Resource Allocation in LTE-A Networks with Markov Decision Process and Q-Learning27 Sep 2017 0 repositories listed
-
Object-oriented Neural Programming (OONP) for Document Understanding26 Sep 2017 0 repositories listed
-
Towards continuous control of flippers for a multi-terrain robot using deep reinforcement learning25 Sep 2017 0 repositories listed
-
An Optimal Online Method of Selecting Source Policies for Reinforcement Learning24 Sep 2017 0 repositories listed
-
Learning Unmanned Aerial Vehicle Control for Autonomous Target Following24 Sep 2017 0 repositories listed
-
Bootstrapping incremental dialogue systems from minimal data: the generalisation power of dialogue grammars22 Sep 2017 0 repositories listed
-
Inverse Reinforcement Learning with Conditional Choice Probabilities22 Sep 2017 0 repositories listed
-
Multiqubit and multilevel quantum reinforcement learning with quantum technologies22 Sep 2017 0 repositories listed
-
On overfitting and asymptotic bias in batch reinforcement learning with partial observability22 Sep 2017 0 repositories listed
-
OptLayer - Practical Constrained Optimization for Deep Reinforcement Learning in the Real World22 Sep 2017 0 repositories listed
-
Feature Engineering for Predictive Modeling using Reinforcement Learning21 Sep 2017 0 repositories listed
-
Local Communication Protocols for Learning Complex Swarm Behaviors with Deep Reinforcement Learning21 Sep 2017 0 repositories listed
-
A Deep-Reinforcement Learning Approach for Software-Defined Networking Routing Optimization20 Sep 2017 0 repositories listed
-
Deep Reinforcement Learning for Dexterous Manipulation with Concept Networks20 Sep 2017 0 repositories listed
-
Sparse Markov Decision Processes with Causal Sparse Tsallis Entropy Regularization for Reinforcement Learning19 Sep 2017 0 repositories listed
-
Iterative Policy Learning in End-to-End Trainable Task-Oriented Neural Dialog Models18 Sep 2017 0 repositories listed
-
N2N Learning: Network to Network Compression via Policy Gradient Reinforcement Learning18 Sep 2017 0 repositories listed
-
Why Pay More When You Can Pay Less: A Joint Learning Framework for Active Feature Acquisition and Classification18 Sep 2017 0 repositories listed
-
Closing the loop between neural network simulators and the OpenAI Gym17 Sep 2017 0 repositories listed
-
Improving Search through A3C Reinforcement Learning based Conversational Agent17 Sep 2017 0 repositories listed
-
Transforming Cooling Optimization for Green Data Center via Deep Reinforcement Learning15 Sep 2017 0 repositories listed
-
Unsupervised state representation learning with robotic priors: a robustness benchmark15 Sep 2017 0 repositories listed
-
Autonomous Extracting a Hierarchical Structure of Tasks in Reinforcement Learning and Multi-task Reinforcement Learning14 Sep 2017 0 repositories listed
-
Shared Learning : Enhancing Reinforcement in Q-Ensembles14 Sep 2017 0 repositories listed
-
Towards personalized human AI interaction - adapting the behavior of AI agents using neural signatures of subjective interest14 Sep 2017 0 repositories listed
-
A Study of AI Population Dynamics with Million-agent Reinforcement Learning13 Sep 2017 0 repositories listed
-
Deep Reinforcement Learning with Surrogate Agent-Environment Interface12 Sep 2017 0 repositories listed
-
Explore, Exploit or Listen: Combining Human Feedback and Policy Model to Speed up Deep Reinforcement Learning in 3D Worlds12 Sep 2017 0 repositories listed
-
Linear Stochastic Approximation: Constant Step-Size and Iterate Averaging12 Sep 2017 0 repositories listed
-
Pre-training Neural Networks with Human Demonstrations for Deep Reinforcement Learning12 Sep 2017 0 repositories listed
-
Autonomous Quadrotor Landing using Deep Reinforcement Learning11 Sep 2017 0 repositories listed
-
MBMF: Model-Based Priors for Model-Free Reinforcement Learning10 Sep 2017 0 repositories listed
-
Ultimate Intelligence Part III: Measures of Intelligence, Perception and Intelligent Agents8 Sep 2017 0 repositories listed
-
A Deep Reinforcement Learning Chatbot7 Sep 2017 0 repositories listed
-
Approximating meta-heuristics with homotopic recurrent neural networks7 Sep 2017 0 repositories listed
-
Formulation of Deep Reinforcement Learning Architecture Toward Autonomous Driving for On-Ramp Merge7 Sep 2017 0 repositories listed
-
Towards Neural Machine Translation with Latent Tree Attention6 Sep 2017 0 repositories listed
-
BOOK: Storing Algorithm-Invariant Episodes for Deep Reinforcement Learning5 Sep 2017 0 repositories listed
-
Agent-Aware Dropout DQN for Safe and Efficient On-line Dialogue Policy Learning1 Sep 2017 0 repositories listed
-
BIBI System Description: Building with CNNs and Breaking with Deep Reinforcement Learning1 Sep 2017 0 repositories listed
-
Learning what to read: Focused machine reading1 Sep 2017 0 repositories listed
-
Resilient Autonomous Control of Distributed Multi-agent Systems in Contested Environments31 Aug 2017 0 repositories listed
-
Asymptotic Bias of Stochastic Gradient Search30 Aug 2017 0 repositories listed
-
Optimal and Learning Control for Autonomous Robots30 Aug 2017 0 repositories listed
-
Novel Sensor Scheduling Scheme for Intruder Tracking in Energy Efficient Sensor Networks27 Aug 2017 0 repositories listed
-
A Function Approximation Method for Model-based High-Dimensional Inverse Reinforcement Learning23 Aug 2017 0 repositories listed
-
Reinforcement Learning in POMDPs with Memoryless Options and Option-Observation Initiation Sets22 Aug 2017 0 repositories listed
-
Solving a New 3D Bin Packing Problem with Deep Reinforcement Learning Method20 Aug 2017 0 repositories listed
-
A Brief Survey of Deep Reinforcement Learning19 Aug 2017 0 repositories listed
-
Deep Reinforcement Learning for High Precision Assembly Tasks14 Aug 2017 0 repositories listed
-
A Machine Learning Approach to Routing10 Aug 2017 0 repositories listed
-
Attention-Aware Face Hallucination via Deep Reinforcement Learning10 Aug 2017 0 repositories listed
-
Decoupled Learning of Environment Characteristics for Safe Exploration9 Aug 2017 0 repositories listed
-
Investigating Reinforcement Learning Agents for Continuous State Space Environments8 Aug 2017 0 repositories listed
-
Reinforced Video Captioning with Entailment Rewards7 Aug 2017 0 repositories listed
-
An Information-Theoretic Optimality Principle for Deep Reinforcement Learning6 Aug 2017 0 repositories listed
-
Effective sketching methods for value function approximation3 Aug 2017 0 repositories listed
-
Reinforcement learning techniques for Outer Loop Link Adaptation in 4G/5G systems3 Aug 2017 0 repositories listed
-
The UMD Neural Machine Translation Systems at WMT17 Bandit Learning Task3 Aug 2017 0 repositories listed
-
Deep Reinforcement Learning for Inquiry Dialog Policies with Logical Formula Embeddings2 Aug 2017 0 repositories listed
-
Hierarchy Through Composition with Multitask LMDPs1 Aug 2017 0 repositories listed
-
Neural Optimizer Search using Reinforcement Learning1 Aug 2017 0 repositories listed
-
Plan, Attend, Generate: Character-Level Neural Machine Translation with Planning1 Aug 2017 0 repositories listed
-
Using Reinforcement Learning to Model Incrementality in a Fast-Paced Dialogue Game1 Aug 2017 0 repositories listed
-
World of Bits: An Open-Domain Platform for Web-Based Agents1 Aug 2017 0 repositories listed
-
Advantages and Limitations of using Successor Features for Transfer in Reinforcement Learning31 Jul 2017 0 repositories listed
-
Spectrum Access In Cognitive Radio Using A Two Stage Reinforcement Learning Approach31 Jul 2017 0 repositories listed
-
Inverse Reinforcement Learning in Large State Spaces via Function Approximation28 Jul 2017 0 repositories listed
-
Learning to Teach Reinforcement Learning Agents28 Jul 2017 0 repositories listed
-
Guiding Reinforcement Learning Exploration Using Natural Language26 Jul 2017 0 repositories listed
-
Learning Sparse Representations in Reinforcement Learning with Sparse Coding26 Jul 2017 0 repositories listed
-
Bellman Gradient Iteration for Inverse Reinforcement Learning24 Jul 2017 0 repositories listed
-
Reward-Balancing for Statistical Spoken Dialogue Systems using Multi-objective Reinforcement Learning19 Jul 2017 0 repositories listed
-
On-line Building Energy Optimization using Deep Reinforcement Learning18 Jul 2017 0 repositories listed
-
Reverse Curriculum Generation for Reinforcement Learning17 Jul 2017 0 repositories listed
-
Tracking as Online Decision-Making: Learning a Policy from Streaming Videos with Reinforcement Learning17 Jul 2017 0 repositories listed
-
Freeway Merging in Congested Traffic based on Multipolicy Decision Making with Passive Actor Critic14 Jul 2017 0 repositories listed
-
Distral: Robust Multitask Reinforcement Learning13 Jul 2017 0 repositories listed
-
Autoencoder-augmented Neuroevolution for Visual Doom Playing12 Jul 2017 0 repositories listed
-
Fastest Convergence for Q-learning12 Jul 2017 0 repositories listed
-
Deep Q-Learning for Self-Organizing Networks Fault Management and Radio Performance Improvement10 Jul 2017 0 repositories listed
-
Deep Reinforcement Learning Attention Selection for Person Re-Identification10 Jul 2017 0 repositories listed
-
Q-Learning Algorithm for VoLTE Closed-Loop Power Control in Indoor Small Cells10 Jul 2017 0 repositories listed
-
Learning to Design Games: Strategic Environments in Reinforcement Learning5 Jul 2017 0 repositories listed
-
The Complex Negotiation Dialogue Game5 Jul 2017 0 repositories listed
-
OPEB: Open Physical Environment Benchmark for Artificial Intelligence4 Jul 2017 0 repositories listed
-
Hashing over Predicted Future Frames for Informed Exploration of Deep Reinforcement Learning3 Jul 2017 0 repositories listed
-
Grammatical Error Correction with Neural Reinforcement Learning2 Jul 2017 0 repositories listed
-
Sample-efficient Actor-Critic Reinforcement Learning with Supervised Data for Dialogue Management1 Jul 2017 0 repositories listed
-
Actor-Critic Sequence Training for Image Captioning29 Jun 2017 0 repositories listed
-
Interpretability via Model Extraction29 Jun 2017 0 repositories listed
-
Learning to Learn: Meta-Critic Networks for Sample Efficient Learning29 Jun 2017 0 repositories listed
-
Path Integral Networks: End-to-End Differentiable Optimal Control29 Jun 2017 0 repositories listed
-
Uncertainty Decomposition in Bayesian Neural Networks with Latent Variables26 Jun 2017 0 repositories listed
-
Temporal-related Convolutional-Restricted-Boltzmann-Machine capable of learning relational order via reinforcement learning procedure?24 Jun 2017 0 repositories listed
-
Structure Learning in Motor Control:A Deep Reinforcement Learning Model21 Jun 2017 0 repositories listed
-
Observational Learning by Reinforcement Learning20 Jun 2017 0 repositories listed
-
Policy Gradient Methods for Reinforcement Learning with Function Approximation and Action-Dependent Baselines20 Jun 2017 0 repositories listed
-
Toward Real-Time Decentralized Reinforcement Learning using Finite Support Basis Functions20 Jun 2017 0 repositories listed
-
Pedestrian Prediction by Planning using Deep Neural Networks19 Jun 2017 0 repositories listed