Browse State-of-the-Art › Reinforcement Learning › Papers, page 111
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 111 of 132: papers 11,001 to 11,100 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Intrinsic Social Motivation via Causal Influence in Multi-Agent RL1 May 2019 0 repositories listed
-
Learning a Meta-Solver for Syntax-Guided Program Synthesis1 May 2019 0 repositories listed
-
Learning Abstract Models for Long-Horizon Exploration1 May 2019 0 repositories listed
-
Learning Actionable Representations with Goal Conditioned Policies1 May 2019 0 repositories listed
-
Learning agents with prioritization and parameter noise in continuous state and action space1 May 2019 0 repositories listed
-
Learning Goal-Conditioned Value Functions with one-step Path rewards rather than Goal-Rewards1 May 2019 0 repositories listed
-
Learning Heuristics for Automated Reasoning through Reinforcement Learning1 May 2019 0 repositories listed
-
Learning to Control Visual Abstractions for Structured Exploration in Deep Reinforcement Learning1 May 2019 0 repositories listed
-
Learning to Decompose Compound Questions with Reinforcement Learning1 May 2019 0 repositories listed
-
Learning to Progressively Plan1 May 2019 0 repositories listed
-
Learning to Reinforcement Learn by Imitation1 May 2019 0 repositories listed
-
Learning to Search Efficient DenseNet with Layer-wise Pruning1 May 2019 0 repositories listed
-
Learning To Solve Circuit-SAT: An Unsupervised Differentiable Approach1 May 2019 0 repositories listed
-
M^3RL: Mind-aware Multi-agent Management Reinforcement Learning1 May 2019 0 repositories listed
-
Modeling the Long Term Future in Model-Based Reinforcement Learning1 May 2019 0 repositories listed
-
NEURAL MALWARE CONTROL WITH DEEP REINFORCEMENT LEARNING1 May 2019 0 repositories listed
-
Predicted Variables in Programming1 May 2019 0 repositories listed
-
Rating Continuous Actions in Spatial Multi-Agent Problems1 May 2019 0 repositories listed
-
Reinforced Imitation Learning from Observations1 May 2019 0 repositories listed
-
Sample-efficient policy learning in multi-agent Reinforcement Learning via meta-learning1 May 2019 0 repositories listed
-
SIMILE: Introducing Sequential Information towards More Effective Imitation Learning1 May 2019 0 repositories listed
-
Single Shot Neural Architecture Search Via Direct Sparse Optimization1 May 2019 0 repositories listed
-
Soft Q-Learning with Mutual-Information Regularization1 May 2019 0 repositories listed
-
SSoC: Learning Spontaneous and Self-Organizing Communication for Multi-Agent Collaboration1 May 2019 0 repositories listed
-
StrokeNet: A Neural Painting Environment1 May 2019 0 repositories listed
-
Towards Consistent Performance on Atari using Expert Demonstrations1 May 2019 0 repositories listed
-
Transfer and Exploration via the Information Bottleneck1 May 2019 0 repositories listed
-
Two-Timescale Networks for Nonlinear Value Function Approximation1 May 2019 0 repositories listed
-
Uncovering Surprising Behaviors in Reinforcement Learning via Worst-case Analysis1 May 2019 0 repositories listed
-
Understanding & Generalizing AlphaGo Zero1 May 2019 0 repositories listed
-
Visceral Machines: Reinforcement Learning with Intrinsic Physiological Rewards1 May 2019 0 repositories listed
-
Visual Imitation with a Minimal Adversary1 May 2019 0 repositories listed
-
A Deep Q-Learning Method for Downlink Power Allocation in Multi-Cell Networks30 Apr 2019 0 repositories listed
-
Generative Adversarial Imagination for Sample Efficient Deep Reinforcement Learning30 Apr 2019 0 repositories listed
-
Argus: Smartphone-enabled Human Cooperation via Multi-Agent Reinforcement Learning for Disaster Situational Awareness29 Apr 2019 0 repositories listed
-
Reinforcement Learning Scheduler for Vehicle-to-Vehicle Communications Outside Coverage29 Apr 2019 0 repositories listed
-
Arbitrage of Energy Storage in Electricity Markets with Deep Reinforcement Learning28 Apr 2019 0 repositories listed
-
Self Training Autonomous Driving Agent26 Apr 2019 0 repositories listed
-
Deep Reinforcement Learning for Optimal Critical Care Pain Management with Morphine using Dueling Double-Deep Q Networks25 Apr 2019 0 repositories listed
-
Ray Interference: a Source of Plateaus in Deep Reinforcement Learning25 Apr 2019 0 repositories listed
-
Zap Q-Learning for Optimal Stopping Time Problems25 Apr 2019 0 repositories listed
-
Grounding Natural Language Commands to StarCraft II Game States for Narration-Guided Reinforcement Learning24 Apr 2019 0 repositories listed
-
Autonomous Voltage Control for Grid Operation Using Deep Reinforcement Learning24 Apr 2019 0 repositories listed
-
Cognitive Radar Using Reinforcement Learning in Automotive Applications24 Apr 2019 0 repositories listed
-
Evolving Neural Networks in Reinforcement Learning by means of UMDAc24 Apr 2019 0 repositories listed
-
How You Act Tells a Lot: Privacy-Leakage Attack on Deep Reinforcement Learning24 Apr 2019 0 repositories listed
-
Stochastic Lipschitz Q-Learning24 Apr 2019 0 repositories listed
-
Target-Based Temporal Difference Learning24 Apr 2019 0 repositories listed
-
Towards Combining On-Off-Policy Methods for Real-World Applications24 Apr 2019 0 repositories listed
-
Driving Decision and Control for Autonomous Lane Change based on Deep Reinforcement Learning23 Apr 2019 0 repositories listed
-
Algorithm Portfolio for Individual-based Surrogate-Assisted Evolutionary Algorithms22 Apr 2019 0 repositories listed
-
Non-Stationary Markov Decision Processes, a Worst-Case Approach using Model-Based Reinforcement Learning, Extended version22 Apr 2019 0 repositories listed
-
Tripping through time: Efficient Localization of Activities in Videos22 Apr 2019 0 repositories listed
-
Generative Exploration and Exploitation21 Apr 2019 0 repositories listed
-
Neural Architecture Search for Deep Face Recognition21 Apr 2019 0 repositories listed
-
Compression and Localization in Reinforcement Learning for ATARI Games20 Apr 2019 0 repositories listed
-
Teaching on a Budget in Multi-Agent Deep Reinforcement Learning19 Apr 2019 0 repositories listed
-
Decoding Molecular Graph Embeddings with Reinforcement Learning18 Apr 2019 0 repositories listed
-
Improving Interactive Reinforcement Agent Planning with Human Demonstration18 Apr 2019 0 repositories listed
-
Making Meaning: Semiotics Within Predictive Knowledge Architectures18 Apr 2019 0 repositories listed
-
When is a Prediction Knowledge?18 Apr 2019 0 repositories listed
-
A Game Theoretical Framework for the Evaluation of Unmanned Aircraft Systems Airspace Integration Concepts17 Apr 2019 0 repositories listed
-
A Survey on Traffic Signal Control Methods17 Apr 2019 0 repositories listed
-
Bayesian policy selection using active inference17 Apr 2019 0 repositories listed
-
Reinforcement Learning Based Emotional Editing Constraint Conversation Generation17 Apr 2019 0 repositories listed
-
Robust Exploration with Tight Bayesian Plausibility Sets17 Apr 2019 0 repositories listed
-
Learning 3D Navigation Protocols on Touch Interfaces with Cooperative Multi-Agent Reinforcement Learning16 Apr 2019 0 repositories listed
-
Reinforcement Learning for Nested Polar Code Construction16 Apr 2019 0 repositories listed
-
Simion Zoo: A Workbench for Distributed Experimentation with Reinforcement Learning for Continuous Control Tasks16 Apr 2019 0 repositories listed
-
Curious iLQR: Resolving Uncertainty in Model-based RL15 Apr 2019 0 repositories listed
-
Disentangling Options with Hellinger Distance Regularizer15 Apr 2019 0 repositories listed
-
Improving interactive reinforcement learning: What makes a good teacher?15 Apr 2019 0 repositories listed
-
Multi-Objective Autonomous Braking System using Naturalistic Dataset15 Apr 2019 0 repositories listed
-
Reinforcement Learning with Probabilistic Guarantees for Autonomous Driving15 Apr 2019 0 repositories listed
-
Saliency Prediction on Omnidirectional Images with Generative Adversarial Imitation Learning15 Apr 2019 0 repositories listed
-
Self-critical n-step Training for Image Captioning15 Apr 2019 0 repositories listed
-
A Short Survey On Memory Based Reinforcement Learning14 Apr 2019 0 repositories listed
-
Dot-to-Dot: Explainable Hierarchical Reinforcement Learning for Robotic Manipulation14 Apr 2019 0 repositories listed
-
Effective Scheduling Function Design in SDN through Deep Reinforcement Learning12 Apr 2019 0 repositories listed
-
Interaction-aware Decision Making with Adaptive Strategies under Merging Scenarios12 Apr 2019 0 repositories listed
-
Similarities between policy gradient methods (PGM) in Reinforcement learning (RL) and supervised learning (SL)12 Apr 2019 0 repositories listed
-
Knowledge Flow: Improve Upon Your Teachers11 Apr 2019 0 repositories listed
-
Model-Free Reinforcement Learning for Financial Portfolios: A Brief Survey10 Apr 2019 0 repositories listed
-
Safer Deep RL with Shallow MCTS: A Case Study in Pommerman10 Apr 2019 0 repositories listed
-
Embryo staging with weakly-supervised region selection and dynamically-decoded predictions9 Apr 2019 0 repositories listed
-
RL-Based User Association and Resource Allocation for Multi-UAV enabled MEC8 Apr 2019 0 repositories listed
-
Creating Pro-Level AI for a Real-Time Fighting Game Using Deep Reinforcement Learning8 Apr 2019 0 repositories listed
-
"Jam Me If You Can'': Defeating Jammer with Deep Dueling Neural Network Architecture and Ambient Backscattering Augmented Communications8 Apr 2019 0 repositories listed
-
Only Relevant Information Matters: Filtering Out Noisy Samples to Boost RL8 Apr 2019 0 repositories listed
-
Teaching GANs to Sketch in Vector Format7 Apr 2019 0 repositories listed
-
Reinforced Imitation in Heterogeneous Action Space6 Apr 2019 0 repositories listed
-
Reinforcement Learning with Attention that Works: A Self-Supervised Approach6 Apr 2019 0 repositories listed
-
Multi-Preference Actor Critic5 Apr 2019 0 repositories listed
-
Reducing catastrophic forgetting when evolving neural networks5 Apr 2019 0 repositories listed
-
Structured agents for physical construction5 Apr 2019 0 repositories listed
-
Can a Robot Become a Movie Director? Learning Artistic Principles for Aerial Cinematography4 Apr 2019 0 repositories listed
-
Self-Adapting Goals Allow Transfer of Predictive Models to New Tasks4 Apr 2019 0 repositories listed
-
Multi-Modal Generative Adversarial Network for Short Product Title Generation in Mobile E-Commerce3 Apr 2019 0 repositories listed
-
PaintBot: A Reinforcement Learning Approach for Natural Media Painting3 Apr 2019 0 repositories listed
-
Robust Multi-agent Counterfactual Prediction3 Apr 2019 0 repositories listed