Browse State-of-the-Art › Reinforcement Learning › Papers, page 106
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 106 of 132: papers 10,501 to 10,600 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Resource Optimized Neural Architecture Search for 3D Medical Image Segmentation2 Sep 2019 0 repositories listed
-
Scalable Reinforcement-Learning-Based Neural Architecture Search for Cancer Deep Learning Research1 Sep 2019 0 repositories listed
-
To Combine or Not To Combine? A Rainbow Deep Reinforcement Learning Agent for Dialog Policies1 Sep 2019 0 repositories listed
-
Deep Reinforcement Learning with Distributional Semantic Rewards for Abstractive Summarization31 Aug 2019 0 repositories listed
-
Named Entity Recognition Only from Word Embeddings31 Aug 2019 0 repositories listed
-
Reinforcement learning with world model30 Aug 2019 0 repositories listed
-
Learning to Transfer Learn: Reinforcement Learning-Based Selection for Adaptive Transfer Learning29 Aug 2019 0 repositories listed
-
PaccMannᴿᴸ: Designing anticancer drugs from transcriptomic data via reinforcement learning29 Aug 2019 0 repositories listed
-
Solving Discounted Stochastic Two-Player Games with Near-Optimal Time and Sample Complexity29 Aug 2019 0 repositories listed
-
Deep Actor-Critic Reinforcement Learning for Anomaly Detection28 Aug 2019 0 repositories listed
-
Reinforcement Learning: Prediction, Control and Value Function Approximation28 Aug 2019 0 repositories listed
-
Solving Math Word Problems with Double-Decoder Transformer28 Aug 2019 0 repositories listed
-
STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control28 Aug 2019 0 repositories listed
-
A Data-Efficient Deep Learning Approach for Deployable Multimodal Social Robots27 Aug 2019 0 repositories listed
-
Deep Reinforcement Learning for Chatbots Using Clustered Actions and Human-Likeness Rewards27 Aug 2019 0 repositories listed
-
Ensemble-Based Deep Reinforcement Learning for Chatbots27 Aug 2019 0 repositories listed
-
Exploration-Enhanced POLITEX27 Aug 2019 0 repositories listed
-
MER-SDN: Machine Learning Framework for Traffic Aware Energy Efficient Routing in SDN27 Aug 2019 0 repositories listed
-
A Deep Reinforcement Learning Approach to Multi-component Job Scheduling in Edge Computing26 Aug 2019 0 repositories listed
-
Urban flows prediction from spatial-temporal data using machine learning: A survey26 Aug 2019 0 repositories listed
-
Tutorial and Survey on Probabilistic Graphical Model and Variational Inference in Deep Reinforcement Learning25 Aug 2019 0 repositories listed
-
A Comparison of Action Spaces for Learning Manipulation Tasks23 Aug 2019 0 repositories listed
-
Improving the dynamics of quantum sensors with reinforcement learning22 Aug 2019 0 repositories listed
-
On Convergence Rate of Adaptive Multiscale Value Function Approximation For Reinforcement Learning22 Aug 2019 0 repositories listed
-
Practical Risk Measures in Reinforcement Learning22 Aug 2019 0 repositories listed
-
Reinforcement Learning in Healthcare: A Survey22 Aug 2019 0 repositories listed
-
Dialog State Tracking with Reinforced Data Augmentation21 Aug 2019 0 repositories listed
-
Analyzing Cyber-Physical Systems from the Perspective of Artificial Intelligence21 Aug 2019 0 repositories listed
-
Deep Reinforcement Learning for Foreign Exchange Trading21 Aug 2019 0 repositories listed
-
Reinforcement Learning is not a Causal problem20 Aug 2019 0 repositories listed
-
A Deep Actor-Critic Reinforcement Learning Framework for Dynamic Multichannel Access20 Aug 2019 0 repositories listed
-
Learning to Sit: Synthesizing Human-Chair Interactions via Hierarchical Control20 Aug 2019 0 repositories listed
-
A survey on intrinsic motivation in reinforcement learning19 Aug 2019 0 repositories listed
-
A Domain-Knowledge-Aided Deep Reinforcement Learning Approach for Flight Control Design19 Aug 2019 0 repositories listed
-
Learning to Advertise for Organic Traffic Maximization in E-Commerce Product Feeds19 Aug 2019 0 repositories listed
-
Mitigating Multi-Stage Cascading Failure by Reinforcement Learning19 Aug 2019 0 repositories listed
-
Reinforcement Learning Applications19 Aug 2019 0 repositories listed
-
Transfer in Deep Reinforcement Learning using Knowledge Graphs19 Aug 2019 0 repositories listed
-
Iterative Update and Unified Representation for Multi-Agent Reinforcement Learning16 Aug 2019 0 repositories listed
-
Online Feature Selection for Activity Recognition using Reinforcement Learning with Multiple Feedback16 Aug 2019 0 repositories listed
-
Model-based Lookahead Reinforcement Learning15 Aug 2019 0 repositories listed
-
Playing a Strategy Game with Knowledge-Based Reinforcement Learning15 Aug 2019 0 repositories listed
-
Sample-efficient Deep Reinforcement Learning with Imaginary Rollouts for Human-Robot Interaction15 Aug 2019 0 repositories listed
-
Towards End-to-End Learning for Efficient Dialogue Agent by Modeling Looking-ahead Ability15 Aug 2019 0 repositories listed
-
Unpaired Cross-lingual Image Caption Generation with Self-Supervised Rewards15 Aug 2019 0 repositories listed
-
Continuous Control for High-Dimensional State Spaces: An Interactive Learning Approach14 Aug 2019 0 repositories listed
-
Skill Transfer in Deep Reinforcement Learning under Morphological Heterogeneity14 Aug 2019 0 repositories listed
-
Competitive Multi-Agent Deep Reinforcement Learning with Counterfactual Thinking13 Aug 2019 0 repositories listed
-
From Crystallized Adaptivity to Fluid Adaptivity in Deep Reinforcement Learning -- Insights from Biological Systems on Adaptive Flexibility13 Aug 2019 0 repositories listed
-
Multi-Agent Manipulation via Locomotion using Hierarchical Sim2Real13 Aug 2019 0 repositories listed
-
Reward Tampering Problems and Solutions in Reinforcement Learning: A Causal Influence Diagram Perspective13 Aug 2019 0 repositories listed
-
Fast Adaptation with Meta-Reinforcement Learning for Trust Modelling in Human-Robot Interaction12 Aug 2019 0 repositories listed
-
Superstition in the Network: Deep Reinforcement Learning Plays Deceptive Games12 Aug 2019 0 repositories listed
-
A Review of Cooperative Multi-Agent Deep Reinforcement Learning11 Aug 2019 0 repositories listed
-
Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning10 Aug 2019 0 repositories listed
-
Learning to Explore in Motion and Interaction Tasks10 Aug 2019 0 repositories listed
-
"Conservatives Overfit, Liberals Underfit": The Social-Psychological Control of Affect and Uncertainty8 Aug 2019 0 repositories listed
-
Incremental Reinforcement Learning --- a New Continuous Reinforcement Learning Frame Based on Stochastic Differential Equation methods8 Aug 2019 0 repositories listed
-
Learning to Grasp from 2.5D images: a Deep Reinforcement Learning Approach8 Aug 2019 0 repositories listed
-
Progressive Relation Learning for Group Activity Recognition8 Aug 2019 0 repositories listed
-
Trajectory-wise Control Variates for Variance Reduction in Policy Gradient Methods8 Aug 2019 0 repositories listed
-
Fast Multi-Agent Temporal-Difference Learning via Homotopy Stochastic Primal-Dual Optimization7 Aug 2019 0 repositories listed
-
Large-scale traffic signal control using machine learning: some traffic flow considerations7 Aug 2019 0 repositories listed
-
Task-Oriented Optimal Sequencing of Visualization Charts7 Aug 2019 0 repositories listed
-
A physics-informed reinforcement learning approach for the interfacial area transport in two-phase flow6 Aug 2019 0 repositories listed
-
Age of Information-Aware Radio Resource Management in Vehicular Networks: A Proactive Deep Reinforcement Learning Perspective6 Aug 2019 0 repositories listed
-
Batch Recurrent Q-Learning for Backchannel Generation Towards Engaging Agents6 Aug 2019 0 repositories listed
-
Benchmarking Bonus-Based Exploration Methods on the Arcade Learning Environment6 Aug 2019 0 repositories listed
-
Promoting Coordination through Policy Regularization in Multi-Agent Deep Reinforcement Learning6 Aug 2019 0 repositories listed
-
Attention Control with Metric Learning Alignment for Image Set-based Recognition5 Aug 2019 0 repositories listed
-
Reusability and Transferability of Macro Actions for Reinforcement Learning5 Aug 2019 0 repositories listed
-
Speech Driven Backchannel Generation using Deep Q-Network for Enhancing Engagement in Human-Robot Interaction5 Aug 2019 0 repositories listed
-
A View on Deep Reinforcement Learning in System Optimization4 Aug 2019 0 repositories listed
-
4 Aug 2019 0 repositories listed
-
Adaptive Stress Testing with Reward Augmentation for Autonomous Vehicle Validation2 Aug 2019 0 repositories listed
-
Improving Deep Reinforcement Learning in Minecraft with Action Advice2 Aug 2019 0 repositories listed
-
Curiosity-driven Reinforcement Learning for Diverse Visual Paragraph Generation1 Aug 2019 0 repositories listed
-
Learning When to Drive in Intersections by Combining Reinforcement Learning and Model Predictive Control1 Aug 2019 0 repositories listed
-
Neural Simplex Architecture1 Aug 2019 0 repositories listed
-
On the Theory of Policy Gradient Methods: Optimality, Approximation, and Distribution Shift1 Aug 2019 0 repositories listed
-
Reinforcement Learning for Personalized Dialogue Management1 Aug 2019 0 repositories listed
-
Robby is Not a Robber (anymore): On the Use of Institutions for Learning Normative Behavior1 Aug 2019 0 repositories listed
-
Inverse Reinforcement Learning with Multiple Ranked Experts31 Jul 2019 0 repositories listed
-
31 Jul 2019 0 repositories listed
-
Multi-Point Bandit Algorithms for Nonstationary Online Nonconvex Optimization31 Jul 2019 0 repositories listed
-
Optimal Attacks on Reinforcement Learning Policies31 Jul 2019 0 repositories listed
-
PrecoderNet: Hybrid Beamforming for Millimeter Wave Systems with Deep Reinforcement Learning31 Jul 2019 0 repositories listed
-
DeepPlace: Learning to Place Applications in Multi-Tenant Clusters30 Jul 2019 0 repositories listed
-
Model-Free Unsupervised Learning for Optimization Problems with Constraints30 Jul 2019 0 repositories listed
-
Wasserstein Robust Reinforcement Learning30 Jul 2019 0 repositories listed
-
Goal-Driven Sequential Data Abstraction29 Jul 2019 0 repositories listed
-
Lotka-Volterra competition mechanism embedded in a decision-making method29 Jul 2019 0 repositories listed
-
Particle Swarm Optimisation for Evolving Deep Neural Networks for Image Classification by Evolving and Stacking Transferable Blocks29 Jul 2019 0 repositories listed
-
Taxable Stock Trading with Deep Reinforcement Learning28 Jul 2019 0 repositories listed
-
What Should I Ask? Using Conversationally Informative Rewards for Goal-Oriented Visual Dialog28 Jul 2019 0 repositories listed
-
Q-MIND: Defeating Stealthy DoS Attacks in SDN with a Machine-learning based Defense Framework27 Jul 2019 0 repositories listed
-
A Unified Bellman Optimality Principle Combining Reward Maximization and Empowerment26 Jul 2019 0 repositories listed
-
An Information-theoretic On-line Learning Principle for Specialization in Hierarchical Decision-Making Systems26 Jul 2019 0 repositories listed
-
Deep Reinforcement Learning for Personalized Search Story Recommendation26 Jul 2019 0 repositories listed
-
Large scale continuous-time mean-variance portfolio allocation via reinforcement learning26 Jul 2019 0 repositories listed