Browse State-of-the-Art › Reinforcement Learning › Papers, page 105
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 105 of 132: papers 10,401 to 10,500 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
A Human-Centered Data-Driven Planner-Actor-Critic Architecture via Logic Programming18 Sep 2019 0 repositories listed
-
Automated Lane Change Decision Making using Deep Reinforcement Learning in Dynamic and Uncertain Highway Environment18 Sep 2019 0 repositories listed
-
DeepGait: Planning and Control of Quadrupedal Gaits using Deep Reinforcement Learning18 Sep 2019 0 repositories listed
-
Robust Opponent Modeling via Adversarial Ensemble Reinforcement Learning in Asymmetric Imperfect-Information Games18 Sep 2019 0 repositories listed
-
Segregation Dynamics with Reinforcement Learning and Agent Based Modeling18 Sep 2019 0 repositories listed
-
Visual Tracking by means of Deep Reinforcement Learning and an Expert Demonstrator18 Sep 2019 0 repositories listed
-
A Review of Tracking, Prediction and Decision Making Methods for Autonomous Driving17 Sep 2019 0 repositories listed
-
Adversarial Feature Training for Generalizable Robotic Visuomotor Control17 Sep 2019 0 repositories listed
-
Attraction-Repulsion Actor-Critic for Continuous Control Reinforcement Learning17 Sep 2019 0 repositories listed
-
Controllable Length Control Neural Encoder-Decoder via Reinforcement Learning17 Sep 2019 0 repositories listed
-
Generating Black-Box Adversarial Examples for Text Classifiers Using a Deep Reinforced Model17 Sep 2019 0 repositories listed
-
Split Deep Q-Learning for Robust Object Singulation17 Sep 2019 0 repositories listed
-
Stock market microstructure inference via multi-agent reinforcement learning17 Sep 2019 0 repositories listed
-
Selective Network Discovery via Deep Reinforcement Learning on Embedded Spaces16 Sep 2019 0 repositories listed
-
Discovering Differential Features: Adversarial Learning for Information Credibility Evaluation16 Sep 2019 0 repositories listed
-
Data Centers Job Scheduling with Deep Reinforcement Learning16 Sep 2019 0 repositories listed
-
Leveraging human Domain Knowledge to model an empirical Reward function for a Reinforcement Learning problem16 Sep 2019 0 repositories listed
-
Meta Reinforcement Learning for Sim-to-real Domain Adaptation16 Sep 2019 0 repositories listed
-
Off-road Autonomous Vehicles Traversability Analysis and Trajectory Planning Based on Deep Inverse Reinforcement Learning16 Sep 2019 0 repositories listed
-
Biased Estimates of Advantages over Path Ensembles15 Sep 2019 0 repositories listed
-
Model Based Planning with Energy Based Models15 Sep 2019 0 repositories listed
-
Policy Prediction Network: Model-Free Behavior Policy with Model-Based Learning in Continuous Action Space15 Sep 2019 0 repositories listed
-
State Representation Learning from Demonstration15 Sep 2019 0 repositories listed
-
VILD: Variational Imitation Learning with Diverse-quality Demonstrations15 Sep 2019 0 repositories listed
-
Wield: Systematic Reinforcement Learning With Progressive Randomization15 Sep 2019 0 repositories listed
-
Active Learning for Risk-Sensitive Inverse Reinforcement Learning14 Sep 2019 0 repositories listed
-
Learning to Collaborate from Simulation for Robot-Assisted Dressing14 Sep 2019 0 repositories listed
-
Neural Architecture Search for Class-incremental Learning14 Sep 2019 0 repositories listed
-
Neuromodulated Patience for Robot and Self-Driving Vehicle Navigation14 Sep 2019 0 repositories listed
-
Node Injection Attacks on Graphs via Reinforcement Learning14 Sep 2019 0 repositories listed
-
AITuning: Machine Learning-based Tuning Tool for Run-Time Communication Libraries13 Sep 2019 0 repositories listed
-
HJB Optimal Feedback Control with Deep Differential Value Functions and Action Constraints13 Sep 2019 0 repositories listed
-
Petri Net Machines for Human-Agent Interaction13 Sep 2019 0 repositories listed
-
Reinforcement Learning: a Comparison of UCB Versus Alternative Adaptive Policies13 Sep 2019 0 repositories listed
-
Say What I Want: Towards the Dark Side of Neural Dialogue Models13 Sep 2019 0 repositories listed
-
Towards an Adaptive Robot for Sports and Rehabilitation Coaching13 Sep 2019 0 repositories listed
-
Differentially Private Meta-Learning12 Sep 2019 0 repositories listed
-
Efficiently Breaking the Curse of Horizon in Off-Policy Evaluation with Double Reinforcement Learning12 Sep 2019 0 repositories listed
-
Joint Inference of Reward Machines and Policies for Reinforcement Learning12 Sep 2019 0 repositories listed
-
Machine Learning in/for Blockchain: Future and Challenges12 Sep 2019 0 repositories listed
-
Maximum Likelihood Constraint Inference for Inverse Reinforcement Learning12 Sep 2019 0 repositories listed
-
Modeling Sensorimotor Coordination as Multi-Agent Reinforcement Learning with Differentiable Communication12 Sep 2019 0 repositories listed
-
SQLR: Short-Term Memory Q-Learning for Elastic Provisioning12 Sep 2019 0 repositories listed
-
An Online Reinforcement Learning Approach to Quality-Cost-Aware Task Allocation for Multi-Attribute Social Sensing11 Sep 2019 0 repositories listed
-
Correlation Priors for Reinforcement Learning11 Sep 2019 0 repositories listed
-
Modelling Working Memory using Deep Recurrent Reinforcement Learning11 Sep 2019 0 repositories listed
-
Mutual-Information Regularization in Markov Decision Processes and Actor-Critic Learning11 Sep 2019 0 repositories listed
-
On Memory Mechanism in Multi-Agent Reinforcement Learning11 Sep 2019 0 repositories listed
-
Safe Policy Improvement with an Estimated Baseline Policy11 Sep 2019 0 repositories listed
-
A Multistep Lyapunov Approach for Finite-Time Analysis of Biased Stochastic Approximation10 Sep 2019 0 repositories listed
-
Discovery of Useful Questions as Auxiliary Tasks10 Sep 2019 0 repositories listed
-
Learning Transferable Domain Priors for Safe Exploration in Reinforcement Learning10 Sep 2019 0 repositories listed
-
MAT: Multi-Fingered Adaptive Tactile Grasping via Deep Reinforcement Learning10 Sep 2019 0 repositories listed
-
Q-Learning Based Aerial Base Station Placement for Fairness Enhancement in Mobile Networks10 Sep 2019 0 repositories listed
-
Reinforcement Learning and Video Games10 Sep 2019 0 repositories listed
-
Sampling Strategies for GAN Synthetic Data10 Sep 2019 0 repositories listed
-
Signal Instructed Coordination in Cooperative Multi-agent Reinforcement Learning10 Sep 2019 0 repositories listed
-
Transfer of Temporal Logic Formulas in Reinforcement Learning10 Sep 2019 0 repositories listed
-
DEAR: Deep Reinforcement Learning for Online Advertising Impression in Recommender Systems9 Sep 2019 0 repositories listed
-
Deterministic Value-Policy Gradients9 Sep 2019 0 repositories listed
-
Fixed-Horizon Temporal Difference Methods for Stable Reinforcement Learning9 Sep 2019 0 repositories listed
-
Gradient-Aware Model-based Policy Search9 Sep 2019 0 repositories listed
-
Neural Architecture Search in Embedding Space9 Sep 2019 0 repositories listed
-
Off-Policy Evaluation in Partially Observable Environments9 Sep 2019 0 repositories listed
-
Option Encoder: A Framework for Discovering a Policy Basis in Reinforcement Learning9 Sep 2019 0 repositories listed
-
Partner Approximating Learners (PAL): Simulation-Accelerated Learning with Explicit Partner Modeling in Multi-Agent Domains9 Sep 2019 0 repositories listed
-
Recommendation System-based Upper Confidence Bound for Online Advertising9 Sep 2019 0 repositories listed
-
Solving Continual Combinatorial Selection via Deep Reinforcement Learning9 Sep 2019 0 repositories listed
-
Open Compound Domain Adaptation8 Sep 2019 0 repositories listed
-
Countering the Effects of Lead Bias in News Summarization via Multi-Stage Training and Auxiliary Losses8 Sep 2019 0 repositories listed
-
8 Sep 2019 0 repositories listed
-
Personalized HeartSteps: A Reinforcement Learning Algorithm for Optimizing Physical Activity8 Sep 2019 0 repositories listed
-
Self-driving scale car trained by Deep reinforcement learning8 Sep 2019 0 repositories listed
-
7 Sep 2019 0 repositories listed
-
Automatic Financial Trading Agent for Low-risk Portfolio Management using Deep Reinforcement Learning7 Sep 2019 0 repositories listed
-
Soft Policy Gradient Method for Maximum Entropy Deep Reinforcement Learning7 Sep 2019 0 repositories listed
-
Reinforcement Learning for Joint Optimization of Multiple Rewards6 Sep 2019 0 repositories listed
-
Adaptive Trust Region Policy Optimization: Global Convergence and Faster Rates for Regularized MDPs6 Sep 2019 0 repositories listed
-
Blackbox Attacks on Reinforcement Learning Agents Using Approximated Temporal Information6 Sep 2019 0 repositories listed
-
Building Task-Oriented Visual Dialog Systems Through Alternative Optimization Between Dialog Policy and Language Generation6 Sep 2019 0 repositories listed
-
Encoders and Decoders for Quantum Expander Codes Using Machine Learning6 Sep 2019 0 repositories listed
-
From Few to More: Large-scale Dynamic Multiagent Curriculum Learning6 Sep 2019 0 repositories listed
-
Gradient Q(σ, λ): A Unified Algorithm with Function Approximation for Reinforcement Learning6 Sep 2019 0 repositories listed
-
√(n)-Regret for Learning in Markov Decision Processes with Function Approximation and Low Bellman Rank5 Sep 2019 0 repositories listed
-
ACES -- Automatic Configuration of Energy Harvesting Sensors with Reinforcement Learning4 Sep 2019 0 repositories listed
-
An Entity-Driven Framework for Abstractive Summarization4 Sep 2019 0 repositories listed
-
Augmented Memory Networks for Streaming-Based Active One-Shot Learning4 Sep 2019 0 repositories listed
-
Inductive-bias-driven Reinforcement Learning For Efficient Schedules in Heterogeneous Clusters4 Sep 2019 0 repositories listed
-
Learning sparse representations in reinforcement learning4 Sep 2019 0 repositories listed
-
LeDeepChef: Deep Reinforcement Learning Agent for Families of Text-Based Games4 Sep 2019 0 repositories listed
-
Q-DATA: Enhanced Traffic Flow Monitoring in Software-Defined Networks applying Q-learning4 Sep 2019 0 repositories listed
-
Quasi-Newton Optimization Methods For Deep Learning Applications4 Sep 2019 0 repositories listed
-
A Reinforcement Learning-Based Framework for Solving Physical Design Routing Problem in the Absence of Large Test Sets3 Sep 2019 0 repositories listed
-
A Smart Sliding Chinese Pinyin Input Method Editor on Touchscreen3 Sep 2019 0 repositories listed
-
Generalization in Transfer Learning3 Sep 2019 0 repositories listed
-
Classification Betters Regression in Query-based Multi-document Summarisation Techniques for Question Answering: Macquarie University at BioASQ7b2 Sep 2019 0 repositories listed
-
Evolutionary reinforcement learning of dynamical large deviations2 Sep 2019 0 repositories listed
-
Logic and the 2-Simplicial Transformer2 Sep 2019 0 repositories listed
-
Reinforcement Learning-based Automatic Diagnosis of Acute Appendicitis in Abdominal CT2 Sep 2019 0 repositories listed
-
Reinforcing Medical Image Classifier to Improve Generalization on Small Datasets2 Sep 2019 0 repositories listed