Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 134
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 134 of 152: papers 13,301 to 13,400 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Risk-Sensitive Compact Decision Trees for Autonomous Execution in Presence of Simulated Market Response5 Jun 2019 0 repositories listed
-
Autonomous Reinforcement Learning of Multiple Interrelated Tasks4 Jun 2019 0 repositories listed
-
Off-Policy Evaluation via Off-Policy Classification4 Jun 2019 0 repositories listed
-
On-board Deep Q-Network for UAV-assisted Online Power Transfer and Data Collection4 Jun 2019 0 repositories listed
-
Options as responses: Grounding behavioural hierarchies in multi-agent RL4 Jun 2019 0 repositories listed
-
Posterior Variance Analysis of Gaussian Processes with Application to Average Learning Curves4 Jun 2019 0 repositories listed
-
Simultaneous Translation with Flexible Policy via Restricted Imitation Learning4 Jun 2019 0 repositories listed
-
Deep Reinforcement Learning Architecture for Continuous Power Allocation in High Throughput Satellites3 Jun 2019 0 repositories listed
-
Decentralized Deep Reinforcement Learning for Delay-Power Tradeoff in Vehicular Communications3 Jun 2019 0 repositories listed
-
Load Balancing for Ultra-Dense Networks: A Deep Reinforcement Learning Based Approach3 Jun 2019 0 repositories listed
-
Adversarial Exploitation of Policy Imitation3 Jun 2019 0 repositories listed
-
Proximal Reliability Optimization for Reinforcement Learning3 Jun 2019 0 repositories listed
-
Reconstruct and Represent Video Contents for Captioning via Reinforcement Learning3 Jun 2019 0 repositories listed
-
RL-Based Method for Benchmarking the Adversarial Resilience and Robustness of Deep Reinforcement Learning Policies3 Jun 2019 0 repositories listed
-
Sequential Triggers for Watermarking of Deep Reinforcement Learning Policies3 Jun 2019 0 repositories listed
-
Automated Video Game Testing Using Synthetic and Human-Like Agents2 Jun 2019 0 repositories listed
-
The Principle of Unchanged Optimality in Reinforcement Learning Generalization2 Jun 2019 0 repositories listed
-
Learner-aware Teaching: Inverse Reinforcement Learning with Preferences and Constraints2 Jun 2019 0 repositories listed
-
An Empirical Study on Hyperparameters and their Interdependence for RL Generalization2 Jun 2019 0 repositories listed
-
Decision-Making in Reinforcement Learning1 Jun 2019 0 repositories listed
-
Enhanced Bayesian Compression via Deep Reinforcement Learning1 Jun 2019 0 repositories listed
-
Exploiting Noisy Data in Distant Supervision Relation Classification1 Jun 2019 0 repositories listed
-
Language-Driven Temporal Activity Localization: A Semantic Matching Reinforcement Learning Model1 Jun 2019 0 repositories listed
-
Attentional Policies for Cross-Context Multi-Agent Reinforcement Learning31 May 2019 0 repositories listed
-
Reinforcement Learning Experience Reuse with Policy Residual Representation31 May 2019 0 repositories listed
-
31 May 2019 0 repositories listed
-
Combating the Compounding-Error Problem with a Multi-step Model30 May 2019 0 repositories listed
-
Defining Admissible Rewards for High Confidence Policy Evaluation30 May 2019 0 repositories listed
-
Don't Forget Your Teacher: A Corrective Reinforcement Learning Framework30 May 2019 0 repositories listed
-
Effective Medical Test Suggestions Using Deep Reinforcement Learning30 May 2019 0 repositories listed
-
Finite-time Analysis of Approximate Policy Iteration for the Linear Quadratic Regulator30 May 2019 0 repositories listed
-
On Value Functions and the Agent-Environment Boundary30 May 2019 0 repositories listed
-
Reinforcement Learning for Mean Field Game30 May 2019 0 repositories listed
-
Advantage Amplification in Slowly Evolving Latent-State Environments29 May 2019 0 repositories listed
-
An Improved Convergence Analysis of Stochastic Variance-Reduced Policy Gradient29 May 2019 0 repositories listed
-
Linear interpolation gives better gradients than Gaussian smoothing in derivative-free optimization29 May 2019 0 repositories listed
-
On the Generalization Gap in Reparameterizable Reinforcement Learning29 May 2019 0 repositories listed
-
Reinforcement Learning with Policy Mixture Model for Temporal Point Processes Clustering29 May 2019 0 repositories listed
-
Switching Linear Dynamics for Variational Bayes Filtering29 May 2019 0 repositories listed
-
CopyCAT: Taking Control of Neural Policies with Constant Attacks29 May 2019 0 repositories listed
-
Variance Reduction for Evolution Strategies via Structured Control Variates29 May 2019 0 repositories listed
-
A General Markov Decision Process Framework for Directly Learning Optimal Control Policies28 May 2019 0 repositories listed
-
Beyond Exponentially Discounted Sum: Automatic Learning of Return Function28 May 2019 0 repositories listed
-
Conditions on Features for Temporal Difference-Like Methods to Converge28 May 2019 0 repositories listed
-
Generation of Policy-Level Explanations for Reinforcement Learning28 May 2019 0 repositories listed
-
Interactive Teaching Algorithms for Inverse Reinforcement Learning28 May 2019 0 repositories listed
-
Hypothesis-Driven Skill Discovery for Hierarchical Deep Reinforcement Learning27 May 2019 0 repositories listed
-
AgentGraph: Towards Universal Dialogue Management with Structured Deep Reinforcement Learning27 May 2019 0 repositories listed
-
Disentangling Dynamics and Returns: Value Function Decomposition with Future Prediction27 May 2019 0 repositories listed
-
Near-optimal Optimistic Reinforcement Learning using Empirical Bernstein Inequalities27 May 2019 0 repositories listed
-
Policy Search by Target Distribution Learning for Continuous Control27 May 2019 0 repositories listed
-
26 May 2019 0 repositories listed
-
Variational Bayes: A report on approaches and applications26 May 2019 0 repositories listed
-
Prioritized Sequence Experience Replay25 May 2019 0 repositories listed
-
Transferable Cost-Aware Security Policy Implementation for Malware Detection Using Deep Reinforcement Learning25 May 2019 0 repositories listed
-
Composing Task-Agnostic Policies with Deep Reinforcement Learning25 May 2019 0 repositories listed
-
25 May 2019 0 repositories listed
-
MQLV: Optimal Policy of Money Management in Retail Banking with Q-Learning24 May 2019 0 repositories listed
-
RL4health: Crowdsourcing Reinforcement Learning for Knee Replacement Pathway Optimization24 May 2019 0 repositories listed
-
Automatic Machine Learning by Pipeline Synthesis using Model-Based Reinforcement Learning and a Grammar24 May 2019 0 repositories listed
-
InfoRL: Interpretable Reinforcement Learning using Information Maximization24 May 2019 0 repositories listed
-
Reinforcement Learning in Feature Space: Matrix Bandit, Kernels, and Regret Bound24 May 2019 0 repositories listed
-
A Micro-Objective Perspective of Reinforcement Learning24 May 2019 0 repositories listed
-
Scene Induced Multi-Modal Trajectory Forecasting via Planning23 May 2019 0 repositories listed
-
Unknown mixing times in apprenticeship and reinforcement learning23 May 2019 0 repositories listed
-
Deep Q-Learning with Q-Matrix Transfer Learning for Novel Fire Evacuation Environment23 May 2019 0 repositories listed
-
From semantics to execution: Integrating action planning with reinforcement learning for robotic causal problem-solving23 May 2019 0 repositories listed
-
PAC Guarantees for Cooperative Multi-Agent Reinforcement Learning with Restricted Communication23 May 2019 0 repositories listed
-
Population-based Global Optimisation Methods for Learning Long-term Dependencies with RNNs23 May 2019 0 repositories listed
-
Recurrent Value Functions23 May 2019 0 repositories listed
-
Deep Reinforcement Learning for Detecting Malicious Websites22 May 2019 0 repositories listed
-
Hierarchical Reinforcement Learning for Quadruped Locomotion22 May 2019 0 repositories listed
-
Stochastic Inverse Reinforcement Learning21 May 2019 0 repositories listed
-
A Bayesian Approach to Robust Reinforcement Learning20 May 2019 0 repositories listed
-
Issues concerning realizability of Blackwell optimal policies in reinforcement learning20 May 2019 0 repositories listed
-
Perceptual Values from Observation20 May 2019 0 repositories listed
-
Reinforcement Learning without Ground-Truth State20 May 2019 0 repositories listed
-
Stochastic Variance Reduction for Deep Q-learning20 May 2019 0 repositories listed
-
Reinforcement Learning for Learning of Dynamical Systems in Uncertain Environment: a Tutorial19 May 2019 0 repositories listed
-
Evolving Rewards to Automate Reinforcement Learning18 May 2019 0 repositories listed
-
Deep Reinforcement Learning-Based Channel Allocation for Wireless LANs with Graph Convolutional Networks17 May 2019 0 repositories listed
-
Enforcing constraints for time series prediction in supervised, unsupervised and reinforcement learning17 May 2019 0 repositories listed
-
In Support of Over-Parametrization in Deep Reinforcement Learning: an Empirical Study17 May 2019 0 repositories listed
-
MaMiC: Macro and Micro Curriculum for Robotic Reinforcement Learning17 May 2019 0 repositories listed
-
Stochastically Dominant Distributional Reinforcement Learning17 May 2019 0 repositories listed
-
Stratospheric Aerosol Injection as a Deep Reinforcement Learning Problem17 May 2019 0 repositories listed
-
TBQ(σ): Improving Efficiency of Trace Utilization for Off-Policy Reinforcement Learning17 May 2019 0 repositories listed
-
Deep Knowledge Based Agent: Learning to do tasks by self-thinking about imaginary worlds16 May 2019 0 repositories listed
-
Goal-conditioned Imitation Learning16 May 2019 0 repositories listed
-
Knowledge-Based Sequential Decision-Making Under Uncertainty16 May 2019 0 repositories listed
-
Learning Exploration Policies for Model-Agnostic Meta-Reinforcement Learning16 May 2019 0 repositories listed
-
Meta-Reinforcement Learning for Adaptive Autonomous Driving16 May 2019 0 repositories listed
-
Sub-policy Adaptation for Hierarchical Reinforcement Learning16 May 2019 0 repositories listed
-
A Learning based Branch and Bound for Maximum Common Subgraph Problems15 May 2019 0 repositories listed
-
Addressing the Loss-Metric Mismatch with Adaptive Loss Alignment15 May 2019 0 repositories listed
-
Autonomous Penetration Testing using Reinforcement Learning15 May 2019 0 repositories listed
-
Deep reinforcement learning for scheduling in large-scale networked control systems15 May 2019 0 repositories listed
-
Deep Reinforcement Learning for Scheduling in Cellular Networks15 May 2019 0 repositories listed
-
Reinforcement Learning for Robotics and Control with Active Uncertainty Reduction15 May 2019 0 repositories listed
-
Combining Parametric and Nonparametric Models for Off-Policy Evaluation14 May 2019 0 repositories listed