Browse State-of-the-Art › Reinforcement Learning › Papers, page 109
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 109 of 132: papers 10,801 to 10,900 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Multi-modal Active Learning From Human Data: A Deep Reinforcement Learning Approach7 Jun 2019 0 repositories listed
-
Non-Stationary Reinforcement Learning: The Blessing of (More) Optimism7 Jun 2019 0 repositories listed
-
Watch, Try, Learn: Meta-Learning from Demonstrations and Reward7 Jun 2019 0 repositories listed
-
Worst-Case Regret Bounds for Exploration via Randomized Value Functions7 Jun 2019 0 repositories listed
-
An Extensible Interactive Interface for Agent Design6 Jun 2019 0 repositories listed
-
Clustered Reinforcement Learning6 Jun 2019 0 repositories listed
-
Combining Reinforcement Learning and Configuration Checking for Maximum k-plex Problem6 Jun 2019 0 repositories listed
-
Deep Reinforcement Learning for Multi-objective Optimization6 Jun 2019 0 repositories listed
-
DeepMDP: Learning Continuous Latent Space Models for Representation Learning6 Jun 2019 0 repositories listed
-
Playing the lottery with rewards and multiple languages: lottery tickets in RL and NLP6 Jun 2019 0 repositories listed
-
Continuous Control for Automated Lane Change Behavior Based on Deep Deterministic Policy Gradient Algorithm5 Jun 2019 0 repositories listed
-
Deep Q-Learning for Directed Acyclic Graph Generation5 Jun 2019 0 repositories listed
-
Escaping the State of Nature: A Hobbesian Approach to Cooperation in Multi-agent Reinforcement Learning5 Jun 2019 0 repositories listed
-
Exploration with Unreliable Intrinsic Reward in Multi-Agent Reinforcement Learning5 Jun 2019 0 repositories listed
-
Global Optimality Guarantees For Policy Gradient Methods5 Jun 2019 0 repositories listed
-
Measurement-based Online Available Bandwidth Estimation employing Reinforcement Learning5 Jun 2019 0 repositories listed
-
Probabilistic hypergraph grammars for efficient molecular optimization5 Jun 2019 0 repositories listed
-
Risk-Sensitive Compact Decision Trees for Autonomous Execution in Presence of Simulated Market Response5 Jun 2019 0 repositories listed
-
Autonomous Reinforcement Learning of Multiple Interrelated Tasks4 Jun 2019 0 repositories listed
-
Learning dynamic polynomial proofs4 Jun 2019 0 repositories listed
-
Off-Policy Evaluation via Off-Policy Classification4 Jun 2019 0 repositories listed
-
On-board Deep Q-Network for UAV-assisted Online Power Transfer and Data Collection4 Jun 2019 0 repositories listed
-
Options as responses: Grounding behavioural hierarchies in multi-agent RL4 Jun 2019 0 repositories listed
-
Posterior Variance Analysis of Gaussian Processes with Application to Average Learning Curves4 Jun 2019 0 repositories listed
-
Simultaneous Translation with Flexible Policy via Restricted Imitation Learning4 Jun 2019 0 repositories listed
-
Deep Reinforcement Learning Architecture for Continuous Power Allocation in High Throughput Satellites3 Jun 2019 0 repositories listed
-
Decentralized Deep Reinforcement Learning for Delay-Power Tradeoff in Vehicular Communications3 Jun 2019 0 repositories listed
-
Load Balancing for Ultra-Dense Networks: A Deep Reinforcement Learning Based Approach3 Jun 2019 0 repositories listed
-
Adversarial Exploitation of Policy Imitation3 Jun 2019 0 repositories listed
-
Proximal Reliability Optimization for Reinforcement Learning3 Jun 2019 0 repositories listed
-
Reconstruct and Represent Video Contents for Captioning via Reinforcement Learning3 Jun 2019 0 repositories listed
-
RL-Based Method for Benchmarking the Adversarial Resilience and Robustness of Deep Reinforcement Learning Policies3 Jun 2019 0 repositories listed
-
Sequential Triggers for Watermarking of Deep Reinforcement Learning Policies3 Jun 2019 0 repositories listed
-
Automated Video Game Testing Using Synthetic and Human-Like Agents2 Jun 2019 0 repositories listed
-
The Principle of Unchanged Optimality in Reinforcement Learning Generalization2 Jun 2019 0 repositories listed
-
Learner-aware Teaching: Inverse Reinforcement Learning with Preferences and Constraints2 Jun 2019 0 repositories listed
-
An Empirical Study on Hyperparameters and their Interdependence for RL Generalization2 Jun 2019 0 repositories listed
-
Decision-Making in Reinforcement Learning1 Jun 2019 0 repositories listed
-
Context-Reinforced Semantic Segmentation1 Jun 2019 0 repositories listed
-
Early Rumour Detection1 Jun 2019 0 repositories listed
-
Enhanced Bayesian Compression via Deep Reinforcement Learning1 Jun 2019 0 repositories listed
-
Exploiting Noisy Data in Distant Supervision Relation Classification1 Jun 2019 0 repositories listed
-
Language-Driven Temporal Activity Localization: A Semantic Matching Reinforcement Learning Model1 Jun 2019 0 repositories listed
-
Learning Channel-Wise Interactions for Binary Convolutional Neural Networks1 Jun 2019 0 repositories listed
-
Learning Interpretable Negation Rules via Weak Supervision at Document Level: A Reinforcement Learning Approach1 Jun 2019 0 repositories listed
-
Learning Personalized Modular Network Guided by Structured Knowledge1 Jun 2019 0 repositories listed
-
Spot and Learn: A Maximum-Entropy Patch Sampler for Few-Shot Image Classification1 Jun 2019 0 repositories listed
-
Task Agnostic Meta-Learning for Few-Shot Learning1 Jun 2019 0 repositories listed
-
Diversity-Inducing Policy Gradient: Using Maximum Mean Discrepancy to Find a Set of Diverse Policies31 May 2019 0 repositories listed
-
Policy Optimization Provably Converges to Nash Equilibria in Zero-Sum Linear Quadratic Games31 May 2019 0 repositories listed
-
Attentional Policies for Cross-Context Multi-Agent Reinforcement Learning31 May 2019 0 repositories listed
-
Reinforcement Learning Experience Reuse with Policy Residual Representation31 May 2019 0 repositories listed
-
31 May 2019 0 repositories listed
-
Combating the Compounding-Error Problem with a Multi-step Model30 May 2019 0 repositories listed
-
Defining Admissible Rewards for High Confidence Policy Evaluation30 May 2019 0 repositories listed
-
Don't Forget Your Teacher: A Corrective Reinforcement Learning Framework30 May 2019 0 repositories listed
-
Effective Medical Test Suggestions Using Deep Reinforcement Learning30 May 2019 0 repositories listed
-
Finite-time Analysis of Approximate Policy Iteration for the Linear Quadratic Regulator30 May 2019 0 repositories listed
-
On Value Functions and the Agent-Environment Boundary30 May 2019 0 repositories listed
-
Reinforcement Learning for Mean Field Game30 May 2019 0 repositories listed
-
Unsupervised Model Selection for Variational Disentangled Representation Learning29 May 2019 0 repositories listed
-
Advantage Amplification in Slowly Evolving Latent-State Environments29 May 2019 0 repositories listed
-
An Improved Convergence Analysis of Stochastic Variance-Reduced Policy Gradient29 May 2019 0 repositories listed
-
Learning Navigation Subroutines from Egocentric Videos29 May 2019 0 repositories listed
-
Linear interpolation gives better gradients than Gaussian smoothing in derivative-free optimization29 May 2019 0 repositories listed
-
On the Generalization Gap in Reparameterizable Reinforcement Learning29 May 2019 0 repositories listed
-
Reinforcement Learning with Policy Mixture Model for Temporal Point Processes Clustering29 May 2019 0 repositories listed
-
Learning NP-Hard Multi-Agent Assignment Planning using GNN: Inference on a Random Graph and Provable Auction-Fitted Q-learning29 May 2019 0 repositories listed
-
Switching Linear Dynamics for Variational Bayes Filtering29 May 2019 0 repositories listed
-
CopyCAT: Taking Control of Neural Policies with Constant Attacks29 May 2019 0 repositories listed
-
Variance Reduction for Evolution Strategies via Structured Control Variates29 May 2019 0 repositories listed
-
A General Markov Decision Process Framework for Directly Learning Optimal Control Policies28 May 2019 0 repositories listed
-
Beyond Exponentially Discounted Sum: Automatic Learning of Return Function28 May 2019 0 repositories listed
-
Conditions on Features for Temporal Difference-Like Methods to Converge28 May 2019 0 repositories listed
-
Generation of Policy-Level Explanations for Reinforcement Learning28 May 2019 0 repositories listed
-
Interactive Teaching Algorithms for Inverse Reinforcement Learning28 May 2019 0 repositories listed
-
Learning Efficient and Effective Exploration Policies with Counterfactual Meta Policy28 May 2019 0 repositories listed
-
Sample Complexity of Sample Average Approximation for Conditional Stochastic Optimization28 May 2019 0 repositories listed
-
Hypothesis-Driven Skill Discovery for Hierarchical Deep Reinforcement Learning27 May 2019 0 repositories listed
-
AgentGraph: Towards Universal Dialogue Management with Structured Deep Reinforcement Learning27 May 2019 0 repositories listed
-
Disentangling Dynamics and Returns: Value Function Decomposition with Future Prediction27 May 2019 0 repositories listed
-
Learning latent state representation for speeding up exploration27 May 2019 0 repositories listed
-
Learning Policies from Human Data for Skat27 May 2019 0 repositories listed
-
Near-optimal Optimistic Reinforcement Learning using Empirical Bernstein Inequalities27 May 2019 0 repositories listed
-
Policy Search by Target Distribution Learning for Continuous Control27 May 2019 0 repositories listed
-
26 May 2019 0 repositories listed
-
Variational Bayes: A report on approaches and applications26 May 2019 0 repositories listed
-
Prioritized Sequence Experience Replay25 May 2019 0 repositories listed
-
Transferable Cost-Aware Security Policy Implementation for Malware Detection Using Deep Reinforcement Learning25 May 2019 0 repositories listed
-
Composing Task-Agnostic Policies with Deep Reinforcement Learning25 May 2019 0 repositories listed
-
25 May 2019 0 repositories listed
-
MQLV: Optimal Policy of Money Management in Retail Banking with Q-Learning24 May 2019 0 repositories listed
-
RL4health: Crowdsourcing Reinforcement Learning for Knee Replacement Pathway Optimization24 May 2019 0 repositories listed
-
Automatic Machine Learning by Pipeline Synthesis using Model-Based Reinforcement Learning and a Grammar24 May 2019 0 repositories listed
-
InfoRL: Interpretable Reinforcement Learning using Information Maximization24 May 2019 0 repositories listed
-
Reinforcement Learning in Feature Space: Matrix Bandit, Kernels, and Regret Bound24 May 2019 0 repositories listed
-
A Micro-Objective Perspective of Reinforcement Learning24 May 2019 0 repositories listed
-
Scene Induced Multi-Modal Trajectory Forecasting via Planning23 May 2019 0 repositories listed
-
Unknown mixing times in apprenticeship and reinforcement learning23 May 2019 0 repositories listed
-
Deep Q-Learning with Q-Matrix Transfer Learning for Novel Fire Evacuation Environment23 May 2019 0 repositories listed