Browse State-of-the-Art › reinforcement-learning › Papers, page 119
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 119 of 135: papers 11,801 to 11,900 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Toward Simulating Environments in Reinforcement Learning Based Recommendations27 Jun 2019 0 repositories listed
-
A Tractable Algorithm For Finite-Horizon Continuous Reinforcement Learning26 Jun 2019 0 repositories listed
-
Approximate Dynamic Programming For Linear Systems with State and Input Constraints26 Jun 2019 0 repositories listed
-
Compositional Transfer in Hierarchical Reinforcement Learning26 Jun 2019 0 repositories listed
-
Neural Proximal/Trust Region Policy Optimization Attains Globally Optimal Policy25 Jun 2019 0 repositories listed
-
On Multi-Agent Learning in Team Sports Games25 Jun 2019 0 repositories listed
-
Optimistic Proximal Policy Optimization25 Jun 2019 0 repositories listed
-
Policy Optimization with Stochastic Mirror Descent25 Jun 2019 0 repositories listed
-
Reinforcement Learning with Competitive Ensembles of Information-Constrained Primitives25 Jun 2019 0 repositories listed
-
A Theoretical Connection Between Statistical Physics and Reinforcement Learning24 Jun 2019 0 repositories listed
-
Deceptive Reinforcement Learning Under Adversarial Manipulations on Cost Signals24 Jun 2019 0 repositories listed
-
Inverse reinforcement learning conditioned on brain scan24 Jun 2019 0 repositories listed
-
Neural networks with motivation23 Jun 2019 0 repositories listed
-
Reinforcement Learning-Based Trajectory Design for the Aerial Base Stations23 Jun 2019 0 repositories listed
-
A Study of State Aliasing in Structured Prediction with RNNs21 Jun 2019 0 repositories listed
-
Continual Reinforcement Learning with Diversity Exploration and Adversarial Self-Correction21 Jun 2019 0 repositories listed
-
Disentangled Skill Embeddings for Reinforcement Learning21 Jun 2019 0 repositories listed
-
Leveraging Reinforcement Learning Techniques for Effective Policy Adoption and Validation21 Jun 2019 0 repositories listed
-
Cache-Aided NOMA Mobile Edge Computing: A Reinforcement Learning Approach20 Jun 2019 0 repositories listed
-
Cooperative Lane Changing via Deep Reinforcement Learning20 Jun 2019 0 repositories listed
-
Finding Needles in a Moving Haystack: Prioritizing Alerts with Adversarial Reinforcement Learning20 Jun 2019 0 repositories listed
-
Adapting Behaviour via Intrinsic Reward: A Survey and Empirical Study19 Jun 2019 0 repositories listed
-
Experience Replay Optimization19 Jun 2019 0 repositories listed
-
Multi-user Resource Control with Deep Reinforcement Learning in IoT Edge Computing19 Jun 2019 0 repositories listed
-
Reward Prediction Error as an Exploration Objective in Deep RL19 Jun 2019 0 repositories listed
-
Wasserstein Adversarial Imitation Learning19 Jun 2019 0 repositories listed
-
Directed Exploration for Reinforcement Learning18 Jun 2019 0 repositories listed
-
Evolutionary Reinforcement Learning for Sample-Efficient Multiagent Coordination18 Jun 2019 0 repositories listed
-
Gap-Increasing Policy Evaluation for Efficient and Noise-Tolerant Reinforcement Learning18 Jun 2019 0 repositories listed
-
RIDM: Reinforced Inverse Dynamics Modeling for Learning from a Single Observed Demonstration18 Jun 2019 0 repositories listed
-
Robust Reinforcement Learning for Continuous Control with Model Misspecification18 Jun 2019 0 repositories listed
-
A gray-box approach for curriculum learning17 Jun 2019 0 repositories listed
-
Iterative Model-Based Reinforcement Learning Using Simulations in the Differentiable Neural Computer17 Jun 2019 0 repositories listed
-
LPaintB: Learning to Paint from Self-Supervision17 Jun 2019 0 repositories listed
-
Universal Successor Features Based Deep Reinforcement Learning for Navigation17 Jun 2019 0 repositories listed
-
Reinforcement Learning Driven Heuristic Optimization16 Jun 2019 0 repositories listed
-
Reinforcement Learning with Non-uniform State Representations for Adaptive Search15 Jun 2019 0 repositories listed
-
Epistemic Risk-Sensitive Reinforcement Learning14 Jun 2019 0 repositories listed
-
Provably Efficient Q-learning with Function Approximation via Distribution Shift Error Checking Oracle14 Jun 2019 0 repositories listed
-
Self-Tuning Sectorization: Deep Reinforcement Learning Meets Broadcast Beam Optimization14 Jun 2019 0 repositories listed
-
Deep Reinforcement Learning for Cyber Security13 Jun 2019 0 repositories listed
-
Conditioning of Reinforcement Learning Agents and its Policy Regularization Application13 Jun 2019 0 repositories listed
-
Modeling and Interpreting Real-world Human Risk Decision Making with Inverse Reinforcement Learning13 Jun 2019 0 repositories listed
-
Sub-policy Adaptation for Hierarchical Reinforcement Learning13 Jun 2019 0 repositories listed
-
Deep Reinforcement Learning for Unmanned Aerial Vehicle-Assisted Vehicular Networks12 Jun 2019 0 repositories listed
-
Regret Minimization for Reinforcement Learning by Evaluating the Optimal Bias Function12 Jun 2019 0 repositories listed
-
Adaptive Optimal Control for Reference Tracking Independent of Exo-System Dynamics12 Jun 2019 0 repositories listed
-
Sub-Goal Trees -- a Framework for Goal-Directed Trajectory Prediction and Optimization12 Jun 2019 0 repositories listed
-
A Hybrid Approach Between Adversarial Generative Networks and Actor-Critic Policy Gradient for Low Rate High-Resolution Image Compression11 Jun 2019 0 repositories listed
-
Continual Reinforcement Learning deployed in Real-life using Policy Distillation and Sim2Real Transfer11 Jun 2019 0 repositories listed
-
Dealing with Non-Stationarity in Multi-Agent Deep Reinforcement Learning11 Jun 2019 0 repositories listed
-
Reinforcement Learning for Integer Programming: Learning to Cut11 Jun 2019 0 repositories listed
-
Reinforcement Learning of Minimalist Numeral Grammars11 Jun 2019 0 repositories listed
-
Towards Inverse Reinforcement Learning for Limit Order Book Dynamics11 Jun 2019 0 repositories listed
-
A Survey of Reinforcement Learning Informed by Natural Language10 Jun 2019 0 repositories listed
-
Model-Based Reinforcement Learning with a Generative Model is Minimax Optimal10 Jun 2019 0 repositories listed
-
Neural Heterogeneous Scheduler9 Jun 2019 0 repositories listed
-
Transfer Learning by Modeling a Distribution over Policies9 Jun 2019 0 repositories listed
-
Towards Optimal Off-Policy Evaluation for Reinforcement Learning with Marginalized Importance Sampling8 Jun 2019 0 repositories listed
-
Multi-modal Active Learning From Human Data: A Deep Reinforcement Learning Approach7 Jun 2019 0 repositories listed
-
Non-Stationary Reinforcement Learning: The Blessing of (More) Optimism7 Jun 2019 0 repositories listed
-
Worst-Case Regret Bounds for Exploration via Randomized Value Functions7 Jun 2019 0 repositories listed
-
Clustered Reinforcement Learning6 Jun 2019 0 repositories listed
-
Combining Reinforcement Learning and Configuration Checking for Maximum k-plex Problem6 Jun 2019 0 repositories listed
-
Deep Reinforcement Learning for Multi-objective Optimization6 Jun 2019 0 repositories listed
-
Deep Q-Learning for Directed Acyclic Graph Generation5 Jun 2019 0 repositories listed
-
Exploration with Unreliable Intrinsic Reward in Multi-Agent Reinforcement Learning5 Jun 2019 0 repositories listed
-
Measurement-based Online Available Bandwidth Estimation employing Reinforcement Learning5 Jun 2019 0 repositories listed
-
Probabilistic hypergraph grammars for efficient molecular optimization5 Jun 2019 0 repositories listed
-
Risk-Sensitive Compact Decision Trees for Autonomous Execution in Presence of Simulated Market Response5 Jun 2019 0 repositories listed
-
Autonomous Reinforcement Learning of Multiple Interrelated Tasks4 Jun 2019 0 repositories listed
-
On-board Deep Q-Network for UAV-assisted Online Power Transfer and Data Collection4 Jun 2019 0 repositories listed
-
Posterior Variance Analysis of Gaussian Processes with Application to Average Learning Curves4 Jun 2019 0 repositories listed
-
Simultaneous Translation with Flexible Policy via Restricted Imitation Learning4 Jun 2019 0 repositories listed
-
Deep Reinforcement Learning Architecture for Continuous Power Allocation in High Throughput Satellites3 Jun 2019 0 repositories listed
-
Decentralized Deep Reinforcement Learning for Delay-Power Tradeoff in Vehicular Communications3 Jun 2019 0 repositories listed
-
Load Balancing for Ultra-Dense Networks: A Deep Reinforcement Learning Based Approach3 Jun 2019 0 repositories listed
-
Adversarial Exploitation of Policy Imitation3 Jun 2019 0 repositories listed
-
Proximal Reliability Optimization for Reinforcement Learning3 Jun 2019 0 repositories listed
-
Reconstruct and Represent Video Contents for Captioning via Reinforcement Learning3 Jun 2019 0 repositories listed
-
RL-Based Method for Benchmarking the Adversarial Resilience and Robustness of Deep Reinforcement Learning Policies3 Jun 2019 0 repositories listed
-
Sequential Triggers for Watermarking of Deep Reinforcement Learning Policies3 Jun 2019 0 repositories listed
-
Automated Video Game Testing Using Synthetic and Human-Like Agents2 Jun 2019 0 repositories listed
-
The Principle of Unchanged Optimality in Reinforcement Learning Generalization2 Jun 2019 0 repositories listed
-
Learner-aware Teaching: Inverse Reinforcement Learning with Preferences and Constraints2 Jun 2019 0 repositories listed
-
An Empirical Study on Hyperparameters and their Interdependence for RL Generalization2 Jun 2019 0 repositories listed
-
Decision-Making in Reinforcement Learning1 Jun 2019 0 repositories listed
-
Enhanced Bayesian Compression via Deep Reinforcement Learning1 Jun 2019 0 repositories listed
-
Exploiting Noisy Data in Distant Supervision Relation Classification1 Jun 2019 0 repositories listed
-
Language-Driven Temporal Activity Localization: A Semantic Matching Reinforcement Learning Model1 Jun 2019 0 repositories listed
-
Attentional Policies for Cross-Context Multi-Agent Reinforcement Learning31 May 2019 0 repositories listed
-
Reinforcement Learning Experience Reuse with Policy Residual Representation31 May 2019 0 repositories listed
-
31 May 2019 0 repositories listed
-
Combating the Compounding-Error Problem with a Multi-step Model30 May 2019 0 repositories listed
-
Don't Forget Your Teacher: A Corrective Reinforcement Learning Framework30 May 2019 0 repositories listed
-
Effective Medical Test Suggestions Using Deep Reinforcement Learning30 May 2019 0 repositories listed
-
On Value Functions and the Agent-Environment Boundary30 May 2019 0 repositories listed
-
Reinforcement Learning for Mean Field Game30 May 2019 0 repositories listed
-
Advantage Amplification in Slowly Evolving Latent-State Environments29 May 2019 0 repositories listed
-
An Improved Convergence Analysis of Stochastic Variance-Reduced Policy Gradient29 May 2019 0 repositories listed