Browse State-of-the-Art › reinforcement-learning › Papers, page 120
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 120 of 135: papers 11,901 to 12,000 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Linear interpolation gives better gradients than Gaussian smoothing in derivative-free optimization29 May 2019 0 repositories listed
-
On the Generalization Gap in Reparameterizable Reinforcement Learning29 May 2019 0 repositories listed
-
Reinforcement Learning with Policy Mixture Model for Temporal Point Processes Clustering29 May 2019 0 repositories listed
-
Switching Linear Dynamics for Variational Bayes Filtering29 May 2019 0 repositories listed
-
CopyCAT: Taking Control of Neural Policies with Constant Attacks29 May 2019 0 repositories listed
-
Beyond Exponentially Discounted Sum: Automatic Learning of Return Function28 May 2019 0 repositories listed
-
Conditions on Features for Temporal Difference-Like Methods to Converge28 May 2019 0 repositories listed
-
Generation of Policy-Level Explanations for Reinforcement Learning28 May 2019 0 repositories listed
-
Interactive Teaching Algorithms for Inverse Reinforcement Learning28 May 2019 0 repositories listed
-
Hypothesis-Driven Skill Discovery for Hierarchical Deep Reinforcement Learning27 May 2019 0 repositories listed
-
AgentGraph: Towards Universal Dialogue Management with Structured Deep Reinforcement Learning27 May 2019 0 repositories listed
-
Near-optimal Optimistic Reinforcement Learning using Empirical Bernstein Inequalities27 May 2019 0 repositories listed
-
Variational Bayes: A report on approaches and applications26 May 2019 0 repositories listed
-
Prioritized Sequence Experience Replay25 May 2019 0 repositories listed
-
Transferable Cost-Aware Security Policy Implementation for Malware Detection Using Deep Reinforcement Learning25 May 2019 0 repositories listed
-
Composing Task-Agnostic Policies with Deep Reinforcement Learning25 May 2019 0 repositories listed
-
25 May 2019 0 repositories listed
-
MQLV: Optimal Policy of Money Management in Retail Banking with Q-Learning24 May 2019 0 repositories listed
-
RL4health: Crowdsourcing Reinforcement Learning for Knee Replacement Pathway Optimization24 May 2019 0 repositories listed
-
Automatic Machine Learning by Pipeline Synthesis using Model-Based Reinforcement Learning and a Grammar24 May 2019 0 repositories listed
-
InfoRL: Interpretable Reinforcement Learning using Information Maximization24 May 2019 0 repositories listed
-
Reinforcement Learning in Feature Space: Matrix Bandit, Kernels, and Regret Bound24 May 2019 0 repositories listed
-
A Micro-Objective Perspective of Reinforcement Learning24 May 2019 0 repositories listed
-
Scene Induced Multi-Modal Trajectory Forecasting via Planning23 May 2019 0 repositories listed
-
Unknown mixing times in apprenticeship and reinforcement learning23 May 2019 0 repositories listed
-
Deep Q-Learning with Q-Matrix Transfer Learning for Novel Fire Evacuation Environment23 May 2019 0 repositories listed
-
From semantics to execution: Integrating action planning with reinforcement learning for robotic causal problem-solving23 May 2019 0 repositories listed
-
PAC Guarantees for Cooperative Multi-Agent Reinforcement Learning with Restricted Communication23 May 2019 0 repositories listed
-
Population-based Global Optimisation Methods for Learning Long-term Dependencies with RNNs23 May 2019 0 repositories listed
-
Deep Reinforcement Learning for Detecting Malicious Websites22 May 2019 0 repositories listed
-
Hierarchical Reinforcement Learning for Quadruped Locomotion22 May 2019 0 repositories listed
-
Stochastic Inverse Reinforcement Learning21 May 2019 0 repositories listed
-
A Bayesian Approach to Robust Reinforcement Learning20 May 2019 0 repositories listed
-
Issues concerning realizability of Blackwell optimal policies in reinforcement learning20 May 2019 0 repositories listed
-
Perceptual Values from Observation20 May 2019 0 repositories listed
-
Reinforcement Learning without Ground-Truth State20 May 2019 0 repositories listed
-
Stochastic Variance Reduction for Deep Q-learning20 May 2019 0 repositories listed
-
Reinforcement Learning for Learning of Dynamical Systems in Uncertain Environment: a Tutorial19 May 2019 0 repositories listed
-
Evolving Rewards to Automate Reinforcement Learning18 May 2019 0 repositories listed
-
Deep Reinforcement Learning-Based Channel Allocation for Wireless LANs with Graph Convolutional Networks17 May 2019 0 repositories listed
-
Enforcing constraints for time series prediction in supervised, unsupervised and reinforcement learning17 May 2019 0 repositories listed
-
In Support of Over-Parametrization in Deep Reinforcement Learning: an Empirical Study17 May 2019 0 repositories listed
-
MaMiC: Macro and Micro Curriculum for Robotic Reinforcement Learning17 May 2019 0 repositories listed
-
Stochastically Dominant Distributional Reinforcement Learning17 May 2019 0 repositories listed
-
Stratospheric Aerosol Injection as a Deep Reinforcement Learning Problem17 May 2019 0 repositories listed
-
TBQ(σ): Improving Efficiency of Trace Utilization for Off-Policy Reinforcement Learning17 May 2019 0 repositories listed
-
Deep Knowledge Based Agent: Learning to do tasks by self-thinking about imaginary worlds16 May 2019 0 repositories listed
-
Knowledge-Based Sequential Decision-Making Under Uncertainty16 May 2019 0 repositories listed
-
Learning Exploration Policies for Model-Agnostic Meta-Reinforcement Learning16 May 2019 0 repositories listed
-
Meta-Reinforcement Learning for Adaptive Autonomous Driving16 May 2019 0 repositories listed
-
Sub-policy Adaptation for Hierarchical Reinforcement Learning16 May 2019 0 repositories listed
-
A Learning based Branch and Bound for Maximum Common Subgraph Problems15 May 2019 0 repositories listed
-
Autonomous Penetration Testing using Reinforcement Learning15 May 2019 0 repositories listed
-
Deep reinforcement learning for scheduling in large-scale networked control systems15 May 2019 0 repositories listed
-
Deep Reinforcement Learning for Scheduling in Cellular Networks15 May 2019 0 repositories listed
-
Reinforcement Learning for Robotics and Control with Active Uncertainty Reduction15 May 2019 0 repositories listed
-
Combining Parametric and Nonparametric Models for Off-Policy Evaluation14 May 2019 0 repositories listed
-
TauRieL: Targeting Traveling Salesman Problem with a deep reinforcement learning inspired architecture14 May 2019 0 repositories listed
-
Variational Regret Bounds for Reinforcement Learning14 May 2019 0 repositories listed
-
Deep Multi-Agent Reinforcement Learning Based Cooperative Edge Caching in Wireless Networks13 May 2019 0 repositories listed
-
Distributional Reinforcement Learning for Efficient Exploration13 May 2019 0 repositories listed
-
Learning and Exploiting Multiple Subgoals for Fast Exploration in Hierarchical Reinforcement Learning13 May 2019 0 repositories listed
-
Diagnosing Reinforcement Learning for Traffic Signal Control12 May 2019 0 repositories listed
-
Metareasoning in Modular Software Systems: On-the-Fly Configuration using Reinforcement Learning with Rich Contextual Representations12 May 2019 0 repositories listed
-
Optimizing Routerless Network-on-Chip Designs: An Innovative Learning-Based Framework11 May 2019 0 repositories listed
-
Attention-based Deep Reinforcement Learning for Multi-view Environments10 May 2019 0 repositories listed
-
Design of Artificial Intelligence Agents for Games using Deep Reinforcement Learning10 May 2019 0 repositories listed
-
Do Autonomous Agents Benefit from Hearing?10 May 2019 0 repositories listed
-
Domain Adversarial Reinforcement Learning for Partial Domain Adaptation10 May 2019 0 repositories listed
-
Emergent Escape-based Flocking Behavior using Multi-Agent Reinforcement Learning10 May 2019 0 repositories listed
-
GAN-powered Deep Distributional Reinforcement Learning for Resource Management in Network Slicing10 May 2019 0 repositories listed
-
Intelligent User Association for Symbiotic Radio Networks using Deep Reinforcement Learning10 May 2019 0 repositories listed
-
On the Detection of Mutual Influences and Their Consideration in Reinforcement Learning Processes10 May 2019 0 repositories listed
-
Reinforcement Learning in Non-Stationary Environments10 May 2019 0 repositories listed
-
Path Design for Cellular-Connected UAV with Reinforcement Learning9 May 2019 0 repositories listed
-
Toward Packet Routing with Fully-distributed Multi-agent Deep Reinforcement Learning9 May 2019 0 repositories listed
-
Pretrain Soft Q-Learning with Imperfect Demonstrations9 May 2019 0 repositories listed
-
A Reinforcement Learning Perspective on the Optimal Control of Mutation Probabilities for the (1+1) Evolutionary Algorithm: First Results on the OneMax Problem9 May 2019 0 repositories listed
-
Longitudinal Dynamic versus Kinematic Models for Car-Following Control Using Deep Reinforcement Learning7 May 2019 0 repositories listed
-
Accelerated Target Updates for Q-learning7 May 2019 0 repositories listed
-
Continual and Multi-task Reinforcement Learning With Shared Episodic Memory7 May 2019 0 repositories listed
-
Object Exchangeability in Reinforcement Learning: Extended Abstract7 May 2019 0 repositories listed
-
Reinforced Genetic Algorithm Learning for Optimizing Computation Graphs7 May 2019 0 repositories listed
-
A Survey of Adaptive Resonance Theory Neural Network Models for Engineering Applications4 May 2019 0 repositories listed
-
Face Hallucination by Attentive Sequence Optimization with Reinforcement Learning4 May 2019 0 repositories listed
-
Adaptive Intelligent Secondary Control of Microgrids Using a Biologically-Inspired Reinforcement Learning2 May 2019 0 repositories listed
-
Autonomous Air Traffic Controller: A Deep Multi-Agent Reinforcement Learning Approach2 May 2019 0 repositories listed
-
A Guider Network for Multi-Dual Learning1 May 2019 0 repositories listed
-
A new dog learns old tricks: RL finds classic optimization algorithms1 May 2019 0 repositories listed
-
ACTRCE: Augmenting Experience via Teacher’s Advice1 May 2019 0 repositories listed
-
Automata Guided Skill Composition1 May 2019 0 repositories listed
-
Deep reinforcement learning with relational inductive biases1 May 2019 0 repositories listed
-
Driving with Style: Inverse Reinforcement Learning in General-Purpose Planning for Automated Driving1 May 2019 0 repositories listed
-
Explicit Recall for Efficient Exploration1 May 2019 0 repositories listed
-
Few-Shot Intent Inference via Meta-Inverse Reinforcement Learning1 May 2019 0 repositories listed
-
Information-Theoretic Considerations in Batch Reinforcement Learning1 May 2019 0 repositories listed
-
Learning Actionable Representations with Goal Conditioned Policies1 May 2019 0 repositories listed
-
Learning agents with prioritization and parameter noise in continuous state and action space1 May 2019 0 repositories listed
-
Learning Goal-Conditioned Value Functions with one-step Path rewards rather than Goal-Rewards1 May 2019 0 repositories listed
-
Learning Heuristics for Automated Reasoning through Reinforcement Learning1 May 2019 0 repositories listed