Browse State-of-the-Art › Q-Learning › Papers, page 18
Q-Learning
Papers archive 2025-07-28
archive papers tagged: 1,918 · with a code link: 463 · where Syntology ran a sample: 119 (102 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (119 of 1,918 tagged: 102 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument)
Page 18 of 20: papers 1,701 to 1,800 of 1,918, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Target-Based Temporal Difference Learning24 Apr 2019 0 repositories listed
-
Driving Decision and Control for Autonomous Lane Change based on Deep Reinforcement Learning23 Apr 2019 0 repositories listed
-
Deep Q Learning Driven CT Pancreas Segmentation with Geometry-Aware U-Net19 Apr 2019 0 repositories listed
-
"Jam Me If You Can'': Defeating Jammer with Deep Dueling Neural Network Architecture and Ambient Backscattering Augmented Communications8 Apr 2019 0 repositories listed
-
Patchwork: A Patch-wise Attention Network for Efficient Object Detection and Segmentation in Video Streams3 Apr 2019 0 repositories listed
-
Personalized Cancer Chemotherapy Schedule: a numerical comparison of performance and robustness in model-based and model-free scheduling methodologies2 Apr 2019 0 repositories listed
-
Learning Automata Based Q-learning for Content Placement in Cooperative Caching30 Mar 2019 0 repositories listed
-
Q-Learning for Continuous Actions with Cross-Entropy Guided Policies25 Mar 2019 0 repositories listed
-
Towards Characterizing Divergence in Deep Q-Learning21 Mar 2019 0 repositories listed
-
Online Antenna Tuning in Heterogeneous Cellular Networks with Deep Reinforcement Learning15 Mar 2019 0 repositories listed
-
Deep Multi-Agent Reinforcement Learning with Discrete-Continuous Hybrid Action Spaces12 Mar 2019 0 repositories listed
-
Successive Over Relaxation Q-Learning9 Mar 2019 0 repositories listed
-
Distributed Edge Caching via Reinforcement Learning in Fog Radio Access Networks27 Feb 2019 0 repositories listed
-
Unifying Ensemble Methods for Q-learning via Social Choice Theory27 Feb 2019 0 repositories listed
-
Optimal and Fast Real-time Resources Slicing with Deep Dueling Neural Networks26 Feb 2019 0 repositories listed
-
Distributionally Robust Reinforcement Learning23 Feb 2019 0 repositories listed
-
Autonomous Airline Revenue Management: A Deep Reinforcement Learning Approach to Seat Inventory Control and Overbooking18 Feb 2019 0 repositories listed
-
Long and Short Memory Balancing in Visual Co-Tracking using Q-Learning14 Feb 2019 0 repositories listed
-
Sample-Optimal Parametric Q-Learning Using Linearly Additive Features13 Feb 2019 0 repositories listed
-
Learning Best Response Strategies for Agents in Ad Exchanges10 Feb 2019 0 repositories listed
-
Finite-Sample Analysis for SARSA with Linear Function Approximation6 Feb 2019 0 repositories listed
-
A Theory of Regularized Markov Decision Processes31 Jan 2019 0 repositories listed
-
Q-learning with UCB Exploration is Sample Efficient for Infinite-Horizon MDP27 Jan 2019 0 repositories listed
-
Distillation Strategies for Proximal Policy Optimization23 Jan 2019 0 repositories listed
-
Reinforcement Learning of Markov Decision Processes with Peak Constraints23 Jan 2019 0 repositories listed
-
Accelerating Goal-Directed Reinforcement Learning by Model Characterization4 Jan 2019 0 repositories listed
-
Optimal Decision-Making in Mixed-Agent Partially Observable Stochastic Environments via Reinforcement Learning4 Jan 2019 0 repositories listed
-
A Theoretical Analysis of Deep Q-Learning1 Jan 2019 0 repositories listed
-
Double Deep Q-Learning for Optimal Execution17 Dec 2018 0 repositories listed
-
Reinforcement Learning for Adaptive Caching with Dynamic Storage Pricing17 Dec 2018 0 repositories listed
-
Learning Sharing Behaviors with Arbitrary Numbers of Agents10 Dec 2018 0 repositories listed
-
A new multilayer optical film optimal method based on deep q-learning7 Dec 2018 0 repositories listed
-
Active Deep Q-learning with Demonstration6 Dec 2018 0 repositories listed
-
Non-delusional Q-learning and value-iteration1 Dec 2018 0 repositories listed
-
Emergence of Addictive Behaviors in Reinforcement Learning Agents14 Nov 2018 0 repositories listed
-
Managing App Install Ad Campaigns in RTB: A Q-Learning Approach11 Nov 2018 0 repositories listed
-
Deep Reinforcement Learning for Green Security Games with Real-Time Information6 Nov 2018 0 repositories listed
-
Deep Reinforcement Learning via L-BFGS Optimization6 Nov 2018 0 repositories listed
-
Reinforcement Learning based Dynamic Model Selection for Short-Term Load Forecasting5 Nov 2018 0 repositories listed
-
Approximate Dynamic Oracle for Dependency Parsing with Reinforcement Learning1 Nov 2018 0 repositories listed
-
Structure Learning of Deep Neural Networks with Q-Learning31 Oct 2018 0 repositories listed
-
Distributive Dynamic Spectrum Access through Deep Reinforcement Learning: A Reservoir Computing Based Approach28 Oct 2018 0 repositories listed
-
Learning Negotiating Behavior Between Cars in Intersections using Deep Q-Learning24 Oct 2018 0 repositories listed
-
Multi-Agent Reinforcement Learning Based Resource Allocation for UAV Networks24 Oct 2018 0 repositories listed
-
Finding the best design parameters for optical nanostructures using reinforcement learning18 Oct 2018 0 repositories listed
-
Learning to Sketch with Deep Q Networks and Demonstrated Strokes14 Oct 2018 0 repositories listed
-
Learning to Reason12 Oct 2018 0 repositories listed
-
Reinforcement Evolutionary Learning Method for self-learning7 Oct 2018 0 repositories listed
-
Reinforcement Learning in R29 Sep 2018 0 repositories listed
-
A Convergent Variant of the Boltzmann Softmax Operator in Reinforcement Learning27 Sep 2018 0 repositories listed
-
Accelerated Value Iteration via Anderson Mixing27 Sep 2018 0 repositories listed
-
Convergent Reinforcement Learning with Function Approximation: A Bilevel Optimization Perspective27 Sep 2018 0 repositories listed
-
Hybrid Policies Using Inverse Rewards for Reinforcement Learning27 Sep 2018 0 repositories listed
-
The wisdom of the crowd: reliable deep reinforcement learning through ensembles of Q-functions27 Sep 2018 0 repositories listed
-
What Would pi* Do?: Imitation Learning via Off-Policy Reinforcement Learning27 Sep 2018 0 repositories listed
-
Learning through Probing: a decentralized reinforcement learning architecture for social dilemmas26 Sep 2018 0 repositories listed
-
Floyd-Warshall Reinforcement Learning: Learning from Past Experiences to Reach New Goals25 Sep 2018 0 repositories listed
-
Target Transfer Q-Learning and Its Convergence Analysis21 Sep 2018 0 repositories listed
-
Hidden Markov Model Estimation-Based Q-learning for Partially Observable Markov Decision Process17 Sep 2018 0 repositories listed
-
Optimal Matrix Momentum Stochastic Approximation and Applications to Q-learning17 Sep 2018 0 repositories listed
-
Directed Exploration in PAC Model-Free Reinforcement Learning31 Aug 2018 0 repositories listed
-
MARL-FWC: Optimal Coordination of Freeway Traffic Control Measures27 Aug 2018 0 repositories listed
-
Automatic Derivation Of Formulas Using Reforcement Learning15 Aug 2018 0 repositories listed
-
Robbins-Monro conditions for persistent exploration learning strategies1 Aug 2018 0 repositories listed
-
A Reinforcement Learning Approach to Target Tracking in a Camera Network26 Jul 2018 0 repositories listed
-
Variational Bayesian Reinforcement Learning with Regret Bounds25 Jul 2018 0 repositories listed
-
Accelerated Structure-Aware Reinforcement Learning for Delay-Sensitive Energy Harvesting Wireless Sensors22 Jul 2018 0 repositories listed
-
Discrete linear-complexity reinforcement learning in continuous action spaces for Q-learning algorithms16 Jul 2018 0 repositories listed
-
Video Summarisation by Classification with Deep Reinforcement Learning9 Jul 2018 0 repositories listed
-
Playing against Nature: causal discovery for decision making under uncertainty3 Jul 2018 0 repositories listed
-
Learning to Coordinate with Coordination Graphs in Repeated Single-Stage Multi-Agent Decision Problems1 Jul 2018 0 repositories listed
-
Learning to Explore via Meta-Policy Gradient1 Jul 2018 0 repositories listed
-
Many-Goals Reinforcement Learning22 Jun 2018 0 repositories listed
-
Reinforcement Learning using Augmented Neural Networks20 Jun 2018 0 repositories listed
-
Action Learning for 3D Point Cloud Based Organ Segmentation14 Jun 2018 0 repositories listed
-
Automatic formation of the structure of abstract machines in hierarchical reinforcement learning with state clustering13 Jun 2018 0 repositories listed
-
Distributional Advantage Actor-Critic10 Jun 2018 0 repositories listed
-
Fidelity-based Probabilistic Q-learning for Control of Quantum Systems8 Jun 2018 0 repositories listed
-
A Finite Time Analysis of Temporal Difference Learning With Linear Function Approximation6 Jun 2018 0 repositories listed
-
Hyperparameter Optimization for Tracking With Continuous Deep Q-Learning1 Jun 2018 0 repositories listed
-
Depth and nonlinearity induce implicit exploration for RL29 May 2018 0 repositories listed
-
Hierarchical clustering with deep Q-learning28 May 2018 0 repositories listed
-
Learning Self-Imitating Diverse Policies25 May 2018 0 repositories listed
-
When Simple Exploration is Sample Efficient: Identifying Sufficient Conditions for Random Exploration to Yield PAC RL Algorithms23 May 2018 0 repositories listed
-
Learning Sampling Policies for Domain Adaptation19 May 2018 0 repositories listed
-
Algorithmic Trading with Fitted Q Iteration and Heston Model18 May 2018 0 repositories listed
-
Stochastic Approximation for Risk-aware Markov Decision Processes11 May 2018 0 repositories listed
-
Planning and Learning with Stochastic Action Sets7 May 2018 0 repositories listed
-
A Hybrid Q-Learning Sine-Cosine-based Strategy for Addressing the Combinatorial Test Suite Minimization Problem27 Apr 2018 0 repositories listed
-
Multiagent Soft Q-Learning25 Apr 2018 0 repositories listed
-
Benchmarking projective simulation in navigation problems23 Apr 2018 0 repositories listed
-
State Distribution-aware Sampling for Deep Q-learning23 Apr 2018 0 repositories listed
-
Reinforced Co-Training17 Apr 2018 0 repositories listed
-
State-Augmentation Transformations for Risk-Sensitive Reinforcement Learning16 Apr 2018 0 repositories listed
-
Hierarchical Modular Reinforcement Learning Method and Knowledge Acquisition of State-Action Rule for Multi-target Problem8 Apr 2018 0 repositories listed
-
Information Maximizing Exploration with a Latent Dynamics Model4 Apr 2018 0 repositories listed
-
Joint Learning of Interactive Spoken Content Retrieval and Trainable User Simulator1 Apr 2018 0 repositories listed
-
Natural Gradient Deep Q-learning20 Mar 2018 0 repositories listed
-
Learning to Explore with Meta-Policy Gradient13 Mar 2018 0 repositories listed
-
Multi-Armed Bandits for Correlated Markovian Environments with Smoothed Reward Feedback11 Mar 2018 0 repositories listed