Browse State-of-the-Art › Q-Learning › Papers, page 19
Q-Learning
Papers archive 2025-07-28
archive papers tagged: 1,918 · with a code link: 463 · where Syntology ran a sample: 119 (102 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (119 of 1,918 tagged: 102 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument)
Page 19 of 20: papers 1,801 to 1,900 of 1,918, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
SA-IGA: A Multiagent Reinforcement Learning Method Towards Socially Optimal Outcomes8 Mar 2018 0 repositories listed
-
Smoothed Action Value Functions for Learning Gaussian Policies6 Mar 2018 0 repositories listed
-
Q-CP: Learning Action Values for Cooperative Planning1 Mar 2018 0 repositories listed
-
Variance Reduction Methods for Sublinear Reinforcement Learning26 Feb 2018 0 repositories listed
-
Temporal Difference Models: Model-Free Deep RL for Model-Based Control25 Feb 2018 0 repositories listed
-
Weighted Double Deep Multiagent Reinforcement Learning in Stochastic Cooperative Environments23 Feb 2018 0 repositories listed
-
Prioritized Sweeping Neural DynaQ with Multiple Predecessors, and Hippocampal Replays15 Feb 2018 0 repositories listed
-
12 Feb 2018 0 repositories listed
-
Q-learning with Nearest Neighbors12 Feb 2018 0 repositories listed
-
Balancing Two-Player Stochastic Games with Soft Q-Learning9 Feb 2018 0 repositories listed
-
Deep Reinforcement Learning using Capsules in Advanced Game Environments29 Jan 2018 0 repositories listed
-
The QLBS Q-Learner Goes NuQLear: Fitted Q Iteration, Inverse RL, and Option Portfolios17 Jan 2018 0 repositories listed
-
Deep Reinforcement Fuzzing14 Jan 2018 0 repositories listed
-
Trading the Twitter Sentiment with Reinforcement Learning7 Jan 2018 0 repositories listed
-
Faster Deep Q-learning using Neural Episodic Control6 Jan 2018 0 repositories listed
-
ScreenerNet: Learning Self-Paced Curriculum for Deep Neural Networks3 Jan 2018 0 repositories listed
-
ViZDoom: DRQN with Prioritized Experience Replay, Double-Q Learning, & Snapshot Ensembling3 Jan 2018 0 repositories listed
-
Autonomous Vehicle Fleet Coordination With Deep Reinforcement Learning1 Jan 2018 0 repositories listed
-
Avoiding Catastrophic States with Intrinsic Fear1 Jan 2018 0 repositories listed
-
Learning Gaussian Policies from Smoothed Action Value Functions1 Jan 2018 0 repositories listed
-
Representing Entropy : A short proof of the equivalence between soft Q-learning and policy gradients1 Jan 2018 0 repositories listed
-
TD Learning with Constrained Gradients1 Jan 2018 0 repositories listed
-
SBEED: Convergent Reinforcement Learning with Nonlinear Function Approximation29 Dec 2017 0 repositories listed
-
A short variational proof of equivalence between policy gradients and soft Q learning22 Dec 2017 0 repositories listed
-
Scale-invariant temporal history (SITH): optimal slicing of the past in an uncertain world19 Dec 2017 0 repositories listed
-
Towards a Deep Reinforcement Learning Approach for Tower Line Wars17 Dec 2017 0 repositories listed
-
Robust Deep Reinforcement Learning with Adversarial Attacks11 Dec 2017 0 repositories listed
-
Deep Primal-Dual Reinforcement Learning: Accelerating Actor-Critic using Bellman Duality7 Dec 2017 0 repositories listed
-
Q-LDA: Uncovering Latent Patterns in Text-based Sequential Decision Processes1 Dec 2017 0 repositories listed
-
Zap Q-Learning1 Dec 2017 0 repositories listed
-
Curriculum Q-Learning for Visual Vocabulary Acquisition29 Nov 2017 0 repositories listed
-
A reinforcement learning algorithm for building collaboration in multi-agent systems28 Nov 2017 0 repositories listed
-
Neural Network Based Reinforcement Learning for Audio-Visual Gaze Control in Human-Robot Interaction18 Nov 2017 0 repositories listed
-
BBQ-Networks: Efficient Exploration in Deep Reinforcement Learning for Task-Oriented Dialogue Systems15 Nov 2017 0 repositories listed
-
A unified decision making framework for supply and demand management in microgrid networks14 Nov 2017 0 repositories listed
-
Double Q(σ) and Q(σ, λ): Unifying Reinforcement Learning Control Algorithms5 Nov 2017 0 repositories listed
-
Deep Reinforcement Learning: Framework, Applications, and Embedded Implementations10 Oct 2017 0 repositories listed
-
Supervised Q-walk for Learning Vector Representation of Nodes in Networks3 Oct 2017 0 repositories listed
-
A Simple Reinforcement Learning Mechanism for Resource Allocation in LTE-A Networks with Markov Decision Process and Q-Learning27 Sep 2017 0 repositories listed
-
An Optimal Online Method of Selecting Source Policies for Reinforcement Learning24 Sep 2017 0 repositories listed
-
Improving Search through A3C Reinforcement Learning based Conversational Agent17 Sep 2017 0 repositories listed
-
BIBI System Description: Building with CNNs and Breaking with Deep Reinforcement Learning1 Sep 2017 0 repositories listed
-
Constructing narrative using a generative model and continuous action policies1 Sep 2017 0 repositories listed
-
Multi-Agent Q-Learning for Minimizing Demand-Supply Power Deficit in Microgrids25 Aug 2017 0 repositories listed
-
Investigating Reinforcement Learning Agents for Continuous State Space Environments8 Aug 2017 0 repositories listed
-
Guiding Reinforcement Learning Exploration Using Natural Language26 Jul 2017 0 repositories listed
-
Empirical evaluation of a Q-Learning Algorithm for Model-free Autonomous Soaring18 Jul 2017 0 repositories listed
-
On-line Building Energy Optimization using Deep Reinforcement Learning18 Jul 2017 0 repositories listed
-
Fastest Convergence for Q-learning12 Jul 2017 0 repositories listed
-
Deep Q-Learning for Self-Organizing Networks Fault Management and Radio Performance Improvement10 Jul 2017 0 repositories listed
-
Q-Learning Algorithm for VoLTE Closed-Loop Power Control in Indoor Small Cells10 Jul 2017 0 repositories listed
-
Reinforcement Learning under Model Mismatch15 Jun 2017 0 repositories listed
-
Learning to Learn from Noisy Web Videos9 Jun 2017 0 repositories listed
-
UCB Exploration via Q-Ensembles5 Jun 2017 0 repositories listed
-
Learning to Factor Policies and Action-Value Functions: Factored Action Space Representations for Deep Reinforcement learning20 May 2017 0 repositories listed
-
A Comparison of Reinforcement Learning Techniques for Fuzzy Cloud Auto-Scaling19 May 2017 0 repositories listed
-
Identification and Off-Policy Learning of Multiple Objectives Using Adaptive Clustering17 May 2017 0 repositories listed
-
Learning to Represent Haptic Feedback for Partially-Observable Tasks17 May 2017 0 repositories listed
-
Learning Hard Alignments with Variational Inference16 May 2017 0 repositories listed
-
Discrete Sequential Prediction of Continuous Actions for Deep RL14 May 2017 0 repositories listed
-
Deep Episodic Value Iteration for Model-based Meta-Reinforcement Learning9 May 2017 0 repositories listed
-
Equivalence Between Policy Gradients and Soft Q-Learning21 Apr 2017 0 repositories listed
-
Reinforcement Learning with External Knowledge and Two-Stage Q-functions for Predicting Popular Reddit Threads20 Apr 2017 0 repositories listed
-
Data-efficient Deep Reinforcement Learning for Dexterous Manipulation10 Apr 2017 0 repositories listed
-
Pseudorehearsal in value function approximation21 Mar 2017 0 repositories listed
-
Online Learning for Offloading and Autoscaling in Energy Harvesting Mobile Edge Computing17 Mar 2017 0 repositories listed
-
Multi-step Reinforcement Learning: A Unifying Algorithm3 Mar 2017 0 repositories listed
-
Learning Control for Air Hockey Striking using Deep Reinforcement Learning26 Feb 2017 0 repositories listed
-
Collaborative Deep Reinforcement Learning for Joint Object Search18 Feb 2017 0 repositories listed
-
The Game Imitation: Deep Supervised Convolutional Networks for Quick Video Game AI18 Feb 2017 0 repositories listed
-
FPGA Architecture for Deep Learning and its application to Planetary Robotics26 Jan 2017 0 repositories listed
-
Learning to predict where to look in interactive environments using deep recurrent q-learning17 Dec 2016 0 repositories listed
-
A Differentiable Physics Engine for Deep Learning in Robotics5 Nov 2016 0 repositories listed
-
Combining policy gradient and Q-learning5 Nov 2016 0 repositories listed
-
Combating Reinforcement Learning's Sisyphean Curse with Intrinsic Fear3 Nov 2016 0 repositories listed
-
Using a Deep Reinforcement Learning Agent for Traffic Signal Control3 Nov 2016 0 repositories listed
-
Internet of Things Applications: Animal Monitoring with Unmanned Aerial Vehicle17 Oct 2016 0 repositories listed
-
Modelling Stock-market Investors as Reinforcement Learning Agents [Correction]20 Sep 2016 0 repositories listed
-
Interactive Spoken Content Retrieval by Deep Reinforcement Learning16 Sep 2016 0 repositories listed
-
3D Simulation for Robot Arm Control with Deep Q-Learning13 Sep 2016 0 repositories listed
-
Episodic Exploration for Deep Deterministic Policies: An Application to StarCraft Micromanagement Tasks10 Sep 2016 0 repositories listed
-
Multi Exit Configuration of Mesoscopic Pedestrian Simulation6 Sep 2016 0 repositories listed
-
Q-Learning with Basic Emotions6 Sep 2016 0 repositories listed
-
BBQ-Networks: Efficient Exploration in Deep Reinforcement Learning for Task-Oriented Dialogue Systems17 Aug 2016 0 repositories listed
-
Neurohex: A Deep Q-learning Hex Agent24 Apr 2016 0 repositories listed
-
Reinforcement Learning approach for Real Time Strategy Games Battle city and S316 Feb 2016 0 repositories listed
-
Using Deep Q-Learning to Control Optimization Hyperparameters12 Feb 2016 0 repositories listed
-
Q-Networks for Binary Vector Actions4 Dec 2015 0 repositories listed
-
Deep Reinforcement Learning with Attention for Slate Markov Decision Processes with High-Dimensional States and Actions3 Dec 2015 0 repositories listed
-
Robotic Search & Rescue via Online Multi-task Reinforcement Learning29 Nov 2015 0 repositories listed
-
Two Phase Q-learning for Bidding-based Vehicle Sharing29 Sep 2015 0 repositories listed
-
Optimization of anemia treatment in hemodialysis patients via reinforcement learning14 Sep 2015 0 repositories listed
-
Distributed Deep Q-Learning18 Aug 2015 0 repositories listed
-
Artificial Prediction Markets for Online Prediction of Continuous Variables-A Preliminary Report11 Aug 2015 0 repositories listed
-
Online Transfer Learning in Reinforcement Learning Domains2 Jul 2015 0 repositories listed
-
Decentralized Q-Learning for Stochastic Teams and Games25 Jun 2015 0 repositories listed
-
Autonomous CRM Control via CLV Approximation with Deep Reinforcement Learning in Discrete and Continuous Action Space8 Apr 2015 0 repositories listed
-
Energy Sharing for Multiple Sensor Nodes with Finite Buffers17 Mar 2015 0 repositories listed
-
Correct-by-synthesis reinforcement learning with temporal logic constraints5 Mar 2015 0 repositories listed
-
Empirical Q-Value Iteration30 Nov 2014 0 repositories listed