Browse State-of-the-Art › Q-Learning › Papers, page 17
Q-Learning
Papers archive 2025-07-28
archive papers tagged: 1,918 · with a code link: 463 · where Syntology ran a sample: 119 (102 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (119 of 1,918 tagged: 102 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument)
Page 17 of 20: papers 1,601 to 1,700 of 1,918, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Quantum Observables for continuous control of the Quantum Approximate Optimization Algorithm via Reinforcement Learning21 Nov 2019 0 repositories listed
-
Asymptotics of Reinforcement Learning with Neural Networks13 Nov 2019 0 repositories listed
-
Modelling Bahdanau Attention using Election methods aided by Q-Learning10 Nov 2019 0 repositories listed
-
Two-stage WECC Composite Load Modeling: A Double Deep Q-Learning Networks Approach8 Nov 2019 0 repositories listed
-
Challenging On Car Racing Problem from OpenAI gym2 Nov 2019 0 repositories listed
-
Biomimetic Ultra-Broadband Perfect Absorbers Optimised with Reinforcement Learning28 Oct 2019 0 repositories listed
-
Model-Free Mean-Field Reinforcement Learning: Mean-Field MDP and Mean-Field Q-Learning28 Oct 2019 0 repositories listed
-
D-Point Trigonometric Path Planning based on Q-Learning in Uncertain Environments26 Oct 2019 0 repositories listed
-
Deep Q-Learning for Same-Day Delivery with Vehicles and Drones25 Oct 2019 0 repositories listed
-
Partially Detected Intelligent Traffic Signal Control: Environmental Adaptation23 Oct 2019 0 repositories listed
-
Reverse Experience Replay19 Oct 2019 0 repositories listed
-
On the Reduction of Variance and Overestimation of Deep Q-Learning14 Oct 2019 0 repositories listed
-
Zap Q-Learning With Nonlinear Function Approximation11 Oct 2019 0 repositories listed
-
A Dual-Hormone Closed-Loop Delivery System for Type 1 Diabetes Using Deep Reinforcement Learning9 Oct 2019 0 repositories listed
-
Integrating Behavior Cloning and Reinforcement Learning for Improved Performance in Dense and Sparse Reward Environments9 Oct 2019 0 repositories listed
-
Tactical Reward Shaping: Bypassing Reinforcement Learning with Strategy-Based Goals8 Oct 2019 0 repositories listed
-
Toward Synergic Learning for Autonomous Manipulation of Deformable Tissues via Surgical Robots: An Approximate Q-Learning Approach8 Oct 2019 0 repositories listed
-
Reinforcement Learning with Structured Hierarchical Grammar Representations of Actions7 Oct 2019 0 repositories listed
-
I'm sorry Dave, I'm afraid I can't do that, Deep Q-learning from forbidden action4 Oct 2019 0 repositories listed
-
Fair Loss: Margin-Aware Reinforcement Learning for Deep Face Recognition1 Oct 2019 0 repositories listed
-
Quantile QT-Opt for Risk-Aware Vision-Based Robotic Grasping1 Oct 2019 0 repositories listed
-
Composite Q-learning: Multi-scale Q-function Decomposition and Separable Optimization30 Sep 2019 0 repositories listed
-
Q-learning for POMDP: An application to learning locomotion gaits30 Sep 2019 0 repositories listed
-
CAQL: Continuous Action Q-Learning26 Sep 2019 0 repositories listed
-
CAN ALTQ LEARN FASTER: EXPERIMENTS AND THEORY25 Sep 2019 0 repositories listed
-
Long-term planning, short-term adjustments25 Sep 2019 0 repositories listed
-
Modeling Fake News in Social Networks with Deep Multi-Agent Reinforcement Learning25 Sep 2019 0 repositories listed
-
Off-policy Multi-step Q-learning25 Sep 2019 0 repositories listed
-
Policy Tree Network25 Sep 2019 0 repositories listed
-
QXplore: Q-Learning Exploration by Maximizing Temporal Difference Error25 Sep 2019 0 repositories listed
-
Striving for Simplicity in Off-Policy Deep Reinforcement Learning25 Sep 2019 0 repositories listed
-
On the Convergence of Approximate and Regularized Policy Iteration Schemes20 Sep 2019 0 repositories listed
-
Dependency-Aware Computation Offloading in Mobile Edge Computing: A Reinforcement Learning Approach18 Sep 2019 0 repositories listed
-
Split Deep Q-Learning for Robust Object Singulation17 Sep 2019 0 repositories listed
-
Joint Inference of Reward Machines and Policies for Reinforcement Learning12 Sep 2019 0 repositories listed
-
SQLR: Short-Term Memory Q-Learning for Elastic Provisioning12 Sep 2019 0 repositories listed
-
Mutual-Information Regularization in Markov Decision Processes and Actor-Critic Learning11 Sep 2019 0 repositories listed
-
Q-learning Assisted Energy-Aware Traffic Offloading and Cell Switching in Heterogeneous Networks11 Sep 2019 0 repositories listed
-
Reinforcement Learning Models of Human Behavior: Reward Processing in Mental Disorders11 Sep 2019 0 repositories listed
-
A Multistep Lyapunov Approach for Finite-Time Analysis of Biased Stochastic Approximation10 Sep 2019 0 repositories listed
-
Q-Learning Based Aerial Base Station Placement for Fairness Enhancement in Mobile Networks10 Sep 2019 0 repositories listed
-
Fixed-Horizon Temporal Difference Methods for Stable Reinforcement Learning9 Sep 2019 0 repositories listed
-
Self-driving scale car trained by Deep reinforcement learning8 Sep 2019 0 repositories listed
-
Multi Pseudo Q-learning Based Deterministic Policy Gradient for Tracking Control of Autonomous Underwater Vehicles7 Sep 2019 0 repositories listed
-
Encoders and Decoders for Quantum Expander Codes Using Machine Learning6 Sep 2019 0 repositories listed
-
Gradient Q(σ, λ): A Unified Algorithm with Function Approximation for Reinforcement Learning6 Sep 2019 0 repositories listed
-
Q-DATA: Enhanced Traffic Flow Monitoring in Software-Defined Networks applying Q-learning4 Sep 2019 0 repositories listed
-
Solving Discounted Stochastic Two-Player Games with Near-Optimal Time and Sample Complexity29 Aug 2019 0 repositories listed
-
Networked Control of Nonlinear Systems under Partial Observation Using Continuous Deep Q-Learning28 Aug 2019 0 repositories listed
-
STMARL: A Spatio-Temporal Multi-Agent Reinforcement Learning Approach for Cooperative Traffic Light Control28 Aug 2019 0 repositories listed
-
Deep Reinforcement Learning for Foreign Exchange Trading21 Aug 2019 0 repositories listed
-
Large-Scale Traffic Signal Control Using a Novel Multi-Agent Reinforcement Learning10 Aug 2019 0 repositories listed
-
Batch Recurrent Q-Learning for Backchannel Generation Towards Engaging Agents6 Aug 2019 0 repositories listed
-
Q-MIND: Defeating Stealthy DoS Attacks in SDN with a Machine-learning based Defense Framework27 Jul 2019 0 repositories listed
-
Potential-Based Advice for Stochastic Policy Learning20 Jul 2019 0 repositories listed
-
Photonic architecture for reinforcement learning17 Jul 2019 0 repositories listed
-
Model-free Control of Chaos with Continuous Deep Q-learning16 Jul 2019 0 repositories listed
-
Q-learning pour la résolution des anaphores pronominales en langue arabe (Q-learning for pronominal anaphora resolution in Arabic texts)1 Jul 2019 0 repositories listed
-
Q-Learning Inspired Self-Tuning for Energy Efficiency in HPC26 Jun 2019 0 repositories listed
-
Deceptive Reinforcement Learning Under Adversarial Manipulations on Cost Signals24 Jun 2019 0 repositories listed
-
In Hindsight: A Smooth Reward for Steady Exploration24 Jun 2019 0 repositories listed
-
Optimal Use of Experience in First Person Shooter Environments24 Jun 2019 0 repositories listed
-
Neural networks with motivation23 Jun 2019 0 repositories listed
-
Reinforcement Learning-Based Trajectory Design for the Aerial Base Stations23 Jun 2019 0 repositories listed
-
Cache-Aided NOMA Mobile Edge Computing: A Reinforcement Learning Approach20 Jun 2019 0 repositories listed
-
Reward Prediction Error as an Exploration Objective in Deep RL19 Jun 2019 0 repositories listed
-
A Generalized Minimax Q-learning Algorithm for Two-Player Zero-Sum Stochastic Games16 Jun 2019 0 repositories listed
-
Provably Efficient Q-learning with Function Approximation via Distribution Shift Error Checking Oracle14 Jun 2019 0 repositories listed
-
Variance-reduced Q-learning is minimax optimal11 Jun 2019 0 repositories listed
-
Deep Reinforcement Learning with Discrete Normalized Advantage Functions for Resource Management in Network Slicing10 Jun 2019 0 repositories listed
-
"Did You Hear That?" Learning to Play Video Games from Audio Cues10 Jun 2019 0 repositories listed
-
Deep Q-Learning for Directed Acyclic Graph Generation5 Jun 2019 0 repositories listed
-
Escaping the State of Nature: A Hobbesian Approach to Cooperation in Multi-agent Reinforcement Learning5 Jun 2019 0 repositories listed
-
Exploration with Unreliable Intrinsic Reward in Multi-Agent Reinforcement Learning5 Jun 2019 0 repositories listed
-
Risk-Sensitive Compact Decision Trees for Autonomous Execution in Presence of Simulated Market Response5 Jun 2019 0 repositories listed
-
On-board Deep Q-Network for UAV-assisted Online Power Transfer and Data Collection4 Jun 2019 0 repositories listed
-
Feature-Based Q-Learning for Two-Player Stochastic Games2 Jun 2019 0 repositories listed
-
RSS-Based Q-Learning for Indoor UAV Navigation31 May 2019 0 repositories listed
-
Provably Efficient Q-Learning with Low Switching Cost30 May 2019 0 repositories listed
-
Learning NP-Hard Multi-Agent Assignment Planning using GNN: Inference on a Random Graph and Provable Auction-Fitted Q-learning29 May 2019 0 repositories listed
-
A General Markov Decision Process Framework for Directly Learning Optimal Control Policies28 May 2019 0 repositories listed
-
Prioritized Sequence Experience Replay25 May 2019 0 repositories listed
-
MQLV: Optimal Policy of Money Management in Retail Banking with Q-Learning24 May 2019 0 repositories listed
-
Deep Q-Learning with Q-Matrix Transfer Learning for Novel Fire Evacuation Environment23 May 2019 0 repositories listed
-
Stochastic Variance Reduction for Deep Q-learning20 May 2019 0 repositories listed
-
Reinforcement Learning for Learning of Dynamical Systems in Uncertain Environment: a Tutorial19 May 2019 0 repositories listed
-
Autonomous Penetration Testing using Reinforcement Learning15 May 2019 0 repositories listed
-
Reinforcement Learning for Robotics and Control with Active Uncertainty Reduction15 May 2019 0 repositories listed
-
Design of Artificial Intelligence Agents for Games using Deep Reinforcement Learning10 May 2019 0 repositories listed
-
Domain Adversarial Reinforcement Learning for Partial Domain Adaptation10 May 2019 0 repositories listed
-
Toward Packet Routing with Fully-distributed Multi-agent Deep Reinforcement Learning9 May 2019 0 repositories listed
-
Pretrain Soft Q-Learning with Imperfect Demonstrations9 May 2019 0 repositories listed
-
A Reinforcement Learning Perspective on the Optimal Control of Mutation Probabilities for the (1+1) Evolutionary Algorithm: First Results on the OneMax Problem9 May 2019 0 repositories listed
-
Accelerated Target Updates for Q-learning7 May 2019 0 repositories listed
-
Learning agents with prioritization and parameter noise in continuous state and action space1 May 2019 0 repositories listed
-
Soft Q-Learning with Mutual-Information Regularization1 May 2019 0 repositories listed
-
Two-Timescale Networks for Nonlinear Value Function Approximation1 May 2019 0 repositories listed
-
A Deep Q-Learning Method for Downlink Power Allocation in Multi-Cell Networks30 Apr 2019 0 repositories listed
-
Zap Q-Learning for Optimal Stopping Time Problems25 Apr 2019 0 repositories listed
-
Stochastic Lipschitz Q-Learning24 Apr 2019 0 repositories listed