Browse State-of-the-Art › Q-Learning › Papers, page 13
Q-Learning
Papers archive 2025-07-28
archive papers tagged: 1,918 · with a code link: 463 · where Syntology ran a sample: 119 (102 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (119 of 1,918 tagged: 102 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument)
Page 13 of 20: papers 1,201 to 1,300 of 1,918, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Fast Block Linear System Solver Using Q-Learning Schduling for Unified Dynamic Power System Simulations12 Oct 2021 0 repositories listed
-
Provably Efficient Reinforcement Learning in Decentralized General-Sum Markov Games12 Oct 2021 0 repositories listed
-
Navigation In Urban Environments Amongst Pedestrians Using Multi-Objective Deep Reinforcement Learning11 Oct 2021 0 repositories listed
-
Urban traffic dynamic rerouting framework: A DRL-based model with fog-cloud architecture11 Oct 2021 0 repositories listed
-
A Deep Learning Inference Scheme Based on Pipelined Matrix Multiplication Acceleration Design and Non-uniform Quantization10 Oct 2021 0 repositories listed
-
Breaking the Sample Complexity Barrier to Regret-Optimal Model-Free Reinforcement Learning9 Oct 2021 0 repositories listed
-
Compositional Q-learning for electrolyte repletion with imbalanced patient sub-populations6 Oct 2021 0 repositories listed
-
A Deep Reinforcement Learning Framework for Contention-Based Spectrum Sharing5 Oct 2021 0 repositories listed
-
A study of first-passage time minimization via Q-learning in heated gridworlds5 Oct 2021 0 repositories listed
-
Deep reinforcement learning for guidewire navigation in coronary artery phantom5 Oct 2021 0 repositories listed
-
A Modified Q-Learning Algorithm for Rate-Profiling of Polarization Adjusted Convolutional (PAC) Codes4 Oct 2021 0 repositories listed
-
Cellular traffic offloading via Opportunistic Networking with Reinforcement Learning1 Oct 2021 0 repositories listed
-
Adaptive Q-learning for Interaction-Limited Reinforcement Learning29 Sep 2021 0 repositories listed
-
An Attempt to Model Human Trust with Reinforcement Learning29 Sep 2021 0 repositories listed
-
Bootstrapped Hindsight Experience replay with Counterintuitive Prioritization29 Sep 2021 0 repositories listed
-
Continuous Deep Q-Learning in Optimal Control Problems: Normalized Advantage Functions Analysis29 Sep 2021 0 repositories listed
-
Convergent and Efficient Deep Q Learning Algorithm29 Sep 2021 0 repositories listed
-
Decentralized Cooperative Multi-Agent Reinforcement Learning with Exploration29 Sep 2021 0 repositories listed
-
Density Estimation for Conservative Q-Learning29 Sep 2021 0 repositories listed
-
Learning Explicit Credit Assignment for Multi-agent Joint Q-learning29 Sep 2021 0 repositories listed
-
Online Robust Reinforcement Learning with Model Uncertainty29 Sep 2021 0 repositories listed
-
Polyphonic Music Composition: An Adversarial Inverse Reinforcement Learning Approach29 Sep 2021 0 repositories listed
-
Q-learning for real time control of heterogeneous microagent collectives29 Sep 2021 0 repositories listed
-
Q-Learning Scheduler for Multi-Task Learning through the use of Histogram of Task Uncertainty29 Sep 2021 0 repositories listed
-
Robust and Data-efficient Q-learning by Composite Value-estimation29 Sep 2021 0 repositories listed
-
δ²-exploration for Reinforcement Learning29 Sep 2021 0 repositories listed
-
Text Generation with Efficient (Soft) Q-Learning29 Sep 2021 0 repositories listed
-
Towards Unknown-aware Deep Q-Learning29 Sep 2021 0 repositories listed
-
Unifying Top-down and Bottom-up for Recurrent Visual Attention29 Sep 2021 0 repositories listed
-
Untangling Braids with Multi-agent Q-Learning29 Sep 2021 0 repositories listed
-
Value Refinement Network (VRN)29 Sep 2021 0 repositories listed
-
Deep Reinforcement Learning with Adjustments28 Sep 2021 0 repositories listed
-
Smart Home Energy Management: Sequence-to-Sequence Load Forecasting and Q-Learning25 Sep 2021 0 repositories listed
-
MEPG: A Minimalist Ensemble Policy Gradient Framework for Deep Reinforcement Learning22 Sep 2021 0 repositories listed
-
Off-line approximate dynamic programming for the vehicle routing problem with a highly variable customer basis and stochastic demands21 Sep 2021 0 repositories listed
-
Search For Deep Graph Neural Networks21 Sep 2021 0 repositories listed
-
Greedy UnMixing for Q-Learning in Multi-Agent Reinforcement Learning19 Sep 2021 0 repositories listed
-
Regularize! Don't Mix: Multi-Agent Reinforcement Learning without Explicit Centralized Structures19 Sep 2021 0 repositories listed
-
Learning from Peers: Deep Transfer Reinforcement Learning for Joint Radio and Cache Resource Allocation in 5G RAN Slicing16 Sep 2021 0 repositories listed
-
Convergence of a Human-in-the-Loop Policy-Gradient Algorithm With Eligibility Trace Under Reward, Policy, and Advantage Feedback15 Sep 2021 0 repositories listed
-
Optimal Cycling of a Heterogenous Battery Bank via Reinforcement Learning15 Sep 2021 0 repositories listed
-
Deep hierarchical reinforcement agents for automated penetration testing14 Sep 2021 0 repositories listed
-
User Tampering in Reinforcement Learning Recommender Systems9 Sep 2021 0 repositories listed
-
Convergence of Batch Asynchronous Stochastic Approximation With Applications to Reinforcement Learning8 Sep 2021 0 repositories listed
-
Deep SIMBAD: Active Landmark-based Self-localization Using Ranking -based Scene Descriptor6 Sep 2021 0 repositories listed
-
Learning-Based Strategy Design for Robot-Assisted Reminiscence Therapy Based on a Developed Model for People with Dementia6 Sep 2021 0 repositories listed
-
Event-Based Communication in Distributed Q-Learning3 Sep 2021 0 repositories listed
-
Deep Reinforcement Learning for Dynamic Band Switch in Cellular-Connected UAV26 Aug 2021 0 repositories listed
-
DQLEL: Deep Q-Learning for Energy-Optimized LoS/NLoS UWB Node Selection24 Aug 2021 0 repositories listed
-
An Independent Study of Reinforcement Learning and Autonomous Driving20 Aug 2021 0 repositories listed
-
DQ-GAT: Towards Safe and Efficient Autonomous Driving with Deep Q-Learning and Graph Attention Networks11 Aug 2021 0 repositories listed
-
Maximizing Influence with Graph Neural Networks10 Aug 2021 0 repositories listed
-
Modified Double DQN: addressing stability9 Aug 2021 0 repositories listed
-
An Elementary Proof that Q-learning Converges Almost Surely5 Aug 2021 0 repositories listed
-
Offline Decentralized Multi-Agent Reinforcement Learning4 Aug 2021 0 repositories listed
-
A Distributed Intelligence Architecture for B5G Network Automation28 Jul 2021 0 repositories listed
-
Value-Based Reinforcement Learning for Continuous Control Robotic Manipulation in Multi-Task Sparse Reward Settings28 Jul 2021 0 repositories listed
-
Double Deep Q-learning Based Real-Time Optimization Strategy for Microgrids27 Jul 2021 0 repositories listed
-
Integrating Deep Learning and Augmented Reality to Enhance Situational Awareness in Firefighting Environments23 Jul 2021 0 repositories listed
-
Constraints Penalized Q-learning for Safe Offline Reinforcement Learning19 Jul 2021 0 repositories listed
-
A Penalized Shared-parameter Algorithm for Estimating Optimal Dynamic Treatment Regimens13 Jul 2021 0 repositories listed
-
Q-SMASH: Q-Learning-based Self-Adaptation of Human-Centered Internet of Things13 Jul 2021 0 repositories listed
-
Transfer Learning in Multi-Agent Reinforcement Learning with Double Q-Networks for Distributed Resource Sharing in V2X Communication13 Jul 2021 0 repositories listed
-
Reinforced Hybrid Genetic Algorithm for the Traveling Salesman Problem9 Jul 2021 0 repositories listed
-
The Least Restriction for Offline Reinforcement Learning5 Jul 2021 0 repositories listed
-
A Novel Deep Reinforcement Learning Based Stock Direction Prediction using Knowledge Graph and Community Aware Sentiments2 Jul 2021 0 repositories listed
-
Gap-Dependent Bounds for Two-Player Markov Games1 Jul 2021 0 repositories listed
-
Markov Decision Process modeled with Bandits for Sequential Decision Making in Linear-flow1 Jul 2021 0 repositories listed
-
DRILL-- Deep Reinforcement Learning for Refinement Operators in 𝒜ℒ𝒞29 Jun 2021 0 repositories listed
-
Expert Q-learning: Deep Reinforcement Learning with Coarse State Values from Offline Expert Examples28 Jun 2021 0 repositories listed
-
Instance-optimality in optimal value estimation: Adaptivity via variance-reduced Q-learning28 Jun 2021 0 repositories listed
-
Concentration of Contractive Stochastic Approximation and Reinforcement Learning27 Jun 2021 0 repositories listed
-
Reinforcement Learning for Mean Field Games, with Applications to Economics25 Jun 2021 0 repositories listed
-
Exploration-Exploitation in Multi-Agent Competition: Convergence with Bounded Rationality24 Jun 2021 0 repositories listed
-
Analytically Tractable Bayesian Deep Q-Learning21 Jun 2021 0 repositories listed
-
Reinforcement Learning for Resource Allocation in Steerable Laser-based Optical Wireless Systems21 Jun 2021 0 repositories listed
-
Boosting Offline Reinforcement Learning with Residual Generative Modeling19 Jun 2021 0 repositories listed
-
A Deep Reinforcement Learning Approach towards Pendulum Swing-up Problem based on TF-Agents17 Jun 2021 0 repositories listed
-
Deep reinforcement learning with automated label extraction from clinical reports accurately classifies 3D MRI brain volumes17 Jun 2021 0 repositories listed
-
A Q-Learning-Based Topology-Aware Routing Protocol for Flying Ad Hoc Networks16 Jun 2021 0 repositories listed
-
Unbiased Methods for Multi-Goal Reinforcement Learning16 Jun 2021 0 repositories listed
-
Decentralized Q-Learning in Zero-sum Markov Games4 Jun 2021 0 repositories listed
-
Design and Comparison of Reward Functions in Reinforcement Learning for Energy Management of Sensor Nodes2 Jun 2021 0 repositories listed
-
Smooth Q-learning: Accelerate Convergence of Q-learning Using Similarity2 Jun 2021 0 repositories listed
-
A reinforcement learning approach to improve communication performance and energy utilization in fog-based IoT1 Jun 2021 0 repositories listed
-
Energy-aware optimization of UAV base stations placement via decentralized multi-agent Q-learning1 Jun 2021 0 repositories listed
-
Sample-Efficient Reinforcement Learning for Linearly-Parameterized MDPs with a Generative Model28 May 2021 0 repositories listed
-
Reputation Bootstrapping for Composite Services using CP-nets27 May 2021 0 repositories listed
-
Verification of Dissipativity and Evaluation of Storage Function in Economic Nonlinear MPC using Q-Learning24 May 2021 0 repositories listed
-
Online Adaptive Optimal Control Algorithm Based on Synchronous Integral Reinforcement Learning With Explorations19 May 2021 0 repositories listed
-
Reinforcement Learning With Sparse-Executing Actions via Sparsity Regularization18 May 2021 0 repositories listed
-
Efficient Off-Policy Q-Learning for Data-Based Discrete-Time LQR Problems17 May 2021 0 repositories listed
-
Learn to Intervene: An Adaptive Learning Policy for Restless Bandits in Application to Preventive Healthcare17 May 2021 0 repositories listed
-
Interpretable performance analysis towards offline reinforcement learning: A dataset perspective12 May 2021 0 repositories listed
-
Fast constraint satisfaction problem and learning-based algorithm for solving Minesweeper10 May 2021 0 repositories listed
-
Reinforcement Learning with Expert Trajectory For Quantitative Trading9 May 2021 0 repositories listed
-
Survey on Multi-Agent Q-Learning frameworks for resource management in wireless sensor network5 May 2021 0 repositories listed
-
CARL-DTN: Context Adaptive Reinforcement Learning based Routing Algorithm in Delay Tolerant Network2 May 2021 0 repositories listed
-
RP-DQN: An application of Q-Learning to Vehicle Routing Problems25 Apr 2021 0 repositories listed
-
Model-aided Deep Reinforcement Learning for Sample-efficient UAV Trajectory Design in IoT Networks21 Apr 2021 0 repositories listed