Browse State-of-the-Art › Q-Learning › Papers, page 16
Q-Learning
Papers archive 2025-07-28
archive papers tagged: 1,918 · with a code link: 463 · where Syntology ran a sample: 119 (102 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (119 of 1,918 tagged: 102 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument)
Page 16 of 20: papers 1,501 to 1,600 of 1,918, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Should artificial agents ask for help in human-robot collaborative problem-solving?25 May 2020 0 repositories listed
-
A reinforcement learning based decision support system in textile manufacturing process20 May 2020 0 repositories listed
-
Safe Learning for Near Optimal Scheduling19 May 2020 0 repositories listed
-
Basal Glucose Control in Type 1 Diabetes using Deep Reinforcement Learning: An In Silico Validation18 May 2020 0 repositories listed
-
Entropy-Augmented Entropy-Regularized Reinforcement Learning and a Continuous Path from Policy Gradient to Q-Learning18 May 2020 0 repositories listed
-
A Deep Q-learning/genetic Algorithms Based Novel Methodology For Optimizing Covid-19 Pandemic Government Actions15 May 2020 0 repositories listed
-
A Deep Reinforcement Learning Approach to Efficient Drone Mobility Support11 May 2020 0 repositories listed
-
An FPGA-Based On-Device Reinforcement Learning Approach using Online Sequential Learning10 May 2020 0 repositories listed
-
Reinforcement Learning for Thermostatically Controlled Loads Control using Modelica and Python9 May 2020 0 repositories listed
-
Optimal Beam Association for High Mobility mmWave Vehicular Networks: Lightweight Parallel Reinforcement Learning Approach2 May 2020 0 repositories listed
-
Implementing Inductive bias for different navigation tasks through diverse RNN attrractors1 May 2020 0 repositories listed
-
Learning Efficient Parameter Server Synchronization Policies for Distributed SGD1 May 2020 0 repositories listed
-
Whittle index based Q-learning for restless bandits with average reward29 Apr 2020 0 repositories listed
-
Evolution of Q Values for Deep Q Learning in Stable Baselines24 Apr 2020 0 repositories listed
-
Learning Dialog Policies from Weak Demonstrations23 Apr 2020 0 repositories listed
-
Energy-Efficient Power Allocation and Q-Learning-Based Relay Selection for Relay-Aided D2D Communication20 Apr 2020 0 repositories listed
-
Intelligent Querying for Target Tracking in Camera Networks using Deep Q-Learning with n-Step Bootstrapping20 Apr 2020 0 repositories listed
-
Deep Reinforcement Learning for Adaptive Learning Systems17 Apr 2020 0 repositories listed
-
Show Us the Way: Learning to Manage Dialog from Demonstrations17 Apr 2020 0 repositories listed
-
K-spin Hamiltonian for quantum-resolvable Markov decision processes13 Apr 2020 0 repositories listed
-
Zero-Shot Learning of Text Adventure Games with Sentence-Level Semantics6 Apr 2020 0 repositories listed
-
Multi-agent Reinforcement Learning for Resource Allocation in IoT networks with Edge Computing5 Apr 2020 0 repositories listed
-
Minimizing Age-of-Information for Fog Computing-supported Vehicular Networks with Deep Q-learning4 Apr 2020 0 repositories listed
-
Reinforcement Learning for Mixed-Integer Problems Based on MPC3 Apr 2020 0 repositories listed
-
Safe Reinforcement Learning via Projection on a Safe Set: How to Achieve Optimality?2 Apr 2020 0 repositories listed
-
Statistically Model Checking PCTL Specifications on Markov Decision Processes via Reinforcement Learning1 Apr 2020 0 repositories listed
-
Enhanced Rolling Horizon Evolution Algorithm with Opponent Model Learning: Results for the Fighting Game AI Competition31 Mar 2020 0 repositories listed
-
Learning medical triage from clinicians using Deep Q-Learning28 Mar 2020 0 repositories listed
-
A Distributional Analysis of Sampling-Based Reinforcement Learning Algorithms27 Mar 2020 0 repositories listed
-
Robust Q-learning27 Mar 2020 0 repositories listed
-
Convergence of Recursive Stochastic Algorithms using Wasserstein Divergence25 Mar 2020 0 repositories listed
-
Q-Learning in Regularized Mean-field Games24 Mar 2020 0 repositories listed
-
Distributed Reinforcement Learning for Cooperative Multi-Robot Object Manipulation21 Mar 2020 0 repositories listed
-
Deep Reinforcement Learning with Weighted Q-Learning20 Mar 2020 0 repositories listed
-
Deep Constrained Q-learning20 Mar 2020 0 repositories listed
-
Active Perception and Representation for Robotic Manipulation15 Mar 2020 0 repositories listed
-
A General Framework for Learning Mean-Field Games13 Mar 2020 0 repositories listed
-
Application of Deep Q-Network in Portfolio Management13 Mar 2020 0 repositories listed
-
Provably Efficient Model-Free Algorithm for MDPs with Peak Constraints11 Mar 2020 0 repositories listed
-
Indirect and Direct Training of Spiking Neural Networks for End-to-End Control of a Lane-Keeping Vehicle10 Mar 2020 0 repositories listed
-
Privacy-Cost Management in Smart Meters Using Deep Reinforcement Learning10 Mar 2020 0 repositories listed
-
A Multi-Agent Reinforcement Learning Approach For Safe and Efficient Behavior Planning Of Connected Autonomous Vehicles9 Mar 2020 0 repositories listed
-
Software-Level Accuracy Using Stochastic Computing With Charge-Trap-Flash Based Weight Matrix9 Mar 2020 0 repositories listed
-
Transfer Reinforcement Learning under Unobserved Contextual Information9 Mar 2020 0 repositories listed
-
Reinforcement Learning Based Cooperative Coded Caching under Dynamic Popularities in Ultra-Dense Networks8 Mar 2020 0 repositories listed
-
Relevance-Guided Modeling of Object Dynamics for Reinforcement Learning3 Mar 2020 0 repositories listed
-
Adaptive Structural Hyper-Parameter Configuration by Q-Learning2 Mar 2020 0 repositories listed
-
Contextual Policy Transfer in Reinforcement Learning Domains via Deep Mixtures-of-Experts29 Feb 2020 0 repositories listed
-
Deep Reinforcement Learning for FlipIt Security Game28 Feb 2020 0 repositories listed
-
G-Learner and GIRL: Goal Based Wealth Management with Reinforcement Learning25 Feb 2020 0 repositories listed
-
Simultaneously Evolving Deep Reinforcement Learning Models using Multifactorial Optimization25 Feb 2020 0 repositories listed
-
A Double Q-Learning Approach for Navigation of Aerial Vehicles with Connectivity Constraint24 Feb 2020 0 repositories listed
-
Millimeter Wave Communications with an Intelligent Reflector: Performance Optimization and Distributional Reinforcement Learning24 Feb 2020 0 repositories listed
-
Q-learning with Uniformly Bounded Variance: Large Discounting is Not a Barrier to Fast Learning24 Feb 2020 0 repositories listed
-
Periodic Q-Learning23 Feb 2020 0 repositories listed
-
Anypath Routing Protocol Design via Q-Learning for Underwater Sensor Networks22 Feb 2020 0 repositories listed
-
UAV Aided Search and Rescue Operation Using Reinforcement Learning19 Feb 2020 0 repositories listed
-
Agnostic Q-learning with Function Approximation in Deterministic Systems: Tight Bounds on Approximation Error and Sample Complexity17 Feb 2020 0 repositories listed
-
Listwise Learning to Rank with Deep Q-Networks13 Feb 2020 0 repositories listed
-
Regret Bounds for Discounted MDPs12 Feb 2020 0 repositories listed
-
Mean-Field Controls with Q-learning for Cooperative MARL: Convergence and Complexity Analysis10 Feb 2020 0 repositories listed
-
GLSearch: Maximum Common Subgraph Detection via Learning to Search8 Feb 2020 0 repositories listed
-
Manipulating Reinforcement Learning: Poisoning Attacks on Cost Signals7 Feb 2020 0 repositories listed
-
Safe Wasserstein Constrained Deep Q-Learning7 Feb 2020 0 repositories listed
-
Finite-Sample Analysis of Stochastic Approximation Using Smooth Convex Envelopes3 Feb 2020 0 repositories listed
-
Finite-Time Analysis of Asynchronous Stochastic Approximation and Q-Learning1 Feb 2020 0 repositories listed
-
Autonomous Control of a Line Follower Robot Using a Q-Learning Controller23 Jan 2020 0 repositories listed
-
Q-Learning in enormous action spaces via amortized approximate maximization22 Jan 2020 0 repositories listed
-
Model-based Multi-Agent Reinforcement Learning with Cooperative Prioritized Sweeping15 Jan 2020 0 repositories listed
-
A storage expansion planning framework using reinforcement learning and simulation-based optimization10 Jan 2020 0 repositories listed
-
A Probabilistic Simulator of Spatial Demand for Product Allocation9 Jan 2020 0 repositories listed
-
EEG-based Drowsiness Estimation for Driving Safety using Deep Q-Learning8 Jan 2020 0 repositories listed
-
Experimental Analysis of Reinforcement Learning Techniques for Spectrum Sharing Radar6 Jan 2020 0 repositories listed
-
SVQN: Sequential Variational Soft Q-Learning Networks1 Jan 2020 0 repositories listed
-
Way Off-Policy Batch Deep Reinforcement Learning of Human Preferences in Dialog1 Jan 2020 0 repositories listed
-
Learning in Discounted-cost and Average-cost Mean-field Games31 Dec 2019 0 repositories listed
-
Information Theoretic Model Predictive Q-Learning31 Dec 2019 0 repositories listed
-
The Gambler's Problem and Beyond31 Dec 2019 0 repositories listed
-
Hamilton-Jacobi-Bellman Equations for Q-Learning in Continuous Time23 Dec 2019 0 repositories listed
-
Soft Q Network20 Dec 2019 0 repositories listed
-
Sepsis World Model: A MIMIC-based OpenAI Gym "World Model" Simulator for Sepsis Treatment15 Dec 2019 0 repositories listed
-
High dimensional precision medicine from patient-derived xenografts13 Dec 2019 0 repositories listed
-
Provably Efficient Reinforcement Learning with Aggregated States13 Dec 2019 0 repositories listed
-
A Finite-Time Analysis of Q-Learning with Neural Network Function Approximation10 Dec 2019 0 repositories listed
-
Value-of-Information based Arbitration between Model-based and Model-free Control8 Dec 2019 0 repositories listed
-
Reinforcement Learning with Non-Markovian Rewards5 Dec 2019 0 repositories listed
-
Combining Q-Learning and Search with Amortized Value Estimates5 Dec 2019 0 repositories listed
-
A Unified Switching System Perspective and O.D.E. Analysis of Q-Learning Algorithms4 Dec 2019 0 repositories listed
-
Learning to Dynamically Coordinate Multi-Robot Teams in Graph Attention Networks4 Dec 2019 0 repositories listed
-
Neighborhood Cognition Consistent Multi-Agent Reinforcement Learning3 Dec 2019 0 repositories listed
-
Modelling the Dynamics of Multiagent Q-Learning in Repeated Symmetric Games: a Mean Field Theoretic Approach1 Dec 2019 0 repositories listed
-
Neural Temporal-Difference Learning Converges to Global Optima1 Dec 2019 0 repositories listed
-
Provably Efficient Q-learning with Function Approximation via Distribution Shift Error Checking Oracle1 Dec 2019 0 repositories listed
-
Quadratic Q-network for Learning Continuous Control for Autonomous Vehicles29 Nov 2019 0 repositories listed
-
Control-Tutored Reinforcement Learning: an application to the Herding Problem26 Nov 2019 0 repositories listed
-
A Deep Reinforcement Learning Architecture for Multi-stage Optimal Control25 Nov 2019 0 repositories listed
-
Adaptive Modulation and Coding based on Reinforcement Learning for 5G Networks25 Nov 2019 0 repositories listed
-
Mitigate Bias in Face Recognition using Skewness-Aware Reinforcement Learning25 Nov 2019 0 repositories listed
-
Which Channel to Ask My Question? Personalized Customer Service RequestStream Routing using DeepReinforcement Learning24 Nov 2019 0 repositories listed
-
Efficient Drone Mobility Support Using Reinforcement Learning21 Nov 2019 0 repositories listed