Browse State-of-the-Art › Q-Learning › Papers, page 11
Q-Learning
Papers archive 2025-07-28
archive papers tagged: 1,918 · with a code link: 463 · where Syntology ran a sample: 119 (102 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (119 of 1,918 tagged: 102 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument)
Page 11 of 20: papers 1,001 to 1,100 of 1,918, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
PALMER: Perception-Action Loop with Memory for Long-Horizon Planning8 Dec 2022 0 repositories listed
-
Reinforcement Learning for Resilient Power Grids8 Dec 2022 0 repositories listed
-
Automatic Discovery of Multi-perspective Process Model using Reinforcement Learning30 Nov 2022 0 repositories listed
-
Causal Deep Reinforcement Learning Using Observational Data28 Nov 2022 0 repositories listed
-
Offline Q-Learning on Diverse Multi-Task Data Both Scales And Generalizes28 Nov 2022 0 repositories listed
-
QLAMMP: A Q-Learning Agent for Optimizing Fees on Automated Market Making Protocols28 Nov 2022 0 repositories listed
-
State-Aware Proximal Pessimistic Algorithms for Offline Reinforcement Learning28 Nov 2022 0 repositories listed
-
UAV-Assisted Space-Air-Ground Integrated Networks: A Technical Review of Recent Learning Algorithms27 Nov 2022 0 repositories listed
-
Double Deep Q-Learning in Opponent Modeling24 Nov 2022 0 repositories listed
-
Learning Self-Awareness Models for Physical Layer Security in Cognitive and AI-enabled Radios23 Nov 2022 0 repositories listed
-
Reinforcement Causal Structure Learning on Order Graph22 Nov 2022 0 repositories listed
-
Simultaneously Updating All Persistence Values in Reinforcement Learning21 Nov 2022 0 repositories listed
-
Analysis of Reinforcement Learning Schemes for Trajectory Optimization of an Aerial Radio Unit18 Nov 2022 0 repositories listed
-
Credit-cognisant reinforcement learning for multi-agent cooperation18 Nov 2022 0 repositories listed
-
A Reinforcement Learning Approach for Process Parameter Optimization in Additive Manufacturing17 Nov 2022 0 repositories listed
-
Planning Irregular Object Packing via Hierarchical Reinforcement Learning17 Nov 2022 0 repositories listed
-
Addressing the issue of stochastic environments and local decision-making in multi-objective reinforcement learning16 Nov 2022 0 repositories listed
-
Exploratory Control with Tsallis Entropy for Latent Factor Models14 Nov 2022 0 repositories listed
-
On the Global Convergence of Fitted Q-Iteration with Two-layer Neural Network Parametrization14 Nov 2022 0 repositories listed
-
Reinforcement Learning in Non-Markovian Environments3 Nov 2022 0 repositories listed
-
Deep Reinforcement Learning for Power Control in Next-Generation WiFi Network Systems2 Nov 2022 0 repositories listed
-
Offline RL With Realistic Datasets: Heteroskedasticity and Support Constraints2 Nov 2022 0 repositories listed
-
Quantum deep recurrent reinforcement learning26 Oct 2022 0 repositories listed
-
Attitude Control of Highly Maneuverable Aircraft Using an Improved Q-learning22 Oct 2022 0 repositories listed
-
Sufficient Exploration for Convex Q-learning17 Oct 2022 0 repositories listed
-
Model-Free Characterizations of the Hamilton-Jacobi-Bellman Equation and Convex Q-Learning in Continuous Time14 Oct 2022 0 repositories listed
-
Deep reinforcement learning for automatic run-time adaptation of UWB PHY radio settings13 Oct 2022 0 repositories listed
-
Censored Deep Reinforcement Patrolling with Information Criterion for Monitoring Large Water Resources using Autonomous Surface Vehicles12 Oct 2022 0 repositories listed
-
DQLAP: Deep Q-Learning Recommender Algorithm with Update Policy for a Real Steam Turbine System12 Oct 2022 0 repositories listed
-
Reinforcement Learning Approach for Multi-Agent Flexible Scheduling Problems7 Oct 2022 0 repositories listed
-
Interpretable Option Discovery using Deep Q-Learning and Variational Autoencoders3 Oct 2022 0 repositories listed
-
Offline Reinforcement Learning with Differentiable Function Approximation is Provably Efficient3 Oct 2022 0 repositories listed
-
Bayesian Q-learning With Imperfect Expert Demonstrations1 Oct 2022 0 repositories listed
-
Deep Recurrent Q-learning for Energy-constrained Coverage with a Mobile Robot1 Oct 2022 0 repositories listed
-
Application of Deep Q Learning with Simulation Results for Elevator Optimization30 Sep 2022 0 repositories listed
-
Efficient LSTM Training with Eligibility Traces30 Sep 2022 0 repositories listed
-
On Convergence of Average-Reward Off-Policy Control Algorithms in Weakly Communicating MDPs30 Sep 2022 0 repositories listed
-
FIRE: A Failure-Adaptive Reinforcement Learning Framework for Edge Computing Migrations28 Sep 2022 0 repositories listed
-
Predictive Crypto-Asset Automated Market Making Architecture for Decentralized Finance using Deep Reinforcement Learning28 Sep 2022 0 repositories listed
-
Understanding Hindsight Goal Relabeling from a Divergence Minimization Perspective26 Sep 2022 0 repositories listed
-
Comparative Study of Q-Learning and NeuroEvolution of Augmenting Topologies for Self Driving Agents19 Sep 2022 0 repositories listed
-
MA2QL: A Minimalist Approach to Fully Decentralized Multi-Agent Reinforcement Learning17 Sep 2022 0 repositories listed
-
Reinforcement Learning-Based Cooperative P2P Power Trading between DC Nanogrid Clusters with Wind and PV Energy Resources16 Sep 2022 0 repositories listed
-
Deep Reinforcement Learning for Task Offloading in UAV-Aided Smart Farm Networks15 Sep 2022 0 repositories listed
-
IoT-Aerial Base Station Task Offloading with Risk-Sensitive Reinforcement Learning for Smart Agriculture15 Sep 2022 0 repositories listed
-
Structured Q-learning For Antibody Design10 Sep 2022 0 repositories listed
-
Double Q-Learning for Citizen Relocation During Natural Hazards8 Sep 2022 0 repositories listed
-
On the Convergence of Monte Carlo UCB for Random-Length Episodic MDPs7 Sep 2022 0 repositories listed
-
SlateFree: a Model-Free Decomposition for Reinforcement Learning with Slate Actions5 Sep 2022 0 repositories listed
-
A Technique to Create Weaker Abstract Board Game Agents via Reinforcement Learning1 Sep 2022 0 repositories listed
-
Partial Counterfactual Identification for Infinite Horizon Partially Observable Markov Decision Process31 Aug 2022 0 repositories listed
-
Direct Data-Driven Discrete-time Bilinear Biquadratic Regulator29 Aug 2022 0 repositories listed
-
Object Goal Navigation using Data Regularized Q-Learning27 Aug 2022 0 repositories listed
-
Prospect Theory-inspired Automated P2P Energy Trading with Q-learning-based Dynamic Pricing26 Aug 2022 0 repositories listed
-
Recurrent Neural Network-based Anti-jamming Framework for Defense Against Multiple Jamming Policies19 Aug 2022 0 repositories listed
-
A Novel Resource Allocation for Anti-jamming in Cognitive-UAVs: an Active Inference Approach10 Aug 2022 0 repositories listed
-
Compositional Reinforcement Learning for Discrete-Time Stochastic Control Systems6 Aug 2022 0 repositories listed
-
Reinforcement Learning for Joint V2I Network Selection and Autonomous Driving Policies3 Aug 2022 0 repositories listed
-
Digital Twin-Assisted Efficient Reinforcement Learning for Edge Task Scheduling2 Aug 2022 0 repositories listed
-
A Maintenance Planning Framework using Online and Offline Deep Reinforcement Learning1 Aug 2022 0 repositories listed
-
Playing a 2D Game Indefinitely using NEAT and Reinforcement Learning28 Jul 2022 0 repositories listed
-
Structural Similarity for Improved Transfer in Reinforcement Learning27 Jul 2022 0 repositories listed
-
Finite-Time Analysis of Asynchronous Q-learning under Diminishing Step-Size from Control-Theoretic View25 Jul 2022 0 repositories listed
-
Multi-Source AoI-Constrained Resource Minimization under HARQ: Heterogeneous Sampling Processes19 Jul 2022 0 repositories listed
-
On Decentralizing Federated Reinforcement Learning in Multi-Robot Scenarios19 Jul 2022 0 repositories listed
-
Approximate Nash Equilibrium Learning for n-Player Markov Games in Dynamic Pricing13 Jul 2022 0 repositories listed
-
DDPG Learning for Aerial RIS-Assisted MU-MISO Communications13 Jul 2022 0 repositories listed
-
Multi-objective Optimization of Notifications Using Offline Reinforcement Learning7 Jul 2022 0 repositories listed
-
Planning with RL and episodic-memory behavioral priors5 Jul 2022 0 repositories listed
-
q-Learning in Continuous Time2 Jul 2022 0 repositories listed
-
Action-modulated midbrain dopamine activity arises from distributed control policies1 Jul 2022 0 repositories listed
-
Interactive Learning from Natural Language and Demonstrations using Signal Temporal Logic1 Jul 2022 0 repositories listed
-
Predicting the Need for Blood Transfusion in Intensive Care Units with Reinforcement Learning26 Jun 2022 0 repositories listed
-
Recursive Reinforcement Learning23 Jun 2022 0 repositories listed
-
Reinforcement Learning under Partial Observability Guided by Learned Environment Models23 Jun 2022 0 repositories listed
-
Federated Stochastic Approximation under Markov Noise and Heterogeneity: Applications in Reinforcement Learning21 Jun 2022 0 repositories listed
-
The Integration of Machine Learning into Automated Test Generation: A Systematic Mapping Study21 Jun 2022 0 repositories listed
-
Visual Radial Basis Q-Network14 Jun 2022 0 repositories listed
-
RL-GA: A Reinforcement Learning-Based Genetic Algorithm for Electromagnetic Detection Satellite Scheduling Problem12 Jun 2022 0 repositories listed
-
An Optimization Method-Assisted Ensemble Deep Reinforcement Learning Algorithm to Solve Unit Commitment Problems9 Jun 2022 0 repositories listed
-
A Study of Continual Learning Methods for Q-Learning8 Jun 2022 0 repositories listed
-
Concentration bounds for SSP Q-learning for average cost MDPs7 Jun 2022 0 repositories listed
-
Balancing Profit, Risk, and Sustainability for Portfolio Management6 Jun 2022 0 repositories listed
-
DDPG based on multi-scale strokes for financial time series trading strategy5 Jun 2022 0 repositories listed
-
CoNSoLe: Convex Neural Symbolic Learning1 Jun 2022 0 repositories listed
-
Stabilizing Q-learning with Linear Architectures for Provably Efficient Learning1 Jun 2022 0 repositories listed
-
Designing Rewards for Fast Learning30 May 2022 0 repositories listed
-
GraMeR: Graph Meta Reinforcement Learning for Multi-Objective Influence Maximization30 May 2022 0 repositories listed
-
Deep Reinforcement Learning for Distributed and Uncoordinated Cognitive Radios Resource Allocation27 May 2022 0 repositories listed
-
Does DQN Learn?26 May 2022 0 repositories listed
-
Exploration, Exploitation, and Engagement in Multi-Armed Bandits with Abandonment26 May 2022 0 repositories listed
-
An Experimental Comparison Between Temporal Difference and Residual Gradient with Neural Network Approximation25 May 2022 0 repositories listed
-
Analytics of Business Time Series Using Machine Learning and Bayesian Inference25 May 2022 0 repositories listed
-
Optimizing Returns Using the Hurst Exponent and Q Learning on Momentum and Mean Reversion Strategies23 May 2022 0 repositories listed
-
Reinforced Pedestrian Attribute Recognition with Group Optimization Reward21 May 2022 0 repositories listed
-
Parallel bandit architecture based on laser chaos for reinforcement learning19 May 2022 0 repositories listed
-
Efficient Off-Policy Reinforcement Learning via Brain-Inspired Computing14 May 2022 0 repositories listed
-
Representation Learning for Context-Dependent Decision-Making12 May 2022 0 repositories listed
-
Characterizing the Action-Generalization Gap in Deep Q-Learning11 May 2022 0 repositories listed
-
Final Iteration Convergence Bound of Q-Learning: Switching System Approach11 May 2022 0 repositories listed