Browse State-of-the-Art › Q-Learning › Papers, page 8
Q-Learning
Papers archive 2025-07-28
archive papers tagged: 1,918 · with a code link: 463 · where Syntology ran a sample: 119 (102 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (119 of 1,918 tagged: 102 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument)
Page 8 of 20: papers 701 to 800 of 1,918, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Mutation-Bias Learning in Games28 May 2024 0 repositories listed
-
Analysis of Multiscale Reinforcement Q-Learning Algorithms for Mean Field Control Games27 May 2024 0 repositories listed
-
An Evolutionary Framework for Connect-4 as Test-Bed for Comparison of Advanced Minimax, Q-Learning and MCTS26 May 2024 0 repositories listed
-
Reinforcement Learning for Jump-Diffusions, with Financial Applications26 May 2024 0 repositories listed
-
Extracting Heuristics from Large Language Models for Reward Shaping in Reinforcement Learning24 May 2024 0 repositories listed
-
Knowledge-Informed Auto-Penetration Testing Based on Reinforcement Learning with Reward Machine24 May 2024 0 repositories listed
-
SF-DQN: Provable Knowledge Transfer using Successor Feature for Deep Reinforcement Learning24 May 2024 0 repositories listed
-
A finite time analysis of distributed Q-learning23 May 2024 0 repositories listed
-
Exclusively Penalized Q-learning for Offline Reinforcement Learning23 May 2024 0 repositories listed
-
Stochastic Q-learning for Large Discrete Action Spaces16 May 2024 0 repositories listed
-
Deep Reinforcement Learning for Real-Time Ground Delay Program Revision and Corresponding Flight Delay Assignments14 May 2024 0 repositories listed
-
Smart Sampling: Self-Attention and Bootstrapping for Improved Ensembled Q-Learning14 May 2024 0 repositories listed
-
An Initial Introduction to Cooperative Multi-Agent Reinforcement Learning10 May 2024 0 repositories listed
-
An Overview of Machine Learning-Enabled Optimization for Reconfigurable Intelligent Surfaces-Aided 6G Networks: From Reinforcement Learning to Large Language Models9 May 2024 0 repositories listed
-
Enhancing Q-Learning with Large Language Model Heuristics6 May 2024 0 repositories listed
-
A Network Simulation of OTC Markets with Multiple Agents3 May 2024 0 repositories listed
-
Zero-Sum Positional Differential Games as a Framework for Robust Reinforcement Learning: Deep Q-Learning Approach3 May 2024 0 repositories listed
-
LOQA: Learning with Opponent Q-Learning Awareness2 May 2024 0 repositories listed
-
Cell Switching in HAPS-Aided Networking: How the Obscurity of Traffic Loads Affects the Decision1 May 2024 0 repositories listed
-
Numeric Reward Machines30 Apr 2024 0 repositories listed
-
Reinforcement Learning Problem Solving with Large Language Models29 Apr 2024 0 repositories listed
-
Using Deep Q-Learning to Dynamically Toggle between Push/Pull Actions in Computational Trust Mechanisms28 Apr 2024 0 repositories listed
-
Q-learning with temporal memory to navigate turbulence26 Apr 2024 0 repositories listed
-
Age of Information Minimization using Multi-agent UAVs based on AI-Enhanced Mean Field Resource Allocation24 Apr 2024 0 repositories listed
-
Recursive Backwards Q-Learning in Deterministic Environments24 Apr 2024 0 repositories listed
-
Unified ODE Analysis of Smooth Q-Learning Algorithms20 Apr 2024 0 repositories listed
-
Continuous-time Risk-sensitive Reinforcement Learning via Quadratic Variation Penalty19 Apr 2024 0 repositories listed
-
Data-Incremental Continual Offline Reinforcement Learning19 Apr 2024 0 repositories listed
-
From r to Q^*: Your Language Model is Secretly a Q-Function18 Apr 2024 0 repositories listed
-
Empowering Embodied Visual Tracking with Visual Foundation Models and Offline RL15 Apr 2024 0 repositories listed
-
Advancing Forest Fire Prevention: Deep Reinforcement Learning for Effective Firebreak Placement12 Apr 2024 0 repositories listed
-
Prelimit Coupling and Steady-State Convergence of Constant-stepsize Nonsmooth Contractive SA9 Apr 2024 0 repositories listed
-
Traffic Signal Control and Speed Offset Coordination Using Q-Learning for Arterial Road Networks9 Apr 2024 0 repositories listed
-
Deep Reinforcement Learning Control for Disturbance Rejection in a Nonlinear Dynamic System with Parametric Uncertainty6 Apr 2024 0 repositories listed
-
Growing Q-Networks: Solving Continuous Control Tasks with Adaptive Control Resolution5 Apr 2024 0 repositories listed
-
Data-Driven Knowledge Transfer in Batch Q^* Learning1 Apr 2024 0 repositories listed
-
Utilizing Maximum Mean Discrepancy Barycenter for Propagating the Uncertainty of Value Functions in Reinforcement Learning31 Mar 2024 0 repositories listed
-
EnCoMP: Enhanced Covert Maneuver Planning with Adaptive Threat-Aware Visibility Estimation using Offline Reinforcement Learning29 Mar 2024 0 repositories listed
-
DASA: Delay-Adaptive Multi-Agent Stochastic Approximation25 Mar 2024 0 repositories listed
-
Semantic-Aware Remote Estimation of Multiple Markov Sources Under Constraints25 Mar 2024 0 repositories listed
-
Reinforcement Learning for Online Testing of Autonomous Driving Systems: a Replication and Extension Study20 Mar 2024 0 repositories listed
-
State-Separated SARSA: A Practical Sequential Decision-Making Algorithm with Recovering Rewards18 Mar 2024 0 repositories listed
-
Neural-Kernel Conditional Mean Embeddings16 Mar 2024 0 repositories listed
-
A Reinforcement Learning Approach to Dairy Farm Battery Management using Q Learning14 Mar 2024 0 repositories listed
-
Model-free Resilient Controller Design based on Incentive Feedback Stackelberg Game and Q-learning13 Mar 2024 0 repositories listed
-
Strategizing against Q-learners: A Control-theoretical Approach13 Mar 2024 0 repositories listed
-
Optimal Design and Implementation of an Open-source Emulation Platform for User-Centric Shared E-mobility Services12 Mar 2024 0 repositories listed
-
Symmetric Q-learning: Reducing Skewness of Bellman Error in Online Reinforcement Learning12 Mar 2024 0 repositories listed
-
Finite-Time Error Analysis of Soft Q-Learning: Switching System Approach11 Mar 2024 0 repositories listed
-
Algorithmic Collusion and Price Discrimination: The Over-Usage of Data10 Mar 2024 0 repositories listed
-
Enhancing Classification Performance via Reinforcement Learning for Feature Selection9 Mar 2024 0 repositories listed
-
SMAUG: A Sliding Multidimensional Task Window-Based MARL Framework for Adaptive Real-Time Subtask Recognition4 Mar 2024 0 repositories listed
-
QF-tuner: Breaking Tradition in Reinforcement Learning26 Feb 2024 0 repositories listed
-
An Index Policy Based on Sarsa and Q-learning for Heterogeneous Smart Target Tracking19 Feb 2024 0 repositories listed
-
Easy as ABCs: Unifying Boltzmann Q-Learning and Counterfactual Regret Minimization19 Feb 2024 0 repositories listed
-
Finite-Time Error Analysis of Online Model-Based Q-Learning with a Relaxed Sampling Model19 Feb 2024 0 repositories listed
-
Reinforcement Learning for Optimal Execution when Liquidity is Time-Varying19 Feb 2024 0 repositories listed
-
Stochastic Approximation with Delayed Updates: Finite-Time Rates under Markovian Sampling19 Feb 2024 0 repositories listed
-
Reinforcement learning to maximise wind turbine energy generation17 Feb 2024 0 repositories listed
-
Exploiting Estimation Bias in Clipped Double Q-Learning for Continous Control Reinforcement Learning Tasks14 Feb 2024 0 repositories listed
-
Enhanced Deep Q-Learning for 2D Self-Driving Cars: Implementation and Evaluation on a Custom Track Environment13 Feb 2024 0 repositories listed
-
Intelligent Agricultural Management Considering N₂O Emission and Climate Variability with Uncertainties13 Feb 2024 0 repositories listed
-
Federated Deep Q-Learning and 5G load balancing10 Feb 2024 0 repositories listed
-
ORIENT: A Priority-Aware Energy-Efficient Approach for Latency-Sensitive Applications in 6G10 Feb 2024 0 repositories listed
-
Value function interference and greedy action selection in value-based multi-objective reinforcement learning9 Feb 2024 0 repositories listed
-
Attention-Enhanced Prioritized Proximal Policy Optimization for Adaptive Edge Caching8 Feb 2024 0 repositories listed
-
Enhancement of High-definition Map Update Service Through Coverage-aware and Reinforcement Learning8 Feb 2024 0 repositories listed
-
Federated Offline Reinforcement Learning: Collaborative Single-Policy Coverage Suffices8 Feb 2024 0 repositories listed
-
A Deep Reinforcement Learning Approach for Adaptive Traffic Routing in Next-gen Networks7 Feb 2024 0 repositories listed
-
Diffusion World Model: Future Modeling Beyond Step-by-Step Rollout for Offline Reinforcement Learning5 Feb 2024 0 repositories listed
-
Multi-Agent Reinforcement Learning for Offloading Cellular Communications with Cooperating UAVs5 Feb 2024 0 repositories listed
-
MinMaxMin Q-learning3 Feb 2024 0 repositories listed
-
SQT -- std Q-target3 Feb 2024 0 repositories listed
-
DRL-Based Dynamic Channel Access and SCLAR Maximization for Networks Under Jamming2 Feb 2024 0 repositories listed
-
Deep Robot Sketching: An application of Deep Q-Learning Networks for human-like sketching1 Feb 2024 0 repositories listed
-
FM3Q: Factorized Multi-Agent MiniMax Q-Learning for Two-Team Zero-Sum Markov Game1 Feb 2024 0 repositories listed
-
Nash Soft Actor-Critic LEO Satellite Handover Management Algorithm for Flying Vehicles31 Jan 2024 0 repositories listed
-
Scheduled Curiosity-Deep Dyna-Q: Efficient Exploration for Dialog Policy Learning31 Jan 2024 0 repositories listed
-
Extrinsicaly Rewarded Soft Q Imitation Learning with Discriminator30 Jan 2024 0 repositories listed
-
Emergence of cooperation under punishment: A reinforcement learning perspective29 Jan 2024 0 repositories listed
-
Regularized Q-Learning with Linear Function Approximation26 Jan 2024 0 repositories listed
-
Constant Stepsize Q-learning: Distributional Convergence, Bias and Extrapolation25 Jan 2024 0 repositories listed
-
REValueD: Regularised Ensemble Value-Decomposition for Factorisable Markov Decision Processes16 Jan 2024 0 repositories listed
-
Graph Q-Learning for Combinatorial Optimization11 Jan 2024 0 repositories listed
-
Model-Free Reinforcement Learning for Automated Fluid Administration in Critical Care11 Jan 2024 0 repositories listed
-
Advancing ECG Diagnosis Using Reinforcement Learning on Global Waveform Variations Related to P Wave and PR Interval10 Jan 2024 0 repositories listed
-
Deep Reinforcement Multi-agent Learning framework for Information Gathering with Local Gaussian Processes for Water Monitoring9 Jan 2024 0 repositories listed
-
An Empirical Investigation of Value-Based Multi-objective Reinforcement Learning for Stochastic Environments6 Jan 2024 0 repositories listed
-
A Deep Q-Learning based Smart Scheduling of EVs for Demand Response in Smart Grids5 Jan 2024 0 repositories listed
-
The Best Time for an Update: Risk-Sensitive Minimization of Age-Based Metrics3 Jan 2024 0 repositories listed
-
Personalized Dynamic Pricing Policy for Electric Vehicles: Reinforcement learning approach1 Jan 2024 0 repositories listed
-
Dynamic Decision Making in Engineering System Design: A Deep Q-Learning Approach28 Dec 2023 0 repositories listed
-
Distributional Reinforcement Learning-based Energy Arbitrage Strategies in Imbalance Settlement Mechanism23 Dec 2023 0 repositories listed
-
Reinforcement Learning for Safe Occupancy Strategies in Educational Spaces during an Epidemic23 Dec 2023 0 repositories listed
-
Federated Q-Learning: Linear Regret Speedup with Low Communication Cost22 Dec 2023 0 repositories listed
-
Maximum entropy GFlowNets with soft Q-learning21 Dec 2023 0 repositories listed
-
Optimal coordination of resources: A solution from reinforcement learning20 Dec 2023 0 repositories listed
-
Stability of Multi-Agent Learning in Competitive Networks: Delaying the Onset of Chaos19 Dec 2023 0 repositories listed
-
Deep-Dispatch: A Deep Reinforcement Learning-Based Vehicle Dispatch Algorithm for Advanced Air Mobility17 Dec 2023 0 repositories listed
-
On Designing Multi-UAV aided Wireless Powered Dynamic Communication via Hierarchical Deep Reinforcement Learning13 Dec 2023 0 repositories listed