Browse State-of-the-Art › Q-Learning › Papers, page 6
Q-Learning
Papers archive 2025-07-28
archive papers tagged: 1,918 · with a code link: 463 · where Syntology ran a sample: 119 (102 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (119 of 1,918 tagged: 102 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument)
Page 6 of 20: papers 501 to 600 of 1,918, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Mixed-Precision Conjugate Gradient Solvers with RL-Driven Precision Tuning19 Apr 2025 0 repositories listed
-
Understanding the theoretical properties of projected Bellman equation, linear Q-learning, and approximate value iteration15 Apr 2025 0 repositories listed
-
Nash Equilibrium Between Consumer Electronic Devices and DoS Attacker for Distributed IoT-enabled RSE Systems13 Apr 2025 0 repositories listed
-
A Framework of decision-relevant observability: Reinforcement Learning converges under relative ignorability10 Apr 2025 0 repositories listed
-
State Estimation Using Particle Filtering in Adaptive Machine Learning Methods: Integrating Q-Learning and NEAT Algorithms with Noisy Radar Measurements10 Apr 2025 0 repositories listed
-
Inverse RL Scene Dynamics Learning for Nonlinear Predictive Control in Autonomous Vehicles2 Apr 2025 0 repositories listed
-
Probabilistic Curriculum Learning for Goal-Based Reinforcement Learning2 Apr 2025 0 repositories listed
-
Late Breaking Results: Breaking Symmetry- Unconventional Placement of Analog Circuits using Multi-Level Multi-Agent Reinforcement Learning29 Mar 2025 0 repositories listed
-
Optimal Path Planning and Cost Minimization for a Drone Delivery System Via Model Predictive Control25 Mar 2025 0 repositories listed
-
Finite-Time Bounds for Two-Time-Scale Stochastic Approximation with Arbitrary Norm Contractions and Markovian Noise24 Mar 2025 0 repositories listed
-
Reinforcement Learning in Switching Non-Stationary Markov Decision Processes: Algorithms and Convergence Analysis24 Mar 2025 0 repositories listed
-
Bandwidth Reservation for Time-Critical Vehicular Applications: A Multi-Operator Environment22 Mar 2025 0 repositories listed
-
Planning and Learning in Average Risk-aware MDPs22 Mar 2025 0 repositories listed
-
Deep Q-Learning with Gradient Target Tracking20 Mar 2025 0 repositories listed
-
APF+: Boosting adaptive-potential function reinforcement learning methods with a W-shaped network for high-dimensional games17 Mar 2025 0 repositories listed
-
Exploring Competitive and Collusive Behaviors in Algorithmic Pricing with Deep Reinforcement Learning14 Mar 2025 0 repositories listed
-
Residual Policy Gradient: A Reward View of KL-regularized Objective14 Mar 2025 0 repositories listed
-
Multi-Agent Q-Learning Dynamics in Random Networks: Convergence due to Exploration and Sparsity13 Mar 2025 0 repositories listed
-
A Novel Multi-Objective Reinforcement Learning Algorithm for Pursuit-Evasion Game9 Mar 2025 0 repositories listed
-
Generative Multi-Agent Q-Learning for Policy Optimization: Decentralized Wireless Networks7 Mar 2025 0 repositories listed
-
Multi-Agent Inverse Q-Learning from Demonstrations6 Mar 2025 0 repositories listed
-
Quantum-Inspired Reinforcement Learning in the Presence of Epistemic Ambivalence6 Mar 2025 0 repositories listed
-
DO-IQS: Dynamics-Aware Offline Inverse Q-Learning for Optimal Stopping with Unknown Gain Functions5 Mar 2025 0 repositories listed
-
Navigating Intelligence: A Survey of Google OR-Tools and Machine Learning for Global Path Planning in Autonomous Vehicles5 Mar 2025 0 repositories listed
-
An Efficient and Uncertainty-aware Reinforcement Learning Framework for Quality Assurance in Extrusion Additive Manufacturing2 Mar 2025 0 repositories listed
-
Nucleolus Credit Assignment for Effective Coalitions in Multi-agent Reinforcement Learning1 Mar 2025 0 repositories listed
-
Cycles and collusion in congestion games under Q-learning26 Feb 2025 0 repositories listed
-
Policy Learning with a Natural Language Action Space: A Causal Approach24 Feb 2025 0 repositories listed
-
Yes, Q-learning Helps Offline In-Context RL24 Feb 2025 0 repositories listed
-
A Non-Asymptotic Theory of Seminorm Lyapunov Stability: From Deterministic to Stochastic Iterative Algorithms20 Feb 2025 0 repositories listed
-
Algorithmic Collusion under Observed Demand Shocks20 Feb 2025 0 repositories listed
-
Causal Mean Field Multi-Agent Reinforcement Learning20 Feb 2025 0 repositories listed
-
Is Q-learning an Ill-posed Problem?20 Feb 2025 0 repositories listed
-
Multi-Objective Reinforcement Learning for Critical Scenario Generation of Autonomous Vehicles18 Feb 2025 0 repositories listed
-
Few is More: Task-Efficient Skill-Discovery for Multi-Task Offline Multi-Agent Reinforcement Learning13 Feb 2025 0 repositories listed
-
Fast Adaptive Anti-Jamming Channel Access via Deep Q Learning and Coarse-Grained Spectrum Prediction7 Feb 2025 0 repositories listed
-
Optimizing Wireless Resource Management and Synchronization in Digital Twin Networks7 Feb 2025 0 repositories listed
-
Seasonal Station-Keeping of Short Duration High Altitude Balloons using Deep Reinforcement Learning7 Feb 2025 0 repositories listed
-
CleanSurvival: Automated data preprocessing for time-to-event models using reinforcement learning6 Feb 2025 0 repositories listed
-
DECAF: Learning to be Fair in Multi-agent Resource Allocation6 Feb 2025 0 repositories listed
-
Efficient Triangular Arbitrage Detection via Graph Neural Networks5 Feb 2025 0 repositories listed
-
Gap-Dependent Bounds for Federated Q-learning5 Feb 2025 0 repositories listed
-
VistaFlow: Photorealistic Volumetric Reconstruction with Dynamic Resolution Management via Q-Learning5 Feb 2025 0 repositories listed
-
Resilient UAV Trajectory Planning via Few-Shot Meta-Offline Reinforcement Learning3 Feb 2025 0 repositories listed
-
An MDP Model for Censoring in Harvesting Sensors: Optimal and Approximated Solutions2 Feb 2025 0 repositories listed
-
Computing and Learning Stationary Mean Field Equilibria with Scalar Interactions: Algorithms and Applications2 Feb 2025 0 repositories listed
-
Learning from Suboptimal Data in Continuous Control via Auto-Regressive Soft Q-Network1 Feb 2025 0 repositories listed
-
Linear Q-Learning Does Not Diverge: Convergence Rates to a Bounded Set31 Jan 2025 0 repositories listed
-
Reinforcement Learning for Quantum Circuit Design: Using Matrix Representations27 Jan 2025 0 repositories listed
-
Music Generation using Human-In-The-Loop Reinforcement Learning25 Jan 2025 0 repositories listed
-
Coordinating Ride-Pooling with Public Transit using Reward-Guided Conservative Q-Learning: An Offline Training and Online Fine-Tuning Reinforcement Learning Framework24 Jan 2025 0 repositories listed
-
BMG-Q: Localized Bipartite Match Graph Attention Q-Learning for Ride-Pooling Order Dispatch23 Jan 2025 0 repositories listed
-
Random-Key Algorithms for Optimizing Integrated Operating Room Scheduling17 Jan 2025 0 repositories listed
-
Projection Implicit Q-Learning with Support Constraint for Offline Reinforcement Learning15 Jan 2025 0 repositories listed
-
SPEQ: Stabilization Phases for Efficient Q-Learning in High Update-To-Data Ratio Reinforcement Learning15 Jan 2025 0 repositories listed
-
Data-driven inventory management for new products: An adjusted Dyna-Q approach with transfer learning14 Jan 2025 0 repositories listed
-
Online inductive learning from answer sets for efficient reinforcement learning exploration13 Jan 2025 0 repositories listed
-
Cooperative Optimal Output Tracking for Discrete-Time Multiagent Systems: Stabilizing Policy Iteration Frameworks and Analysis11 Jan 2025 0 repositories listed
-
Deep Transfer Q-Learning for Offline Non-Stationary Reinforcement Learning8 Jan 2025 0 repositories listed
-
β-DQN: Improving Deep Q-Learning By Evolving the Behavior1 Jan 2025 0 repositories listed
-
Data-Based Efficient Off-Policy Stabilizing Optimal Control Algorithms for Discrete-Time Linear Systems via Damping Coefficients30 Dec 2024 0 repositories listed
-
Dynamic Optimization of Storage Systems Using Reinforcement Learning Techniques29 Dec 2024 0 repositories listed
-
Protein Structure Prediction in the 3D HP Model Using Deep Reinforcement Learning29 Dec 2024 0 repositories listed
-
A Reinforcement Learning-Based Task Mapping Method to Improve the Reliability of Clustered Manycores26 Dec 2024 0 repositories listed
-
HyperQ-Opt: Q-learning for Hyperparameter Optimization23 Dec 2024 0 repositories listed
-
ACL-QL: Adaptive Conservative Level in Q-Learning for Offline Reinforcement Learning22 Dec 2024 0 repositories listed
-
Multi-Agent Q-Learning for Real-Time Load Balancing User Association and Handover in Mobile Networks22 Dec 2024 0 repositories listed
-
Distribution-Free Uncertainty Quantification in Mechanical Ventilation Treatment: A Conformal Deep Q-Learning Framework17 Dec 2024 0 repositories listed
-
Neural-Network-Driven Reward Prediction as a Heuristic: Advancing Q-Learning for Mobile Robot Path Planning17 Dec 2024 0 repositories listed
-
Integrated trucks assignment and scheduling problem with mixed service mode docks: A Q-learning based adaptive large neighborhood search algorithm12 Dec 2024 0 repositories listed
-
PickLLM: Context-Aware RL-Assisted Large Language Model Routing12 Dec 2024 0 repositories listed
-
Edge Delayed Deep Deterministic Policy Gradient: efficient continuous control for edge scenarios9 Dec 2024 0 repositories listed
-
Demonstration Selection for In-Context Learning via Reinforcement Learning5 Dec 2024 0 repositories listed
-
Comparative Analysis of Multi-Agent Reinforcement Learning Policies for Crop Planning Decision Support3 Dec 2024 0 repositories listed
-
Mean-Field Sampling for Cooperative Multi-Agent Reinforcement Learning1 Dec 2024 0 repositories listed
-
Q-learning-based Model-free Safety Filter29 Nov 2024 0 repositories listed
-
Dynamic Retail Pricing via Q-Learning -- A Reinforcement Learning Framework for Enhanced Revenue Management27 Nov 2024 0 repositories listed
-
Time-Scale Separation in Q-Learning: Extending TD(△) for Action-Value Function Decomposition21 Nov 2024 0 repositories listed
-
Almost Sure Convergence Rates and Concentration of Stochastic Approximation and Reinforcement Learning with Markovian Noise20 Nov 2024 0 repositories listed
-
Structure learning with Temporal Gaussian Mixture for model-based Reinforcement Learning18 Nov 2024 0 repositories listed
-
Mitigating Relative Over-Generalization in Multi-Agent Reinforcement Learning17 Nov 2024 0 repositories listed
-
Coverage Analysis for Digital Cousin Selection -- Improving Multi-Environment Q-Learning13 Nov 2024 0 repositories listed
-
Navigation with QPHIL: Quantizing Planner for Hierarchical Implicit Q-Learning12 Nov 2024 0 repositories listed
-
Overcoming the Curse of Dimensionality in Reinforcement Learning Through Approximate Factorization12 Nov 2024 0 repositories listed
-
Real-World Offline Reinforcement Learning from Vision Language Model Feedback8 Nov 2024 0 repositories listed
-
Reinforcement Learning for Adaptive Resource Scheduling in Complex System Environments8 Nov 2024 0 repositories listed
-
Asymptotic regularity of a generalised stochastic Halpern scheme with applications7 Nov 2024 0 repositories listed
-
Maximizing User Connectivity in AI-Enabled Multi-UAV Networks: A Distributed Strategy Generalized to Arbitrary User Distributions7 Nov 2024 0 repositories listed
-
Q-SFT: Q-Learning for Language Models via Supervised Fine-Tuning7 Nov 2024 0 repositories listed
-
Regret of exploratory policy improvement and q-learning2 Nov 2024 0 repositories listed
-
HAVER: Instance-Dependent Error Bounds for Maximum Mean Estimation and Applications to Q-Learning and Monte Carlo Tree Search1 Nov 2024 0 repositories listed
-
Offline Reinforcement Learning and Sequence Modeling for Downlink Link Adaptation30 Oct 2024 0 repositories listed
-
Stochastic Approximation with Unbounded Markovian Noise: A General-Purpose Theorem29 Oct 2024 0 repositories listed
-
Optimizing Load Scheduling in Power Grids Using Reinforcement Learning and Markov Decision Processes23 Oct 2024 0 repositories listed
-
A Novel Reinforcement Learning Model for Post-Incident Malware Investigations19 Oct 2024 0 repositories listed
-
DIAR: Diffusion-model-guided Implicit Q-learning with Adaptive Revaluation15 Oct 2024 0 repositories listed
-
Diffusion-Based Offline RL for Improved Decision-Making in Augmented ARC Task15 Oct 2024 0 repositories listed
-
Improve Value Estimation of Q Function and Reshape Reward with Monte Carlo Tree Search15 Oct 2024 0 repositories listed
-
Learning Agents With Prioritization and Parameter Noise in Continuous State and Action Space15 Oct 2024 0 repositories listed
-
MFC-EQ: Mean-Field Control with Envelope Q-Learning for Moving Decentralized Agents in Formation15 Oct 2024 0 repositories listed