Browse State-of-the-Art › Q-Learning › Papers, page 7
Q-Learning
Papers archive 2025-07-28
archive papers tagged: 1,918 · with a code link: 463 · where Syntology ran a sample: 119 (102 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (119 of 1,918 tagged: 102 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument)
Page 7 of 20: papers 601 to 700 of 1,918, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Multi-Objective-Optimization Multi-AUV Assisted Data Collection Framework for IoUT Based on Offline Reinforcement Learning15 Oct 2024 0 repositories listed
-
Asymptotic Analysis of Sample-averaged Q-learning14 Oct 2024 0 repositories listed
-
Online waveform selection for cognitive radar14 Oct 2024 0 repositories listed
-
Hybrid LLM-DDQN based Joint Optimization of V2I Communication and Autonomous Driving11 Oct 2024 0 repositories listed
-
Gap-Dependent Bounds for Q-Learning using Reference-Advantage Decomposition10 Oct 2024 0 repositories listed
-
UNIQ: Offline Inverse Q-learning for Avoiding Undesirable Demonstrations10 Oct 2024 0 repositories listed
-
VerifierQ: Enhancing LLM Test Time Compute with Q-Learning-based Verifiers10 Oct 2024 0 repositories listed
-
Optimized Resource Allocation for Cloud-Native 6G Networks: Zero-Touch ML Models in Microservices-based VNF Deployments9 Oct 2024 0 repositories listed
-
Q-WSL: Optimizing Goal-Conditioned RL with Weighted Supervised Learning via Dynamic Programming9 Oct 2024 0 repositories listed
-
Learning in complex action spaces without policy gradients8 Oct 2024 0 repositories listed
-
Reinforcenment Learning-Aided NOMA Random Access: An AoI-Based Timeliness Perspective4 Oct 2024 0 repositories listed
-
Mimicking Human Intuition: Cognitive Belief-Driven Q-Learning2 Oct 2024 0 repositories listed
-
Adaptive Knowledge-based Multi-Objective Evolutionary Algorithm for Hybrid Flow Shop Scheduling Problems with Multiple Parallel Batch Processing Stages27 Sep 2024 0 repositories listed
-
Optimized Monte Carlo Tree Search for Enhanced Decision Making in the FrozenLake Environment25 Sep 2024 0 repositories listed
-
Reinforcement Learning for Finite Space Mean-Field Type Games25 Sep 2024 0 repositories listed
-
Agent-state based policies in POMDPs: Beyond belief-state MDPs24 Sep 2024 0 repositories listed
-
Learning to Play Video Games with Intuitive Physics Priors20 Sep 2024 0 repositories listed
-
Data-Efficient Quadratic Q-Learning Using LMIs18 Sep 2024 0 repositories listed
-
Automating proton PBS treatment planning for head and neck cancers using policy gradient-based deep reinforcement learning17 Sep 2024 0 repositories listed
-
SHIRE: Enhancing Sample Efficiency using Human Intuition in REinforcement Learning16 Sep 2024 0 repositories listed
-
KAN v.s. MLP for Offline Reinforcement Learning15 Sep 2024 0 repositories listed
-
Autonomous Vehicle Decision-Making Framework for Considering Malicious Behavior at Unsignalized Intersections11 Sep 2024 0 repositories listed
-
Reinforcement Learning for Rate Maximization in IRS-aided OWC Networks7 Sep 2024 0 repositories listed
-
Reward-Directed Score-Based Diffusion Models via q-Learning7 Sep 2024 0 repositories listed
-
Faster Q-Learning Algorithms for Restless Bandits6 Sep 2024 0 repositories listed
-
Whittle Index Learning Algorithms for Restless Bandits with Constant Stepsizes6 Sep 2024 0 repositories listed
-
Asynchronous Stochastic Approximation and Average-Reward Reinforcement Learning5 Sep 2024 0 repositories listed
-
On the Convergence Rates of Federated Q-Learning across Heterogeneous Environments5 Sep 2024 0 repositories listed
-
Reinforcement Learning-enabled Satellite Constellation Reconfiguration and Retasking for Mission-Critical Applications3 Sep 2024 0 repositories listed
-
Accelerated Multi-objective Task Learning using Modified Q-learning Algorithm2 Sep 2024 0 repositories listed
-
Imitating Language via Scalable Inverse Reinforcement Learning2 Sep 2024 0 repositories listed
-
The Sample-Communication Complexity Trade-off in Federated Q-Learning30 Aug 2024 0 repositories listed
-
Coverage Analysis of Multi-Environment Q-Learning Algorithms for Wireless Network Optimization29 Aug 2024 0 repositories listed
-
On Convergence of Average-Reward Q-Learning in Weakly Communicating Markov Decision Processes29 Aug 2024 0 repositories listed
-
Dynamic operator management in meta-heuristics using reinforcement learning: an application to permutation flowshop scheduling problems27 Aug 2024 0 repositories listed
-
Optimizing TD3 for 7-DOF Robotic Arm Grasping: Overcoming Suboptimality with Exploration-Enhanced Contrastive Learning26 Aug 2024 0 repositories listed
-
Can LLM be a Good Path Planner based on Prompt Engineering? Mitigating the Hallucination for Path Planning23 Aug 2024 0 repositories listed
-
Deviations from the Nash equilibrium and emergence of tacit collusion in a two-player optimal execution game with reinforcement learning21 Aug 2024 0 repositories listed
-
GINO-Q: Learning an Asymptotically Optimal Index Policy for Restless Multi-armed Bandits19 Aug 2024 0 repositories listed
-
Improved Q-learning based Multi-hop Routing for UAV-Assisted Communication17 Aug 2024 0 repositories listed
-
A Conflicts-free, Speed-lossless KAN-based Reinforcement Learning Decision System for Interactive Driving in Roundabouts15 Aug 2024 0 repositories listed
-
Variance-Reduced Cascade Q-learning: Algorithms and Sample Complexity13 Aug 2024 0 repositories listed
-
A Geometric Nash Approach in Tuning the Learning Rate in Q-Learning Algorithm9 Aug 2024 0 repositories listed
-
QADQN: Quantum Attention Deep Q-Network for Financial Market Prediction6 Aug 2024 0 repositories listed
-
Model-free optimal controller for discrete-time Markovian jump linear systems: A Q-learning approach6 Aug 2024 0 repositories listed
-
Whittle's index-based age-of-information minimization in multi-energy harvesting source networks5 Aug 2024 0 repositories listed
-
Reinforcement Learning for an Efficient and Effective Malware Investigation during Cyber Incident Response4 Aug 2024 0 repositories listed
-
Multi-Objective Deep Reinforcement Learning for Optimisation in Autonomous Systems2 Aug 2024 0 repositories listed
-
Multi-agent Assessment with QoS Enhancement for HD Map Updates in a Vehicular Network31 Jul 2024 0 repositories listed
-
Evolution of cooperation in the public goods game with Q-learning29 Jul 2024 0 repositories listed
-
Evolution of cooperation with Q-learning: the impact of information perception29 Jul 2024 0 repositories listed
-
Multi-Agent Deep Reinforcement Learning for Energy Efficient Multi-Hop STAR-RIS-Assisted Transmissions26 Jul 2024 0 repositories listed
-
QT-TDM: Planning With Transformer Dynamics Model and Autoregressive Q-Learning26 Jul 2024 0 repositories listed
-
Long-term Fairness in Ride-Hailing Platform25 Jul 2024 0 repositories listed
-
Principal-Agent Reinforcement Learning: Orchestrating AI Agents with Contracts25 Jul 2024 0 repositories listed
-
In Search for Architectures and Loss Functions in Multi-Objective Reinforcement Learning23 Jul 2024 0 repositories listed
-
Evaluation of Reinforcement Learning for Autonomous Penetration Testing using A3C, Q-learning and DQN22 Jul 2024 0 repositories listed
-
MODRL-TA:A Multi-Objective Deep Reinforcement Learning Framework for Traffic Allocation in E-Commerce Search22 Jul 2024 0 repositories listed
-
Coverage-aware and Reinforcement Learning Using Multi-agent Approach for HD Map QoS in a Realistic Environment19 Jul 2024 0 repositories listed
-
An Agile Adaptation Method for Multi-mode Vehicle Communication Networks18 Jul 2024 0 repositories listed
-
Deep Reinforcement Learning for Multi-Objective Optimization: Enhancing Wind Turbine Energy Generation while Mitigating Noise Emissions18 Jul 2024 0 repositories listed
-
Misspecified Q-Learning with Sparse Linear Function Approximation: Tight Bounds on Approximation Error18 Jul 2024 0 repositories listed
-
Optimistic Q-learning for average reward and episodic reinforcement learning18 Jul 2024 0 repositories listed
-
Reinforcement Learning: Tutorial and Survey18 Jul 2024 0 repositories listed
-
Solving the Model Unavailable MARE using Q-Learning Algorithm18 Jul 2024 0 repositories listed
-
Cooperative Reward Shaping for Multi-Agent Pathfinding15 Jul 2024 0 repositories listed
-
Exploration in Knowledge Transfer Utilizing Reinforcement Learning15 Jul 2024 0 repositories listed
-
PAIL: Performance based Adversarial Imitation Learning Engine for Carbon Neutral Optimization12 Jul 2024 0 repositories listed
-
PID Accelerated Temporal Difference Algorithms11 Jul 2024 0 repositories listed
-
Periodic agent-state based Q-learning for POMDPs8 Jul 2024 0 repositories listed
-
Unified continuous-time q-learning for mean-field game and mean-field control problems5 Jul 2024 0 repositories listed
-
Artificial Intelligence and Algorithmic Price Collusion in Two-sided Markets4 Jul 2024 0 repositories listed
-
Configuring Transmission Thresholds in IIoT Alarm Scenarios for Energy-Efficient Event Reporting4 Jul 2024 0 repositories listed
-
Continuous-time q-Learning for Jump-Diffusion Models under Tsallis Entropy4 Jul 2024 0 repositories listed
-
Two-Step Q-Learning2 Jul 2024 0 repositories listed
-
A Deep Reinforcement Learning Approach to Battery Management in Dairy Farming via Proximal Policy Optimization1 Jul 2024 0 repositories listed
-
Model-based Offline Reinforcement Learning with Lower Expectile Q-Learning30 Jun 2024 0 repositories listed
-
Towards Secure and Efficient Data Scheduling for Vehicular Social Networks28 Jun 2024 0 repositories listed
-
Decentralized Semantic Traffic Control in AVs Using RL and DQN for Dynamic Roadblocks26 Jun 2024 0 repositories listed
-
MEReQ: Max-Ent Residual-Q Inverse RL for Sample-Efficient Alignment from Intervention24 Jun 2024 0 repositories listed
-
A General Control-Theoretic Approach for Reinforcement Learning: Theory and Algorithms20 Jun 2024 0 repositories listed
-
EduQate: Generating Adaptive Curricula through RMABs in Education Settings20 Jun 2024 0 repositories listed
-
Equivariant Offline Reinforcement Learning20 Jun 2024 0 repositories listed
-
Learning to Select Goals in Automated Planning with Deep-Q Learning20 Jun 2024 0 repositories listed
-
Catalytic evolution of cooperation in a population with behavioural bimodality17 Jun 2024 0 repositories listed
-
Optimal Transport-Assisted Risk-Sensitive Q-Learning17 Jun 2024 0 repositories listed
-
Finite-Time Analysis of Simultaneous Double Q-learning14 Jun 2024 0 repositories listed
-
Mix Q-learning for Lane Changing: A Collaborative Decision-Making Method in Multi-Agent Deep Reinforcement Learning14 Jun 2024 0 repositories listed
-
Multi-agent Reinforcement Learning with Deep Networks for Diverse Q-Vectors12 Jun 2024 0 repositories listed
-
Fast-Fading Channel and Power Optimization of the Magnetic Inductive Cellular Network7 Jun 2024 0 repositories listed
-
Online Frequency Scheduling by Learning Parallel Actions7 Jun 2024 0 repositories listed
-
Bootstrapping Expectiles in Reinforcement Learning6 Jun 2024 0 repositories listed
-
Age of Trust (AoT): A Continuous Verification Framework for Wireless Networks4 Jun 2024 0 repositories listed
-
Algorithmic Collusion in Dynamic Pricing with Deep Reinforcement Learning4 Jun 2024 0 repositories listed
-
Tabular and Deep Learning for the Whittle Index4 Jun 2024 0 repositories listed
-
How to discretize continuous state-action spaces in Q-learning: A symbolic control approach3 Jun 2024 0 repositories listed
-
Approximate Global Convergence of Independent Learning in Multi-Agent Systems30 May 2024 0 repositories listed
-
Q-learning as a monotone scheme30 May 2024 0 repositories listed
-
Federated Q-Learning with Reference-Advantage Decomposition: Almost Optimal Regret and Logarithmic Communication Cost29 May 2024 0 repositories listed
-
Highway Reinforcement Learning28 May 2024 0 repositories listed