Methods › Reinforcement Learning › Replay Memory › Experience Replay › Papers, page 2
Experience Replay
Papers archive 2025-07-28
archive papers tagged: 865 · with a code link: 317 · where Syntology ran a sample: 94 (86 with a run with no instrument failure, 8 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (94 of 865 tagged: 86 with a run with no instrument failure, 8 where every run was a failure of Syntology's instrument)
Page 2 of 9: papers 101 to 200 of 865, newest first by the archive's date (ties by slug), in archive order.
Repository counts are the archive's code-links table. A Syntology line states what Syntology ran from that paper's harvested code, as “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the instrument figure counts failures of Syntology's instrument, not of the code. It is per sample and not a correctness claim. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code; “community repositories only” when every sample that ran came from a community repository, “official: no sample here; runs from other or unrecorded repositories” when some came from a repository the paper names or has in its text, or from none recorded); hover it for the repositories the samples that ran came from.
-
Cooperative Multi-Agent Deep Reinforcement Learning in Content Ranking Optimization 8 Aug 2024 · 0 repositories · arXiv:2408.04251
-
QADQN: Quantum Attention Deep Q-Network for Financial Market Prediction 6 Aug 2024 · 0 repositories · arXiv:2408.03088
-
Image-Based Deep Reinforcement Learning with Intrinsically Motivated Stimuli: On the Execution of Complex Robotic Tasks 31 Jul 2024 · 0 repositories · arXiv:2407.21338
-
FTF-ER: Feature-Topology Fusion-Based Experience Replay Method for Continual Graph Learning 28 Jul 2024 · 1 repository · arXiv:2407.19429
-
FH-DRL: Exponential-Hyperbolic Frontier Heuristics with DRL for accelerated Exploration in Unknown Environments 26 Jul 2024 · 0 repositories · arXiv:2407.18892
-
The Cross-environment Hyperparameter Setting Benchmark for Reinforcement Learning 26 Jul 2024 · 0 repositories · arXiv:2407.18840
-
Learn to Memorize and to Forget: A Continual Learning Perspective of Dynamic SLAM 18 Jul 2024 · 0 repositories · arXiv:2407.13338
-
Reconfigurable Intelligent Surface Aided Vehicular Edge Computing: Joint Phase-shift Optimization and Multi-User Power Allocation 18 Jul 2024 · 1 repository · arXiv:2407.13123
-
ER-FSL: Experience Replay with Feature Subspace Learning for Online Continual Learning 17 Jul 2024 · 0 repositories · arXiv:2407.12279
-
Deep reinforcement learning with symmetric data augmentation applied for aircraft lateral attitude tracking control 13 Jul 2024 · 0 repositories · arXiv:2407.11077
-
Deep Attention Driven Reinforcement Learning (DAD-RL) for Autonomous Decision-Making in Dynamic Environment 12 Jul 2024 · 1 repository · arXiv:2407.08932
-
Investigating the Interplay of Prioritized Replay and Generalization 12 Jul 2024 · 0 repositories · arXiv:2407.09702
-
Real-time system optimal traffic routing under uncertainties -- Can physics models boost reinforcement learning? 10 Jul 2024 · 0 repositories · arXiv:2407.07364
-
Economic span selection of bridge based on deep reinforcement learning 9 Jul 2024 · 1 repository · arXiv:2407.06507
-
Enhanced Safety in Autonomous Driving: Integrating Latent State Diffusion Model for End-to-End Navigation 8 Jul 2024 · 0 repositories · arXiv:2407.06317
-
Continual Learning Optimizations for Auto-regressive Decoder of Multilingual ASR systems 4 Jul 2024 · 0 repositories · arXiv:2407.03645
-
ROER: Regularized Optimal Experience Replay 4 Jul 2024 · 1 repository · arXiv:2407.03995
-
Deep Reinforcement Learning Strategies in Finance: Insights into Asset Holding, Trading Behavior, and Purchase Diversity 29 Jun 2024 · 0 repositories · arXiv:2407.09557
-
Performance Comparison of Deep RL Algorithms for Mixed Traffic Cooperative Lane-Changing 25 Jun 2024 · 0 repositories · arXiv:2407.02521
-
Toward Universal Medical Image Registration via Sharpness-Aware Meta-Continual Learning 25 Jun 2024 · 0 repositories · arXiv:2406.17575
-
Towards Dynamic Resource Allocation and Client Scheduling in Hierarchical Federated Learning: A Two-Phase Deep Reinforcement Learning Approach 21 Jun 2024 · 0 repositories · arXiv:2406.14910
-
Physics-informed Imitative Reinforcement Learning for Real-world Driving 18 Jun 2024 · 0 repositories · arXiv:2407.02508
-
CUER: Corrected Uniform Experience Replay for Off-Policy Continuous Deep Reinforcement Learning Algorithms 13 Jun 2024 · 0 repositories · arXiv:2406.09030
-
Adaptive Opponent Policy Detection in Multi-Agent MDPs: Real-Time Strategy Switch Identification Using Running Error Estimation 10 Jun 2024 · 0 repositories · arXiv:2406.06500
-
Lifelong Learning of Video Diffusion Models From a Single Video Stream 7 Jun 2024 · 0 repositories · arXiv:2406.04814
-
A New View on Planning in Online Reinforcement Learning 3 Jun 2024 · 0 repositories · arXiv:2406.01562
-
iKAN: Global Incremental Learning with KAN for Human Activity Recognition Across Heterogeneous Datasets 3 Jun 2024 · 0 repositories · arXiv:2406.01646
-
Value Improved Actor Critic Algorithms 3 Jun 2024 · 0 repositories · arXiv:2406.01423
-
Shared-unique Features and Task-aware Prioritized Sampling on Multi-task Reinforcement Learning 2 Jun 2024 · 0 repositories · arXiv:2406.00761
-
Saturn: Sample-efficient Generative Molecular Design using Memory Manipulation 27 May 2024 · 2 repositories · arXiv:2405.17066Syntology official (archive's flag): 2 ran · 2 ran (of which 0 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 1 where Syntology's instrument failed) · 0 unverified (of 2 harvested samples) · 1 pointer-only (licence)
-
Meta Reinforcement Learning for Resource Allocation in Multi-Antenna UAV Network with Rate Splitting Multiple Access 18 May 2024 · 0 repositories · arXiv:2405.11306
-
Chaos-based reinforcement learning with TD3 15 May 2024 · 0 repositories · arXiv:2405.09086
-
MGSER-SAM: Memory-Guided Soft Experience Replay with Sharpness-Aware Optimization for Enhanced Continual Learning 15 May 2024 · 0 repositories · arXiv:2405.09492
-
CIER: A Novel Experience Replay Approach with Causal Inference in Deep Reinforcement Learning 14 May 2024 · 0 repositories · arXiv:2405.08380
-
An Initial Introduction to Cooperative Multi-Agent Reinforcement Learning 10 May 2024 · 0 repositories · arXiv:2405.06161
-
Offline Reinforcement Learning with Behavioral Supervisor Tuning 25 Apr 2024 · 0 repositories · arXiv:2404.16399
-
A fast balance optimization approach for charging enhancement of lithium-ion battery packs through deep reinforcement learning 24 Apr 2024 · 1 repository
-
Data-Incremental Continual Offline Reinforcement Learning 19 Apr 2024 · 0 repositories · arXiv:2404.12639
-
LTL-Constrained Policy Optimization with Cycle Experience Replay 17 Apr 2024 · 0 repositories · arXiv:2404.11578
-
Continuous Control Reinforcement Learning: Distributed Distributional DrQ Algorithms 16 Apr 2024 · 0 repositories · arXiv:2404.10645
-
Joint Physical-Digital Facial Attack Detection Via Simulating Spoofing Clues 12 Apr 2024 · 3 repositories · arXiv:2404.08450
-
Continual Learning with Weight Interpolation 5 Apr 2024 · 1 repository · arXiv:2404.04002Syntology official (archive's flag): 5 ran · 5 ran (of which 0 constructed an object rather than computing a result; 5 with no instrument failure: 0 honoured, 0 violated, 5 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified (of 5 harvested samples)
-
Laser Learning Environment: A new environment for coordination-critical multi-agent tasks 4 Apr 2024 · 1 repository · arXiv:2404.03596
-
Imitation Game: A Model-based and Imitation Learning Deep Reinforcement Learning Hybrid 2 Apr 2024 · 0 repositories · arXiv:2404.01794
-
K-percent Evaluation for Lifelong RL 2 Apr 2024 · 0 repositories · arXiv:2404.02113
-
An Improved Strategy for Blood Glucose Control Using Multi-Step Deep Reinforcement Learning 12 Mar 2024 · 0 repositories · arXiv:2403.07566
-
RLingua: Improving Reinforcement Learning Sample Efficiency in Robotic Manipulations With Large Language Models 11 Mar 2024 · 0 repositories · arXiv:2403.06420
-
Conservative DDPG -- Pessimistic RL without Ensemble 8 Mar 2024 · 0 repositories · arXiv:2403.05732
-
A Natural Extension To Online Algorithms For Hybrid RL With Limited Coverage 7 Mar 2024 · 0 repositories · arXiv:2403.09701
-
Fill-and-Spill: Deep Reinforcement Learning Policy Gradient Methods for Reservoir Operation Decision and Control 7 Mar 2024 · 0 repositories · arXiv:2403.04195
-
LLMs in the Imaginarium: Tool Learning through Simulated Trial and Error 7 Mar 2024 · 1 repository · arXiv:2403.04746Syntology official (archive's flag): 6 ran · 6 ran (of which 0 constructed an object rather than computing a result; 6 with no instrument failure: 0 honoured, 0 violated, 6 with no contract checked; 0 where Syntology's instrument failed) · 7 unverified (of 13 harvested samples) · 1 pointer-only (licence)
-
Analyzing and Reducing Catastrophic Forgetting in Parameter Efficient Tuning 29 Feb 2024 · 1 repository · arXiv:2402.18865Syntology official (archive's flag): 9 ran · 9 ran (of which 0 constructed an object rather than computing a result; 9 with no instrument failure: 1 honoured, 0 violated, 8 with no contract checked; 0 where Syntology's instrument failed) · 2 unverified (of 11 harvested samples) · 11 pointer-only (licence)
-
Human-Centric Aware UAV Trajectory Planning in Search and Rescue Missions Employing Multi-Objective Reinforcement Learning with AHP and Similarity-Based Experience Replay 28 Feb 2024 · 0 repositories · arXiv:2402.18487
-
Model Free Deep Deterministic Policy Gradient Controller for Setpoint Tracking of Non-minimum Phase Systems 27 Feb 2024 · 0 repositories · arXiv:2402.17703
-
Combinatorial Client-Master Multiagent Deep Reinforcement Learning for Task Offloading in Mobile Edge Computing 18 Feb 2024 · 2 repositories · arXiv:2402.11653
-
Reinforcement learning to maximise wind turbine energy generation 17 Feb 2024 · 0 repositories · arXiv:2402.11384
-
Exploiting Estimation Bias in Clipped Double Q-Learning for Continous Control Reinforcement Learning Tasks 14 Feb 2024 · 0 repositories · arXiv:2402.09078
-
Layerwise Proximal Replay: A Proximal Point Method for Online Continual Learning 14 Feb 2024 · 1 repository · arXiv:2402.09542
-
FlowPG: Action-constrained Policy Gradient with Normalizing Flows 7 Feb 2024 · 1 repository · arXiv:2402.05149
-
MinMaxMin Q-learning 3 Feb 2024 · 0 repositories · arXiv:2402.05951
-
SQT -- std Q-target 3 Feb 2024 · 0 repositories · arXiv:2402.05950
-
Neural Style Transfer with Twin-Delayed DDPG for Shared Control of Robotic Manipulators 1 Feb 2024 · 0 repositories · arXiv:2402.00722
-
Continuous Unsupervised Domain Adaptation Using Stabilized Representations and Experience Replay 31 Jan 2024 · 1 repository · arXiv:2402.00580
-
Deep Reinforcement Learning for Voltage Control and Renewable Accommodation Using Spatial-Temporal Graph Information 29 Jan 2024 · 0 repositories · arXiv:2401.15848
-
Learning fast changing slow in spiking neural networks 25 Jan 2024 · 0 repositories · arXiv:2402.10069
-
Back-stepping Experience Replay with Application to Model-free Reinforcement Learning for a Soft Snake Robot 21 Jan 2024 · 0 repositories · arXiv:2401.11372
-
Reconciling Spatial and Temporal Abstractions for Goal Representation 18 Jan 2024 · 1 repository · arXiv:2401.09870Syntology official (archive's flag): 5 ran · 5 ran (of which 0 constructed an object rather than computing a result; 4 with no instrument failure: 1 honoured, 0 violated, 3 with no contract checked; 1 where Syntology's instrument failed) · 6 unverified (of 11 harvested samples) · 11 pointer-only (licence)
-
Solving Continual Offline Reinforcement Learning with Decision Transformer 16 Jan 2024 · 0 repositories · arXiv:2401.08478
-
Sum Throughput Maximization in Multi-BD Symbiotic Radio NOMA Network Assisted by Active-STAR-RIS 16 Jan 2024 · 0 repositories · arXiv:2401.08301
-
AI-enabled Priority and Auction-Based Spectrum Management for 6G 12 Jan 2024 · 0 repositories · arXiv:2401.06484
-
An experimental evaluation of Deep Reinforcement Learning algorithms for HVAC control 11 Jan 2024 · 1 repository · arXiv:2401.05737
-
A Topology-aware Graph Coarsening Framework for Continual Graph Learning 5 Jan 2024 · 0 repositories · arXiv:2401.03077
-
Adaptive Discounting of Training Time Attacks 5 Jan 2024 · 0 repositories · arXiv:2401.02652
-
Deep Reinforcement Learning for Local Path Following of an Autonomous Formula SAE Vehicle 5 Jan 2024 · 0 repositories · arXiv:2401.02903
-
Uncertainty-Guided Never-Ending Learning to Drive 1 Jan 2024 · 0 repositories
-
Adaptive Kalman-based hybrid car following strategy using TD3 and CACC 26 Dec 2023 · 0 repositories · arXiv:2312.15993
-
Multiagent Copilot Approach for Shared Autonomy between Human EEG and TD3 Deep Reinforcement Learning 22 Dec 2023 · 0 repositories · arXiv:2312.14458
-
Dynamic Fairness-Aware Spectrum Auction for Enhanced Licensed Shared Access in 6G Networks 20 Dec 2023 · 0 repositories · arXiv:2312.12867
-
Contextual Reinforcement Learning for Offshore Wind Farm Bidding 18 Dec 2023 · 0 repositories · arXiv:2312.10884
-
Class-Wise Buffer Management for Incremental Object Detection: An Effective Buffer Training Strategy 14 Dec 2023 · 0 repositories · arXiv:2312.09139
-
Enhancing Robotic Navigation: An Evaluation of Single and Multi-Objective Reinforcement Learning Strategies 13 Dec 2023 · 0 repositories · arXiv:2312.07953
-
On Designing Multi-UAV aided Wireless Powered Dynamic Communication via Hierarchical Deep Reinforcement Learning 13 Dec 2023 · 0 repositories · arXiv:2312.07917
-
Efficient Sparse-Reward Goal-Conditioned Reinforcement Learning with a High Replay Ratio and Regularization 10 Dec 2023 · 1 repository · arXiv:2312.05787
-
Privacy Preserving Multi-Agent Reinforcement Learning in Supply Chains 9 Dec 2023 · 0 repositories · arXiv:2312.05686
-
Finite Horizon Multi-Agent Reinforcement Learning in Solving Optimal Control of State-Dependent Switched Systems 8 Dec 2023 · 0 repositories · arXiv:2312.04767
-
Contact Energy Based Hindsight Experience Prioritization 5 Dec 2023 · 0 repositories · arXiv:2312.02677
-
Directly Attention Loss Adjusted Prioritized Experience Replay 24 Nov 2023 · 0 repositories · arXiv:2311.14390
-
Multi-Timescale Control and Communications with Deep Reinforcement Learning -- Part II: Control-Aware Radio Resource Allocation 19 Nov 2023 · 0 repositories · arXiv:2311.11280
-
6G Fresnel Spot Beamfocusing using Large-Scale Metasurfaces: A Distributed DRL-Based Approach 18 Nov 2023 · 0 repositories · arXiv:2311.11109
-
Joint Sensing and Communication Optimization in Target-Mounted STARS-Assisted Vehicular Networks: A MADRL Approach 17 Nov 2023 · 0 repositories · arXiv:2311.10352
-
Advancing Algorithmic Trading: A Multi-Technique Enhancement of Deep Q-Network Models 9 Nov 2023 · 0 repositories · arXiv:2311.05743
-
Learning to Learn for Few-shot Continual Active Learning 7 Nov 2023 · 0 repositories · arXiv:2311.03732
-
Mitigating Estimation Errors by Twin TD-Regularized Actor and Critic for Deep Reinforcement Learning 7 Nov 2023 · 0 repositories · arXiv:2311.03711
-
Epidemic Decision-making System Based Federated Reinforcement Learning 3 Nov 2023 · 0 repositories · arXiv:2311.01749
-
On the Theory of Risk-Aware Agents: Bridging Actor-Critic and Economics 30 Oct 2023 · 0 repositories · arXiv:2310.19527
-
Dynamic V2X Autonomous Perception from Road-to-Vehicle Vision 29 Oct 2023 · 0 repositories · arXiv:2310.19113
-
Hierarchical Framework for Interpretable and Probabilistic Model-Based Safe Reinforcement Learning 28 Oct 2023 · 1 repository · arXiv:2310.18811
-
Adaptive Resource Management for Edge Network Slicing using Incremental Multi-Agent Deep Reinforcement Learning 26 Oct 2023 · 0 repositories · arXiv:2310.17523
-
Model predictive control-based value estimation for efficient reinforcement learning 25 Oct 2023 · 1 repository · arXiv:2310.16646
-
On the Convergence and Sample Complexity Analysis of Deep Q-Networks with ε-Greedy Exploration 24 Oct 2023 · 0 repositories · arXiv:2310.16173