Methods › Reinforcement Learning › Replay Memory › Experience Replay › Papers, page 5
Experience Replay
Papers archive 2025-07-28
archive papers tagged: 865 · with a code link: 317 · where Syntology ran a sample: 94 (86 with a run with no instrument failure, 8 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (94 of 865 tagged: 86 with a run with no instrument failure, 8 where every run was a failure of Syntology's instrument)
Page 5 of 9: papers 401 to 500 of 865, newest first by the archive's date (ties by slug), in archive order.
Repository counts are the archive's code-links table. A Syntology line states what Syntology ran from that paper's harvested code, as “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the instrument figure counts failures of Syntology's instrument, not of the code. It is per sample and not a correctness claim. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code; “community repositories only” when every sample that ran came from a community repository, “official: no sample here; runs from other or unrecorded repositories” when some came from a repository the paper names or has in its text, or from none recorded); hover it for the repositories the samples that ran came from.
-
MicroRacer: a didactic environment for Deep Reinforcement Learning 20 Mar 2022 · 1 repository · arXiv:2203.10494
-
Decision-making of Emergent Incident based on P-MADDPG 19 Mar 2022 · 0 repositories · arXiv:2203.12673
-
Learning to Infer Belief Embedded Communication 15 Mar 2022 · 0 repositories · arXiv:2203.07832
-
Lifelong Adaptive Machine Learning for Sensor-based Human Activity Recognition Using Prototypical Networks 11 Mar 2022 · 0 repositories · arXiv:2203.05692
-
Random Ensemble Reinforcement Learning for Traffic Signal Control 10 Mar 2022 · 0 repositories · arXiv:2203.05961
-
Designing Heterogeneous GNNs with Desired Permutation Properties for Wireless Resource Allocation 8 Mar 2022 · 0 repositories · arXiv:2203.03906
-
New Insights on Reducing Abrupt Representation Change in Online Continual Learning 8 Mar 2022 · 2 repositories · arXiv:2203.03798
-
Learning Bayesian Sparse Networks with Full Experience Replay for Continual Learning 21 Feb 2022 · 0 repositories · arXiv:2202.10203
-
Soft Actor-Critic Deep Reinforcement Learning for Fault Tolerant Flight Control 16 Feb 2022 · 1 repository · arXiv:2202.09262
-
AI-based Robust Resource Allocation in End-to-End Network Slicing under Demand and CSI Uncertainties 10 Feb 2022 · 0 repositories · arXiv:2202.05131
-
Imitation Learning by State-Only Distribution Matching 9 Feb 2022 · 1 repository · arXiv:2202.04332Syntology official (archive's flag): 1 ran · 1 ran (of which 0 constructed an object rather than computing a result; 0 with no instrument failure: 0 honoured, 0 violated, 0 with no contract checked; 1 where Syntology's instrument failed) · 0 unverified (of 1 harvested sample)
-
skrl: Modular and Flexible Library for Reinforcement Learning 8 Feb 2022 · 1 repository · arXiv:2202.03825
-
Learning Fast, Learning Slow: A General Continual Learning Method based on Complementary Learning System 29 Jan 2022 · 1 repository · arXiv:2201.12604Syntology official (archive's flag): 4 ran · 4 ran (of which 2 constructed an object rather than computing a result; 4 with no instrument failure: 1 honoured, 0 violated, 3 with no contract checked; 0 where Syntology's instrument failed) · 1 unverified (of 5 harvested samples)
-
DDPG-Driven Deep-Unfolding with Adaptive Depth for Channel Estimation with Sparse Bayesian Learning 20 Jan 2022 · 0 repositories · arXiv:2201.08477
-
Critic Algorithms using Cooperative Networks 19 Jan 2022 · 0 repositories · arXiv:2201.07839
-
An Improved Reinforcement Learning Algorithm for Learning to Branch 17 Jan 2022 · 0 repositories · arXiv:2201.06213
-
Reinforcement Learning based Air Combat Maneuver Generation 14 Jan 2022 · 0 repositories · arXiv:2201.05528
-
Smart Magnetic Microrobots Learn to Swim with Deep Reinforcement Learning 14 Jan 2022 · 1 repository · arXiv:2201.05599
-
Benchmarking Deep Reinforcement Learning Algorithms for Vision-based Robotics 11 Jan 2022 · 0 repositories · arXiv:2201.04224
-
3DPG: Distributed Deep Deterministic Policy Gradient Algorithms for Networked Multi-Agent Systems 3 Jan 2022 · 0 repositories · arXiv:2201.00570
-
Class-Incremental Continual Learning into the eXtended DER-verse 3 Jan 2022 · 1 repository · arXiv:2201.00766
-
Toward Pareto Efficient Fairness-Utility Trade-off inRecommendation through Reinforcement Learning 1 Jan 2022 · 0 repositories · arXiv:2201.00140
-
Actor Loss of Soft Actor Critic Explained 31 Dec 2021 · 0 repositories · arXiv:2112.15568
-
Intelligent Traffic Light via Policy-based Deep Reinforcement Learning 27 Dec 2021 · 1 repository · arXiv:2112.13817
-
Improving the Efficiency of Off-Policy Reinforcement Learning by Accounting for Past Decisions 23 Dec 2021 · 0 repositories · arXiv:2112.12281
-
Deep Reinforcement Learning for Optimal Power Flow with Renewables Using Graph Information 22 Dec 2021 · 0 repositories · arXiv:2112.11461
-
Proving Theorems using Incremental Learning and Hindsight Experience Replay 20 Dec 2021 · 0 repositories · arXiv:2112.10664
-
Learning Reward Machines: A Study in Partially Observable Reinforcement Learning 17 Dec 2021 · 0 repositories · arXiv:2112.09477
-
Convergence Results For Q-Learning With Experience Replay 8 Dec 2021 · 0 repositories · arXiv:2112.04213
-
Hyper-parameter optimization based on soft actor critic and hierarchical mixture regularization 8 Dec 2021 · 0 repositories · arXiv:2112.04084
-
Replay For Safety 8 Dec 2021 · 0 repositories · arXiv:2112.04229
-
Lifelong Domain Adaptation via Consolidated Internal Distribution 1 Dec 2021 · 0 repositories
-
Improving Experience Replay with Successor Representation 29 Nov 2021 · 0 repositories · arXiv:2111.14331
-
Adaptively Calibrated Critic Estimates for Deep Reinforcement Learning 24 Nov 2021 · 1 repository · arXiv:2111.12673Syntology official (archive's flag): 1 ran · 1 ran (of which 0 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified (of 1 harvested sample)
-
Generalized Decision Transformer for Offline Hindsight Information Matching 19 Nov 2021 · 1 repository · arXiv:2111.10364Syntology official: no sample here; runs from other or unrecorded repositories · 1 ran (of which 0 constructed an object rather than computing a result; 0 with no instrument failure: 0 honoured, 0 violated, 0 with no contract checked; 1 where Syntology's instrument failed) · 0 unverified (of 1 harvested sample) · 1 pointer-only (licence)
-
Improving Learning from Demonstrations by Learning from Experience 16 Nov 2021 · 0 repositories · arXiv:2111.08156
-
Power Norm Based Lifelong Learning for Paraphrase Generations 16 Nov 2021 · 0 repositories
-
AWD3: Dynamic Reduction of the Estimation Bias 12 Nov 2021 · 0 repositories · arXiv:2111.06780
-
Improving Experience Replay through Modeling of Similar Transitions' Sets 12 Nov 2021 · 1 repository · arXiv:2111.06907
-
Off-Policy Correction for Deep Deterministic Policy Gradient Algorithms via Batch Prioritized Experience Replay 2 Nov 2021 · 0 repositories · arXiv:2111.01865
-
Decentralized Multi-Agent Reinforcement Learning: An Off-Policy Method 31 Oct 2021 · 0 repositories · arXiv:2111.00438
-
Hindsight Goal Ranking on Replay Buffer for Sparse Reward Environment 28 Oct 2021 · 1 repository · arXiv:2110.15043
-
Accelerating Distributed Deep Reinforcement Learning by In-Network Experience Sampling 26 Oct 2021 · 0 repositories · arXiv:2110.13506
-
Automating Control of Overestimation Bias for Reinforcement Learning 26 Oct 2021 · 0 repositories · arXiv:2110.13523
-
Recurrent Off-policy Baselines for Memory-based Continuous Control 25 Oct 2021 · 1 repository · arXiv:2110.12628
-
A Distributed Deep Reinforcement Learning Technique for Application Placement in Edge and Fog Computing Environments 24 Oct 2021 · 0 repositories · arXiv:2110.12415
-
Locality-Sensitive Experience Replay for Online Recommendation 21 Oct 2021 · 0 repositories · arXiv:2110.10850
-
Computationally Efficient Safe Reinforcement Learning for Power Systems 20 Oct 2021 · 0 repositories · arXiv:2110.10333
-
Variance Reduction based Experience Replay for Policy Optimization 17 Oct 2021 · 1 repository · arXiv:2110.08902
-
Online Target Q-learning with Reverse Experience Replay: Efficiently finding the Optimal Policy for Linear MDPs 16 Oct 2021 · 0 repositories · arXiv:2110.08440
-
Cognitively Inspired Learning of Incremental Drifting Concepts 9 Oct 2021 · 0 repositories · arXiv:2110.04662
-
Human-Aware Robot Navigation via Reinforcement Learning with Hindsight Experience Replay and Curriculum Learning 9 Oct 2021 · 0 repositories · arXiv:2110.04564
-
Robotic Lever Manipulation using Hindsight Experience Replay and Shapley Additive Explanations 7 Oct 2021 · 0 repositories · arXiv:2110.03292
-
Imaginary Hindsight Experience Replay: Curious Model-based Learning for Sparse Reward Tasks 5 Oct 2021 · 0 repositories · arXiv:2110.02414
-
Hit and Lead Discovery with Explorative RL and Fragment-based Molecule Generation 4 Oct 2021 · 0 repositories · arXiv:2110.01219Syntology 4 ran (of which 0 constructed an object rather than computing a result; 3 with no instrument failure: 0 honoured, 0 violated, 3 with no contract checked; 1 where Syntology's instrument failed) · 1 unverified (of 5 harvested samples) · 2 pointer-only (licence)
-
Large Batch Experience Replay 4 Oct 2021 · 2 repositories · arXiv:2110.01528Syntology official (archive's flag): 5 ran · 7 ran (of which 4 constructed an object rather than computing a result; 4 with no instrument failure: 0 honoured, 0 violated, 4 with no contract checked; 3 where Syntology's instrument failed) · 4 unverified (of 11 harvested samples)
-
Parallel Actors and Learners: A Framework for Generating Scalable RL Implementations 3 Oct 2021 · 0 repositories · arXiv:2110.01101
-
Solving the Real Robot Challenge using Deep Reinforcement Learning 30 Sep 2021 · 2 repositories · arXiv:2109.15233Syntology official (archive's flag): 1 ran · 1 ran (of which 0 constructed an object rather than computing a result; 0 with no instrument failure: 0 honoured, 0 violated, 0 with no contract checked; 1 where Syntology's instrument failed) · 2 unverified (of 3 harvested samples)
-
Benchmarking Sample Selection Strategies for Batch Reinforcement Learning 29 Sep 2021 · 0 repositories
-
Bootstrapped Hindsight Experience replay with Counterintuitive Prioritization 29 Sep 2021 · 0 repositories
-
Distributional Decision Transformer for Hindsight Information Matching 29 Sep 2021 · 0 repositories
-
Experience Replay More When It's a Key Transition in Deep Reinforcement Learning 29 Sep 2021 · 0 repositories
-
Explanation-Aware Experience Replay in Rule-Dense Environments 29 Sep 2021 · 1 repository · arXiv:2109.14711
-
Faster Reinforcement Learning with Value Target Lower Bounding 29 Sep 2021 · 0 repositories
-
Goal-Directed Planning via Hindsight Experience Replay 29 Sep 2021 · 0 repositories
-
Gradient Imbalance and solution in Online Continual learning 29 Sep 2021 · 0 repositories
-
Improving Meta-Continual Learning Representations with Representation Replay 29 Sep 2021 · 1 repository
-
Meta Attention For Off-Policy Actor-Critic 29 Sep 2021 · 0 repositories
-
Model-augmented Prioritized Experience Replay 29 Sep 2021 · 0 repositories
-
Robust and Data-efficient Q-learning by Composite Value-estimation 29 Sep 2021 · 0 repositories
-
SPLID: Self-Imitation Policy Learning through Iterative Distillation 29 Sep 2021 · 0 repositories
-
SPP-RL: State Planning Policy Reinforcement Learning 29 Sep 2021 · 0 repositories
-
Superior Performance with Diversified Strategic Control in FPS Games Using General Reinforcement Learning 29 Sep 2021 · 0 repositories
-
Prioritized Experience-based Reinforcement Learning with Human Guidance for Autonomous Driving 26 Sep 2021 · 1 repository · arXiv:2109.12516
-
Improved Soft Actor-Critic: Mixing Prioritized Off-Policy Samples with On-Policy Experience 24 Sep 2021 · 0 repositories · arXiv:2109.11767
-
PRANet: Point Cloud Registration with an Artificial Agent 23 Sep 2021 · 0 repositories · arXiv:2109.11349
-
Trust Region Policy Optimisation in Multi-Agent Reinforcement Learning 23 Sep 2021 · 11 repositories · arXiv:2109.11251Syntology community repositories only · 3 ran (of which 0 constructed an object rather than computing a result; 2 with no instrument failure: 1 honoured, 0 violated, 1 with no contract checked; 1 where Syntology's instrument failed) · 2 unverified (of 5 harvested samples) · 1 pointer-only (licence)
-
Towards Multi-Agent Reinforcement Learning using Quantum Boltzmann Machines 22 Sep 2021 · 0 repositories · arXiv:2109.10900
-
Deep Reinforcement Learning Based Multidimensional Resource Management for Energy Harvesting Cognitive NOMA Communications 17 Sep 2021 · 0 repositories · arXiv:2109.09503
-
Meta-Learning with Sparse Experience Replay for Lifelong Language Learning 17 Sep 2021 · 0 repositories
-
DROMO: Distributionally Robust Offline Model-based Policy Optimization 15 Sep 2021 · 0 repositories · arXiv:2109.07275
-
ADER:Adapting between Exploration and Robustness for Actor-Critic Methods 8 Sep 2021 · 0 repositories · arXiv:2109.03443
-
MACRPO: Multi-Agent Cooperative Recurrent Policy Optimization 2 Sep 2021 · 1 repository · arXiv:2109.00882
-
Path Planning for Cellular-Connected UAV: A DRL Solution with Quantum-Inspired Experience Replay 30 Aug 2021 · 0 repositories · arXiv:2108.13184
-
Detection and Continual Learning of Novel Face Presentation Attacks 27 Aug 2021 · 0 repositories · arXiv:2108.12081
-
WAD: A Deep Reinforcement Learning Agent for Urban Autonomous Driving 27 Aug 2021 · 0 repositories · arXiv:2108.12134
-
Responsive Regulation of Dynamic UAV Communication Networks Based on Deep Reinforcement Learning 25 Aug 2021 · 1 repository · arXiv:2108.11012
-
Principal Gradient Direction and Confidence Reservoir Sampling for Continual Learning 21 Aug 2021 · 0 repositories · arXiv:2108.09592
-
Diversity-based Trajectory and Goal Selection with Hindsight Experience Replay 17 Aug 2021 · 1 repository · arXiv:2108.07887
-
Optimal Scheduling of Isolated Microgrids Using Automated Reinforcement Learning-based Multi-period Forecasting 15 Aug 2021 · 0 repositories · arXiv:2108.06764
-
Continual Neural Mapping: Learning An Implicit Scene Representation from Sequential Observations 12 Aug 2021 · 0 repositories · arXiv:2108.05851
-
Modified Double DQN: addressing stability 9 Aug 2021 · 0 repositories · arXiv:2108.04115
-
Safe Deep Reinforcement Learning for Multi-Agent Systems with Continuous Action Spaces 9 Aug 2021 · 1 repository · arXiv:2108.03952Syntology official (archive's flag): 1 ran · 1 ran (of which 0 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified (of 1 harvested sample)
-
Deep Reinforcement Learning for Continuous Docking Control of Autonomous Underwater Vehicles: A Benchmarking Study 5 Aug 2021 · 0 repositories · arXiv:2108.02665
-
Risk Conditioned Neural Motion Planning 4 Aug 2021 · 1 repository · arXiv:2108.01851
-
Value-Based Reinforcement Learning for Continuous Control Robotic Manipulation in Multi-Task Sparse Reward Settings 28 Jul 2021 · 0 repositories · arXiv:2107.13356
-
An Improved Algorithm of Robot Path Planning in Complex Environment Based on Double DQN 23 Jul 2021 · 0 repositories · arXiv:2107.11245
-
A Reinforcement Learning Environment for Mathematical Reasoning via Program Synthesis 15 Jul 2021 · 1 repository · arXiv:2107.07373
-
Mixing Human Demonstrations with Self-Exploration in Experience Replay for Deep Reinforcement Learning 14 Jul 2021 · 0 repositories · arXiv:2107.06840
-
A Deep Reinforcement Learning Approach for Traffic Signal Control Optimization 13 Jul 2021 · 0 repositories · arXiv:2107.06115