Browse State-of-the-Art › reinforcement-learning › Papers, page 72
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 72 of 135: papers 7,101 to 7,200 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Temporal Difference Learning with Compressed Updates: Error-Feedback meets Reinforcement Learning3 Jan 2023 0 repositories listed
-
Towards Deployable RL - What's Broken with RL Research and a Potential Fix3 Jan 2023 0 repositories listed
-
Deep Reinforcement Learning for Asset Allocation: Reward Clipping2 Jan 2023 0 repositories listed
-
Large-Scale Traffic Signal Control by a Nash Deep Q-network Approach2 Jan 2023 0 repositories listed
-
Safety Filtering for Reinforcement Learning-based Adaptive Cruise Control2 Jan 2023 0 repositories listed
-
Co-Speech Gesture Synthesis by Reinforcement Learning With Contrastive Pre-Trained Rewards1 Jan 2023 0 repositories listed
-
GAIT: Generating Aesthetic Indoor Tours with Deep Reinforcement Learning1 Jan 2023 0 repositories listed
-
Local-Guided Global: Paired Similarity Representation for Visual Reinforcement Learning1 Jan 2023 0 repositories listed
-
PolicyCleanse: Backdoor Detection and Mitigation for Competitive Reinforcement Learning1 Jan 2023 0 repositories listed
-
ReGen: A good Generative Zero-Shot Video Classifier Should be Rewarded1 Jan 2023 0 repositories listed
-
ReLeaPS : Reinforcement Learning-based Illumination Planning for Generalized Photometric Stereo1 Jan 2023 0 repositories listed
-
Simoun: Synergizing Interactive Motion-appearance Understanding for Vision-based Reinforcement Learning1 Jan 2023 0 repositories listed
-
Stabilizing Visual Reinforcement Learning via Asymmetric Interactive Cooperation1 Jan 2023 0 repositories listed
-
Accuracy-Guaranteed Collaborative DNN Inference in Industrial IoT via Deep Reinforcement Learning31 Dec 2022 0 repositories listed
-
New Challenges in Reinforcement Learning: A Survey of Security and Privacy31 Dec 2022 0 repositories listed
-
Hybrid Deep Reinforcement Learning and Planning for Safe and Comfortable Automated Driving30 Dec 2022 0 repositories listed
-
A Novel Experts Advice Aggregation Framework Using Deep Reinforcement Learning for Portfolio Management29 Dec 2022 0 repositories listed
-
Backward Curriculum Reinforcement Learning29 Dec 2022 0 repositories listed
-
Federated Multi-Agent Deep Reinforcement Learning Approach via Physics-Informed Reward for Multi-Microgrid Energy Management29 Dec 2022 0 repositories listed
-
On the Geometry of Reinforcement Learning in Continuous State and Action Spaces29 Dec 2022 0 repositories listed
-
On Transforming Reinforcement Learning by Transformer: The Development Trajectory29 Dec 2022 0 repositories listed
-
Certifying Safety in Reinforcement Learning under Adversarial Perturbation Attacks28 Dec 2022 0 repositories listed
-
Don't do it: Safer Reinforcement Learning With Rule-based Guidance28 Dec 2022 0 repositories listed
-
Improving a sequence-to-sequence nlp model using a reinforcement learning policy algorithm28 Dec 2022 0 repositories listed
-
On the Convergence of Discounted Policy Gradient Methods28 Dec 2022 0 repositories listed
-
Towards automating Codenames spymasters with deep reinforcement learning28 Dec 2022 0 repositories listed
-
Towards Learning Abstractions via Reinforcement Learning28 Dec 2022 0 repositories listed
-
Data-driven control of COVID-19 in buildings: a reinforcement-learning approach27 Dec 2022 0 repositories listed
-
Model-Based Reinforcement Learning with Multinomial Logistic Function Approximation27 Dec 2022 0 repositories listed
-
Optimal scheduling of island integrated energy systems considering multi-uncertainties and hydrothermal simultaneous transmission: A deep reinforcement learning approach27 Dec 2022 0 repositories listed
-
Off-Policy Reinforcement Learning with Loss Function Weighted by Temporal Difference Error26 Dec 2022 0 repositories listed
-
Deep Reinforcement Learning for Heat Pump Control24 Dec 2022 0 repositories listed
-
SHIRO: Soft Hierarchical Reinforcement Learning24 Dec 2022 0 repositories listed
-
Streaming Traffic Flow Prediction Based on Continuous Reinforcement Learning24 Dec 2022 0 repositories listed
-
Coordinated Multi-Agent Reinforcement Learning for Unmanned Aerial Vehicle Swarms in Autonomous Mobile Access Applications23 Dec 2022 0 repositories listed
-
Investigation of reinforcement learning for shape optimization of profile extrusion dies23 Dec 2022 0 repositories listed
-
Offline Reinforcement Learning for Human-Guided Human-Machine Interaction with Private Information23 Dec 2022 0 repositories listed
-
A Learned Simulation Environment to Model Student Engagement and Retention in Automated Online Courses22 Dec 2022 0 repositories listed
-
Decoding surface codes with deep reinforcement learning and probabilistic policy reuse22 Dec 2022 0 repositories listed
-
Reinforcement Learning Based Approaches to Adaptive Context Caching in Distributed Context Management Systems22 Dec 2022 0 repositories listed
-
A Memetic Algorithm with Reinforcement Learning for Sociotechnical Production Scheduling21 Dec 2022 0 repositories listed
-
Imitation Is Not Enough: Robustifying Imitation with Reinforcement Learning for Challenging Driving Scenarios21 Dec 2022 0 repositories listed
-
Neighboring state-based RL Exploration21 Dec 2022 0 repositories listed
-
Robust Path Selection in Software-defined WANs using Deep Reinforcement Learning21 Dec 2022 0 repositories listed
-
Adapting the Exploration Rate for Value-of-Information-Based Reinforcement Learning20 Dec 2022 0 repositories listed
-
AdverSAR: Adversarial Search and Rescue via Multi-Agent Reinforcement Learning20 Dec 2022 0 repositories listed
-
Bandit approach to conflict-free multi-agent Q-learning in view of photonic implementation20 Dec 2022 0 repositories listed
-
Variational Quantum Soft Actor-Critic for Robotic Arm Control20 Dec 2022 0 repositories listed
-
Dexterous Manipulation from Images: Autonomous Real-World RL via Substep Guidance19 Dec 2022 0 repositories listed
-
Inverse Reinforcement Learning for Text Summarization19 Dec 2022 0 repositories listed
-
Near-optimal Policy Identification in Active Reinforcement Learning19 Dec 2022 0 repositories listed
-
Quantum policy gradient algorithms19 Dec 2022 0 repositories listed
-
Taming Lagrangian Chaos with Multi-Objective Reinforcement Learning19 Dec 2022 0 repositories listed
-
Neural Coreference Resolution based on Reinforcement Learning18 Dec 2022 0 repositories listed
-
Risk-Sensitive Reinforcement Learning with Exponential Criteria18 Dec 2022 0 repositories listed
-
Enhancing Cyber Resilience of Networked Microgrids using Vertical Federated Reinforcement Learning17 Dec 2022 0 repositories listed
-
Latent Variable Representation for Reinforcement Learning17 Dec 2022 0 repositories listed
-
Cognitive Level-k Meta-Learning for Safe and Pedestrian-Aware Autonomous Driving17 Dec 2022 0 repositories listed
-
Pre-Trained Image Encoder for Generalizable Visual Reinforcement Learning17 Dec 2022 0 repositories listed
-
An Energy-aware and Fault-tolerant Deep Reinforcement Learning based approach for Multi-agent Patrolling Problems16 Dec 2022 0 repositories listed
-
Offline Robot Reinforcement Learning with Uncertainty-Guided Human Expert Sampling16 Dec 2022 0 repositories listed
-
Reinforcement Learning for Agile Active Target Sensing with a UAV16 Dec 2022 0 repositories listed
-
Bridging the Gap Between Offline and Online Reinforcement Learning Evaluation Methodologies15 Dec 2022 0 repositories listed
-
Driver Assistance Eco-driving and Transmission Control with Deep Reinforcement Learning15 Dec 2022 0 repositories listed
-
Multi-Agent Reinforcement Learning with Shared Resources for Inventory Management15 Dec 2022 0 repositories listed
-
Towards Hardware-Specific Automatic Compression of Neural Networks15 Dec 2022 0 repositories listed
-
Reinforcement Learning in Credit Scoring and Underwriting15 Dec 2022 0 repositories listed
-
Efficient Exploration in Resource-Restricted Reinforcement Learning14 Dec 2022 0 repositories listed
-
Explaining Agent's Decision-making in a Hierarchical Reinforcement Learning Scenario14 Dec 2022 0 repositories listed
-
Hierarchical Strategies for Cooperative Multi-Agent Reinforcement Learning14 Dec 2022 0 repositories listed
-
Quantum Control based on Deep Reinforcement Learning14 Dec 2022 0 repositories listed
-
Reinforcement Learning in System Identification14 Dec 2022 0 repositories listed
-
Safety Correction from Baseline: Towards the Risk-aware Policy in Robotics via Dual-agent Reinforcement Learning14 Dec 2022 0 repositories listed
-
A Review of Off-Policy Evaluation in Reinforcement Learning13 Dec 2022 0 repositories listed
-
Improving generalization in reinforcement learning through forked agents13 Dec 2022 0 repositories listed
-
Model-Free Approach to Fair Solar PV Curtailment Using Reinforcement Learning13 Dec 2022 0 repositories listed
-
PPO-UE: Proximal Policy Optimization via Uncertainty-Aware Exploration13 Dec 2022 0 repositories listed
-
Scalable and Sample Efficient Distributed Policy Gradient Algorithms in Multi-Agent Networked Systems13 Dec 2022 0 repositories listed
-
Single Cell Training on Architecture Search for Image Denoising13 Dec 2022 0 repositories listed
-
A Survey on Reinforcement Learning Security with Application to Autonomous Driving12 Dec 2022 0 repositories listed
-
Evaluating Model-free Reinforcement Learning toward Safety-critical Tasks12 Dec 2022 0 repositories listed
-
Nearly Minimax Optimal Reinforcement Learning for Linear Markov Decision Processes12 Dec 2022 0 repositories listed
-
Variance-Reduced Conservative Policy Iteration12 Dec 2022 0 repositories listed
-
Generalization Through the Lens of Learning Dynamics11 Dec 2022 0 repositories listed
-
Hierarchical Deep Reinforcement Learning for VWAP Strategy Optimization11 Dec 2022 0 repositories listed
-
Off-Policy Deep Reinforcement Learning Algorithms for Handling Various Robotic Manipulator Tasks11 Dec 2022 0 repositories listed
-
Leveraging Modality-specific Representations for Audio-visual Speech Recognition via Reinforcement Learning10 Dec 2022 0 repositories listed
-
Relate to Predict: Towards Task-Independent Knowledge Representations for Reinforcement Learning10 Dec 2022 0 repositories listed
-
Near-Optimal Differentially Private Reinforcement Learning9 Dec 2022 0 repositories listed
-
Reinforcement Learning for Predicting Traffic Accidents9 Dec 2022 0 repositories listed
-
A Novel Stochastic Gradient Descent Algorithm for Learning Principal Subspaces8 Dec 2022 0 repositories listed
-
Confidence-Conditioned Value Functions for Offline Reinforcement Learning8 Dec 2022 0 repositories listed
-
Design and Planning of Flexible Mobile Micro-Grids Using Deep Reinforcement Learning8 Dec 2022 0 repositories listed
-
Reinforcement Learning for Resilient Power Grids8 Dec 2022 0 repositories listed
-
System Design for an Integrated Lifelong Reinforcement Learning Agent for Real-Time Strategy Games8 Dec 2022 0 repositories listed
-
Accelerating Self-Imitation Learning from Demonstrations via Policy Constraints and Q-Ensemble7 Dec 2022 0 repositories listed
-
A Learned Simulation Environment to Model Plant Growth in Indoor Farming6 Dec 2022 0 repositories listed
-
A Novel Deep Reinforcement Learning Based Automated Stock Trading System Using Cascaded LSTM Networks6 Dec 2022 0 repositories listed
-
Efficient Learning of Voltage Control Strategies via Model-based Deep Reinforcement Learning6 Dec 2022 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.