Browse State-of-the-Art › reinforcement-learning › Papers, page 74
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 74 of 135: papers 7,301 to 7,400 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Identifying Coordination in a Cognitive Radar Network -- A Multi-Objective Inverse Reinforcement Learning Approach13 Nov 2022 0 repositories listed
-
Multi-Agent Deep Reinforcement Learning for Efficient Passenger Delivery in Urban Air Mobility13 Nov 2022 0 repositories listed
-
Deep Reinforcement Learning with Vector Quantized Encoding12 Nov 2022 0 repositories listed
-
Rewards Encoding Environment Dynamics Improves Preference-based Reinforcement Learning12 Nov 2022 0 repositories listed
-
Controlling Commercial Cooling Systems Using Reinforcement Learning11 Nov 2022 0 repositories listed
-
Deep Reinforcement Learning Microgrid Optimization Strategy Considering Priority Flexible Demand Side11 Nov 2022 0 repositories listed
-
Emergency action termination for immediate reaction in hierarchical reinforcement learning11 Nov 2022 0 repositories listed
-
Gradient Imitation Reinforcement Learning for General Low-Resource Information Extraction11 Nov 2022 0 repositories listed
-
Job Scheduling in Datacenters using Constraint Controlled RL10 Nov 2022 0 repositories listed
-
Robust N-1 secure HV Grid Flexibility Estimation for TSO-DSO coordinated Congestion Management with Deep Reinforcement Learning10 Nov 2022 0 repositories listed
-
When is Realizability Sufficient for Off-Policy Reinforcement Learning?10 Nov 2022 0 repositories listed
-
Foundation Models for Semantic Novelty in Reinforcement Learning9 Nov 2022 0 repositories listed
-
Interpretable Deep Reinforcement Learning for Green Security Games with Real-Time Information9 Nov 2022 0 repositories listed
-
Leveraging Offline Data in Online Reinforcement Learning9 Nov 2022 0 repositories listed
-
Solving Collaborative Dec-POMDPs with Deep Reinforcement Learning Heuristics9 Nov 2022 0 repositories listed
-
Efficient Compressed Ratio Estimation Using Online Sequential Learning for Edge Computing8 Nov 2022 0 repositories listed
-
Pretraining in Deep Reinforcement Learning: A Survey8 Nov 2022 0 repositories listed
-
Progress and summary of reinforcement learning on energy management of MPS-EV8 Nov 2022 0 repositories listed
-
Reinforcement Learning with Stepwise Fairness Constraints8 Nov 2022 0 repositories listed
-
A Survey on Quantum Reinforcement Learning7 Nov 2022 0 repositories listed
-
Reward-Predictive Clustering7 Nov 2022 0 repositories listed
-
Exposing Surveillance Detection Routes via Reinforcement Learning, Attack Graphs, and Cyber Terrain6 Nov 2022 0 repositories listed
-
Spatio-temporal Incentives Optimization for Ride-hailing Services with Offline Deep Reinforcement Learning6 Nov 2022 0 repositories listed
-
Wall Street Tree Search: Risk-Aware Planning for Offline Reinforcement Learning6 Nov 2022 0 repositories listed
-
Decentralized Federated Reinforcement Learning for User-Centric Dynamic TFDD Control4 Nov 2022 0 repositories listed
-
A Survey on Reinforcement Learning in Aviation Applications3 Nov 2022 0 repositories listed
-
3 Nov 2022 0 repositories listed
-
Oracle Inequalities for Model Selection in Offline Reinforcement Learning3 Nov 2022 0 repositories listed
-
Reinforcement Learning in Non-Markovian Environments3 Nov 2022 0 repositories listed
-
Theta-Resonance: A Single-Step Reinforcement Learning Method for Design Space Exploration3 Nov 2022 0 repositories listed
-
Deep Reinforcement Learning for IRS Phase Shift Design in Spatiotemporally Correlated Environments2 Nov 2022 0 repositories listed
-
Deep Reinforcement Learning for Power Control in Next-Generation WiFi Network Systems2 Nov 2022 0 repositories listed
-
Model-based Reinforcement Learning with a Hamiltonian Canonical ODE Network2 Nov 2022 0 repositories listed
-
Wind Power Forecasting Considering Data Privacy Protection: A Federated Deep Reinforcement Learning Approach2 Nov 2022 0 repositories listed
-
Discrete Factorial Representations as an Abstraction for Goal Conditioned Reinforcement Learning1 Nov 2022 0 repositories listed
-
Event Tables for Efficient Experience Replay1 Nov 2022 0 repositories listed
-
Reinforcement Learning Applied to Trading Systems: A Survey1 Nov 2022 0 repositories listed
-
Reinforcement Learning in Education: A Multi-Armed Bandit Approach1 Nov 2022 0 repositories listed
-
DanZero: Mastering GuanDan Game with Reinforcement Learning31 Oct 2022 0 repositories listed
-
Teacher-student curriculum learning for reinforcement learning31 Oct 2022 0 repositories listed
-
On Rate-Distortion Theory in Capacity-Limited Cognition & Reinforcement Learning30 Oct 2022 0 repositories listed
-
Planning to the Information Horizon of BAMDPs via Epistemic State Abstraction30 Oct 2022 0 repositories listed
-
LearningGroup: A Real-Time Sparse Training on FPGA via Learnable Weight Grouping for Multi-Agent Reinforcement Learning29 Oct 2022 0 repositories listed
-
Nonuniqueness and Convergence to Equivalent Solutions in Observer-based Inverse Reinforcement Learning28 Oct 2022 0 repositories listed
-
Reinforcement Learning-based Defect Mitigation for Quality Assurance of Additive Manufacturing28 Oct 2022 0 repositories listed
-
Using Contrastive Samples for Identifying and Leveraging Possible Causal Relationships in Reinforcement Learning28 Oct 2022 0 repositories listed
-
Hybrid Indoor Localization via Reinforcement Learning-based Information Fusion27 Oct 2022 0 repositories listed
-
Many-Objective Reinforcement Learning for Online Testing of DNN-Enabled Systems27 Oct 2022 0 repositories listed
-
Meta-Reinforcement Learning Using Model Parameters27 Oct 2022 0 repositories listed
-
SAM-RL: Sensing-Aware Model-Based Reinforcement Learning via Differentiable Physics-Based Simulation and Rendering27 Oct 2022 0 repositories listed
-
Towards customizable reinforcement learning agents: Enabling preference specification through online vocabulary expansion27 Oct 2022 0 repositories listed
-
A Bibliometric Analysis and Review on Reinforcement Learning for Transportation Applications26 Oct 2022 0 repositories listed
-
D-Shape: Demonstration-Shaped Reinforcement Learning via Goal Conditioning26 Oct 2022 0 repositories listed
-
Knowledge-Guided Exploration in Deep Reinforcement Learning26 Oct 2022 0 repositories listed
-
Quantum deep recurrent reinforcement learning26 Oct 2022 0 repositories listed
-
Uncertainty-based Meta-Reinforcement Learning for Robust Radar Tracking26 Oct 2022 0 repositories listed
-
Bridging Distributional and Risk-sensitive Reinforcement Learning with Provable Regret Bounds25 Oct 2022 0 repositories listed
-
Entity Divider with Language Grounding in Multi-Agent Reinforcement Learning25 Oct 2022 0 repositories listed
-
One-shot, Offline and Production-Scalable PID Optimisation with Deep Reinforcement Learning25 Oct 2022 0 repositories listed
-
Causal Explanation for Reinforcement Learning: Quantifying State and Temporal Importance24 Oct 2022 0 repositories listed
-
Graph Reinforcement Learning-based CNN Inference Offloading in Dynamic Edge Computing24 Oct 2022 0 repositories listed
-
Hardness in Markov Decision Processes: Theory and Practice24 Oct 2022 0 repositories listed
-
Opportunistic Episodic Reinforcement Learning24 Oct 2022 0 repositories listed
-
OSS Mentor A framework for improving developers contributions via deep reinforcement learning24 Oct 2022 0 repositories listed
-
Reachability-Aware Laplacian Representation in Reinforcement Learning24 Oct 2022 0 repositories listed
-
Reinforcement Learning and Bandits for Speech and Language Processing: Tutorial, Review and Outlook24 Oct 2022 0 repositories listed
-
A Cooperative Reinforcement Learning Environment for Detecting and Penalizing Betrayal23 Oct 2022 0 repositories listed
-
Active Predictive Coding: A Unified Neural Framework for Learning Hierarchical World Models for Perception and Planning23 Oct 2022 0 repositories listed
-
Climate Change Policy Exploration using Reinforcement Learning23 Oct 2022 0 repositories listed
-
MetaEMS: A Meta Reinforcement Learning-based Control Framework for Building Energy Management System23 Oct 2022 0 repositories listed
-
Faster and more diverse de novo molecular optimization with double-loop reinforcement learning using augmented SMILES22 Oct 2022 0 repositories listed
-
Probing Transfer in Deep Reinforcement Learning without Task Engineering22 Oct 2022 0 repositories listed
-
Continual Vision-based Reinforcement Learning with Group Symmetries21 Oct 2022 0 repositories listed
-
Redefining Counterfactual Explanations for Reinforcement Learning: Overview, Challenges and Opportunities21 Oct 2022 0 repositories listed
-
Deep Reinforcement Learning for Inverse Inorganic Materials Design21 Oct 2022 0 repositories listed
-
Deep Reinforcement Learning for Stabilization of Large-scale Probabilistic Boolean Networks21 Oct 2022 0 repositories listed
-
Group Distributionally Robust Reinforcement Learning with Hierarchical Latent Variables21 Oct 2022 0 repositories listed
-
Implicit Offline Reinforcement Learning via Supervised Learning21 Oct 2022 0 repositories listed
-
Integrating Policy Summaries with Reward Decomposition for Explaining Reinforcement Learning Agents21 Oct 2022 0 repositories listed
-
On the connection between Bregman divergence and value in regularized Markov decision processes21 Oct 2022 0 repositories listed
-
Epistemic Monte Carlo Tree Search21 Oct 2022 0 repositories listed
-
Towards Quantum-Enabled 6G Slicing21 Oct 2022 0 repositories listed
-
Fine-Grained Session Recommendations in E-commerce using Deep Reinforcement Learning20 Oct 2022 0 repositories listed
-
Horizon-Free and Variance-Dependent Reinforcement Learning for Latent Markov Decision Processes20 Oct 2022 0 repositories listed
-
Robust Imitation via Mirror Descent Inverse Reinforcement Learning20 Oct 2022 0 repositories listed
-
A Reinforcement Learning Approach in Multi-Phase Second-Price Auction Design19 Oct 2022 0 repositories listed
-
Hierarchical Reinforcement Learning for Furniture Layout in Virtual Indoor Scenes19 Oct 2022 0 repositories listed
-
Oracles & Followers: Stackelberg Equilibria in Deep Multi-Agent Reinforcement Learning19 Oct 2022 0 repositories listed
-
Palm up: Playing in the Latent Manifold for Unsupervised Pretraining19 Oct 2022 0 repositories listed
-
Provably Safe Reinforcement Learning via Action Projection using Reachability Analysis and Polynomial Zonotopes19 Oct 2022 0 repositories listed
-
Robotic Table Wiping via Reinforcement Learning and Whole-body Trajectory Optimization19 Oct 2022 0 repositories listed
-
Scaling Laws for Reward Model Overoptimization19 Oct 2022 0 repositories listed
-
RPM: Generalizable Behaviors for Multi-Agent Reinforcement Learning18 Oct 2022 0 repositories listed
-
Unpacking Reward Shaping: Understanding the Benefits of Reward Engineering on Sample Complexity18 Oct 2022 0 repositories listed
-
Boosting Offline Reinforcement Learning via Data Rebalancing17 Oct 2022 0 repositories listed
-
PTDE: Personalized Training with Distilled Execution for Multi-Agent Reinforcement Learning17 Oct 2022 0 repositories listed
-
You Only Live Once: Single-Life Reinforcement Learning17 Oct 2022 0 repositories listed
-
Data-Efficient Pipeline for Offline Reinforcement Learning with Limited Data16 Oct 2022 0 repositories listed
-
Entropy Regularized Reinforcement Learning with Cascading Networks16 Oct 2022 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.