Browse State-of-the-Art › Reinforcement Learning › Papers, page 69
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 69 of 132: papers 6,801 to 6,900 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Autotuning PID control using Actor-Critic Deep Reinforcement Learning29 Nov 2022 0 repositories listed
-
Distributed Energy Management and Demand Response in Smart Grids: A Multi-Agent Deep Reinforcement Learning Framework29 Nov 2022 0 repositories listed
-
Multi-Agent Reinforcement Learning for Microprocessor Design Space Exploration29 Nov 2022 0 repositories listed
-
Offline Reinforcement Learning with Closed-Form Policy Improvement Operators29 Nov 2022 0 repositories listed
-
AcceRL: Policy Acceleration Framework for Deep Reinforcement Learning28 Nov 2022 0 repositories listed
-
Autonomous Assessment of Demonstration Sufficiency via Bayesian Inverse Reinforcement Learning28 Nov 2022 0 repositories listed
-
Causal Deep Reinforcement Learning Using Observational Data28 Nov 2022 0 repositories listed
-
Continuous Episodic Control28 Nov 2022 0 repositories listed
-
Hypernetworks for Zero-shot Transfer in Reinforcement Learning28 Nov 2022 0 repositories listed
-
Inapplicable Actions Learning for Knowledge Transfer in Reinforcement Learning28 Nov 2022 0 repositories listed
-
Learning from Good Trajectories in Offline Multi-Agent Reinforcement Learning28 Nov 2022 0 repositories listed
-
State-Aware Proximal Pessimistic Algorithms for Offline Reinforcement Learning28 Nov 2022 0 repositories listed
-
Domain Generalization for Robust Model-Based Offline Reinforcement Learning27 Nov 2022 0 repositories listed
-
Model-Free Reinforcement Learning with the Decision-Estimation Coefficient25 Nov 2022 0 repositories listed
-
Improving Proactive Dialog Agents Using Socially-Aware Reinforcement Learning25 Nov 2022 0 repositories listed
-
Software Simulation and Visualization of Quantum Multi-Drone Reinforcement Learning24 Nov 2022 0 repositories listed
-
Monte Carlo Tree Search Algorithms for Risk-Aware and Multi-Objective Reinforcement Learning23 Nov 2022 0 repositories listed
-
Powderworld: A Platform for Understanding Generalization via Rich Task Distributions23 Nov 2022 0 repositories listed
-
Reinforcement Learning Agent Design and Optimization with Bandwidth Allocation Model23 Nov 2022 0 repositories listed
-
Reinforcement learning for traffic signal control in hybrid action space23 Nov 2022 0 repositories listed
-
Representation Learning for Continuous Action Spaces is Beneficial for Efficient Policy Learning23 Nov 2022 0 repositories listed
-
A Deep Reinforcement Learning Approach to Rare Event Estimation22 Nov 2022 0 repositories listed
-
A Reinforcement Learning Approach to Optimize Available Network Bandwidth Utilization22 Nov 2022 0 repositories listed
-
Improving Multimodal Interactive Agents with Reinforcement Learning from Human Feedback21 Nov 2022 0 repositories listed
-
Learning Cooperative Oversubscription for Cloud by Chance-Constrained Multi-Agent Reinforcement Learning21 Nov 2022 0 repositories listed
-
Model-based Trajectory Stitching for Improved Offline Reinforcement Learning21 Nov 2022 0 repositories listed
-
PhysQ: A Physics Informed Reinforcement Learning Framework for Building Control21 Nov 2022 0 repositories listed
-
Simultaneously Updating All Persistence Values in Reinforcement Learning21 Nov 2022 0 repositories listed
-
Safe Reinforcement Learning using Data-Driven Predictive Control20 Nov 2022 0 repositories listed
-
Structure-Enhanced Deep Reinforcement Learning for Optimal Transmission Scheduling20 Nov 2022 0 repositories listed
-
Evaluating the Perceived Safety of Urban City via Maximum Entropy Deep Inverse Reinforcement Learning19 Nov 2022 0 repositories listed
-
Credit-cognisant reinforcement learning for multi-agent cooperation18 Nov 2022 0 repositories listed
-
AlphaSnake: Policy Iteration on a Nondeterministic NP-hard Markov Decision Process17 Nov 2022 0 repositories listed
-
Planning Irregular Object Packing via Hierarchical Reinforcement Learning17 Nov 2022 0 repositories listed
-
Solar Power driven EV Charging Optimization with Deep Reinforcement Learning17 Nov 2022 0 repositories listed
-
Data-pooling Reinforcement Learning for Personalized Healthcare Intervention16 Nov 2022 0 repositories listed
-
Minimum information divergence of Q-functions for dynamic treatment resumes16 Nov 2022 0 repositories listed
-
APT: Adaptive Perceptual quality based camera Tuning using reinforcement learning15 Nov 2022 0 repositories listed
-
Contextual Transformer for Offline Meta Reinforcement Learning15 Nov 2022 0 repositories listed
-
General Intelligence Requires Rethinking Exploration15 Nov 2022 0 repositories listed
-
Offline Reinforcement Learning with Adaptive Behavior Regularization15 Nov 2022 0 repositories listed
-
Reinforcement Learning Methods for Wordle: A POMDP/Adaptive Control Approach15 Nov 2022 0 repositories listed
-
Universal Distributional Decision-based Black-box Adversarial Attack with Reinforcement Learning15 Nov 2022 0 repositories listed
-
Linear Reinforcement Learning with Ball Structure Action Space14 Nov 2022 0 repositories listed
-
Parallel Automatic History Matching Algorithm Using Reinforcement Learning14 Nov 2022 0 repositories listed
-
(When) Are Contrastive Explanations of Reinforcement Learning Helpful?14 Nov 2022 0 repositories listed
-
Goal-Conditioned Reinforcement Learning in the Presence of an Adversary13 Nov 2022 0 repositories listed
-
Deep Reinforcement Learning with Vector Quantized Encoding12 Nov 2022 0 repositories listed
-
Rewards Encoding Environment Dynamics Improves Preference-based Reinforcement Learning12 Nov 2022 0 repositories listed
-
Controlling Commercial Cooling Systems Using Reinforcement Learning11 Nov 2022 0 repositories listed
-
Emergency action termination for immediate reaction in hierarchical reinforcement learning11 Nov 2022 0 repositories listed
-
Gradient Imitation Reinforcement Learning for General Low-Resource Information Extraction11 Nov 2022 0 repositories listed
-
Robust N-1 secure HV Grid Flexibility Estimation for TSO-DSO coordinated Congestion Management with Deep Reinforcement Learning10 Nov 2022 0 repositories listed
-
When is Realizability Sufficient for Off-Policy Reinforcement Learning?10 Nov 2022 0 repositories listed
-
Foundation Models for Semantic Novelty in Reinforcement Learning9 Nov 2022 0 repositories listed
-
Leveraging Offline Data in Online Reinforcement Learning9 Nov 2022 0 repositories listed
-
Solving Collaborative Dec-POMDPs with Deep Reinforcement Learning Heuristics9 Nov 2022 0 repositories listed
-
Pretraining in Deep Reinforcement Learning: A Survey8 Nov 2022 0 repositories listed
-
Reinforcement Learning with Stepwise Fairness Constraints8 Nov 2022 0 repositories listed
-
A Survey on Quantum Reinforcement Learning7 Nov 2022 0 repositories listed
-
Reward-Predictive Clustering7 Nov 2022 0 repositories listed
-
Decentralized Federated Reinforcement Learning for User-Centric Dynamic TFDD Control4 Nov 2022 0 repositories listed
-
A Survey on Reinforcement Learning in Aviation Applications3 Nov 2022 0 repositories listed
-
3 Nov 2022 0 repositories listed
-
Oracle Inequalities for Model Selection in Offline Reinforcement Learning3 Nov 2022 0 repositories listed
-
Reinforcement Learning in Non-Markovian Environments3 Nov 2022 0 repositories listed
-
Deep Reinforcement Learning for Power Control in Next-Generation WiFi Network Systems2 Nov 2022 0 repositories listed
-
Model-based Reinforcement Learning with a Hamiltonian Canonical ODE Network2 Nov 2022 0 repositories listed
-
Wind Power Forecasting Considering Data Privacy Protection: A Federated Deep Reinforcement Learning Approach2 Nov 2022 0 repositories listed
-
Reinforcement Learning Applied to Trading Systems: A Survey1 Nov 2022 0 repositories listed
-
Reinforcement Learning in Education: A Multi-Armed Bandit Approach1 Nov 2022 0 repositories listed
-
DanZero: Mastering GuanDan Game with Reinforcement Learning31 Oct 2022 0 repositories listed
-
Teacher-student curriculum learning for reinforcement learning31 Oct 2022 0 repositories listed
-
On Rate-Distortion Theory in Capacity-Limited Cognition & Reinforcement Learning30 Oct 2022 0 repositories listed
-
Planning to the Information Horizon of BAMDPs via Epistemic State Abstraction30 Oct 2022 0 repositories listed
-
LearningGroup: A Real-Time Sparse Training on FPGA via Learnable Weight Grouping for Multi-Agent Reinforcement Learning29 Oct 2022 0 repositories listed
-
Using Contrastive Samples for Identifying and Leveraging Possible Causal Relationships in Reinforcement Learning28 Oct 2022 0 repositories listed
-
Hybrid Indoor Localization via Reinforcement Learning-based Information Fusion27 Oct 2022 0 repositories listed
-
Meta-Reinforcement Learning Using Model Parameters27 Oct 2022 0 repositories listed
-
SAM-RL: Sensing-Aware Model-Based Reinforcement Learning via Differentiable Physics-Based Simulation and Rendering27 Oct 2022 0 repositories listed
-
D-Shape: Demonstration-Shaped Reinforcement Learning via Goal Conditioning26 Oct 2022 0 repositories listed
-
Knowledge-Guided Exploration in Deep Reinforcement Learning26 Oct 2022 0 repositories listed
-
Quantum deep recurrent reinforcement learning26 Oct 2022 0 repositories listed
-
Uncertainty-based Meta-Reinforcement Learning for Robust Radar Tracking26 Oct 2022 0 repositories listed
-
Bridging Distributional and Risk-sensitive Reinforcement Learning with Provable Regret Bounds25 Oct 2022 0 repositories listed
-
Entity Divider with Language Grounding in Multi-Agent Reinforcement Learning25 Oct 2022 0 repositories listed
-
Causal Explanation for Reinforcement Learning: Quantifying State and Temporal Importance24 Oct 2022 0 repositories listed
-
Graph Reinforcement Learning-based CNN Inference Offloading in Dynamic Edge Computing24 Oct 2022 0 repositories listed
-
Hardness in Markov Decision Processes: Theory and Practice24 Oct 2022 0 repositories listed
-
Opportunistic Episodic Reinforcement Learning24 Oct 2022 0 repositories listed
-
OSS Mentor A framework for improving developers contributions via deep reinforcement learning24 Oct 2022 0 repositories listed
-
Reachability-Aware Laplacian Representation in Reinforcement Learning24 Oct 2022 0 repositories listed
-
Reinforcement Learning and Bandits for Speech and Language Processing: Tutorial, Review and Outlook24 Oct 2022 0 repositories listed
-
A Cooperative Reinforcement Learning Environment for Detecting and Penalizing Betrayal23 Oct 2022 0 repositories listed
-
Active Predictive Coding: A Unified Neural Framework for Learning Hierarchical World Models for Perception and Planning23 Oct 2022 0 repositories listed
-
Climate Change Policy Exploration using Reinforcement Learning23 Oct 2022 0 repositories listed
-
Faster and more diverse de novo molecular optimization with double-loop reinforcement learning using augmented SMILES22 Oct 2022 0 repositories listed
-
Probing Transfer in Deep Reinforcement Learning without Task Engineering22 Oct 2022 0 repositories listed
-
Continual Vision-based Reinforcement Learning with Group Symmetries21 Oct 2022 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.