Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 78
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 78 of 152: papers 7,701 to 7,800 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Addressing the issue of stochastic environments and local decision-making in multi-objective reinforcement learning16 Nov 2022 0 repositories listed
-
Data-pooling Reinforcement Learning for Personalized Healthcare Intervention16 Nov 2022 0 repositories listed
-
Minimum information divergence of Q-functions for dynamic treatment resumes16 Nov 2022 0 repositories listed
-
Model Based Residual Policy Learning with Applications to Antenna Control16 Nov 2022 0 repositories listed
-
Reward Gaming in Conditional Text Generation16 Nov 2022 0 repositories listed
-
APT: Adaptive Perceptual quality based camera Tuning using reinforcement learning15 Nov 2022 0 repositories listed
-
Contextual Transformer for Offline Meta Reinforcement Learning15 Nov 2022 0 repositories listed
-
General Intelligence Requires Rethinking Exploration15 Nov 2022 0 repositories listed
-
Offline Reinforcement Learning with Adaptive Behavior Regularization15 Nov 2022 0 repositories listed
-
Reinforcement Learning Methods for Wordle: A POMDP/Adaptive Control Approach15 Nov 2022 0 repositories listed
-
Universal Distributional Decision-based Black-box Adversarial Attack with Reinforcement Learning15 Nov 2022 0 repositories listed
-
Dynamic Collaborative Multi-Agent Reinforcement Learning Communication for Autonomous Drone Reforestation14 Nov 2022 0 repositories listed
-
Linear Reinforcement Learning with Ball Structure Action Space14 Nov 2022 0 repositories listed
-
NeurIPS 2022 Competition: Driving SMARTS14 Nov 2022 0 repositories listed
-
Parallel Automatic History Matching Algorithm Using Reinforcement Learning14 Nov 2022 0 repositories listed
-
Reinforcement Learning Based Resource Allocation for Network Slices in O-RAN Midhaul14 Nov 2022 0 repositories listed
-
(When) Are Contrastive Explanations of Reinforcement Learning Helpful?14 Nov 2022 0 repositories listed
-
Goal-Conditioned Reinforcement Learning in the Presence of an Adversary13 Nov 2022 0 repositories listed
-
Identifying Coordination in a Cognitive Radar Network -- A Multi-Objective Inverse Reinforcement Learning Approach13 Nov 2022 0 repositories listed
-
Multi-Agent Deep Reinforcement Learning for Efficient Passenger Delivery in Urban Air Mobility13 Nov 2022 0 repositories listed
-
CACTO: Continuous Actor-Critic with Trajectory Optimization -- Towards global optimality12 Nov 2022 0 repositories listed
-
Deep Reinforcement Learning with Vector Quantized Encoding12 Nov 2022 0 repositories listed
-
Rewards Encoding Environment Dynamics Improves Preference-based Reinforcement Learning12 Nov 2022 0 repositories listed
-
Controlling Commercial Cooling Systems Using Reinforcement Learning11 Nov 2022 0 repositories listed
-
Deep Reinforcement Learning Microgrid Optimization Strategy Considering Priority Flexible Demand Side11 Nov 2022 0 repositories listed
-
Efficient Domain Coverage for Vehicles with Second-Order Dynamics via Multi-Agent Reinforcement Learning11 Nov 2022 0 repositories listed
-
Emergency action termination for immediate reaction in hierarchical reinforcement learning11 Nov 2022 0 repositories listed
-
Gradient Imitation Reinforcement Learning for General Low-Resource Information Extraction11 Nov 2022 0 repositories listed
-
Job Scheduling in Datacenters using Constraint Controlled RL10 Nov 2022 0 repositories listed
-
Robust N-1 secure HV Grid Flexibility Estimation for TSO-DSO coordinated Congestion Management with Deep Reinforcement Learning10 Nov 2022 0 repositories listed
-
When is Realizability Sufficient for Off-Policy Reinforcement Learning?10 Nov 2022 0 repositories listed
-
Foundation Models for Semantic Novelty in Reinforcement Learning9 Nov 2022 0 repositories listed
-
Interpretable Deep Reinforcement Learning for Green Security Games with Real-Time Information9 Nov 2022 0 repositories listed
-
Leveraging Offline Data in Online Reinforcement Learning9 Nov 2022 0 repositories listed
-
Solving Collaborative Dec-POMDPs with Deep Reinforcement Learning Heuristics9 Nov 2022 0 repositories listed
-
Efficient Compressed Ratio Estimation Using Online Sequential Learning for Edge Computing8 Nov 2022 0 repositories listed
-
Pretraining in Deep Reinforcement Learning: A Survey8 Nov 2022 0 repositories listed
-
Progress and summary of reinforcement learning on energy management of MPS-EV8 Nov 2022 0 repositories listed
-
Reinforcement Learning with Stepwise Fairness Constraints8 Nov 2022 0 repositories listed
-
Reward-Predictive Clustering7 Nov 2022 0 repositories listed
-
Exposing Surveillance Detection Routes via Reinforcement Learning, Attack Graphs, and Cyber Terrain6 Nov 2022 0 repositories listed
-
Spatio-temporal Incentives Optimization for Ride-hailing Services with Offline Deep Reinforcement Learning6 Nov 2022 0 repositories listed
-
Wall Street Tree Search: Risk-Aware Planning for Offline Reinforcement Learning6 Nov 2022 0 repositories listed
-
Decentralized Federated Reinforcement Learning for User-Centric Dynamic TFDD Control4 Nov 2022 0 repositories listed
-
GEC: A Unified Framework for Interactive Decision Making in MDP, POMDP, and Beyond3 Nov 2022 0 repositories listed
-
A Survey on Reinforcement Learning in Aviation Applications3 Nov 2022 0 repositories listed
-
Contrastive Value Learning: Implicit Models for Simple Offline RL3 Nov 2022 0 repositories listed
-
3 Nov 2022 0 repositories listed
-
Oracle Inequalities for Model Selection in Offline Reinforcement Learning3 Nov 2022 0 repositories listed
-
Reinforcement Learning in Non-Markovian Environments3 Nov 2022 0 repositories listed
-
Sensor Control for Information Gain in Dynamic, Sparse and Partially Observed Environments3 Nov 2022 0 repositories listed
-
Theta-Resonance: A Single-Step Reinforcement Learning Method for Design Space Exploration3 Nov 2022 0 repositories listed
-
Deep Reinforcement Learning for IRS Phase Shift Design in Spatiotemporally Correlated Environments2 Nov 2022 0 repositories listed
-
Deep Reinforcement Learning for Power Control in Next-Generation WiFi Network Systems2 Nov 2022 0 repositories listed
-
Knowing the Past to Predict the Future: Reinforcement Virtual Learning2 Nov 2022 0 repositories listed
-
Learning to Grasp the Ungraspable with Emergent Extrinsic Dexterity2 Nov 2022 0 repositories listed
-
Model-based Reinforcement Learning with a Hamiltonian Canonical ODE Network2 Nov 2022 0 repositories listed
-
Offline RL With Realistic Datasets: Heteroskedasticity and Support Constraints2 Nov 2022 0 repositories listed
-
Over-communicate no more: Situated RL agents learn concise communication protocols2 Nov 2022 0 repositories listed
-
Wind Power Forecasting Considering Data Privacy Protection: A Federated Deep Reinforcement Learning Approach2 Nov 2022 0 repositories listed
-
Discrete Factorial Representations as an Abstraction for Goal Conditioned Reinforcement Learning1 Nov 2022 0 repositories listed
-
Event Tables for Efficient Experience Replay1 Nov 2022 0 repositories listed
-
Optimal Conservative Offline RL with General Function Approximation via Augmented Lagrangian1 Nov 2022 0 repositories listed
-
Reinforcement Learning Applied to Trading Systems: A Survey1 Nov 2022 0 repositories listed
-
Reinforcement Learning in Education: A Multi-Armed Bandit Approach1 Nov 2022 0 repositories listed
-
DanZero: Mastering GuanDan Game with Reinforcement Learning31 Oct 2022 0 repositories listed
-
Teacher-student curriculum learning for reinforcement learning31 Oct 2022 0 repositories listed
-
Imitating Opponent to Win: Adversarial Policy Imitation Learning in Two-player Competitive Games30 Oct 2022 0 repositories listed
-
On Rate-Distortion Theory in Capacity-Limited Cognition & Reinforcement Learning30 Oct 2022 0 repositories listed
-
Planning to the Information Horizon of BAMDPs via Epistemic State Abstraction30 Oct 2022 0 repositories listed
-
LearningGroup: A Real-Time Sparse Training on FPGA via Learnable Weight Grouping for Multi-Agent Reinforcement Learning29 Oct 2022 0 repositories listed
-
Nonuniqueness and Convergence to Equivalent Solutions in Observer-based Inverse Reinforcement Learning28 Oct 2022 0 repositories listed
-
Reinforcement Learning-based Defect Mitigation for Quality Assurance of Additive Manufacturing28 Oct 2022 0 repositories listed
-
Using Contrastive Samples for Identifying and Leveraging Possible Causal Relationships in Reinforcement Learning28 Oct 2022 0 repositories listed
-
Hybrid Indoor Localization via Reinforcement Learning-based Information Fusion27 Oct 2022 0 repositories listed
-
Many-Objective Reinforcement Learning for Online Testing of DNN-Enabled Systems27 Oct 2022 0 repositories listed
-
Meta-Reinforcement Learning Using Model Parameters27 Oct 2022 0 repositories listed
-
SAM-RL: Sensing-Aware Model-Based Reinforcement Learning via Differentiable Physics-Based Simulation and Rendering27 Oct 2022 0 repositories listed
-
Towards customizable reinforcement learning agents: Enabling preference specification through online vocabulary expansion27 Oct 2022 0 repositories listed
-
A Bibliometric Analysis and Review on Reinforcement Learning for Transportation Applications26 Oct 2022 0 repositories listed
-
D-Shape: Demonstration-Shaped Reinforcement Learning via Goal Conditioning26 Oct 2022 0 repositories listed
-
Knowledge-Guided Exploration in Deep Reinforcement Learning26 Oct 2022 0 repositories listed
-
Quantum deep recurrent reinforcement learning26 Oct 2022 0 repositories listed
-
Uncertainty-based Meta-Reinforcement Learning for Robust Radar Tracking26 Oct 2022 0 repositories listed
-
Bridging Distributional and Risk-sensitive Reinforcement Learning with Provable Regret Bounds25 Oct 2022 0 repositories listed
-
Entity Divider with Language Grounding in Multi-Agent Reinforcement Learning25 Oct 2022 0 repositories listed
-
One-shot, Offline and Production-Scalable PID Optimisation with Deep Reinforcement Learning25 Oct 2022 0 repositories listed
-
Causal Explanation for Reinforcement Learning: Quantifying State and Temporal Importance24 Oct 2022 0 repositories listed
-
Graph Reinforcement Learning-based CNN Inference Offloading in Dynamic Edge Computing24 Oct 2022 0 repositories listed
-
Hardness in Markov Decision Processes: Theory and Practice24 Oct 2022 0 repositories listed
-
Opportunistic Episodic Reinforcement Learning24 Oct 2022 0 repositories listed
-
OSS Mentor A framework for improving developers contributions via deep reinforcement learning24 Oct 2022 0 repositories listed
-
Reachability-Aware Laplacian Representation in Reinforcement Learning24 Oct 2022 0 repositories listed
-
Reinforcement Learning and Bandits for Speech and Language Processing: Tutorial, Review and Outlook24 Oct 2022 0 repositories listed
-
A Cooperative Reinforcement Learning Environment for Detecting and Penalizing Betrayal23 Oct 2022 0 repositories listed
-
Active Predictive Coding: A Unified Neural Framework for Learning Hierarchical World Models for Perception and Planning23 Oct 2022 0 repositories listed
-
Climate Change Policy Exploration using Reinforcement Learning23 Oct 2022 0 repositories listed
-
LEAGUE: Guided Skill Learning and Abstraction for Long-Horizon Manipulation23 Oct 2022 0 repositories listed
-
Learning General World Models in a Handful of Reward-Free Deployments23 Oct 2022 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.