Browse State-of-the-Art › Reinforcement Learning › Papers, page 64
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 64 of 132: papers 6,301 to 6,400 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Skill-Critic: Refining Learned Skills for Hierarchical Reinforcement Learning14 Jun 2023 0 repositories listed
-
A Primal-Dual-Critic Algorithm for Offline Constrained Reinforcement Learning13 Jun 2023 0 repositories listed
-
Dynamic Interval Restrictions on Action Spaces in Deep Reinforcement Learning for Obstacle Avoidance13 Jun 2023 0 repositories listed
-
Kernelized Reinforcement Learning with Order Optimal Regret Bounds13 Jun 2023 0 repositories listed
-
Multi-market Energy Optimization with Renewables via Reinforcement Learning13 Jun 2023 0 repositories listed
-
Data Poisoning to Fake a Nash Equilibrium in Markov Games13 Jun 2023 0 repositories listed
-
Using Collision Momentum in Deep Reinforcement Learning Based Adversarial Pedestrian Modeling13 Jun 2023 0 repositories listed
-
Diverse Projection Ensembles for Distributional Reinforcement Learning12 Jun 2023 0 repositories listed
-
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles12 Jun 2023 0 repositories listed
-
Robust Reinforcement Learning through Efficient Adversarial Herding12 Jun 2023 0 repositories listed
-
Multi-Agent Reinforcement Learning Guided by Signal Temporal Logic Specifications11 Jun 2023 0 repositories listed
-
PACER: A Fully Push-forward-based Distributional Reinforcement Learning Algorithm11 Jun 2023 0 repositories listed
-
HIPODE: Enhancing Offline Reinforcement Learning with High-Quality Synthetic Data from a Policy-Decoupled Approach10 Jun 2023 0 repositories listed
-
PEAR: Primitive enabled Adaptive Relabeling for boosting Hierarchical Reinforcement Learning10 Jun 2023 0 repositories listed
-
Iteratively Refined Behavior Regularization for Offline Reinforcement Learning9 Jun 2023 0 repositories listed
-
Self-Paced Absolute Learning Progress as a Regularized Approach to Curriculum Learning9 Jun 2023 0 repositories listed
-
The Role of Diverse Replay for Generalisation in Reinforcement Learning9 Jun 2023 0 repositories listed
-
A framework for dynamically training and adapting deep reinforcement learning models to different, low-compute, and continuously changing radiology deployment environments8 Jun 2023 0 repositories listed
-
Instructed Diffuser with Temporal Condition Guidance for Offline Reinforcement Learning8 Jun 2023 0 repositories listed
-
Balancing of competitive two-player Game Levels with Reinforcement Learning7 Jun 2023 0 repositories listed
-
Generalization Across Observation Shifts in Reinforcement Learning7 Jun 2023 0 repositories listed
-
Timing Process Interventions with Causal Inference and Reinforcement Learning7 Jun 2023 0 repositories listed
-
Boosting Offline Reinforcement Learning with Action Preference Query6 Jun 2023 0 repositories listed
-
Inductive Bias for Emergent Communication in a Continuous Setting6 Jun 2023 0 repositories listed
-
Reinforcement Learning-Based Control of CrazyFlie 2.X Quadrotor6 Jun 2023 0 repositories listed
-
A General Perspective on Objectives of Reinforcement Learning5 Jun 2023 0 repositories listed
-
A Novel Multi-Agent Deep RL Approach for Traffic Signal Control5 Jun 2023 0 repositories listed
-
Survival Instinct in Offline Reinforcement Learning5 Jun 2023 0 repositories listed
-
A Modular Test Bed for Reinforcement Learning Incorporation into Industrial Applications2 Jun 2023 0 repositories listed
-
An Architecture for Deploying Reinforcement Learning in Industrial Environments2 Jun 2023 0 repositories listed
-
Efficient Multi-Task and Transfer Reinforcement Learning with Parameter-Compositional Framework2 Jun 2023 0 repositories listed
-
Improving the generalizability and robustness of large-scale traffic signal control2 Jun 2023 0 repositories listed
-
Heterogeneous Knowledge for Augmented Modular Reinforcement Learning1 Jun 2023 0 repositories listed
-
Delphic Offline Reinforcement Learning under Nonidentifiable Hidden Confounding1 Jun 2023 0 repositories listed
-
Differentially Private Episodic Reinforcement Learning with Heavy-tailed Rewards1 Jun 2023 0 repositories listed
-
Non-stationary Reinforcement Learning under General Function Approximation1 Jun 2023 0 repositories listed
-
What model does MuZero learn?1 Jun 2023 0 repositories listed
-
Accelerating Reinforcement Learning with Value-Conditional State Entropy Exploration31 May 2023 0 repositories listed
-
Factually Consistent Summarization via Reinforcement Learning with Textual Entailment Feedback31 May 2023 0 repositories listed
-
Multi-environment lifelong deep reinforcement learning for medical imaging31 May 2023 0 repositories listed
-
Provably Efficient Generalized Lagrangian Policy Optimization for Safe Multi-Agent Reinforcement Learning31 May 2023 0 repositories listed
-
Replicability in Reinforcement Learning31 May 2023 0 repositories listed
-
Representation-Driven Reinforcement Learning31 May 2023 0 repositories listed
-
Centralised rehearsal of decentralised cooperation: Multi-agent reinforcement learning for the scalable coordination of residential energy flexibility30 May 2023 0 repositories listed
-
Policy Optimization for Continuous Reinforcement Learning30 May 2023 0 repositories listed
-
Action valuation of on- and off-ball soccer players based on multi-agent deep reinforcement learning29 May 2023 0 repositories listed
-
Doing the right thing for the right reason: Evaluating artificial moral cognition by probing cost insensitivity29 May 2023 0 repositories listed
-
Provable Reward-Agnostic Preference-Based Reinforcement Learning29 May 2023 0 repositories listed
-
Perimeter Control Using Deep Reinforcement Learning: A Model-free Approach towards Homogeneous Flow Rate Optimization29 May 2023 0 repositories listed
-
Reinforcement Learning with Human Feedback: Learning Dynamic Choices via Pessimism29 May 2023 0 repositories listed
-
Interpretable Reward Redistribution in Reinforcement Learning: A Causal Approach28 May 2023 0 repositories listed
-
Language Models are Bounded Pragmatic Speakers: Understanding RLHF from a Bayesian Cognitive Modeling Perspective28 May 2023 0 repositories listed
-
The Statistical Benefits of Quantile Temporal-Difference Learning for Value Estimation28 May 2023 0 repositories listed
-
A Comparative Analysis of Portfolio Optimization Using Mean-Variance, Hierarchical Risk Parity, and Reinforcement Learning Approaches on the Indian Stock Market27 May 2023 0 repositories listed
-
No-Regret Online Reinforcement Learning with Adversarial Losses and Transitions27 May 2023 0 repositories listed
-
Online Nonstochastic Model-Free Reinforcement Learning27 May 2023 0 repositories listed
-
Probing reaction channels via reinforcement learning27 May 2023 0 repositories listed
-
Reinforcement Learning With Reward Machines in Stochastic Games27 May 2023 0 repositories listed
-
Distributional Reinforcement Learning with Dual Expectile-Quantile Regression26 May 2023 0 repositories listed
-
Policy Synthesis and Reinforcement Learning for Discounted LTL26 May 2023 0 repositories listed
-
Reinforcement Learning with Simple Sequence Priors26 May 2023 0 repositories listed
-
Self-Supervised Reinforcement Learning that Transfers using Random Features26 May 2023 0 repositories listed
-
Coarse-Tuning Models of Code with Reinforcement Learning Feedback25 May 2023 0 repositories listed
-
Inverse Reinforcement Learning with the Average Reward Criterion24 May 2023 0 repositories listed
-
Provable Offline Preference-Based Reinforcement Learning24 May 2023 0 repositories listed
-
Deep Reinforcement Learning with Plasticity Injection24 May 2023 0 repositories listed
-
Matrix Estimation for Offline Reinforcement Learning with Low-Rank Structure24 May 2023 0 repositories listed
-
Replicable Reinforcement Learning24 May 2023 0 repositories listed
-
Successor-Predecessor Intrinsic Exploration24 May 2023 0 repositories listed
-
Combining Multi-Objective Bayesian Optimization with Reinforcement Learning for TinyML23 May 2023 0 repositories listed
-
ChemGymRL: An Interactive Framework for Reinforcement Learning for Digital Chemistry23 May 2023 0 repositories listed
-
Constrained Proximal Policy Optimization23 May 2023 0 repositories listed
-
Control of a simulated MRI scanner with deep reinforcement learning23 May 2023 0 repositories listed
-
Language Model Self-improvement by Reinforcement Learning Contemplation23 May 2023 0 repositories listed
-
OER: Offline Experience Replay for Continual Offline Reinforcement Learning23 May 2023 0 repositories listed
-
Optimizing Long-term Value for Auction-Based Recommender Systems via On-Policy Reinforcement Learning23 May 2023 0 repositories listed
-
Proximal Policy Gradient Arborescence for Quality Diversity Reinforcement Learning23 May 2023 0 repositories listed
-
RLBoost: Boosting Supervised Models using Deep Reinforcement Learning23 May 2023 0 repositories listed
-
Lagrangian-based online safe reinforcement learning for state-constrained systems22 May 2023 0 repositories listed
-
Offline Primal-Dual Reinforcement Learning for Linear MDPs22 May 2023 0 repositories listed
-
Offline Reinforcement Learning with Additional Covering Distributions22 May 2023 0 repositories listed
-
TOM: Learning Policy-Aware Models for Model-Based Reinforcement Learning via Transition Occupancy Matching22 May 2023 0 repositories listed
-
Game-Theoretical Analysis of Reviewer Rewards in Peer-Review Journal Systems: Analysis and Experimental Evaluation using Deep Reinforcement Learning20 May 2023 0 repositories listed
-
Model-based adaptation for sample efficient transfer in reinforcement learning control of parameter-varying systems20 May 2023 0 repositories listed
-
On First-Order Meta-Reinforcement Learning with Moreau Envelopes20 May 2023 0 repositories listed
-
Shattering the Agent-Environment Interface for Fine-Tuning Inclusive Language Models19 May 2023 0 repositories listed
-
Semantically Aligned Task Decomposition in Multi-Agent Reinforcement Learning18 May 2023 0 repositories listed
-
A proof of imitation of Wasserstein inverse reinforcement learning for multi-objective optimization17 May 2023 0 repositories listed
-
Curriculum Learning in Job Shop Scheduling using Reinforcement Learning17 May 2023 0 repositories listed
-
Discovering Individual Rewards in Collective Behavior through Inverse Multi-Agent Reinforcement Learning17 May 2023 0 repositories listed
-
Integrated Conflict Management for UAM with Strategic Demand Capacity Balancing and Learning-based Tactical Deconfliction17 May 2023 0 repositories listed
-
Model-Free Robust Average-Reward Reinforcement Learning17 May 2023 0 repositories listed
-
Multi-Agent Reinforcement Learning: Methods, Applications, Visionary Prospects, and Challenges17 May 2023 0 repositories listed
-
Pragmatic Reasoning in Structured Signaling Games17 May 2023 0 repositories listed
-
Deep Reinforcement Learning to Maximize Arterial Usage during Extreme Congestion16 May 2023 0 repositories listed
-
Horizon-free Reinforcement Learning in Adversarial Linear Mixture MDPs15 May 2023 0 repositories listed
-
Toward Multi-Agent Reinforcement Learning for Distributed Event-Triggered Control15 May 2023 0 repositories listed
-
Federated TD Learning over Finite-Rate Erasure Channels: Linear Speedup under Markovian Sampling14 May 2023 0 repositories listed
-
Inverse Reinforcement Learning With Constraint Recovery14 May 2023 0 repositories listed
-
Gaussian Prior Reinforcement Learning for Nested Named Entity Recognition12 May 2023 0 repositories listed