Browse State-of-the-Art › reinforcement-learning › Papers, page 66
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 66 of 135: papers 6,501 to 6,600 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Privacy Risks in Reinforcement Learning for Household Robots15 Jun 2023 0 repositories listed
-
A reinforcement learning strategy for p-adaptation in high order solvers14 Jun 2023 0 repositories listed
-
Deep Policy Gradient Methods in Commodity Markets14 Jun 2023 0 repositories listed
-
Density-Aware Reinforcement Learning to Optimise Energy Efficiency in UAV-Assisted Networks14 Jun 2023 0 repositories listed
-
Feeding control and water quality monitoring in aquaculture systems: Opportunities and challenges14 Jun 2023 0 repositories listed
-
Hierarchical Task Network Planning for Facilitating Cooperative Multi-Agent Reinforcement Learning14 Jun 2023 0 repositories listed
-
Provably Efficient Offline Reinforcement Learning with Perturbed Data Sources14 Jun 2023 0 repositories listed
-
Simple Embodied Language Learning as a Byproduct of Meta-Reinforcement Learning14 Jun 2023 0 repositories listed
-
Skill-Critic: Refining Learned Skills for Hierarchical Reinforcement Learning14 Jun 2023 0 repositories listed
-
A Primal-Dual-Critic Algorithm for Offline Constrained Reinforcement Learning13 Jun 2023 0 repositories listed
-
A Simple Unified Uncertainty-Guided Framework for Offline-to-Online Reinforcement Learning13 Jun 2023 0 repositories listed
-
Dynamic Interval Restrictions on Action Spaces in Deep Reinforcement Learning for Obstacle Avoidance13 Jun 2023 0 repositories listed
-
Kernelized Reinforcement Learning with Order Optimal Regret Bounds13 Jun 2023 0 repositories listed
-
Multi-market Energy Optimization with Renewables via Reinforcement Learning13 Jun 2023 0 repositories listed
-
Data Poisoning to Fake a Nash Equilibrium in Markov Games13 Jun 2023 0 repositories listed
-
Pruning the Way to Reliable Policies: A Multi-Objective Deep Q-Learning Approach to Critical Care13 Jun 2023 0 repositories listed
-
Using Collision Momentum in Deep Reinforcement Learning Based Adversarial Pedestrian Modeling13 Jun 2023 0 repositories listed
-
A Black-box Approach for Non-stationary Multi-agent Reinforcement Learning12 Jun 2023 0 repositories listed
-
Adversarial Constrained Bidding via Minimax Regret Optimization with Causality-Aware Reinforcement Learning12 Jun 2023 0 repositories listed
-
Diverse Projection Ensembles for Distributional Reinforcement Learning12 Jun 2023 0 repositories listed
-
ENOTO: Improving Offline-to-Online Reinforcement Learning with Q-Ensembles12 Jun 2023 0 repositories listed
-
Robust Reinforcement Learning through Efficient Adversarial Herding12 Jun 2023 0 repositories listed
-
Multi-Agent Reinforcement Learning Guided by Signal Temporal Logic Specifications11 Jun 2023 0 repositories listed
-
PACER: A Fully Push-forward-based Distributional Reinforcement Learning Algorithm11 Jun 2023 0 repositories listed
-
A Single-Loop Deep Actor-Critic Algorithm for Constrained Reinforcement Learning with Provable Convergence10 Jun 2023 0 repositories listed
-
HIPODE: Enhancing Offline Reinforcement Learning with High-Quality Synthetic Data from a Policy-Decoupled Approach10 Jun 2023 0 repositories listed
-
PEAR: Primitive enabled Adaptive Relabeling for boosting Hierarchical Reinforcement Learning10 Jun 2023 0 repositories listed
-
Confidence-Controlled Exploration: Efficient Sparse-Reward Policy Learning for Robot Navigation9 Jun 2023 0 repositories listed
-
Detecting Adversarial Directions in Deep Reinforcement Learning to Make Robust Decisions9 Jun 2023 0 repositories listed
-
Iteratively Refined Behavior Regularization for Offline Reinforcement Learning9 Jun 2023 0 repositories listed
-
Near-optimal Conservative Exploration in Reinforcement Learning under Episode-wise Constraints9 Jun 2023 0 repositories listed
-
Bring Your Own (Non-Robust) Algorithm to Solve Robust MDPs by Estimating The Worst Kernel9 Jun 2023 0 repositories listed
-
Robustness Testing for Multi-Agent Reinforcement Learning: State Perturbations on Critical Agents9 Jun 2023 0 repositories listed
-
Self-Paced Absolute Learning Progress as a Regularized Approach to Curriculum Learning9 Jun 2023 0 repositories listed
-
The Role of Diverse Replay for Generalisation in Reinforcement Learning9 Jun 2023 0 repositories listed
-
A framework for dynamically training and adapting deep reinforcement learning models to different, low-compute, and continuously changing radiology deployment environments8 Jun 2023 0 repositories listed
-
Instructed Diffuser with Temporal Condition Guidance for Offline Reinforcement Learning8 Jun 2023 0 repositories listed
-
Balancing of competitive two-player Game Levels with Reinforcement Learning7 Jun 2023 0 repositories listed
-
Convergence of SARSA with linear function approximation: The random horizon case7 Jun 2023 0 repositories listed
-
Generalization Across Observation Shifts in Reinforcement Learning7 Jun 2023 0 repositories listed
-
Timing Process Interventions with Causal Inference and Reinforcement Learning7 Jun 2023 0 repositories listed
-
Boosting Offline Reinforcement Learning with Action Preference Query6 Jun 2023 0 repositories listed
-
Inductive Bias for Emergent Communication in a Continuous Setting6 Jun 2023 0 repositories listed
-
Reinforcement Learning-Based Control of CrazyFlie 2.X Quadrotor6 Jun 2023 0 repositories listed
-
A General Perspective on Objectives of Reinforcement Learning5 Jun 2023 0 repositories listed
-
A Novel Multi-Agent Deep RL Approach for Traffic Signal Control5 Jun 2023 0 repositories listed
-
Survival Instinct in Offline Reinforcement Learning5 Jun 2023 0 repositories listed
-
Towards Fairness in Personalized Ads Using Impression Variance Aware Reinforcement Learning5 Jun 2023 0 repositories listed
-
Regret Bounds for Risk-sensitive Reinforcement Learning with Lipschitz Dynamic Risk Measures4 Jun 2023 0 repositories listed
-
A Modular Test Bed for Reinforcement Learning Incorporation into Industrial Applications2 Jun 2023 0 repositories listed
-
An Architecture for Deploying Reinforcement Learning in Industrial Environments2 Jun 2023 0 repositories listed
-
Efficient Multi-Task and Transfer Reinforcement Learning with Parameter-Compositional Framework2 Jun 2023 0 repositories listed
-
Hierarchical Reinforcement Learning for Modeling User Novelty-Seeking Intent in Recommender Systems2 Jun 2023 0 repositories listed
-
Improving the generalizability and robustness of large-scale traffic signal control2 Jun 2023 0 repositories listed
-
Multi-Robot Path Planning Combining Heuristics and Multi-Agent Reinforcement Learning2 Jun 2023 0 repositories listed
-
Achieving Fairness in Multi-Agent Markov Decision Processes Using Reinforcement Learning1 Jun 2023 0 repositories listed
-
Heterogeneous Knowledge for Augmented Modular Reinforcement Learning1 Jun 2023 0 repositories listed
-
Delphic Offline Reinforcement Learning under Nonidentifiable Hidden Confounding1 Jun 2023 0 repositories listed
-
Differentially Private Episodic Reinforcement Learning with Heavy-tailed Rewards1 Jun 2023 0 repositories listed
-
Investigating Navigation Strategies in the Morris Water Maze through Deep Reinforcement Learning1 Jun 2023 0 repositories listed
-
Non-stationary Reinforcement Learning under General Function Approximation1 Jun 2023 0 repositories listed
-
What model does MuZero learn?1 Jun 2023 0 repositories listed
-
Accelerating Reinforcement Learning with Value-Conditional State Entropy Exploration31 May 2023 0 repositories listed
-
Factually Consistent Summarization via Reinforcement Learning with Textual Entailment Feedback31 May 2023 0 repositories listed
-
Multi-environment lifelong deep reinforcement learning for medical imaging31 May 2023 0 repositories listed
-
Provably Efficient Generalized Lagrangian Policy Optimization for Safe Multi-Agent Reinforcement Learning31 May 2023 0 repositories listed
-
Replicability in Reinforcement Learning31 May 2023 0 repositories listed
-
Representation-Driven Reinforcement Learning31 May 2023 0 repositories listed
-
Centralised rehearsal of decentralised cooperation: Multi-agent reinforcement learning for the scalable coordination of residential energy flexibility30 May 2023 0 repositories listed
-
FRAMM: Fair Ranking with Missing Modalities for Clinical Trial Site Selection30 May 2023 0 repositories listed
-
Policy Optimization for Continuous Reinforcement Learning30 May 2023 0 repositories listed
-
Action valuation of on- and off-ball soccer players based on multi-agent deep reinforcement learning29 May 2023 0 repositories listed
-
Statistically Efficient Bayesian Sequential Experiment Design via Reinforcement Learning with Cross-Entropy Estimators29 May 2023 0 repositories listed
-
Doing the right thing for the right reason: Evaluating artificial moral cognition by probing cost insensitivity29 May 2023 0 repositories listed
-
Provable Reward-Agnostic Preference-Based Reinforcement Learning29 May 2023 0 repositories listed
-
Perimeter Control Using Deep Reinforcement Learning: A Model-free Approach towards Homogeneous Flow Rate Optimization29 May 2023 0 repositories listed
-
Reinforcement Learning with Human Feedback: Learning Dynamic Choices via Pessimism29 May 2023 0 repositories listed
-
RLAD: Reinforcement Learning from Pixels for Autonomous Driving in Urban Environments29 May 2023 0 repositories listed
-
Interpretable Reward Redistribution in Reinforcement Learning: A Causal Approach28 May 2023 0 repositories listed
-
Language Models are Bounded Pragmatic Speakers: Understanding RLHF from a Bayesian Cognitive Modeling Perspective28 May 2023 0 repositories listed
-
The Statistical Benefits of Quantile Temporal-Difference Learning for Value Estimation28 May 2023 0 repositories listed
-
A Comparative Analysis of Portfolio Optimization Using Mean-Variance, Hierarchical Risk Parity, and Reinforcement Learning Approaches on the Indian Stock Market27 May 2023 0 repositories listed
-
No-Regret Online Reinforcement Learning with Adversarial Losses and Transitions27 May 2023 0 repositories listed
-
Online Nonstochastic Model-Free Reinforcement Learning27 May 2023 0 repositories listed
-
Probing reaction channels via reinforcement learning27 May 2023 0 repositories listed
-
Reinforcement Learning With Reward Machines in Stochastic Games27 May 2023 0 repositories listed
-
Distributional Reinforcement Learning with Dual Expectile-Quantile Regression26 May 2023 0 repositories listed
-
Policy Synthesis and Reinforcement Learning for Discounted LTL26 May 2023 0 repositories listed
-
Reinforcement Learning with Simple Sequence Priors26 May 2023 0 repositories listed
-
Self-Supervised Reinforcement Learning that Transfers using Random Features26 May 2023 0 repositories listed
-
Bayesian Reinforcement Learning for Automatic Voltage Control under Cyber-Induced Uncertainty25 May 2023 0 repositories listed
-
Lucy-SKG: Learning to Play Rocket League Efficiently Using Deep Reinforcement Learning25 May 2023 0 repositories listed
-
Markov Decision Processes under External Temporal Processes25 May 2023 0 repositories listed
-
Deterministic policy gradient based optimal control with probabilistic constraints25 May 2023 0 repositories listed
-
Coarse-Tuning Models of Code with Reinforcement Learning Feedback25 May 2023 0 repositories listed
-
Inverse Reinforcement Learning with the Average Reward Criterion24 May 2023 0 repositories listed
-
Provable Offline Preference-Based Reinforcement Learning24 May 2023 0 repositories listed
-
A Mini Review on the utilization of Reinforcement Learning with OPC UA24 May 2023 0 repositories listed
-
Deep Reinforcement Learning with Plasticity Injection24 May 2023 0 repositories listed
-
Matrix Estimation for Offline Reinforcement Learning with Low-Rank Structure24 May 2023 0 repositories listed