Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 68
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 68 of 152: papers 6,701 to 6,800 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Novelty Detection in Reinforcement Learning with World Models12 Oct 2023 0 repositories listed
-
Discerning Temporal Difference Learning12 Oct 2023 0 repositories listed
-
Off-Policy Evaluation for Human Feedback11 Oct 2023 0 repositories listed
-
Online RL in Linearly q^π-Realizable MDPs Is as Easy as in Linear MDPs If You Learn What to Ignore11 Oct 2023 0 repositories listed
-
Reinforcement Learning-based Knowledge Graph Reasoning for Explainable Fact-checking11 Oct 2023 0 repositories listed
-
Bi-Level Offline Policy Optimization with Limited Exploration10 Oct 2023 0 repositories listed
-
f-Policy Gradients: A General Framework for Goal Conditioned RL using f-Divergences10 Oct 2023 0 repositories listed
-
Reinforcement Learning in a Safety-Embedded MDP with Trajectory Optimization10 Oct 2023 0 repositories listed
-
Scalable Semantic Non-Markovian Simulation Proxy for Reinforcement Learning10 Oct 2023 0 repositories listed
-
Spectral Entry-wise Matrix Estimation for Low-Rank Reinforcement Learning10 Oct 2023 0 repositories listed
-
Multi-timestep models for Model-based Reinforcement Learning9 Oct 2023 0 repositories listed
-
On Double Descent in Reinforcement Learning with LSTD and Random Features9 Oct 2023 0 repositories listed
-
Predictive auxiliary objectives in deep RL mimic learning in the brain9 Oct 2023 0 repositories listed
-
When is Agnostic Reinforcement Learning Statistically Tractable?9 Oct 2023 0 repositories listed
-
Distributional Reinforcement Learning with Online Risk-awareness Adaption8 Oct 2023 0 repositories listed
-
Learning Generalizable Agents via Saliency-Guided Features Decorrelation8 Oct 2023 0 repositories listed
-
Lifelong Learning for Fog Load Balancing: A Transfer Learning Approach8 Oct 2023 0 repositories listed
-
Optimal Sequential Decision-Making in Geosteering: A Reinforcement Learning Approach7 Oct 2023 0 repositories listed
-
Reinforced UI Instruction Grounding: Towards a Generic UI Task Automation API7 Oct 2023 0 repositories listed
-
Improving Offline-to-Online Reinforcement Learning with Q Conditioned State Entropy Exploration7 Oct 2023 0 repositories listed
-
AURO: Reinforcement Learning for Adaptive User Retention Optimization in Recommender Systems6 Oct 2023 0 repositories listed
-
Improving Reinforcement Learning Efficiency with Auxiliary Tasks in Non-Visual Environments: A Comparison6 Oct 2023 0 repositories listed
-
Self-Confirming Transformer for Belief-Conditioned Adaptation in Offline Multi-Agent Reinforcement Learning6 Oct 2023 0 repositories listed
-
Constraint-Conditioned Policy Optimization for Versatile Safe Reinforcement Learning5 Oct 2023 0 repositories listed
-
How the level sampling process impacts zero-shot generalisation in deep reinforcement learning5 Oct 2023 0 repositories listed
-
Optimal Control of District Cooling Energy Plant with Reinforcement Learning and MPC5 Oct 2023 0 repositories listed
-
Resilient Legged Local Navigation: Learning to Traverse with Compromised Perception End-to-End5 Oct 2023 0 repositories listed
-
RTDK-BO: High Dimensional Bayesian Optimization with Reinforced Transformer Deep kernels5 Oct 2023 0 repositories listed
-
Safe Exploration in Reinforcement Learning: A Generalized Formulation and Algorithms5 Oct 2023 0 repositories listed
-
Decision ConvFormer: Local Filtering in MetaFormer is Sufficient for Decision Making4 Oct 2023 0 repositories listed
-
Reinforcement Learning with Foundation Priors: Let the Embodied Agent Efficiently Learn on Its Own4 Oct 2023 0 repositories listed
-
ℬ-Coder: Value-Based Deep Reinforcement Learning for Program Synthesis4 Oct 2023 0 repositories listed
-
Neural architecture impact on identifying temporally extended Reinforcement Learning tasks4 Oct 2023 0 repositories listed
-
Proximal Policy Optimization-Based Reinforcement Learning Approach for DC-DC Boost Converter Control: A Comparative Evaluation Against Traditional Control Techniques4 Oct 2023 0 repositories listed
-
Searching for High-Value Molecules Using Reinforcement Learning and Transformers4 Oct 2023 0 repositories listed
-
A Deep Reinforcement Learning Approach for Interactive Search with Sentence-level Feedback3 Oct 2023 0 repositories listed
-
AlignDiff: Aligning Diverse Human Preferences via Behavior-Customisable Diffusion Model3 Oct 2023 0 repositories listed
-
Blending Imitation and Reinforcement Learning for Robust Policy Improvement3 Oct 2023 0 repositories listed
-
Navigating Uncertainty in ESG Investing3 Oct 2023 0 repositories listed
-
On Representation Complexity of Model-based and Model-free Reinforcement Learning3 Oct 2023 0 repositories listed
-
Towards a Unified Framework for Sequential Decision Making3 Oct 2023 0 repositories listed
-
Pessimistic Nonlinear Least-Squares Value Iteration for Offline Reinforcement Learning2 Oct 2023 0 repositories listed
-
REMEDI: REinforcement learning-driven adaptive MEtabolism modeling of primary sclerosing cholangitis DIsease progression2 Oct 2023 0 repositories listed
-
From Bandits Model to Deep Deterministic Policy Gradient, Reinforcement Learning with Contextual Information1 Oct 2023 0 repositories listed
-
Adaptive Control of an Inverted Pendulum by a Reinforcement Learning-based LQR Method30 Sep 2023 0 repositories listed
-
Controlling Neural Style Transfer with Deep Reinforcement Learning30 Sep 2023 0 repositories listed
-
A Quantum States Preparation Method Based on Difference-Driven Reinforcement Learning29 Sep 2023 0 repositories listed
-
Adversarial Driving Behavior Generation Incorporating Human Risk Cognition for Autonomous Vehicle Evaluation29 Sep 2023 0 repositories listed
-
Learning to Rewrite Prompts for Personalized Text Generation29 Sep 2023 0 repositories listed
-
Reinforcement Learning for Node Selection in Branch-and-Bound29 Sep 2023 0 repositories listed
-
Efficiency Separation between RL Methods: Model-Free, Model-Based and Goal-Conditioned28 Sep 2023 0 repositories listed
-
Robust Offline Reinforcement Learning -- Certify the Confidence Interval28 Sep 2023 0 repositories listed
-
Stackelberg Batch Policy Learning28 Sep 2023 0 repositories listed
-
Uncertainty-Aware Decision Transformer for Stochastic Driving Environments28 Sep 2023 0 repositories listed
-
Raijū: Reinforcement Learning-Guided Post-Exploitation for Automating Security Assessment of Network Systems27 Sep 2023 0 repositories listed
-
A comparison of controller architectures and learning mechanisms for arbitrary robot morphologies25 Sep 2023 0 repositories listed
-
ODE-based Recurrent Model-free Reinforcement Learning for POMDPs25 Sep 2023 0 repositories listed
-
On the Effectiveness of Adversarial Samples against Ensemble Learning-based Windows PE Malware Detectors25 Sep 2023 0 repositories listed
-
Sample Complexity of Neural Policy Mirror Descent for Policy Optimization on Low-Dimensional Manifolds25 Sep 2023 0 repositories listed
-
Tracking Control for a Spherical Pendulum via Curriculum Reinforcement Learning25 Sep 2023 0 repositories listed
-
Boosting Offline Reinforcement Learning for Autonomous Driving with Hierarchical Latent Skills24 Sep 2023 0 repositories listed
-
Iterative Reachability Estimation for Safe Reinforcement Learning24 Sep 2023 0 repositories listed
-
Limits of Actor-Critic Algorithms for Decision Tree Policies Learning in IBMDPs23 Sep 2023 0 repositories listed
-
Offline to Online Learning for Real-Time Bandwidth Estimation23 Sep 2023 0 repositories listed
-
Reinforcement Learning for Robust Header Compression under Model Uncertainty23 Sep 2023 0 repositories listed
-
H2O+: An Improved Framework for Hybrid Offline-and-Online RL with Dynamics Gaps22 Sep 2023 0 repositories listed
-
Robotic Offline RL from Internet Videos via Value-Function Pre-Training22 Sep 2023 0 repositories listed
-
Curriculum Reinforcement Learning via Morphology-Environment Co-Evolution21 Sep 2023 0 repositories listed
-
Delays in Reinforcement Learning20 Sep 2023 0 repositories listed
-
Deep Reinforcement Learning for Infinite Horizon Mean Field Problems in Continuous Spaces19 Sep 2023 0 repositories listed
-
Physics-Informed Machine Learning for Data Anomaly Detection, Classification, Localization, and Mitigation: A Review, Challenges, and Path Forward19 Sep 2023 0 repositories listed
-
Graph-enabled Reinforcement Learning for Time Series Forecasting with Adaptive Intelligence18 Sep 2023 0 repositories listed
-
Guided Online Distillation: Promoting Safe Reinforcement Learning by Offline Demonstration18 Sep 2023 0 repositories listed
-
Mechanic Maker 2.0: Reinforcement Learning for Evaluating Generated Rules18 Sep 2023 0 repositories listed
-
Privileged to Predicted: Towards Sensorimotor Reinforcement Learning for Urban Driving18 Sep 2023 0 repositories listed
-
Using Reinforcement Learning to Simplify Mealtime Insulin Dosing for People with Type 1 Diabetes: In-Silico Experiments17 Sep 2023 0 repositories listed
-
Data-Driven H-infinity Control with a Real-Time and Efficient Reinforcement Learning Algorithm: An Application to Autonomous Mobility-on-Demand Systems16 Sep 2023 0 repositories listed
-
DOMAIN: MilDly COnservative Model-BAsed OfflINe Reinforcement Learning16 Sep 2023 0 repositories listed
-
A Spiking Binary Neuron -- Detector of Causal Links15 Sep 2023 0 repositories listed
-
Autonomous and Human-Driven Vehicles Interacting in a Roundabout: A Quantitative and Qualitative Evaluation15 Sep 2023 0 repositories listed
-
Equivariant Data Augmentation for Generalization in Offline Reinforcement Learning14 Sep 2023 0 repositories listed
-
Physically Plausible Full-Body Hand-Object Interaction Synthesis14 Sep 2023 0 repositories listed
-
Proximal Bellman mappings for reinforcement learning and their application to robust adaptive filtering14 Sep 2023 0 repositories listed
-
A Real-World Quadrupedal Locomotion Benchmark for Offline Reinforcement Learning13 Sep 2023 0 repositories listed
-
Harnessing Deep Q-Learning for Enhanced Statistical Arbitrage in High-Frequency Trading: A Comprehensive Exploration13 Sep 2023 0 repositories listed
-
Investigating the Impact of Action Representations in Policy Gradient Algorithms13 Sep 2023 0 repositories listed
-
Safe Reinforcement Learning with Dual Robustness13 Sep 2023 0 repositories listed
-
Risk-Aware Reinforcement Learning through Optimal Transport Theory12 Sep 2023 0 repositories listed
-
Improved Monte Carlo tree search formulation with multiple root nodes for discrete sizing optimization of truss structures12 Sep 2023 0 repositories listed
-
Representation Learning in Low-rank Slate-based Recommender Systems10 Sep 2023 0 repositories listed
-
Signal Temporal Logic Neural Predictive Control10 Sep 2023 0 repositories listed
-
Advantage Actor-Critic with Reasoner: Explaining the Agent's Behavior from an Exploratory Perspective9 Sep 2023 0 repositories listed
-
Verifiable Reinforcement Learning Systems via Compositionality9 Sep 2023 0 repositories listed
-
Seeing-Eye Quadruped Navigation with Force Responsive Locomotion Control8 Sep 2023 0 repositories listed
-
A State Representation for Diminishing Rewards7 Sep 2023 0 repositories listed
-
REBOOT: Reuse Data for Bootstrapping Efficient Real-World Dexterous Manipulation6 Sep 2023 0 repositories listed
-
A Survey of Imitation Learning: Algorithms, Recent Developments, and Challenges5 Sep 2023 0 repositories listed
-
Dialog Action-Aware Transformer for Dialog Policy Learning5 Sep 2023 0 repositories listed
-
INTAGS: Interactive Agent-Guided Simulation4 Sep 2023 0 repositories listed
-
Hundreds Guide Millions: Adaptive Offline Reinforcement Learning with Expert Guidance4 Sep 2023 0 repositories listed