Browse State-of-the-Art › reinforcement-learning › Papers, page 56
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 56 of 135: papers 5,501 to 5,600 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
AD4RL: Autonomous Driving Benchmarks for Offline Reinforcement Learning with Value-based Dataset3 Apr 2024 0 repositories listed
-
Deep Reinforcement Learning for Traveling Purchaser Problems3 Apr 2024 0 repositories listed
-
Methodology for Interpretable Reinforcement Learning for Optimizing Mechanical Ventilation3 Apr 2024 0 repositories listed
-
Reinforcement Learning in Categorical Cybernetics3 Apr 2024 0 repositories listed
-
Active Exploration in Bayesian Model-based Reinforcement Learning for Robot Manipulation2 Apr 2024 0 repositories listed
-
Distributed Autonomous Swarm Formation for Dynamic Network Bridging2 Apr 2024 0 repositories listed
-
Emergence of Chemotactic Strategies with Multi-Agent Reinforcement Learning2 Apr 2024 0 repositories listed
-
Imitation Game: A Model-based and Imitation Learning Deep Reinforcement Learning Hybrid2 Apr 2024 0 repositories listed
-
Learning to Control Camera Exposure via Reinforcement Learning2 Apr 2024 0 repositories listed
-
Multi-granular Adversarial Attacks against Black-box Neural Ranking Models2 Apr 2024 0 repositories listed
-
VLRM: Vision-Language Models act as Reward Models for Image Captioning2 Apr 2024 0 repositories listed
-
CAMO: Correlation-Aware Mask Optimization with Modulated Reinforcement Learning1 Apr 2024 0 repositories listed
-
MTLight: Efficient Multi-Task Reinforcement Learning for Traffic Signal Control1 Apr 2024 0 repositories listed
-
RL-MUL 2.0: Multiplier Design Optimization with Parallel Deep Reinforcement Learning and Space Reduction31 Mar 2024 0 repositories listed
-
Variational Autoencoders for exteroceptive perception in reinforcement learning-based collision avoidance31 Mar 2024 0 repositories listed
-
Facilitating Reinforcement Learning for Process Control Using Transfer Learning: Overview and Perspectives30 Mar 2024 0 repositories listed
-
CtRL-Sim: Reactive and Controllable Driving Agents with Offline Reinforcement Learning29 Mar 2024 0 repositories listed
-
EnCoMP: Enhanced Covert Maneuver Planning with Adaptive Threat-Aware Visibility Estimation using Offline Reinforcement Learning29 Mar 2024 0 repositories listed
-
Removing the need for ground truth UWB data collection: self-supervised ranging error correction using deep reinforcement learning28 Mar 2024 0 repositories listed
-
CaT: Constraints as Terminations for Legged Locomotion Reinforcement Learning27 Mar 2024 0 repositories listed
-
Image Deraining via Self-supervised Reinforcement Learning27 Mar 2024 0 repositories listed
-
Probabilistic Model Checking of Stochastic Reinforcement Learning Policies27 Mar 2024 0 repositories listed
-
Safe and Robust Reinforcement Learning: Principles and Practice27 Mar 2024 0 repositories listed
-
An Analysis of Switchback Designs in Reinforcement Learning26 Mar 2024 0 repositories listed
-
An Open-source End-to-End Logic Optimization Framework for Large-scale Boolean Network with Reinforcement Learning26 Mar 2024 0 repositories listed
-
MA4DIV: Multi-Agent Reinforcement Learning for Search Result Diversification26 Mar 2024 0 repositories listed
-
Paths to Equilibrium in Games26 Mar 2024 0 repositories listed
-
Prioritized League Reinforcement Learning for Large-Scale Heterogeneous Multiagent Systems26 Mar 2024 0 repositories listed
-
Uncertainty-aware Distributional Offline Reinforcement Learning26 Mar 2024 0 repositories listed
-
Deep Reinforcement Learning and Mean-Variance Strategies for Responsible Portfolio Optimization25 Mar 2024 0 repositories listed
-
Offline Reinforcement Learning: Role of State Aggregation and Trajectory Data25 Mar 2024 0 repositories listed
-
Speeding Up Path Planning via Reinforcement Learning in MCTS for Automated Parking25 Mar 2024 0 repositories listed
-
Interpretable Modeling of Deep Reinforcement Learning Driven Scheduling24 Mar 2024 0 repositories listed
-
Automated Feature Selection for Inverse Reinforcement Learning22 Mar 2024 0 repositories listed
-
Subequivariant Reinforcement Learning Framework for Coordinated Motion Control22 Mar 2024 0 repositories listed
-
Constrained Reinforcement Learning with Smoothed Log Barrier Function21 Mar 2024 0 repositories listed
-
Heuristic Algorithm-based Action Masking Reinforcement Learning (HAAM-RL) with Ensemble Inference Method21 Mar 2024 0 repositories listed
-
On the continuity and smoothness of the value function in reinforcement learning and optimal control21 Mar 2024 0 repositories listed
-
Robust Model Based Reinforcement Learning Using ℒ₁ Adaptive Control21 Mar 2024 0 repositories listed
-
Fast Value Tracking for Deep Reinforcement Learning19 Mar 2024 0 repositories listed
-
Simple Ingredients for Offline Reinforcement Learning19 Mar 2024 0 repositories listed
-
Stochastic Halpern iteration in normed spaces and applications to reinforcement learning19 Mar 2024 0 repositories listed
-
Advanced Statistical Arbitrage with Reinforcement Learning18 Mar 2024 0 repositories listed
-
Bootstrapping Reinforcement Learning with Imitation for Vision-Based Agile Flight18 Mar 2024 0 repositories listed
-
Demystifying the Physics of Deep Reinforcement Learning-Based Autonomous Vehicle Decision-Making18 Mar 2024 0 repositories listed
-
Explainable Reinforcement Learning-based Home Energy Management Systems using Differentiable Decision Trees18 Mar 2024 0 repositories listed
-
Offline Multitask Representation Learning for Reinforcement Learning18 Mar 2024 0 repositories listed
-
Pessimistic Causal Reinforcement Learning with Mediators for Confounded Offline Data18 Mar 2024 0 repositories listed
-
Reinforcement Learning with Generalizable Gaussian Splatting18 Mar 2024 0 repositories listed
-
Supervised Fine-Tuning as Inverse Reinforcement Learning18 Mar 2024 0 repositories listed
-
The Value of Reward Lookahead in Reinforcement Learning18 Mar 2024 0 repositories listed
-
Unveil Conditional Diffusion Models with Classifier-free Guidance: A Sharp Statistical Theory18 Mar 2024 0 repositories listed
-
Phasic Diversity Optimization for Population-Based Reinforcement Learning17 Mar 2024 0 repositories listed
-
Prior-dependent analysis of posterior sampling reinforcement learning with function approximation17 Mar 2024 0 repositories listed
-
Mixed-Reality Digital Twins: Leveraging the Physical and Virtual Worlds for Hybrid Sim2Real Transition of Multi-Agent Reinforcement Learning Policies16 Mar 2024 0 repositories listed
-
Reinforcement Learning with Options and State Representation16 Mar 2024 0 repositories listed
-
ViSaRL: Visual Reinforcement Learning Guided by Human Saliency16 Mar 2024 0 repositories listed
-
Chain-structured neural architecture search for financial time series forecasting15 Mar 2024 0 repositories listed
-
Graph Enhanced Reinforcement Learning for Effective Group Formation in Collaborative Problem Solving15 Mar 2024 0 repositories listed
-
Parameter Efficient Reinforcement Learning from Human Feedback15 Mar 2024 0 repositories listed
-
HRLAIF: Improvements in Helpfulness and Harmlessness in Open-domain Reinforcement Learning From AI Feedback13 Mar 2024 0 repositories listed
-
Meta-operators for Enabling Parallel Planning Using Deep Reinforcement Learning13 Mar 2024 0 repositories listed
-
Multi-Objective Optimization Using Adaptive Distributed Reinforcement Learning13 Mar 2024 0 repositories listed
-
An Improved Strategy for Blood Glucose Control Using Multi-Step Deep Reinforcement Learning12 Mar 2024 0 repositories listed
-
Constrained Optimal Fuel Consumption of HEV: A Constrained Reinforcement Learning Approach12 Mar 2024 0 repositories listed
-
Do Agents Dream of Electric Sheep?: Improving Generalization in Reinforcement Learning through Generative Learning12 Mar 2024 0 repositories listed
-
Improving Reinforcement Learning from Human Feedback Using Contrastive Rewards12 Mar 2024 0 repositories listed
-
Symmetric Q-learning: Reducing Skewness of Bellman Error in Online Reinforcement Learning12 Mar 2024 0 repositories listed
-
Deep Reinforcement Learning for Modelling Protein Complexes11 Mar 2024 0 repositories listed
-
DeepSafeMPC: Deep Learning-Based Model Predictive Control for Safe Multi-Agent Reinforcement Learning11 Mar 2024 0 repositories listed
-
Enhancing Image Caption Generation Using Reinforcement Learning with Human Feedback11 Mar 2024 0 repositories listed
-
In-context Exploration-Exploitation for Reinforcement Learning11 Mar 2024 0 repositories listed
-
Large Model driven Radiology Report Generation with Clinical Quality Reinforcement Learning11 Mar 2024 0 repositories listed
-
(N,K)-Puzzle: A Cost-Efficient Testbed for Benchmarking Reinforcement Learning Algorithms in Generative Language Model11 Mar 2024 0 repositories listed
-
Quantifying the Sensitivity of Inverse Reinforcement Learning to Misspecification11 Mar 2024 0 repositories listed
-
Tactical Decision Making for Autonomous Trucks by Deep Reinforcement Learning with Total Cost of Operation Based Reward11 Mar 2024 0 repositories listed
-
Distributional Successor Features Enable Zero-Shot Policy Optimization10 Mar 2024 0 repositories listed
-
Enhancing Classification Performance via Reinforcement Learning for Feature Selection9 Mar 2024 0 repositories listed
-
Reinforcement Learning Paycheck Optimization for Multivariate Financial Goals9 Mar 2024 0 repositories listed
-
Multi-Agent Reinforcement Learning with a Hierarchy of Reward Machines8 Mar 2024 0 repositories listed
-
Provable Multi-Party Reinforcement Learning with Diverse Human Feedback8 Mar 2024 0 repositories listed
-
Shielded Deep Reinforcement Learning for Complex Spacecraft Tasking8 Mar 2024 0 repositories listed
-
Switching the Loss Reduces the Cost in Batch Reinforcement Learning8 Mar 2024 0 repositories listed
-
A mechanism-driven reinforcement learning framework for shape optimization of airfoils7 Mar 2024 0 repositories listed
-
Improved Algorithm for Adversarial Linear Mixture MDPs with Bandit Feedback and Unknown Transition7 Mar 2024 0 repositories listed
-
Proxy-RLHF: Decoupling Generation and Alignment in Large Language Model with Proxy7 Mar 2024 0 repositories listed
-
Teaching Large Language Models to Reason with Reinforcement Learning7 Mar 2024 0 repositories listed
-
Vlearn: Off-Policy Learning with Efficient State-Value Function Estimation7 Mar 2024 0 repositories listed
-
Why Online Reinforcement Learning is Causal7 Mar 2024 0 repositories listed
-
A Survey on Applications of Reinforcement Learning in Spatial Resource Allocation6 Mar 2024 0 repositories listed
-
Dexterous Legged Locomotion in Confined 3D Spaces with Reinforcement Learning6 Mar 2024 0 repositories listed
-
Reconciling Reality through Simulation: A Real-to-Sim-to-Real Approach for Robust Manipulation6 Mar 2024 0 repositories listed
-
A Zero-Shot Reinforcement Learning Strategy for Autonomous Guidewire Navigation5 Mar 2024 0 repositories listed
-
Autonomous vehicle decision and control through reinforcement learning with traffic flow randomization5 Mar 2024 0 repositories listed
-
Enhancing LLM Safety via Constrained Direct Preference Optimization4 Mar 2024 0 repositories listed
-
Koopman-Assisted Reinforcement Learning4 Mar 2024 0 repositories listed
-
SMAUG: A Sliding Multidimensional Task Window-Based MARL Framework for Adaptive Real-Time Subtask Recognition4 Mar 2024 0 repositories listed
-
Tsallis Entropy Regularization for Linearly Solvable MDP and Linear Quadratic Regulator4 Mar 2024 0 repositories listed
-
Twisting Lids Off with Two Hands4 Mar 2024 0 repositories listed
-
Sample Efficient Myopic Exploration Through Multitask Reinforcement Learning with Diverse Tasks3 Mar 2024 0 repositories listed