Browse State-of-the-Art › Reinforcement Learning › Papers, page 56
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 56 of 132: papers 5,501 to 5,600 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Higher Replay Ratio Empowers Sample-Efficient Multi-Agent Reinforcement Learning15 Apr 2024 0 repositories listed
-
On the Effects of Fine-tuning Language Models for Text-Based Reinforcement Learning15 Apr 2024 0 repositories listed
-
Knowledgeable Agents by Offline Reinforcement Learning from Large Language Model Rollouts14 Apr 2024 0 repositories listed
-
Model-based Offline Quantum Reinforcement Learning14 Apr 2024 0 repositories listed
-
Active Learning for Control-Oriented Identification of Nonlinear Systems13 Apr 2024 0 repositories listed
-
Safe Reinforcement Learning on the Constraint Manifold: Theory and Applications13 Apr 2024 0 repositories listed
-
Advancing Forest Fire Prevention: Deep Reinforcement Learning for Effective Firebreak Placement12 Apr 2024 0 repositories listed
-
Agile and versatile bipedal robot tracking control through reinforcement learning12 Apr 2024 0 repositories listed
-
RLEMMO: Evolutionary Multimodal Optimization Assisted By Deep Reinforcement Learning12 Apr 2024 0 repositories listed
-
SIR-RL: Reinforcement Learning for Optimized Policy Control during Epidemiological Outbreaks in Emerging Market and Developing Economies12 Apr 2024 0 repositories listed
-
Differentially Private Reinforcement Learning with Self-Play11 Apr 2024 0 repositories listed
-
FPGA Divide-and-Conquer Placement using Deep Reinforcement Learning11 Apr 2024 0 repositories listed
-
R2 Indicator and Deep Reinforcement Learning Enhanced Adaptive Multi-Objective Evolutionary Algorithm11 Apr 2024 0 repositories listed
-
UAV-enabled Collaborative Beamforming via Multi-Agent Deep Reinforcement Learning11 Apr 2024 0 repositories listed
-
Structured Reinforcement Learning for Media Streaming at the Wireless Edge10 Apr 2024 0 repositories listed
-
Deep Reinforcement Learning-Based Approach for a Single Vehicle Persistent Surveillance Problem with Fuel Constraints9 Apr 2024 0 repositories listed
-
Efficient Multi-Task Reinforcement Learning via Task-Specific Action Correction9 Apr 2024 0 repositories listed
-
Generative Pre-Trained Transformer for Symbolic Regression Base In-Context Reinforcement Learning9 Apr 2024 0 repositories listed
-
Graph Reinforcement Learning for Combinatorial Optimization: A Survey and Unifying Perspective9 Apr 2024 0 repositories listed
-
Chiplet Placement Order Exploration Based on Learning to Rank with Graph Representation7 Apr 2024 0 repositories listed
-
Deep Reinforcement Learning Control for Disturbance Rejection in a Nonlinear Dynamic System with Parametric Uncertainty6 Apr 2024 0 repositories listed
-
Structurally Flexible Neural Networks: Evolving the Building Blocks for General Agents6 Apr 2024 0 repositories listed
-
Demonstration Guided Multi-Objective Reinforcement Learning5 Apr 2024 0 repositories listed
-
Enhancing IoT Intelligence: A Transformer-based Reinforcement Learning Methodology5 Apr 2024 0 repositories listed
-
Heterogeneous Multi-Agent Reinforcement Learning for Zero-Shot Scalable Collaboration5 Apr 2024 0 repositories listed
-
Intervention-Assisted Policy Gradient Methods for Online Stochastic Queuing Network Optimization: Technical Report5 Apr 2024 0 repositories listed
-
A Reinforcement Learning based Reset Policy for CDCL SAT Solvers4 Apr 2024 0 repositories listed
-
Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought4 Apr 2024 0 repositories listed
-
Self-organized free-flight arrival for urban air mobility4 Apr 2024 0 repositories listed
-
AD4RL: Autonomous Driving Benchmarks for Offline Reinforcement Learning with Value-based Dataset3 Apr 2024 0 repositories listed
-
Deep Reinforcement Learning for Traveling Purchaser Problems3 Apr 2024 0 repositories listed
-
Methodology for Interpretable Reinforcement Learning for Optimizing Mechanical Ventilation3 Apr 2024 0 repositories listed
-
Reinforcement Learning in Categorical Cybernetics3 Apr 2024 0 repositories listed
-
Distributed Autonomous Swarm Formation for Dynamic Network Bridging2 Apr 2024 0 repositories listed
-
Emergence of Chemotactic Strategies with Multi-Agent Reinforcement Learning2 Apr 2024 0 repositories listed
-
Imitation Game: A Model-based and Imitation Learning Deep Reinforcement Learning Hybrid2 Apr 2024 0 repositories listed
-
Learning to Control Camera Exposure via Reinforcement Learning2 Apr 2024 0 repositories listed
-
Multi-granular Adversarial Attacks against Black-box Neural Ranking Models2 Apr 2024 0 repositories listed
-
VLRM: Vision-Language Models act as Reward Models for Image Captioning2 Apr 2024 0 repositories listed
-
CAMO: Correlation-Aware Mask Optimization with Modulated Reinforcement Learning1 Apr 2024 0 repositories listed
-
MTLight: Efficient Multi-Task Reinforcement Learning for Traffic Signal Control1 Apr 2024 0 repositories listed
-
RL-MUL 2.0: Multiplier Design Optimization with Parallel Deep Reinforcement Learning and Space Reduction31 Mar 2024 0 repositories listed
-
Facilitating Reinforcement Learning for Process Control Using Transfer Learning: Overview and Perspectives30 Mar 2024 0 repositories listed
-
CtRL-Sim: Reactive and Controllable Driving Agents with Offline Reinforcement Learning29 Mar 2024 0 repositories listed
-
Removing the need for ground truth UWB data collection: self-supervised ranging error correction using deep reinforcement learning28 Mar 2024 0 repositories listed
-
CaT: Constraints as Terminations for Legged Locomotion Reinforcement Learning27 Mar 2024 0 repositories listed
-
Image Deraining via Self-supervised Reinforcement Learning27 Mar 2024 0 repositories listed
-
Probabilistic Model Checking of Stochastic Reinforcement Learning Policies27 Mar 2024 0 repositories listed
-
Safe and Robust Reinforcement Learning: Principles and Practice27 Mar 2024 0 repositories listed
-
An Analysis of Switchback Designs in Reinforcement Learning26 Mar 2024 0 repositories listed
-
An Open-source End-to-End Logic Optimization Framework for Large-scale Boolean Network with Reinforcement Learning26 Mar 2024 0 repositories listed
-
MA4DIV: Multi-Agent Reinforcement Learning for Search Result Diversification26 Mar 2024 0 repositories listed
-
Paths to Equilibrium in Games26 Mar 2024 0 repositories listed
-
Prioritized League Reinforcement Learning for Large-Scale Heterogeneous Multiagent Systems26 Mar 2024 0 repositories listed
-
Uncertainty-aware Distributional Offline Reinforcement Learning26 Mar 2024 0 repositories listed
-
Deep Reinforcement Learning and Mean-Variance Strategies for Responsible Portfolio Optimization25 Mar 2024 0 repositories listed
-
Speeding Up Path Planning via Reinforcement Learning in MCTS for Automated Parking25 Mar 2024 0 repositories listed
-
Interpretable Modeling of Deep Reinforcement Learning Driven Scheduling24 Mar 2024 0 repositories listed
-
Automated Feature Selection for Inverse Reinforcement Learning22 Mar 2024 0 repositories listed
-
Subequivariant Reinforcement Learning Framework for Coordinated Motion Control22 Mar 2024 0 repositories listed
-
Constrained Reinforcement Learning with Smoothed Log Barrier Function21 Mar 2024 0 repositories listed
-
Heuristic Algorithm-based Action Masking Reinforcement Learning (HAAM-RL) with Ensemble Inference Method21 Mar 2024 0 repositories listed
-
Fast Value Tracking for Deep Reinforcement Learning19 Mar 2024 0 repositories listed
-
Simple Ingredients for Offline Reinforcement Learning19 Mar 2024 0 repositories listed
-
Advanced Statistical Arbitrage with Reinforcement Learning18 Mar 2024 0 repositories listed
-
Offline Multitask Representation Learning for Reinforcement Learning18 Mar 2024 0 repositories listed
-
Pessimistic Causal Reinforcement Learning with Mediators for Confounded Offline Data18 Mar 2024 0 repositories listed
-
Reinforcement Learning with Generalizable Gaussian Splatting18 Mar 2024 0 repositories listed
-
Supervised Fine-Tuning as Inverse Reinforcement Learning18 Mar 2024 0 repositories listed
-
The Value of Reward Lookahead in Reinforcement Learning18 Mar 2024 0 repositories listed
-
Unveil Conditional Diffusion Models with Classifier-free Guidance: A Sharp Statistical Theory18 Mar 2024 0 repositories listed
-
Phasic Diversity Optimization for Population-Based Reinforcement Learning17 Mar 2024 0 repositories listed
-
Prior-dependent analysis of posterior sampling reinforcement learning with function approximation17 Mar 2024 0 repositories listed
-
Reinforcement Learning with Options and State Representation16 Mar 2024 0 repositories listed
-
ViSaRL: Visual Reinforcement Learning Guided by Human Saliency16 Mar 2024 0 repositories listed
-
Chain-structured neural architecture search for financial time series forecasting15 Mar 2024 0 repositories listed
-
Graph Enhanced Reinforcement Learning for Effective Group Formation in Collaborative Problem Solving15 Mar 2024 0 repositories listed
-
Parameter Efficient Reinforcement Learning from Human Feedback15 Mar 2024 0 repositories listed
-
HRLAIF: Improvements in Helpfulness and Harmlessness in Open-domain Reinforcement Learning From AI Feedback13 Mar 2024 0 repositories listed
-
Meta-operators for Enabling Parallel Planning Using Deep Reinforcement Learning13 Mar 2024 0 repositories listed
-
Multi-Objective Optimization Using Adaptive Distributed Reinforcement Learning13 Mar 2024 0 repositories listed
-
An Improved Strategy for Blood Glucose Control Using Multi-Step Deep Reinforcement Learning12 Mar 2024 0 repositories listed
-
Do Agents Dream of Electric Sheep?: Improving Generalization in Reinforcement Learning through Generative Learning12 Mar 2024 0 repositories listed
-
Improving Reinforcement Learning from Human Feedback Using Contrastive Rewards12 Mar 2024 0 repositories listed
-
Symmetric Q-learning: Reducing Skewness of Bellman Error in Online Reinforcement Learning12 Mar 2024 0 repositories listed
-
Deep Reinforcement Learning for Modelling Protein Complexes11 Mar 2024 0 repositories listed
-
DeepSafeMPC: Deep Learning-Based Model Predictive Control for Safe Multi-Agent Reinforcement Learning11 Mar 2024 0 repositories listed
-
In-context Exploration-Exploitation for Reinforcement Learning11 Mar 2024 0 repositories listed
-
Large Model driven Radiology Report Generation with Clinical Quality Reinforcement Learning11 Mar 2024 0 repositories listed
-
Quantifying the Sensitivity of Inverse Reinforcement Learning to Misspecification11 Mar 2024 0 repositories listed
-
Tactical Decision Making for Autonomous Trucks by Deep Reinforcement Learning with Total Cost of Operation Based Reward11 Mar 2024 0 repositories listed
-
Distributional Successor Features Enable Zero-Shot Policy Optimization10 Mar 2024 0 repositories listed
-
Enhancing Classification Performance via Reinforcement Learning for Feature Selection9 Mar 2024 0 repositories listed
-
Reinforcement Learning Paycheck Optimization for Multivariate Financial Goals9 Mar 2024 0 repositories listed
-
Multi-Agent Reinforcement Learning with a Hierarchy of Reward Machines8 Mar 2024 0 repositories listed
-
Provable Multi-Party Reinforcement Learning with Diverse Human Feedback8 Mar 2024 0 repositories listed
-
Shielded Deep Reinforcement Learning for Complex Spacecraft Tasking8 Mar 2024 0 repositories listed
-
Switching the Loss Reduces the Cost in Batch Reinforcement Learning8 Mar 2024 0 repositories listed
-
A mechanism-driven reinforcement learning framework for shape optimization of airfoils7 Mar 2024 0 repositories listed
-
Improved Algorithm for Adversarial Linear Mixture MDPs with Bandit Feedback and Unknown Transition7 Mar 2024 0 repositories listed