Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 66
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 66 of 152: papers 6,501 to 6,600 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
On Sample-Efficient Offline Reinforcement Learning: Data Diversity, Posterior Sampling, and Beyond6 Jan 2024 0 repositories listed
-
A unified uncertainty-aware exploration: Combining epistemic and aleatory uncertainty5 Jan 2024 0 repositories listed
-
Adaptive Discounting of Training Time Attacks5 Jan 2024 0 repositories listed
-
Synergistic Formulaic Alpha Generation for Quantitative Trading based on Reinforcement Learning5 Jan 2024 0 repositories listed
-
A comprehensive survey of research towards AI-enabled unmanned aerial systems in pre-, active-, and post-wildfire management4 Jan 2024 0 repositories listed
-
Towards an Adaptable and Generalizable Optimization Engine in Decision and Control: A Meta Reinforcement Learning Approach4 Jan 2024 0 repositories listed
-
GLIDE-RL: Grounded Language Instruction through DEmonstration in RL3 Jan 2024 0 repositories listed
-
Adversarially Trained Weighted Actor-Critic for Safe Offline Reinforcement Learning1 Jan 2024 0 repositories listed
-
Personalized Dynamic Pricing Policy for Electric Vehicles: Reinforcement learning approach1 Jan 2024 0 repositories listed
-
Regularized Parameter Uncertainty for Improving Generalization in Reinforcement Learning1 Jan 2024 0 repositories listed
-
Training Diffusion Models Towards Diverse Image Generation with Reinforcement Learning1 Jan 2024 0 repositories listed
-
Tight Finite Time Bounds of Two-Time-Scale Linear Stochastic Approximation with Markovian Noise31 Dec 2023 0 repositories listed
-
Design Space Exploration of Approximate Computing Techniques with a Reinforcement Learning Approach29 Dec 2023 0 repositories listed
-
Beyond PID Controllers: PPO with Neuralized PID Policy for Proton Beam Intensity Control in Mu2e28 Dec 2023 0 repositories listed
-
Resilient Constrained Reinforcement Learning28 Dec 2023 0 repositories listed
-
Conversational Question Answering with Reformulations over Knowledge Graph27 Dec 2023 0 repositories listed
-
General Method for Solving Four Types of SAT Problems27 Dec 2023 0 repositories listed
-
RL-MPCA: A Reinforcement Learning Based Multi-Phase Computation Allocation Approach for Recommender Systems27 Dec 2023 0 repositories listed
-
A Bayesian Framework of Deep Reinforcement Learning for Joint O-RAN/MEC Orchestration26 Dec 2023 0 repositories listed
-
Learning Online Policies for Person Tracking in Multi-View Environments26 Dec 2023 0 repositories listed
-
Agent based modelling for continuously varying supply chains24 Dec 2023 0 repositories listed
-
Gradient Shaping for Multi-Constraint Safe Reinforcement Learning23 Dec 2023 0 repositories listed
-
Hardware-Aware DNN Compression via Diverse Pruning and Mixed-Precision Quantization23 Dec 2023 0 repositories listed
-
Human-AI Collaboration in Real-World Complex Environment with Reinforcement Learning23 Dec 2023 0 repositories listed
-
Mutual Information as Intrinsic Reward of Reinforcement Learning Agents for On-demand Ride Pooling23 Dec 2023 0 repositories listed
-
Reinforcement Learning for Safe Occupancy Strategies in Educational Spaces during an Epidemic23 Dec 2023 0 repositories listed
-
A Survey of Reinforcement Learning from Human Feedback22 Dec 2023 0 repositories listed
-
Multiagent Copilot Approach for Shared Autonomy between Human EEG and TD3 Deep Reinforcement Learning22 Dec 2023 0 repositories listed
-
Pangu-Agent: A Fine-Tunable Generalist Agent with Structured Reasoning22 Dec 2023 0 repositories listed
-
REBEL: Reward Regularization-Based Approach for Robotic Reinforcement Learning from Human Feedback22 Dec 2023 0 repositories listed
-
Maximum entropy GFlowNets with soft Q-learning21 Dec 2023 0 repositories listed
-
Multi-Agent Probabilistic Ensembles with Trajectory Sampling for Connected Autonomous Vehicles21 Dec 2023 0 repositories listed
-
Optimal coordination of resources: A solution from reinforcement learning20 Dec 2023 0 repositories listed
-
Towards Machines that Trust: AI Agents Learn to Trust in the Trust Game20 Dec 2023 0 repositories listed
-
CUDC: A Curiosity-Driven Unsupervised Data Collection Method with Adaptive Temporal Distances for Offline Reinforcement Learning19 Dec 2023 0 repositories listed
-
Data-Driven Merton's Strategies via Policy Randomization19 Dec 2023 0 repositories listed
-
Neural Network Approximation for Pessimistic Offline Reinforcement Learning19 Dec 2023 0 repositories listed
-
Stable Relay Learning Optimization Approach for Fast Power System Production Cost Minimization Simulation19 Dec 2023 0 repositories listed
-
A Dual Curriculum Learning Framework for Multi-UAV Pursuit-Evasion in Diverse Environments19 Dec 2023 0 repositories listed
-
Active search and coverage using point-cloud reinforcement learning18 Dec 2023 0 repositories listed
-
Safeguarded Progress in Reinforcement Learning: Safe Bayesian Exploration for Control Policy Synthesis18 Dec 2023 0 repositories listed
-
Solving the swing-up and balance task for the Acrobot and Pendubot with SAC18 Dec 2023 0 repositories listed
-
Advancing RAN Slicing with Offline Reinforcement Learning16 Dec 2023 0 repositories listed
-
Fractional Deep Reinforcement Learning for Age-Minimal Mobile Edge Computing16 Dec 2023 0 repositories listed
-
Online Restless Multi-Armed Bandits with Long-Term Fairness Constraints16 Dec 2023 0 repositories listed
-
Assume-Guarantee Reinforcement Learning15 Dec 2023 0 repositories listed
-
Toward Computationally Efficient Inverse Reinforcement Learning via Reward Shaping15 Dec 2023 0 repositories listed
-
iOn-Profiler: intelligent Online multi-objective VNF Profiling with Reinforcement Learning14 Dec 2023 0 repositories listed
-
ReCoRe: Regularized Contrastive Representation Learning of World Model14 Dec 2023 0 repositories listed
-
Towards Automatic Data Augmentation for Disordered Speech Recognition14 Dec 2023 0 repositories listed
-
An Invitation to Deep Reinforcement Learning13 Dec 2023 0 repositories listed
-
Safe Exploration in Reinforcement Learning: Training Backup Control Barrier Functions with Zero Training Time Safety Violations13 Dec 2023 0 repositories listed
-
A dynamical clipping approach with task feedback for Proximal Policy Optimization12 Dec 2023 0 repositories listed
-
Beyond Expected Return: Accounting for Policy Reproducibility when Evaluating Reinforcement Learning Algorithms12 Dec 2023 0 repositories listed
-
Building Open-Ended Embodied Agent via Language-Policy Bidirectional Adaptation12 Dec 2023 0 repositories listed
-
Noise Distribution Decomposition based Multi-Agent Distributional Reinforcement Learning12 Dec 2023 0 repositories listed
-
Toward a Reinforcement-Learning-Based System for Adjusting Medication to Minimize Speech Disfluency12 Dec 2023 0 repositories listed
-
KnowGPT: Knowledge Graph based Prompting for Large Language Models11 Dec 2023 0 repositories listed
-
Learning Polynomial Representations of Physical Objects with Application to Certifying Correct Packing Configurations11 Dec 2023 0 repositories listed
-
Partial End-to-end Reinforcement Learning for Robustness Against Modelling Error in Autonomous Racing11 Dec 2023 0 repositories listed
-
Spreeze: High-Throughput Parallel Reinforcement Learning Framework11 Dec 2023 0 repositories listed
-
Modifying RL Policies with Imagined Actions: How Predictable Policies Can Enable Users to Perform Novel Tasks10 Dec 2023 0 repositories listed
-
PerfRL: A Small Language Model Framework for Efficient Code Optimization9 Dec 2023 0 repositories listed
-
Guaranteed Trust Region Optimization via Two-Phase KL Penalization8 Dec 2023 0 repositories listed
-
Modeling Risk in Reinforcement Learning: A Literature Mapping8 Dec 2023 0 repositories listed
-
Reinforcement Learning-Based Bionic Reflex Control for Anthropomorphic Robotic Grasping exploiting Domain Randomization8 Dec 2023 0 repositories listed
-
Learning to sample in Cartesian MRI7 Dec 2023 0 repositories listed
-
Safety-Enhanced Self-Learning for Optimal Power Converter Control7 Dec 2023 0 repositories listed
-
Demand response for residential building heating: Effective Monte Carlo Tree Search control based on physics-informed neural networks6 Dec 2023 0 repositories listed
-
Diffused Task-Agnostic Milestone Planner6 Dec 2023 0 repositories listed
-
Evaluation of Active Feature Acquisition Methods for Static Feature Settings6 Dec 2023 0 repositories listed
-
On the Role of the Action Space in Robot Manipulation Learning and Sim-to-Real Transfer6 Dec 2023 0 repositories listed
-
Contact Energy Based Hindsight Experience Prioritization5 Dec 2023 0 repositories listed
-
Convergence Rates for Stochastic Approximation: Biased Noise with Unbounded Variance, and Applications5 Dec 2023 0 repositories listed
-
SPOC: Imitating Shortest Paths in Simulation Enables Effective Navigation and Manipulation in the Real World5 Dec 2023 0 repositories listed
-
MASP: Scalable GNN-based Planning for Multi-Agent Navigation5 Dec 2023 0 repositories listed
-
RL-Based Cargo-UAV Trajectory Planning and Cell Association for Minimum Handoffs, Disconnectivity, and Energy Consumption5 Dec 2023 0 repositories listed
-
Score-Aware Policy-Gradient Methods and Performance Guarantees using Local Lyapunov Conditions: Applications to Product-Form Stochastic Networks and Queueing Systems5 Dec 2023 0 repositories listed
-
Adaptive operator selection utilising generalised experience4 Dec 2023 0 repositories listed
-
Deep Reinforcement Learning for Community Battery Scheduling under Uncertainties of Load, PV Generation, and Energy Prices4 Dec 2023 0 repositories listed
-
Foundations for Transfer in Reinforcement Learning: A Taxonomy of Knowledge Modalities4 Dec 2023 0 repositories listed
-
Integrated Drill Boom Hole-Seeking Control via Reinforcement Learning4 Dec 2023 0 repositories listed
-
Training Reinforcement Learning Agents and Humans With Difficulty-Conditioned Generators4 Dec 2023 0 repositories listed
-
Self-Critical Alternate Learning based Semantic Broadcast Communication3 Dec 2023 0 repositories listed
-
A Multifidelity Sim-to-Real Pipeline for Verifiable and Compositional Reinforcement Learning2 Dec 2023 0 repositories listed
-
A Survey of Temporal Credit Assignment in Deep Reinforcement Learning2 Dec 2023 0 repositories listed
-
Efficient Off-Policy Safe Reinforcement Learning Using Trust Region Conditional Value at Risk1 Dec 2023 0 repositories listed
-
Safe Reinforcement Learning in Tensor Reproducing Kernel Hilbert Space1 Dec 2023 0 repositories listed
-
Data-efficient Deep Reinforcement Learning for Vehicle Trajectory Control30 Nov 2023 0 repositories listed
-
Q-learning Based Optimal False Data Injection Attack on Probabilistic Boolean Control Networks29 Nov 2023 0 repositories listed
-
Self-Driving Telescopes: Autonomous Scheduling of Astronomical Observation Campaigns with Offline Reinforcement Learning29 Nov 2023 0 repositories listed
-
Two-Step Reinforcement Learning for Multistage Strategy Card Game29 Nov 2023 0 repositories listed
-
Safe Reinforcement Learning in a Simulated Robotic Arm28 Nov 2023 0 repositories listed
-
Temporal Transfer Learning for Traffic Optimization with Coarse-grained Advisory Autonomy27 Nov 2023 0 repositories listed
-
A Fully Data-Driven Approach for Realistic Traffic Signal Control Using Offline Reinforcement Learning27 Nov 2023 0 repositories listed
-
A Graph Neural Network-Based QUBO-Formulated Hamiltonian-Inspired Loss Function for Combinatorial Optimization using Reinforcement Learning27 Nov 2023 0 repositories listed
-
Optimal Observer Design Using Reinforcement Learning and Quadratic Neural Networks27 Nov 2023 0 repositories listed
-
Replay across Experiments: A Natural Extension of Off-Policy RL27 Nov 2023 0 repositories listed
-
A Nearly Optimal and Low-Switching Algorithm for Reinforcement Learning with General Function Approximation26 Nov 2023 0 repositories listed
-
Projected Off-Policy Q-Learning (POP-QL) for Stabilizing Offline Reinforcement Learning25 Nov 2023 0 repositories listed