Browse State-of-the-Art › reinforcement-learning › Papers, page 62
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 62 of 135: papers 6,101 to 6,200 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Robust Safe Reinforcement Learning under Adversarial Disturbances11 Oct 2023 0 repositories listed
-
Federated Multi-Level Optimization over Decentralized Networks10 Oct 2023 0 repositories listed
-
Information Content Exploration10 Oct 2023 0 repositories listed
-
Realizing Stabilized Landing for Computation-Limited Reusable Rockets: A Quantum Reinforcement Learning Approach10 Oct 2023 0 repositories listed
-
Reinforcement Learning in a Safety-Embedded MDP with Trajectory Optimization10 Oct 2023 0 repositories listed
-
Scalable Semantic Non-Markovian Simulation Proxy for Reinforcement Learning10 Oct 2023 0 repositories listed
-
Spectral Entry-wise Matrix Estimation for Low-Rank Reinforcement Learning10 Oct 2023 0 repositories listed
-
Factual and Personalized Recommendations using Language Models and Reinforcement Learning9 Oct 2023 0 repositories listed
-
Hierarchical Reinforcement Learning for Temporal Pattern Prediction9 Oct 2023 0 repositories listed
-
Logic-Q: Improving Deep Reinforcement Learning-based Quantitative Trading via Program Sketch-based Tuning9 Oct 2023 0 repositories listed
-
Molecular De Novo Design through Transformer-based Reinforcement Learning9 Oct 2023 0 repositories listed
-
Multi-timestep models for Model-based Reinforcement Learning9 Oct 2023 0 repositories listed
-
On Double Descent in Reinforcement Learning with LSTD and Random Features9 Oct 2023 0 repositories listed
-
Reinforcement learning for freeform robot design9 Oct 2023 0 repositories listed
-
Replication of Multi-agent Reinforcement Learning for the "Hide and Seek" Problem9 Oct 2023 0 repositories listed
-
Reward-Consistent Dynamics Models are Strongly Generalizable for Offline Reinforcement Learning9 Oct 2023 0 repositories listed
-
When is Agnostic Reinforcement Learning Statistically Tractable?9 Oct 2023 0 repositories listed
-
Distributional Reinforcement Learning with Online Risk-awareness Adaption8 Oct 2023 0 repositories listed
-
Fully Spiking Neural Network for Legged Robots8 Oct 2023 0 repositories listed
-
Global Convergence of Policy Gradient Methods in Reinforcement Learning, Games and Control8 Oct 2023 0 repositories listed
-
Optimal Sequential Decision-Making in Geosteering: A Reinforcement Learning Approach7 Oct 2023 0 repositories listed
-
Improving Offline-to-Online Reinforcement Learning with Q Conditioned State Entropy Exploration7 Oct 2023 0 repositories listed
-
Adjustable Robust Reinforcement Learning for Online 3D Bin Packing6 Oct 2023 0 repositories listed
-
Applying Reinforcement Learning to Option Pricing and Hedging6 Oct 2023 0 repositories listed
-
Improving Reinforcement Learning Efficiency with Auxiliary Tasks in Non-Visual Environments: A Comparison6 Oct 2023 0 repositories listed
-
Deconstructing Cooperation and Ostracism via Multi-Agent Reinforcement Learning6 Oct 2023 0 repositories listed
-
Searching for Optimal Runtime Assurance via Reachability and Reinforcement Learning6 Oct 2023 0 repositories listed
-
A Kernel Perspective on Behavioural Metrics for Markov Decision Processes5 Oct 2023 0 repositories listed
-
A Review of Deep Reinforcement Learning in Serverless Computing: Function Scheduling and Resource Auto-Scaling5 Oct 2023 0 repositories listed
-
Constraint-Conditioned Policy Optimization for Versatile Safe Reinforcement Learning5 Oct 2023 0 repositories listed
-
PyDCM: Custom Data Center Models with Reinforcement Learning for Sustainability5 Oct 2023 0 repositories listed
-
RTDK-BO: High Dimensional Bayesian Optimization with Reinforced Transformer Deep kernels5 Oct 2023 0 repositories listed
-
Safe Exploration in Reinforcement Learning: A Generalized Formulation and Algorithms5 Oct 2023 0 repositories listed
-
Small batch deep reinforcement learning5 Oct 2023 0 repositories listed
-
Deep Reinforcement Learning Algorithms for Hybrid V2X Communication: A Benchmarking Study4 Oct 2023 0 repositories listed
-
Deep reinforcement learning for machine scheduling: Methodology, the state-of-the-art, and future directions4 Oct 2023 0 repositories listed
-
Reinforcement Learning with Foundation Priors: Let the Embodied Agent Efficiently Learn on Its Own4 Oct 2023 0 repositories listed
-
ℬ-Coder: Value-Based Deep Reinforcement Learning for Program Synthesis4 Oct 2023 0 repositories listed
-
Neural architecture impact on identifying temporally extended Reinforcement Learning tasks4 Oct 2023 0 repositories listed
-
Online Estimation and Inference for Robust Policy Evaluation in Reinforcement Learning4 Oct 2023 0 repositories listed
-
Proximal Policy Optimization-Based Reinforcement Learning Approach for DC-DC Boost Converter Control: A Comparative Evaluation Against Traditional Control Techniques4 Oct 2023 0 repositories listed
-
Reinforcement Learning-based Mixture of Vision Transformers for Video Violence Recognition4 Oct 2023 0 repositories listed
-
Searching for High-Value Molecules Using Reinforcement Learning and Transformers4 Oct 2023 0 repositories listed
-
Blending Imitation and Reinforcement Learning for Robust Policy Improvement3 Oct 2023 0 repositories listed
-
On Representation Complexity of Model-based and Model-free Reinforcement Learning3 Oct 2023 0 repositories listed
-
Reinforcement Learning from Automatic Feedback for High-Quality Unit Test Generation3 Oct 2023 0 repositories listed
-
CAD: Clustering And Deep Reinforcement Learning Based Multi-Period Portfolio Management Strategy2 Oct 2023 0 repositories listed
-
Pessimistic Nonlinear Least-Squares Value Iteration for Offline Reinforcement Learning2 Oct 2023 0 repositories listed
-
Risk-Sensitive Inhibitory Control for Safe Reinforcement Learning2 Oct 2023 0 repositories listed
-
Sample-Efficiency in Multi-Batch Reinforcement Learning: The Need for Dimension-Dependent Adaptivity2 Oct 2023 0 repositories listed
-
Solving the Quadratic Assignment Problem using Deep Reinforcement Learning2 Oct 2023 0 repositories listed
-
A General Offline Reinforcement Learning Framework for Interactive Recommendation1 Oct 2023 0 repositories listed
-
From Bandits Model to Deep Deterministic Policy Gradient, Reinforcement Learning with Contextual Information1 Oct 2023 0 repositories listed
-
A quantum system control method based on enhanced reinforcement learning30 Sep 2023 0 repositories listed
-
Controlling Neural Style Transfer with Deep Reinforcement Learning30 Sep 2023 0 repositories listed
-
Deep Reinforcement Learning for Autonomous Vehicle Intersection Navigation30 Sep 2023 0 repositories listed
-
Pairwise Proximal Policy Optimization: Harnessing Relative Feedback for LLM Alignment30 Sep 2023 0 repositories listed
-
Reinforcement learning adaptive fuzzy controller for lighting systems: application to aircraft cabin30 Sep 2023 0 repositories listed
-
A Quantum States Preparation Method Based on Difference-Driven Reinforcement Learning29 Sep 2023 0 repositories listed
-
Learning to Rewrite Prompts for Personalized Text Generation29 Sep 2023 0 repositories listed
-
DREAM: Decentralized Reinforcement Learning for Exploration and Efficient Energy Management in Multi-Robot Systems29 Sep 2023 0 repositories listed
-
On Generating Explanations for Reinforcement Learning Policies: An Empirical Study29 Sep 2023 0 repositories listed
-
Reinforcement Learning for Node Selection in Branch-and-Bound29 Sep 2023 0 repositories listed
-
Reliability Quantification of Deep Reinforcement Learning-based Control29 Sep 2023 0 repositories listed
-
TranDRL: A Transformer-Driven Deep Reinforcement Learning Enabled Prescriptive Maintenance Framework29 Sep 2023 0 repositories listed
-
Design of JiuTian Intelligent Network Simulation Platform28 Sep 2023 0 repositories listed
-
Intrinsic Language-Guided Exploration for Complex Long-Horizon Robotic Manipulation Tasks28 Sep 2023 0 repositories listed
-
Robust Offline Reinforcement Learning -- Certify the Confidence Interval28 Sep 2023 0 repositories listed
-
Task-Oriented Koopman-Based Control with Contrastive Encoder28 Sep 2023 0 repositories listed
-
Distill Knowledge in Multi-task Reinforcement Learning with Optimal-Transport Regularization27 Sep 2023 0 repositories listed
-
Age Minimization in Massive IoT via UAV Swarm: A Multi-agent Reinforcement Learning Approach26 Sep 2023 0 repositories listed
-
Decoding trust: A reinforcement learning perspective26 Sep 2023 0 repositories listed
-
Gray-box Adversarial Attack of Deep Reinforcement Learning-based Trading Agents26 Sep 2023 0 repositories listed
-
Constrained Deep Reinforcement Learning for Fronthaul Compression Optimization26 Sep 2023 0 repositories listed
-
Adapting Double Q-Learning for Continuous Reinforcement Learning25 Sep 2023 0 repositories listed
-
DISeR: Designing Imaging Systems with Reinforcement Learning25 Sep 2023 0 repositories listed
-
Implicit Sensing in Traffic Optimization: Advanced Deep Reinforcement Learning Techniques25 Sep 2023 0 repositories listed
-
Learning Risk-Aware Quadrupedal Locomotion using Distributional Reinforcement Learning25 Sep 2023 0 repositories listed
-
ODE-based Recurrent Model-free Reinforcement Learning for POMDPs25 Sep 2023 0 repositories listed
-
On the Benefit of Optimal Transport for Curriculum Reinforcement Learning25 Sep 2023 0 repositories listed
-
Tracking Control for a Spherical Pendulum via Curriculum Reinforcement Learning25 Sep 2023 0 repositories listed
-
Boosting Offline Reinforcement Learning for Autonomous Driving with Hierarchical Latent Skills24 Sep 2023 0 repositories listed
-
Iterative Reachability Estimation for Safe Reinforcement Learning24 Sep 2023 0 repositories listed
-
Reinforcement Learning for Robust Header Compression under Model Uncertainty23 Sep 2023 0 repositories listed
-
Diagnosing and exploiting the computational demands of videos games for deep reinforcement learning22 Sep 2023 0 repositories listed
-
Reward Function Design for Crowd Simulation via Reinforcement Learning22 Sep 2023 0 repositories listed
-
Curriculum Reinforcement Learning via Morphology-Environment Co-Evolution21 Sep 2023 0 repositories listed
-
Learning to Recover for Safe Reinforcement Learning21 Sep 2023 0 repositories listed
-
Rewiring Neurons in Non-Stationary Environments21 Sep 2023 0 repositories listed
-
Safe Hierarchical Reinforcement Learning for CubeSat Task Scheduling Based on Energy Consumption21 Sep 2023 0 repositories listed
-
Adaptive Multi-Agent Deep Reinforcement Learning for Timely Healthcare Interventions20 Sep 2023 0 repositories listed
-
Delays in Reinforcement Learning20 Sep 2023 0 repositories listed
-
Hierarchical reinforcement learning with natural language subgoals20 Sep 2023 0 repositories listed
-
Optimizing Crowd-Aware Multi-Agent Path Finding through Local Communication with Graph Neural Networks19 Sep 2023 0 repositories listed
-
Differentiable Quantum Architecture Search for Quantum Reinforcement Learning19 Sep 2023 0 repositories listed
-
FRAMU: Attention-based Machine Unlearning using Federated Reinforcement Learning19 Sep 2023 0 repositories listed
-
Multicopy Reinforcement Learning Agents19 Sep 2023 0 repositories listed
-
PDRL: Multi-Agent based Reinforcement Learning for Predictive Monitoring19 Sep 2023 0 repositories listed
-
Task Graph offloading via Deep Reinforcement Learning in Mobile Edge Computing19 Sep 2023 0 repositories listed
-
Adaptive Liquidity Provision in Uniswap V3 with Deep Reinforcement Learning18 Sep 2023 0 repositories listed