Browse State-of-the-Art › Reinforcement Learning › Papers, page 61
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 61 of 132: papers 6,001 to 6,100 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Exploiting Causal Graph Priors with Posterior Sampling for Reinforcement Learning11 Oct 2023 0 repositories listed
-
Reinforcement Learning-based Knowledge Graph Reasoning for Explainable Fact-checking11 Oct 2023 0 repositories listed
-
Robust Safe Reinforcement Learning under Adversarial Disturbances11 Oct 2023 0 repositories listed
-
Federated Multi-Level Optimization over Decentralized Networks10 Oct 2023 0 repositories listed
-
Information Content Exploration10 Oct 2023 0 repositories listed
-
Realizing Stabilized Landing for Computation-Limited Reusable Rockets: A Quantum Reinforcement Learning Approach10 Oct 2023 0 repositories listed
-
Reinforcement Learning in a Safety-Embedded MDP with Trajectory Optimization10 Oct 2023 0 repositories listed
-
Scalable Semantic Non-Markovian Simulation Proxy for Reinforcement Learning10 Oct 2023 0 repositories listed
-
Spectral Entry-wise Matrix Estimation for Low-Rank Reinforcement Learning10 Oct 2023 0 repositories listed
-
Factual and Personalized Recommendations using Language Models and Reinforcement Learning9 Oct 2023 0 repositories listed
-
Hierarchical Reinforcement Learning for Temporal Pattern Prediction9 Oct 2023 0 repositories listed
-
Logic-Q: Improving Deep Reinforcement Learning-based Quantitative Trading via Program Sketch-based Tuning9 Oct 2023 0 repositories listed
-
Molecular De Novo Design through Transformer-based Reinforcement Learning9 Oct 2023 0 repositories listed
-
Multi-timestep models for Model-based Reinforcement Learning9 Oct 2023 0 repositories listed
-
Reinforcement learning for freeform robot design9 Oct 2023 0 repositories listed
-
Replication of Multi-agent Reinforcement Learning for the "Hide and Seek" Problem9 Oct 2023 0 repositories listed
-
Reward-Consistent Dynamics Models are Strongly Generalizable for Offline Reinforcement Learning9 Oct 2023 0 repositories listed
-
When is Agnostic Reinforcement Learning Statistically Tractable?9 Oct 2023 0 repositories listed
-
Distributional Reinforcement Learning with Online Risk-awareness Adaption8 Oct 2023 0 repositories listed
-
Fully Spiking Neural Network for Legged Robots8 Oct 2023 0 repositories listed
-
Optimal Sequential Decision-Making in Geosteering: A Reinforcement Learning Approach7 Oct 2023 0 repositories listed
-
Adjustable Robust Reinforcement Learning for Online 3D Bin Packing6 Oct 2023 0 repositories listed
-
Applying Reinforcement Learning to Option Pricing and Hedging6 Oct 2023 0 repositories listed
-
Deconstructing Cooperation and Ostracism via Multi-Agent Reinforcement Learning6 Oct 2023 0 repositories listed
-
Searching for Optimal Runtime Assurance via Reachability and Reinforcement Learning6 Oct 2023 0 repositories listed
-
A Kernel Perspective on Behavioural Metrics for Markov Decision Processes5 Oct 2023 0 repositories listed
-
A Review of Deep Reinforcement Learning in Serverless Computing: Function Scheduling and Resource Auto-Scaling5 Oct 2023 0 repositories listed
-
Constraint-Conditioned Policy Optimization for Versatile Safe Reinforcement Learning5 Oct 2023 0 repositories listed
-
PyDCM: Custom Data Center Models with Reinforcement Learning for Sustainability5 Oct 2023 0 repositories listed
-
RTDK-BO: High Dimensional Bayesian Optimization with Reinforced Transformer Deep kernels5 Oct 2023 0 repositories listed
-
Safe Exploration in Reinforcement Learning: A Generalized Formulation and Algorithms5 Oct 2023 0 repositories listed
-
Small batch deep reinforcement learning5 Oct 2023 0 repositories listed
-
Neural architecture impact on identifying temporally extended Reinforcement Learning tasks4 Oct 2023 0 repositories listed
-
Online Estimation and Inference for Robust Policy Evaluation in Reinforcement Learning4 Oct 2023 0 repositories listed
-
Proximal Policy Optimization-Based Reinforcement Learning Approach for DC-DC Boost Converter Control: A Comparative Evaluation Against Traditional Control Techniques4 Oct 2023 0 repositories listed
-
Searching for High-Value Molecules Using Reinforcement Learning and Transformers4 Oct 2023 0 repositories listed
-
Blending Imitation and Reinforcement Learning for Robust Policy Improvement3 Oct 2023 0 repositories listed
-
Pessimistic Nonlinear Least-Squares Value Iteration for Offline Reinforcement Learning2 Oct 2023 0 repositories listed
-
Risk-Sensitive Inhibitory Control for Safe Reinforcement Learning2 Oct 2023 0 repositories listed
-
Sample-Efficiency in Multi-Batch Reinforcement Learning: The Need for Dimension-Dependent Adaptivity2 Oct 2023 0 repositories listed
-
Solving the Quadratic Assignment Problem using Deep Reinforcement Learning2 Oct 2023 0 repositories listed
-
A General Offline Reinforcement Learning Framework for Interactive Recommendation1 Oct 2023 0 repositories listed
-
From Bandits Model to Deep Deterministic Policy Gradient, Reinforcement Learning with Contextual Information1 Oct 2023 0 repositories listed
-
A quantum system control method based on enhanced reinforcement learning30 Sep 2023 0 repositories listed
-
Controlling Neural Style Transfer with Deep Reinforcement Learning30 Sep 2023 0 repositories listed
-
Deep Reinforcement Learning for Autonomous Vehicle Intersection Navigation30 Sep 2023 0 repositories listed
-
Pairwise Proximal Policy Optimization: Harnessing Relative Feedback for LLM Alignment30 Sep 2023 0 repositories listed
-
Learning to Rewrite Prompts for Personalized Text Generation29 Sep 2023 0 repositories listed
-
DREAM: Decentralized Reinforcement Learning for Exploration and Efficient Energy Management in Multi-Robot Systems29 Sep 2023 0 repositories listed
-
On Generating Explanations for Reinforcement Learning Policies: An Empirical Study29 Sep 2023 0 repositories listed
-
Reinforcement Learning for Node Selection in Branch-and-Bound29 Sep 2023 0 repositories listed
-
Reliability Quantification of Deep Reinforcement Learning-based Control29 Sep 2023 0 repositories listed
-
Intrinsic Language-Guided Exploration for Complex Long-Horizon Robotic Manipulation Tasks28 Sep 2023 0 repositories listed
-
Robust Offline Reinforcement Learning -- Certify the Confidence Interval28 Sep 2023 0 repositories listed
-
Age Minimization in Massive IoT via UAV Swarm: A Multi-agent Reinforcement Learning Approach26 Sep 2023 0 repositories listed
-
Decoding trust: A reinforcement learning perspective26 Sep 2023 0 repositories listed
-
Constrained Deep Reinforcement Learning for Fronthaul Compression Optimization26 Sep 2023 0 repositories listed
-
Adapting Double Q-Learning for Continuous Reinforcement Learning25 Sep 2023 0 repositories listed
-
DISeR: Designing Imaging Systems with Reinforcement Learning25 Sep 2023 0 repositories listed
-
Implicit Sensing in Traffic Optimization: Advanced Deep Reinforcement Learning Techniques25 Sep 2023 0 repositories listed
-
Learning Risk-Aware Quadrupedal Locomotion using Distributional Reinforcement Learning25 Sep 2023 0 repositories listed
-
ODE-based Recurrent Model-free Reinforcement Learning for POMDPs25 Sep 2023 0 repositories listed
-
On the Benefit of Optimal Transport for Curriculum Reinforcement Learning25 Sep 2023 0 repositories listed
-
Tracking Control for a Spherical Pendulum via Curriculum Reinforcement Learning25 Sep 2023 0 repositories listed
-
Iterative Reachability Estimation for Safe Reinforcement Learning24 Sep 2023 0 repositories listed
-
Reinforcement Learning for Robust Header Compression under Model Uncertainty23 Sep 2023 0 repositories listed
-
Diagnosing and exploiting the computational demands of videos games for deep reinforcement learning22 Sep 2023 0 repositories listed
-
Reward Function Design for Crowd Simulation via Reinforcement Learning22 Sep 2023 0 repositories listed
-
Curriculum Reinforcement Learning via Morphology-Environment Co-Evolution21 Sep 2023 0 repositories listed
-
Learning to Recover for Safe Reinforcement Learning21 Sep 2023 0 repositories listed
-
Rewiring Neurons in Non-Stationary Environments21 Sep 2023 0 repositories listed
-
Safe Hierarchical Reinforcement Learning for CubeSat Task Scheduling Based on Energy Consumption21 Sep 2023 0 repositories listed
-
Adaptive Multi-Agent Deep Reinforcement Learning for Timely Healthcare Interventions20 Sep 2023 0 repositories listed
-
Delays in Reinforcement Learning20 Sep 2023 0 repositories listed
-
Hierarchical reinforcement learning with natural language subgoals20 Sep 2023 0 repositories listed
-
Differentiable Quantum Architecture Search for Quantum Reinforcement Learning19 Sep 2023 0 repositories listed
-
FRAMU: Attention-based Machine Unlearning using Federated Reinforcement Learning19 Sep 2023 0 repositories listed
-
Multicopy Reinforcement Learning Agents19 Sep 2023 0 repositories listed
-
PDRL: Multi-Agent based Reinforcement Learning for Predictive Monitoring19 Sep 2023 0 repositories listed
-
Adaptive Liquidity Provision in Uniswap V3 with Deep Reinforcement Learning18 Sep 2023 0 repositories listed
-
Guided Online Distillation: Promoting Safe Reinforcement Learning by Offline Demonstration18 Sep 2023 0 repositories listed
-
Mechanic Maker 2.0: Reinforcement Learning for Evaluating Generated Rules18 Sep 2023 0 repositories listed
-
Multi-Agent Deep Reinforcement Learning for Cooperative and Competitive Autonomous Vehicles using AutoDRIVE Ecosystem18 Sep 2023 0 repositories listed
-
Privileged to Predicted: Towards Sensorimotor Reinforcement Learning for Urban Driving18 Sep 2023 0 repositories listed
-
Q-Transformer: Scalable Offline Reinforcement Learning via Autoregressive Q-Functions18 Sep 2023 0 repositories listed
-
DOMAIN: MilDly COnservative Model-BAsed OfflINe Reinforcement Learning16 Sep 2023 0 repositories listed
-
gym-saturation: Gymnasium environments for saturation provers (System description)16 Sep 2023 0 repositories listed
-
Deep Multi-Agent Reinforcement Learning for Decentralized Active Hypothesis Testing14 Sep 2023 0 repositories listed
-
Equivariant Data Augmentation for Generalization in Offline Reinforcement Learning14 Sep 2023 0 repositories listed
-
A Real-World Quadrupedal Locomotion Benchmark for Offline Reinforcement Learning13 Sep 2023 0 repositories listed
-
Attention Loss Adjusted Prioritized Experience Replay13 Sep 2023 0 repositories listed
-
Characterizing Speed Performance of Multi-Agent Reinforcement Learning13 Sep 2023 0 repositories listed
-
Efficient quantum recurrent reinforcement learning via quantum reservoir computing13 Sep 2023 0 repositories listed
-
Safe Reinforcement Learning with Dual Robustness13 Sep 2023 0 repositories listed
-
Fidelity-Induced Interpretable Policy Extraction for Reinforcement Learning12 Sep 2023 0 repositories listed
-
Goal Space Abstraction in Hierarchical Reinforcement Learning via Reachability Analysis12 Sep 2023 0 repositories listed
-
Risk-Aware Reinforcement Learning through Optimal Transport Theory12 Sep 2023 0 repositories listed
-
Mind the Uncertainty: Risk-Aware and Actively Exploring Model-Based Reinforcement Learning11 Sep 2023 0 repositories listed
-
Physics-informed reinforcement learning via probabilistic co-adjustment functions11 Sep 2023 0 repositories listed
-
Chasing the Intruder: A Reinforcement Learning Approach for Tracking Intruder Drones10 Sep 2023 0 repositories listed