Browse State-of-the-Art › reinforcement-learning › Papers, page 73
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 73 of 135: papers 7,201 to 7,300 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Misspecification in Inverse Reinforcement Learning6 Dec 2022 0 repositories listed
-
Reinforcement Learning for UAV control with Policy and Reward Shaping6 Dec 2022 0 repositories listed
-
Safe Inverse Reinforcement Learning via Control Barrier Function6 Dec 2022 0 repositories listed
-
Understanding Self-Predictive Learning for Reinforcement Learning6 Dec 2022 0 repositories listed
-
Robust Reinforcement Learning for Risk-Sensitive Linear Quadratic Gaussian Control5 Dec 2022 0 repositories listed
-
Benchmarking Offline Reinforcement Learning Algorithms for E-Commerce Order Fraud Evaluation5 Dec 2022 0 repositories listed
-
Differentiated Federated Reinforcement Learning Based Traffic Offloading on Space-Air-Ground Integrated Networks5 Dec 2022 0 repositories listed
-
E-MAPP: Efficient Multi-Agent Reinforcement Learning with Parallel Program Guidance5 Dec 2022 0 repositories listed
-
PowRL: A Reinforcement Learning Framework for Robust Management of Power Networks5 Dec 2022 0 repositories listed
-
Online Shielding for Reinforcement Learning4 Dec 2022 0 repositories listed
-
Constrained Reinforcement Learning via Dissipative Saddle Flow Dynamics3 Dec 2022 0 repositories listed
-
DACOM: Learning Delay-Aware Communication for Multi-Agent Reinforcement Learning3 Dec 2022 0 repositories listed
-
Reinforcement learning with Demonstrations from Mismatched Task under Sparse Reward3 Dec 2022 0 repositories listed
-
CT-DQN: Control-Tutored Deep Reinforcement Learning2 Dec 2022 0 repositories listed
-
Flow to Control: Offline Reinforcement Learning with Lossless Primitive Discovery2 Dec 2022 0 repositories listed
-
Selecting Mechanical Parameters of a Monopode Jumping System with Reinforcement Learning2 Dec 2022 0 repositories listed
-
Utilizing Prior Solutions for Reward Shaping and Composition in Entropy-Regularized Reinforcement Learning2 Dec 2022 0 repositories listed
-
Distributed Deep Reinforcement Learning: A Survey and A Multi-Player Multi-Agent Learning Toolbox1 Dec 2022 0 repositories listed
-
Five Properties of Specific Curiosity You Didn't Know Curious Machines Should Have1 Dec 2022 0 repositories listed
-
Launchpad: Learning to Schedule Using Offline and Online RL Methods1 Dec 2022 0 repositories listed
-
Modeling Mobile Health Users as Reinforcement Learning Agents1 Dec 2022 0 repositories listed
-
Online Learning-based Waveform Selection for Improved Vehicle Recognition in Automotive Radar1 Dec 2022 0 repositories listed
-
Reward Function Optimization of a Deep Reinforcement Learning Collision Avoidance System1 Dec 2022 0 repositories listed
-
Safe Reinforcement Learning with Probabilistic Control Barrier Functions for Ramp Merging1 Dec 2022 0 repositories listed
-
Automatic Discovery of Multi-perspective Process Model using Reinforcement Learning30 Nov 2022 0 repositories listed
-
Computationally Efficient Reinforcement Learning: Targeted Exploration leveraging Simple Rules30 Nov 2022 0 repositories listed
-
Global Convergence of Localized Policy Iteration in Networked Multi-Agent Reinforcement Learning30 Nov 2022 0 repositories listed
-
Random Copolymer inverse design system orienting on Accurate discovering of Antimicrobial peptide-mimetic copolymers30 Nov 2022 0 repositories listed
-
Reinforcement Learning for Multi-Truck Vehicle Routing Problems30 Nov 2022 0 repositories listed
-
Funnel-based Reward Shaping for Signal Temporal Logic Tasks in Reinforcement Learning30 Nov 2022 0 repositories listed
-
Safe and Efficient Reinforcement Learning Using Disturbance-Observer-Based Control Barrier Functions30 Nov 2022 0 repositories listed
-
Targets in Reinforcement Learning to solve Stackelberg Security Games30 Nov 2022 0 repositories listed
-
Approximating Martingale Process for Variance Reduction in Deep Reinforcement Learning with Large State Space29 Nov 2022 0 repositories listed
-
Autotuning PID control using Actor-Critic Deep Reinforcement Learning29 Nov 2022 0 repositories listed
-
Discrete Control in Real-World Driving Environments using Deep Reinforcement Learning29 Nov 2022 0 repositories listed
-
Distributed Energy Management and Demand Response in Smart Grids: A Multi-Agent Deep Reinforcement Learning Framework29 Nov 2022 0 repositories listed
-
Learning and Understanding a Disentangled Feature Representation for Hidden Parameters in Reinforcement Learning29 Nov 2022 0 repositories listed
-
Multi-Agent Reinforcement Learning for Microprocessor Design Space Exploration29 Nov 2022 0 repositories listed
-
Offline Reinforcement Learning with Closed-Form Policy Improvement Operators29 Nov 2022 0 repositories listed
-
Symmetry Detection in Trajectory Data for More Meaningful Reinforcement Learning Representations29 Nov 2022 0 repositories listed
-
AcceRL: Policy Acceleration Framework for Deep Reinforcement Learning28 Nov 2022 0 repositories listed
-
Autonomous Assessment of Demonstration Sufficiency via Bayesian Inverse Reinforcement Learning28 Nov 2022 0 repositories listed
-
Causal Deep Reinforcement Learning Using Observational Data28 Nov 2022 0 repositories listed
-
Continuous Episodic Control28 Nov 2022 0 repositories listed
-
Hypernetworks for Zero-shot Transfer in Reinforcement Learning28 Nov 2022 0 repositories listed
-
Inapplicable Actions Learning for Knowledge Transfer in Reinforcement Learning28 Nov 2022 0 repositories listed
-
Learning from Good Trajectories in Offline Multi-Agent Reinforcement Learning28 Nov 2022 0 repositories listed
-
State-Aware Proximal Pessimistic Algorithms for Offline Reinforcement Learning28 Nov 2022 0 repositories listed
-
Domain Generalization for Robust Model-Based Offline Reinforcement Learning27 Nov 2022 0 repositories listed
-
Computational Co-Design for Variable Geometry Truss26 Nov 2022 0 repositories listed
-
Model-Free Reinforcement Learning with the Decision-Estimation Coefficient25 Nov 2022 0 repositories listed
-
An Isolation-Aware Online Virtual Network Embedding via Deep Reinforcement Learning25 Nov 2022 0 repositories listed
-
Operator Splitting Value Iteration25 Nov 2022 0 repositories listed
-
Improving Proactive Dialog Agents Using Socially-Aware Reinforcement Learning25 Nov 2022 0 repositories listed
-
Software Simulation and Visualization of Quantum Multi-Drone Reinforcement Learning24 Nov 2022 0 repositories listed
-
Introspection-based Explainable Reinforcement Learning in Episodic and Non-episodic Scenarios23 Nov 2022 0 repositories listed
-
Monte Carlo Tree Search Algorithms for Risk-Aware and Multi-Objective Reinforcement Learning23 Nov 2022 0 repositories listed
-
On Instance-Dependent Bounds for Offline Reinforcement Learning with Linear Function Approximation23 Nov 2022 0 repositories listed
-
Powderworld: A Platform for Understanding Generalization via Rich Task Distributions23 Nov 2022 0 repositories listed
-
Prototypical context-aware dynamics generalization for high-dimensional model-based reinforcement learning23 Nov 2022 0 repositories listed
-
Reinforcement Learning Agent Design and Optimization with Bandwidth Allocation Model23 Nov 2022 0 repositories listed
-
Reinforcement learning for traffic signal control in hybrid action space23 Nov 2022 0 repositories listed
-
Representation Learning for Continuous Action Spaces is Beneficial for Efficient Policy Learning23 Nov 2022 0 repositories listed
-
A Deep Reinforcement Learning Approach to Rare Event Estimation22 Nov 2022 0 repositories listed
-
A Reinforcement Learning Approach to Optimize Available Network Bandwidth Utilization22 Nov 2022 0 repositories listed
-
Greedy based Value Representation for Optimal Coordination in Multi-agent Reinforcement Learning22 Nov 2022 0 repositories listed
-
Safe Control and Learning Using the Generalized Action Governor22 Nov 2022 0 repositories listed
-
HARL: Hierarchical Adaptive Reinforcement Learning Based Auto Scheduler for Neural Networks21 Nov 2022 0 repositories listed
-
Improving Multimodal Interactive Agents with Reinforcement Learning from Human Feedback21 Nov 2022 0 repositories listed
-
Learning Cooperative Oversubscription for Cloud by Chance-Constrained Multi-Agent Reinforcement Learning21 Nov 2022 0 repositories listed
-
Model-based Trajectory Stitching for Improved Offline Reinforcement Learning21 Nov 2022 0 repositories listed
-
PhysQ: A Physics Informed Reinforcement Learning Framework for Building Control21 Nov 2022 0 repositories listed
-
Simultaneously Updating All Persistence Values in Reinforcement Learning21 Nov 2022 0 repositories listed
-
Efficient Representations of Object Geometry for Reinforcement Learning of Interactive Grasping Policies20 Nov 2022 0 repositories listed
-
Real-time Local Feature with Global Visual Information Enhancement20 Nov 2022 0 repositories listed
-
Safe Reinforcement Learning using Data-Driven Predictive Control20 Nov 2022 0 repositories listed
-
Structure-Enhanced Deep Reinforcement Learning for Optimal Transmission Scheduling20 Nov 2022 0 repositories listed
-
Evaluating the Perceived Safety of Urban City via Maximum Entropy Deep Inverse Reinforcement Learning19 Nov 2022 0 repositories listed
-
Analysis of Reinforcement Learning Schemes for Trajectory Optimization of an Aerial Radio Unit18 Nov 2022 0 repositories listed
-
Credit-cognisant reinforcement learning for multi-agent cooperation18 Nov 2022 0 repositories listed
-
A Reinforcement Learning Approach for Process Parameter Optimization in Additive Manufacturing17 Nov 2022 0 repositories listed
-
AlphaSnake: Policy Iteration on a Nondeterministic NP-hard Markov Decision Process17 Nov 2022 0 repositories listed
-
DexPoint: Generalizable Point Cloud Reinforcement Learning for Sim-to-Real Dexterous Manipulation17 Nov 2022 0 repositories listed
-
Planning Irregular Object Packing via Hierarchical Reinforcement Learning17 Nov 2022 0 repositories listed
-
Solar Power driven EV Charging Optimization with Deep Reinforcement Learning17 Nov 2022 0 repositories listed
-
Addressing the issue of stochastic environments and local decision-making in multi-objective reinforcement learning16 Nov 2022 0 repositories listed
-
Data-pooling Reinforcement Learning for Personalized Healthcare Intervention16 Nov 2022 0 repositories listed
-
Minimum information divergence of Q-functions for dynamic treatment resumes16 Nov 2022 0 repositories listed
-
APT: Adaptive Perceptual quality based camera Tuning using reinforcement learning15 Nov 2022 0 repositories listed
-
Contextual Transformer for Offline Meta Reinforcement Learning15 Nov 2022 0 repositories listed
-
General Intelligence Requires Rethinking Exploration15 Nov 2022 0 repositories listed
-
Offline Reinforcement Learning with Adaptive Behavior Regularization15 Nov 2022 0 repositories listed
-
Reinforcement Learning Methods for Wordle: A POMDP/Adaptive Control Approach15 Nov 2022 0 repositories listed
-
Universal Distributional Decision-based Black-box Adversarial Attack with Reinforcement Learning15 Nov 2022 0 repositories listed
-
Dynamic Collaborative Multi-Agent Reinforcement Learning Communication for Autonomous Drone Reforestation14 Nov 2022 0 repositories listed
-
Linear Reinforcement Learning with Ball Structure Action Space14 Nov 2022 0 repositories listed
-
Parallel Automatic History Matching Algorithm Using Reinforcement Learning14 Nov 2022 0 repositories listed
-
Reinforcement Learning Based Resource Allocation for Network Slices in O-RAN Midhaul14 Nov 2022 0 repositories listed
-
(When) Are Contrastive Explanations of Reinforcement Learning Helpful?14 Nov 2022 0 repositories listed
-
Goal-Conditioned Reinforcement Learning in the Presence of an Adversary13 Nov 2022 0 repositories listed