Browse State-of-the-Art › reinforcement-learning › Papers, page 82
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 82 of 135: papers 8,101 to 8,200 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
External control of a genetic toggle switch via Reinforcement Learning11 Apr 2022 0 repositories listed
-
Implementing Online Reinforcement Learning with Temporal Neural Networks11 Apr 2022 0 repositories listed
-
Settling the Sample Complexity of Model-Based Offline Reinforcement Learning11 Apr 2022 0 repositories listed
-
NeuRL: Closed-form Inverse Reinforcement Learning for Neural Decoding10 Apr 2022 0 repositories listed
-
A Spiking Neural Network Structure Implementing Reinforcement Learning9 Apr 2022 0 repositories listed
-
Hardware Trojan Insertion Using Reinforcement Learning9 Apr 2022 0 repositories listed
-
Approximate discounting-free policy evaluation from transient and recurrent states8 Apr 2022 0 repositories listed
-
Data-Driven Evaluation of Training Action Space for Reinforcement Learning8 Apr 2022 0 repositories listed
-
The Complexity of Markov Equilibrium in Stochastic Games8 Apr 2022 0 repositories listed
-
Distributed Reinforcement Learning for Robot Teams: A Review7 Apr 2022 0 repositories listed
-
Imitating, Fast and Slow: Robust learning from demonstrations via decision-time planning7 Apr 2022 0 repositories listed
-
Q-learning with online random forests7 Apr 2022 0 repositories listed
-
Standardized feature extraction from pairwise conflicts applied to the train rescheduling problem6 Apr 2022 0 repositories listed
-
Configuration Path Control5 Apr 2022 0 repositories listed
-
On the Computational Consequences of Cost Function Design in Nonlinear Optimal Control5 Apr 2022 0 repositories listed
-
RL4ReAl: Reinforcement Learning for Register Allocation5 Apr 2022 0 repositories listed
-
Optimising Energy Efficiency in UAV-Assisted Networks using Deep Reinforcement Learning4 Apr 2022 0 repositories listed
-
Safe Controller for Output Feedback Linear Systems using Model-Based Reinforcement Learning4 Apr 2022 0 repositories listed
-
Best-Response Bayesian Reinforcement Learning with Bayes-adaptive POMDPs for Centaurs3 Apr 2022 0 repositories listed
-
Enhancing Digital Health Services: A Machine Learning Approach to Personalized Exercise Goal Setting3 Apr 2022 0 repositories listed
-
Semi-Data-Aided Channel Estimation for MIMO Systems via Reinforcement Learning3 Apr 2022 0 repositories listed
-
Hybrid Transfer in Deep Reinforcement Learning for Ads Allocation2 Apr 2022 0 repositories listed
-
Safe Reinforcement Learning via Shielding under Partial Observability2 Apr 2022 0 repositories listed
-
Automating Staged Rollout with Reinforcement Learning1 Apr 2022 0 repositories listed
-
Building Decision Forest via Deep Reinforcement Learning1 Apr 2022 0 repositories listed
-
Deep Page-Level Interest Network in Reinforcement Learning for Ads Allocation1 Apr 2022 0 repositories listed
-
Model-agnostic Counterfactual Synthesis Policy for Interactive Recommendation1 Apr 2022 0 repositories listed
-
Maze Learning using a Hyperdimensional Predictive Processing Cognitive Architecture31 Mar 2022 0 repositories listed
-
Spatio-Temporal Graph Convolutional Neural Networks for Physics-Aware Grid Learning Algorithms31 Mar 2022 0 repositories listed
-
DiffSkill: Skill Abstraction from Differentiable Physics for Deformable Object Manipulations with Tools31 Mar 2022 0 repositories listed
-
Mask Atari for Deep Reinforcement Learning as POMDP Benchmarks31 Mar 2022 0 repositories listed
-
Robust Meta-Reinforcement Learning with Curriculum-Based Task Sampling31 Mar 2022 0 repositories listed
-
TrajGen: Generating Realistic and Diverse Trajectories with Reactive and Feasible Agent Behaviors for Autonomous Driving31 Mar 2022 0 repositories listed
-
Visual-Tactile Multimodality for Following Deformable Linear Objects Using Reinforcement Learning31 Mar 2022 0 repositories listed
-
Factored Adaptation for Non-Stationary Reinforcement Learning30 Mar 2022 0 repositories listed
-
Investigating the Properties of Neural Network Representations in Reinforcement Learning30 Mar 2022 0 repositories listed
-
Marginalized Operators for Off-policy Reinforcement Learning30 Mar 2022 0 repositories listed
-
Multi-Robot Active Mapping via Neural Bipartite Graph Matching30 Mar 2022 0 repositories listed
-
Towards Interpretable Deep Reinforcement Learning Models via Inverse Reinforcement Learning30 Mar 2022 0 repositories listed
-
Assessing Evolutionary Terrain Generation Methods for Curriculum Reinforcement Learning29 Mar 2022 0 repositories listed
-
Deep Reinforcement Learning for Data-Driven Adaptive Scanning in Ptychography29 Mar 2022 0 repositories listed
-
Asynchronous, Option-Based Multi-Agent Policy Gradient: A Conditional Reasoning Approach29 Mar 2022 0 repositories listed
-
On Reinforcement Learning, Effect Handlers, and the State Monad29 Mar 2022 0 repositories listed
-
Deep Reinforcement Learning Aided Platoon Control Relying on V2X Information28 Mar 2022 0 repositories listed
-
REPTILE: A Proactive Real-Time Deep Reinforcement Learning Self-adaptive Framework28 Mar 2022 0 repositories listed
-
Optimizing Airborne Wind Energy with Reinforcement Learning27 Mar 2022 0 repositories listed
-
Collaborative Intelligent Reflecting Surface Networks with Multi-Agent Reinforcement Learning26 Mar 2022 0 repositories listed
-
Combining Evolution and Deep Reinforcement Learning for Policy Search: a Survey26 Mar 2022 0 repositories listed
-
Computationally efficient joint coordination of multiple electric vehicle charging points using reinforcement learning26 Mar 2022 0 repositories listed
-
Dynamic Noises of Multi-Agent Environments Can Improve Generalization: Agent-based Models meets Reinforcement Learning26 Mar 2022 0 repositories listed
-
Dealing with Sparse Rewards Using Graph Neural Networks25 Mar 2022 0 repositories listed
-
Quasi-Newton Iteration in Deterministic Policy Gradient25 Mar 2022 0 repositories listed
-
Bellman Residual Orthogonalization for Offline Reinforcement Learning24 Mar 2022 0 repositories listed
-
Horizon-Free Reinforcement Learning in Polynomial Time: the Power of Stationary Policies24 Mar 2022 0 repositories listed
-
MERLIN -- Malware Evasion with Reinforcement LearnINg24 Mar 2022 0 repositories listed
-
Remember and Forget Experience Replay for Multi-Agent Reinforcement Learning24 Mar 2022 0 repositories listed
-
Advanced Skills through Multiple Adversarial Motion Priors in Reinforcement Learning23 Mar 2022 0 repositories listed
-
NovGrid: A Flexible Grid World for Evaluating Agent Response to Novelty23 Mar 2022 0 repositories listed
-
The state-of-the-art review on resource allocation problem using artificial intelligence methods on various computing paradigms23 Mar 2022 0 repositories listed
-
A Primer on Maximum Causal Entropy Inverse Reinforcement Learning22 Mar 2022 0 repositories listed
-
Explainability in reinforcement learning: perspective and position22 Mar 2022 0 repositories listed
-
Linear convergence of a policy gradient method for some finite horizon continuous time control problems22 Mar 2022 0 repositories listed
-
Review of Metrics to Measure the Stability, Robustness and Resilience of Reinforcement Learning22 Mar 2022 0 repositories listed
-
Scalable Deep Reinforcement Learning Algorithms for Mean Field Games22 Mar 2022 0 repositories listed
-
X-MEN: Guaranteed XOR-Maximum Entropy Constrained Inverse Reinforcement Learning22 Mar 2022 0 repositories listed
-
Multitask Neuroevolution for Reinforcement Learning with Long and Short Episodes21 Mar 2022 0 repositories listed
-
Optimizing Trajectories for Highway Driving with Offline Reinforcement Learning21 Mar 2022 0 repositories listed
-
Entailment Relation Aware Paraphrase Generation20 Mar 2022 0 repositories listed
-
Explicit User Manipulation in Reinforcement Learning Based Recommender Systems20 Mar 2022 0 repositories listed
-
Hierarchical Reinforcement Learning of Locomotion Policies in Response to Approaching Objects: A Preliminary Study20 Mar 2022 0 repositories listed
-
Model-based Multi-agent Reinforcement Learning: Recent Progress and Prospects20 Mar 2022 0 repositories listed
-
Reinforcement learning reward function in unmanned aerial vehicle control tasks20 Mar 2022 0 repositories listed
-
Policy Gradients using Variational Quantum Circuits20 Mar 2022 0 repositories listed
-
Thompson Sampling on Asymmetric α-Stable Bandits19 Mar 2022 0 repositories listed
-
Deep reinforcement learning guided graph neural networks for brain network analysis18 Mar 2022 0 repositories listed
-
Infinite-Horizon Reach-Avoid Zero-Sum Games via Deep Reinforcement Learning18 Mar 2022 0 repositories listed
-
Privacy-Preserving Reinforcement Learning Beyond Expectation18 Mar 2022 0 repositories listed
-
Risk-Sensitive Bayesian Games for Multi-Agent Reinforcement Learning under Policy Uncertainty18 Mar 2022 0 repositories listed
-
Meta-Reinforcement Learning for the Tuning of PI Controllers: An Offline Approach17 Mar 2022 0 repositories listed
-
Near Instance-Optimal PAC Reinforcement Learning for Deterministic MDPs17 Mar 2022 0 repositories listed
-
Strategic Maneuver and Disruption with Reinforcement Learning Approaches for Multi-Agent Coordination17 Mar 2022 0 repositories listed
-
The Frost Hollow Experiments: Pavlovian Signalling as a Path to Coordination and Communication Between Agents17 Mar 2022 0 repositories listed
-
A Deep Reinforcement Learning-Based Caching Strategy for IoT Networks with Transient Data16 Mar 2022 0 repositories listed
-
A Survey of Multi-Agent Deep Reinforcement Learning with Communication16 Mar 2022 0 repositories listed
-
Backpropagation through Time and Space: Learning Numerical Methods with Multi-Agent Reinforcement Learning16 Mar 2022 0 repositories listed
-
Lazy-MDPs: Towards Interpretable Reinforcement Learning by Learning When to Act16 Mar 2022 0 repositories listed
-
A Differentiable Approach to Combinatorial Optimization using Dataless Neural Networks15 Mar 2022 0 repositories listed
-
An Introduction to Multi-Agent Reinforcement Learning and Review of its Application to Autonomous Mobility15 Mar 2022 0 repositories listed
-
Bi-Manual Manipulation and Attachment via Sim-to-Real Reinforcement Learning15 Mar 2022 0 repositories listed
-
Blocks Assemble! Learning to Assemble with Large-Scale Structured Reinforcement Learning15 Mar 2022 0 repositories listed
-
Multi-View Dreaming: Multi-View World Model with Contrastive Learning15 Mar 2022 0 repositories listed
-
Calibration of Derivative Pricing Models: a Multi-Agent Reinforcement Learning Perspective14 Mar 2022 0 repositories listed
-
Efficient Model-based Multi-agent Reinforcement Learning via Optimistic Equilibrium Computation14 Mar 2022 0 repositories listed
-
FRL-FI: Transient Fault Analysis for Federated Reinforcement Learning-Based Navigation Systems14 Mar 2022 0 repositories listed
-
Reinforcement Learning for Optimal Control of a District Cooling Energy Plant14 Mar 2022 0 repositories listed
-
Switch Trajectory Transformer with Distributional Value Approximation for Multi-Task Reinforcement Learning14 Mar 2022 0 repositories listed
-
The Multi-Agent Pickup and Delivery Problem: MAPF, MARL and Its Warehouse Applications14 Mar 2022 0 repositories listed
-
DARA: Dynamics-Aware Reward Augmentation in Offline Reinforcement Learning13 Mar 2022 0 repositories listed
-
Concentration Network for Reinforcement Learning of Large-Scale Multi-Agent Systems12 Mar 2022 0 repositories listed
-
Active Phase-Encode Selection for Slice-Specific Fast MR Scanning Using a Transformer-Based Deep Reinforcement Learning Framework11 Mar 2022 0 repositories listed