Browse State-of-the-Art › Reinforcement Learning › Papers, page 83
Reinforcement Learning
Papers archive 2025-07-28
archive papers tagged: 13,178 · with a code link: 4,183 · where Syntology ran a sample: 1,175 (988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,175 of 13,178 tagged: 988 with a run with no instrument failure, 187 where every run was a failure of Syntology's instrument)
Page 83 of 132: papers 8,201 to 8,300 of 13,178, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Intrinsically Motivated Self-supervised Learning in Reinforcement Learning26 Jun 2021 0 repositories listed
-
Balancing Accuracy and Fairness for Interactive Recommendation with Reinforcement Learning25 Jun 2021 0 repositories listed
-
Branch Prediction as a Reinforcement Learning Problem: Why, How and Case Studies25 Jun 2021 0 repositories listed
-
Reinforcement Learning for Mean Field Games, with Applications to Economics25 Jun 2021 0 repositories listed
-
Density Constrained Reinforcement Learning24 Jun 2021 0 repositories listed
-
Hierarchically Integrated Models: Learning to Navigate from Heterogeneous Robots24 Jun 2021 0 repositories listed
-
The Option Keyboard: Combining Skills in Reinforcement Learning24 Jun 2021 0 repositories listed
-
Evolving Hierarchical Memory-Prediction Machines in Multi-Task Reinforcement Learning23 Jun 2021 0 repositories listed
-
A Reduction-Based Framework for Conservative Bandits and Reinforcement Learning22 Jun 2021 0 repositories listed
-
Agnostic Reinforcement Learning with Low-Rank MDPs and Rich Observations22 Jun 2021 0 repositories listed
-
MMD-MIX: Value Function Factorisation with Maximum Mean Discrepancy for Cooperative Multi-Agent Reinforcement Learning22 Jun 2021 0 repositories listed
-
Off-Policy Reinforcement Learning with Delayed Rewards22 Jun 2021 0 repositories listed
-
Provably Efficient Representation Selection in Low-rank Markov Decision Processes: From Online to Offline RL22 Jun 2021 0 repositories listed
-
Uniform-PAC Bounds for Reinforcement Learning with Linear Function Approximation22 Jun 2021 0 repositories listed
-
Analytically Tractable Bayesian Deep Q-Learning21 Jun 2021 0 repositories listed
-
Emphatic Algorithms for Deep Reinforcement Learning21 Jun 2021 0 repositories listed
-
Interpretable Model-based Hierarchical Reinforcement Learning using Inductive Logic Programming21 Jun 2021 0 repositories listed
-
Policy Smoothing for Provably Robust Reinforcement Learning21 Jun 2021 0 repositories listed
-
Boosting Offline Reinforcement Learning with Residual Generative Modeling19 Jun 2021 0 repositories listed
-
Unsupervised Learning for Robust Fitting: A Reinforcement Learning Approach19 Jun 2021 0 repositories listed
-
Adversarially Trained Neural Policies in the Fourier Domain18 Jun 2021 0 repositories listed
-
Deep Reinforcement Learning Models Predict Visual Responses in the Brain: A Preliminary Result18 Jun 2021 0 repositories listed
-
Goal-Directed Planning by Reinforcement Learning and Active Inference18 Jun 2021 0 repositories listed
-
Non-Robust Feature Mapping in Deep Reinforcement Learning18 Jun 2021 0 repositories listed
-
The Curse of Passive Data Collection in Batch Reinforcement Learning18 Jun 2021 0 repositories listed
-
Sample Efficient Social Navigation Using Inverse Reinforcement Learning18 Jun 2021 0 repositories listed
-
Scenic4RL: Programmatic Modeling and Generation of Reinforcement Learning Environments18 Jun 2021 0 repositories listed
-
Strategically-timed State-Observation Attacks on Deep Reinforcement Learning Agents18 Jun 2021 0 repositories listed
-
A Reinforcement Learning Approach for an IRS-assisted NOMA Network17 Jun 2021 0 repositories listed
-
Adapting the Function Approximation Architecture in Online Reinforcement Learning17 Jun 2021 0 repositories listed
-
Many Agent Reinforcement Learning Under Partial Observability17 Jun 2021 0 repositories listed
-
Modelling resource allocation in uncertain system environment through deep reinforcement learning17 Jun 2021 0 repositories listed
-
Mungojerrie: Reinforcement Learning of Linear-Time Objectives16 Jun 2021 0 repositories listed
-
Unbiased Methods for Multi-Goal Reinforcement Learning16 Jun 2021 0 repositories listed
-
Deep reinforcement learning on a multi-asset environment for trading15 Jun 2021 0 repositories listed
-
Fundamental Limits of Reinforcement Learning in Environment with Endogeneous and Exogeneous Uncertainty15 Jun 2021 0 repositories listed
-
Minimizing Communication while Maximizing Performance in Multi-Agent Reinforcement Learning15 Jun 2021 0 repositories listed
-
Residual Reinforcement Learning from Demonstrations15 Jun 2021 0 repositories listed
-
On-Policy Deep Reinforcement Learning for the Average-Reward Criterion14 Jun 2021 0 repositories listed
-
Online Sub-Sampling for Reinforcement Learning with General Function Approximation14 Jun 2021 0 repositories listed
-
Poisoning Deep Reinforcement Learning Agents with In-Distribution Triggers14 Jun 2021 0 repositories listed
-
Targeted Data Acquisition for Evolving Negotiation Agents14 Jun 2021 0 repositories listed
-
Training like Playing: A Reinforcement Learning And Knowledge Graph-based framework for building Automatic Consultation System in Medical Field14 Jun 2021 0 repositories listed
-
A new soft computing method for integration of expert's knowledge in reinforcement learn-ing problems13 Jun 2021 0 repositories listed
-
Bellman-consistent Pessimism for Offline Reinforcement Learning13 Jun 2021 0 repositories listed
-
Disentangled Predictive Representation for Meta-Reinforcement Learning13 Jun 2021 0 repositories listed
-
Exploration-Driven Representation Learning in Reinforcement Learning13 Jun 2021 0 repositories listed
-
Learning Task-Relevant Representations with Selective Contrast for Reinforcement Learning in a Real-World Application13 Jun 2021 0 repositories listed
-
Learning to Explore Multiple Environments without Rewards13 Jun 2021 0 repositories listed
-
MASAI: Multi-agent Summative Assessment Improvement for Unsupervised Environment Design13 Jun 2021 0 repositories listed
-
Representation Learning for Out-of-distribution Generalization in Reinforcement Learning13 Jun 2021 0 repositories listed
-
Tangent Space Least Adaptive Clustering13 Jun 2021 0 repositories listed
-
Model-free Reinforcement Learning for Branching Markov Decision Processes12 Jun 2021 0 repositories listed
-
Automatic Risk Adaptation in Distributional Reinforcement Learning11 Jun 2021 0 repositories listed
-
Corruption-Robust Offline Reinforcement Learning11 Jun 2021 0 repositories listed
-
Courteous Behavior of Automated Vehicles at Unsignalized Intersections via Reinforcement Learning11 Jun 2021 0 repositories listed
-
DECORE: Deep Compression with Reinforcement Learning11 Jun 2021 0 repositories listed
-
11 Jun 2021 0 repositories listed
-
Offline Reinforcement Learning as Anti-Exploration11 Jun 2021 0 repositories listed
-
Safe Reinforcement Learning with Linear Function Approximation11 Jun 2021 0 repositories listed
-
Data-driven battery operation for energy arbitrage using rainbow deep reinforcement learning10 Jun 2021 0 repositories listed
-
Hyperspace Neighbor Penetration Approach to Dynamic Programming for Model-Based Reinforcement Learning Problems with Slowly Changing Variables in A Continuous State Space10 Jun 2021 0 repositories listed
-
RLCorrector: Reinforced Proofreading for Cell-level Microscopy Image Segmentation10 Jun 2021 0 repositories listed
-
Deception in Social Learning: A Multi-Agent Reinforcement Learning Perspective9 Jun 2021 0 repositories listed
-
Offline Inverse Reinforcement Learning9 Jun 2021 0 repositories listed
-
Online Learning for Stochastic Shortest Path Model via Posterior Sampling9 Jun 2021 0 repositories listed
-
Over-the-fiber Digital Predistortion Using Reinforcement Learning9 Jun 2021 0 repositories listed
-
Policy Finetuning: Bridging Sample-Efficient Offline and Online Reinforcement Learning9 Jun 2021 0 repositories listed
-
Reinforcement Learning for Industrial Control Network Cyber Security Orchestration9 Jun 2021 0 repositories listed
-
Don't Get Yourself into Trouble! Risk-aware Decision-Making for Autonomous Vehicles8 Jun 2021 0 repositories listed
-
RewardsOfSum: Exploring Reinforcement Learning Rewards for Summarisation8 Jun 2021 0 repositories listed
-
Towards Practical Credit Assignment for Deep Reinforcement Learning8 Jun 2021 0 repositories listed
-
A Computational Model of Representation Learning in the Brain Cortex, Integrating Unsupervised and Reinforcement Learning7 Jun 2021 0 repositories listed
-
Average-Reward Reinforcement Learning with Trust Region Methods7 Jun 2021 0 repositories listed
-
Concave Utility Reinforcement Learning: the Mean-Field Game Viewpoint7 Jun 2021 0 repositories listed
-
Identifiability in inverse reinforcement learning7 Jun 2021 0 repositories listed
-
Learning to Guide a Saturation-Based Theorem Prover7 Jun 2021 0 repositories listed
-
Learning without Knowing: Unobserved Context in Continuous Transfer Reinforcement Learning7 Jun 2021 0 repositories listed
-
Multi-agent Battery Storage Management using MPC-based Reinforcement Learning7 Jun 2021 0 repositories listed
-
Towards robust and domain agnostic reinforcement learning competitions7 Jun 2021 0 repositories listed
-
DisTop: Discovering a Topological representation to learn diverse and rewarding skills6 Jun 2021 0 repositories listed
-
Heuristic-Guided Reinforcement Learning5 Jun 2021 0 repositories listed
-
Learning Routines for Effective Off-Policy Reinforcement Learning5 Jun 2021 0 repositories listed
-
Reinforcement Learning for Assignment Problem with Time Constraints5 Jun 2021 0 repositories listed
-
Resource Allocation in Disaggregated Data Centre Systems with Reinforcement Learning4 Jun 2021 0 repositories listed
-
Robustifying Reinforcement Learning Policies with ℒ₁ Adaptive Control4 Jun 2021 0 repositories listed
-
Hyperbolically-Discounted Reinforcement Learning on Reward-Punishment Framework3 Jun 2021 0 repositories listed
-
LiMIIRL: Lightweight Multiple-Intent Inverse Reinforcement Learning3 Jun 2021 0 repositories listed
-
Safe RAN control: A Symbolic Reinforcement Learning Approach3 Jun 2021 0 repositories listed
-
Expected Scalarised Returns Dominance: A New Solution Concept for Multi-Objective Decision Making2 Jun 2021 0 repositories listed
-
Towards Deeper Deep Reinforcement Learning with Spectral Normalization2 Jun 2021 0 repositories listed
-
Variational Empowerment as Representation Learning for Goal-Based Reinforcement Learning2 Jun 2021 0 repositories listed
-
A Coarse to Fine Question Answering System based on Reinforcement Learning1 Jun 2021 0 repositories listed
-
An Entropy Regularization Free Mechanism for Policy-based Reinforcement Learning1 Jun 2021 0 repositories listed
-
Quantitative Day Trading from Natural Language using Reinforcement Learning1 Jun 2021 0 repositories listed
-
Reinforce Security: A Model-Free Approach Towards Secure Wiretap Coding1 Jun 2021 0 repositories listed
-
Shapley Counterfactual Credits for Multi-Agent Reinforcement Learning1 Jun 2021 0 repositories listed
-
Procedural Content Generation: Better Benchmarks for Transfer Reinforcement Learning31 May 2021 0 repositories listed
-
Reinforcement Learning-based Dynamic Service Placement in Vehicular Networks31 May 2021 0 repositories listed
-
Tesseract: Tensorised Actors for Multi-Agent Reinforcement Learning31 May 2021 0 repositories listed