Browse State-of-the-Art › reinforcement-learning › Papers, page 94
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 94 of 135: papers 9,301 to 9,400 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Modelling resource allocation in uncertain system environment through deep reinforcement learning17 Jun 2021 0 repositories listed
-
MPC-based Reinforcement Learning for a Simplified Freight Mission of Autonomous Surface Vehicles16 Jun 2021 0 repositories listed
-
Mungojerrie: Reinforcement Learning of Linear-Time Objectives16 Jun 2021 0 repositories listed
-
Reinforcement Learning for Markovian Bandits: Is Posterior Sampling more Scalable than Optimism?16 Jun 2021 0 repositories listed
-
Reinforcement learning for pursuit and evasion of microswimmers at low Reynolds number16 Jun 2021 0 repositories listed
-
Unbiased Methods for Multi-Goal Reinforcement Learning16 Jun 2021 0 repositories listed
-
Deep reinforcement learning on a multi-asset environment for trading15 Jun 2021 0 repositories listed
-
Fundamental Limits of Reinforcement Learning in Environment with Endogeneous and Exogeneous Uncertainty15 Jun 2021 0 repositories listed
-
Minimizing Communication while Maximizing Performance in Multi-Agent Reinforcement Learning15 Jun 2021 0 repositories listed
-
On Multi-objective Policy Optimization as a Tool for Reinforcement Learning: Case Studies in Offline RL and Finetuning15 Jun 2021 0 repositories listed
-
Population-coding and Dynamic-neurons improved Spiking Actor Network for Reinforcement Learning15 Jun 2021 0 repositories listed
-
Residual Reinforcement Learning from Demonstrations15 Jun 2021 0 repositories listed
-
Sample Efficient Reinforcement Learning In Continuous State Spaces: A Perspective Beyond Linearity15 Jun 2021 0 repositories listed
-
Towards Safe Control of Continuum Manipulator Using Shielded Multiagent Reinforcement Learning15 Jun 2021 0 repositories listed
-
Learning-Aided Heuristics Design for Storage System14 Jun 2021 0 repositories listed
-
On-Policy Deep Reinforcement Learning for the Average-Reward Criterion14 Jun 2021 0 repositories listed
-
Online Sub-Sampling for Reinforcement Learning with General Function Approximation14 Jun 2021 0 repositories listed
-
Poisoning Deep Reinforcement Learning Agents with In-Distribution Triggers14 Jun 2021 0 repositories listed
-
Targeted Data Acquisition for Evolving Negotiation Agents14 Jun 2021 0 repositories listed
-
Training like Playing: A Reinforcement Learning And Knowledge Graph-based framework for building Automatic Consultation System in Medical Field14 Jun 2021 0 repositories listed
-
User-Guided Personalized Image Aesthetic Assessment based on Deep Reinforcement Learning14 Jun 2021 0 repositories listed
-
A new soft computing method for integration of expert's knowledge in reinforcement learn-ing problems13 Jun 2021 0 repositories listed
-
Bellman-consistent Pessimism for Offline Reinforcement Learning13 Jun 2021 0 repositories listed
-
Density-Based Bonuses on Learned Representations for Reward-Free Exploration in Deep Reinforcement Learning13 Jun 2021 0 repositories listed
-
Disentangled Predictive Representation for Meta-Reinforcement Learning13 Jun 2021 0 repositories listed
-
Exploration-Driven Representation Learning in Reinforcement Learning13 Jun 2021 0 repositories listed
-
Learning on Abstract Domains: A New Approach for Verifiable Guarantee in Reinforcement Learning13 Jun 2021 0 repositories listed
-
Learning Task-Relevant Representations with Selective Contrast for Reinforcement Learning in a Real-World Application13 Jun 2021 0 repositories listed
-
Learning to Explore Multiple Environments without Rewards13 Jun 2021 0 repositories listed
-
MASAI: Multi-agent Summative Assessment Improvement for Unsupervised Environment Design13 Jun 2021 0 repositories listed
-
Representation Learning for Out-of-distribution Generalization in Reinforcement Learning13 Jun 2021 0 repositories listed
-
Tangent Space Least Adaptive Clustering13 Jun 2021 0 repositories listed
-
Model-free Reinforcement Learning for Branching Markov Decision Processes12 Jun 2021 0 repositories listed
-
A3C-S: Automated Agent Accelerator Co-Search towards Efficient Deep Reinforcement Learning11 Jun 2021 0 repositories listed
-
Automatic Risk Adaptation in Distributional Reinforcement Learning11 Jun 2021 0 repositories listed
-
Corruption-Robust Offline Reinforcement Learning11 Jun 2021 0 repositories listed
-
Courteous Behavior of Automated Vehicles at Unsignalized Intersections via Reinforcement Learning11 Jun 2021 0 repositories listed
-
DECORE: Deep Compression with Reinforcement Learning11 Jun 2021 0 repositories listed
-
11 Jun 2021 0 repositories listed
-
Offline Reinforcement Learning as Anti-Exploration11 Jun 2021 0 repositories listed
-
Safe Reinforcement Learning with Linear Function Approximation11 Jun 2021 0 repositories listed
-
Taylor Expansion of Discount Factors11 Jun 2021 0 repositories listed
-
Data-driven battery operation for energy arbitrage using rainbow deep reinforcement learning10 Jun 2021 0 repositories listed
-
Hyperspace Neighbor Penetration Approach to Dynamic Programming for Model-Based Reinforcement Learning Problems with Slowly Changing Variables in A Continuous State Space10 Jun 2021 0 repositories listed
-
RLCorrector: Reinforced Proofreading for Cell-level Microscopy Image Segmentation10 Jun 2021 0 repositories listed
-
Thompson Sampling with a Mixture Prior10 Jun 2021 0 repositories listed
-
5G MIMO Data for Machine Learning: Application to Beam-Selection using Deep Learning9 Jun 2021 0 repositories listed
-
Deception in Social Learning: A Multi-Agent Reinforcement Learning Perspective9 Jun 2021 0 repositories listed
-
Eye of the Beholder: Improved Relation Generalization for Text-based Reinforcement Learning Agents9 Jun 2021 0 repositories listed
-
Offline Inverse Reinforcement Learning9 Jun 2021 0 repositories listed
-
Online Learning for Stochastic Shortest Path Model via Posterior Sampling9 Jun 2021 0 repositories listed
-
Over-the-fiber Digital Predistortion Using Reinforcement Learning9 Jun 2021 0 repositories listed
-
Policy Finetuning: Bridging Sample-Efficient Offline and Online Reinforcement Learning9 Jun 2021 0 repositories listed
-
Reinforcement Learning for Industrial Control Network Cyber Security Orchestration9 Jun 2021 0 repositories listed
-
A Deep Value-network Based Approach for Multi-Driver Order Dispatching8 Jun 2021 0 repositories listed
-
Don't Get Yourself into Trouble! Risk-aware Decision-Making for Autonomous Vehicles8 Jun 2021 0 repositories listed
-
Left Ventricle Contouring in Cardiac Images Based on Deep Reinforcement Learning8 Jun 2021 0 repositories listed
-
RewardsOfSum: Exploring Reinforcement Learning Rewards for Summarisation8 Jun 2021 0 repositories listed
-
Towards Practical Credit Assignment for Deep Reinforcement Learning8 Jun 2021 0 repositories listed
-
A Computational Model of Representation Learning in the Brain Cortex, Integrating Unsupervised and Reinforcement Learning7 Jun 2021 0 repositories listed
-
Average-Reward Reinforcement Learning with Trust Region Methods7 Jun 2021 0 repositories listed
-
Concave Utility Reinforcement Learning: the Mean-Field Game Viewpoint7 Jun 2021 0 repositories listed
-
Explainable Artificial Intelligence (XAI) for Increasing User Trust in Deep Reinforcement Learning Driven Autonomous Systems7 Jun 2021 0 repositories listed
-
Identifiability in inverse reinforcement learning7 Jun 2021 0 repositories listed
-
Learning to Guide a Saturation-Based Theorem Prover7 Jun 2021 0 repositories listed
-
Learning without Knowing: Unobserved Context in Continuous Transfer Reinforcement Learning7 Jun 2021 0 repositories listed
-
Multi-agent Battery Storage Management using MPC-based Reinforcement Learning7 Jun 2021 0 repositories listed
-
Towards robust and domain agnostic reinforcement learning competitions7 Jun 2021 0 repositories listed
-
3D UAV Trajectory and Data Collection Optimisation via Deep Reinforcement Learning6 Jun 2021 0 repositories listed
-
DisTop: Discovering a Topological representation to learn diverse and rewarding skills6 Jun 2021 0 repositories listed
-
Heuristic-Guided Reinforcement Learning5 Jun 2021 0 repositories listed
-
Learning Routines for Effective Off-Policy Reinforcement Learning5 Jun 2021 0 repositories listed
-
Reinforcement Learning for Assignment Problem with Time Constraints5 Jun 2021 0 repositories listed
-
Detecting and Adapting to Novelty in Games4 Jun 2021 0 repositories listed
-
Resource Allocation in Disaggregated Data Centre Systems with Reinforcement Learning4 Jun 2021 0 repositories listed
-
Robustifying Reinforcement Learning Policies with ℒ₁ Adaptive Control4 Jun 2021 0 repositories listed
-
Feeling of Presence Maximization: mmWave-Enabled Virtual Reality Meets Deep Reinforcement Learning3 Jun 2021 0 repositories listed
-
Grounding Complex Navigational Instructions Using Scene Graphs3 Jun 2021 0 repositories listed
-
Hyperbolically-Discounted Reinforcement Learning on Reward-Punishment Framework3 Jun 2021 0 repositories listed
-
LiMIIRL: Lightweight Multiple-Intent Inverse Reinforcement Learning3 Jun 2021 0 repositories listed
-
Safe RAN control: A Symbolic Reinforcement Learning Approach3 Jun 2021 0 repositories listed
-
Design and Comparison of Reward Functions in Reinforcement Learning for Energy Management of Sensor Nodes2 Jun 2021 0 repositories listed
-
Expected Scalarised Returns Dominance: A New Solution Concept for Multi-Objective Decision Making2 Jun 2021 0 repositories listed
-
Towards Deeper Deep Reinforcement Learning with Spectral Normalization2 Jun 2021 0 repositories listed
-
Variational Empowerment as Representation Learning for Goal-Based Reinforcement Learning2 Jun 2021 0 repositories listed
-
A Coarse to Fine Question Answering System based on Reinforcement Learning1 Jun 2021 0 repositories listed
-
An Entropy Regularization Free Mechanism for Policy-based Reinforcement Learning1 Jun 2021 0 repositories listed
-
Improving Long-Term Metrics in Recommendation Systems using Short-Horizon Reinforcement Learning1 Jun 2021 0 repositories listed
-
Quantitative Day Trading from Natural Language using Reinforcement Learning1 Jun 2021 0 repositories listed
-
Reinforce Security: A Model-Free Approach Towards Secure Wiretap Coding1 Jun 2021 0 repositories listed
-
Shapley Counterfactual Credits for Multi-Agent Reinforcement Learning1 Jun 2021 0 repositories listed
-
AppBuddy: Learning to Accomplish Tasks in Mobile Apps via Reinforcement Learning31 May 2021 0 repositories listed
-
Procedural Content Generation: Better Benchmarks for Transfer Reinforcement Learning31 May 2021 0 repositories listed
-
Reinforcement Learning-based Dynamic Service Placement in Vehicular Networks31 May 2021 0 repositories listed
-
Tesseract: Tensorised Actors for Multi-Agent Reinforcement Learning31 May 2021 0 repositories listed
-
Reducing the Deployment-Time Inference Control Costs of Deep Reinforcement Learning Agents via an Asymmetric Architecture30 May 2021 0 repositories listed
-
Shaped Policy Search for Evolutionary Strategies using Waypoints30 May 2021 0 repositories listed
-
Gradient-Free Neural Network Training via Synaptic-Level Reinforcement Learning29 May 2021 0 repositories listed
-
On the Theory of Reinforcement Learning with Once-per-Episode Feedback29 May 2021 0 repositories listed
-
Joint Optimization of Multi-Objective Reinforcement Learning with Policy Gradient Based Algorithm28 May 2021 0 repositories listed