Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 99
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 99 of 152: papers 9,801 to 9,900 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Uncertainty Regularized Policy Learning for Offline Reinforcement Learning29 Sep 2021 0 repositories listed
-
Understanding and Leveraging Overparameterization in Recursive Value Estimation29 Sep 2021 0 repositories listed
-
Understanding the Generalization Gap in Visual Reinforcement Learning29 Sep 2021 0 repositories listed
-
Untangling Braids with Multi-agent Q-Learning29 Sep 2021 0 repositories listed
-
Value Refinement Network (VRN)29 Sep 2021 0 repositories listed
-
Variational oracle guiding for reinforcement learning29 Sep 2021 0 repositories listed
-
WaveCorr: Deep Reinforcement Learning with Permutation Invariant Policy Networks for Portfolio Management29 Sep 2021 0 repositories listed
-
Weakly-Supervised Learning of Disentangled and Interpretable Skills for Hierarchical Reinforcement Learning29 Sep 2021 0 repositories listed
-
Why so pessimistic? Estimating uncertainties for offline RL through ensembles, and why their independence matters.29 Sep 2021 0 repositories listed
-
Zero-Shot Reward Specification via Grounded Natural Language29 Sep 2021 0 repositories listed
-
A First-Occupancy Representation for Reinforcement Learning28 Sep 2021 0 repositories listed
-
Adaptive Informative Path Planning Using Deep Reinforcement Learning for UAV-based Active Sensing28 Sep 2021 0 repositories listed
-
An Offline Deep Reinforcement Learning for Maintenance Decision-Making28 Sep 2021 0 repositories listed
-
Deep Reinforcement Learning Versus Evolution Strategies: A Comparative Survey28 Sep 2021 0 repositories listed
-
Deep Reinforcement Learning with Adjustments28 Sep 2021 0 repositories listed
-
Exploring More When It Needs in Deep Reinforcement Learning28 Sep 2021 0 repositories listed
-
Identifying Reasoning Flaws in Planning-Based RL Using Tree Explanations28 Sep 2021 0 repositories listed
-
Longitudinal Deep Truck: Deep learning and deep reinforcement learning for modeling and control of longitudinal dynamics of heavy duty trucks28 Sep 2021 0 repositories listed
-
Making Curiosity Explicit in Vision-based RL28 Sep 2021 0 repositories listed
-
Reinforcement Learning for Quantitative Trading28 Sep 2021 0 repositories listed
-
DRL-based Slice Placement under Realistic Network Load Conditions27 Sep 2021 0 repositories listed
-
Efficiently Training On-Policy Actor-Critic Networks in Robotic Deep Reinforcement Learning with Demonstration-like Sampled Exploration27 Sep 2021 0 repositories listed
-
From internal models toward metacognitive AI27 Sep 2021 0 repositories listed
-
Model-Free Reinforcement Learning for Optimal Control of MarkovDecision Processes Under Signal Temporal Logic Specifications27 Sep 2021 0 repositories listed
-
Towards Reinforcement Learning for Pivot-based Neural Machine Translation with Non-autoregressive Transformer27 Sep 2021 0 repositories listed
-
Deep Reinforcement Learning for Wireless Scheduling in Distributed Networked Control26 Sep 2021 0 repositories listed
-
On the Feasibility of Learning Finger-gaiting In-hand Manipulation with Intrinsic Sensing26 Sep 2021 0 repositories listed
-
L²NAS: Learning to Optimize Neural Architectures via Continuous-Action Reinforcement Learning25 Sep 2021 0 repositories listed
-
A Graph Policy Network Approach for Volt-Var Control in Power Distribution Systems24 Sep 2021 0 repositories listed
-
Adaptive Sampling Quasi-Newton Methods for Zeroth-Order Stochastic Optimization24 Sep 2021 0 repositories listed
-
The f-Divergence Reinforcement Learning Framework24 Sep 2021 0 repositories listed
-
Combining Contention-Based Spectrum Access and Adaptive Modulation using Deep Reinforcement Learning24 Sep 2021 0 repositories listed
-
Go-Blend behavior and affect24 Sep 2021 0 repositories listed
-
Learnable Triangulation for Deep Learning-based 3D Reconstruction of Objects of Arbitrary Topology from Single RGB Images24 Sep 2021 0 repositories listed
-
Neuroprospecting with DeepRL agents24 Sep 2021 0 repositories listed
-
Regularization Guarantees Generalization in Bayesian Reinforcement Learning through Algorithmic Stability24 Sep 2021 0 repositories listed
-
A Multi-Agent Deep Reinforcement Learning Coordination Framework for Connected and Automated Vehicles at Merging Roadways23 Sep 2021 0 repositories listed
-
Dimension-Free Rates for Natural Policy Gradient in Multi-Agent Reinforcement Learning23 Sep 2021 0 repositories listed
-
Hierarchies of Planning and Reinforcement Learning for Robot Navigation23 Sep 2021 0 repositories listed
-
Deep Reinforcement Learning-Based Long-Range Autonomous Valet Parking for Smart Cities23 Sep 2021 0 repositories listed
-
PredictionNet: Real-Time Joint Probabilistic Traffic Prediction for Planning, Control, and Simulation23 Sep 2021 0 repositories listed
-
Reinforcement Learning Under Algorithmic Triage23 Sep 2021 0 repositories listed
-
A Survey on Reinforcement Learning for Recommender Systems22 Sep 2021 0 repositories listed
-
Adversarial Training Blocks Generalization in Neural Policies22 Sep 2021 0 repositories listed
-
Benchmarking Lane-changing Decision-making for Deep Reinforcement Learning22 Sep 2021 0 repositories listed
-
Introducing Symmetries to Black Box Meta Reinforcement Learning22 Sep 2021 0 repositories listed
-
Locality Matters: A Scalable Value Decomposition Approach for Cooperative Multi-Agent Reinforcement Learning22 Sep 2021 0 repositories listed
-
MEPG: A Minimalist Ensemble Policy Gradient Framework for Deep Reinforcement Learning22 Sep 2021 0 repositories listed
-
Return Dispersion as an Estimator of Learning Potential for Prioritized Level Replay22 Sep 2021 0 repositories listed
-
Towards Multi-Agent Reinforcement Learning using Quantum Boltzmann Machines22 Sep 2021 0 repositories listed
-
A Distance-based Anomaly Detection Framework for Deep Reinforcement Learning21 Sep 2021 0 repositories listed
-
Example-Driven Model-Based Reinforcement Learning for Solving Long-Horizon Visuomotor Tasks21 Sep 2021 0 repositories listed
-
Learning offline: memory replay in biological and artificial reinforcement learning21 Sep 2021 0 repositories listed
-
A Reinforcement Learning Approach to the Stochastic Cutting Stock Problem20 Sep 2021 0 repositories listed
-
A Survey of Text Games for Reinforcement Learning informed by Natural Language20 Sep 2021 0 repositories listed
-
ACReL: Adversarial Conditional value-at-risk Reinforcement Learning20 Sep 2021 0 repositories listed
-
Learning Natural Language Generation from Scratch20 Sep 2021 0 repositories listed
-
Reinforcement Learning for Finite-Horizon Restless Multi-Armed Multi-Action Bandits20 Sep 2021 0 repositories listed
-
Two Approaches to Building Collaborative, Task-Oriented Dialog Agents through Self-Play20 Sep 2021 0 repositories listed
-
Dual Behavior Regularized Reinforcement Learning19 Sep 2021 0 repositories listed
-
Greedy UnMixing for Q-Learning in Multi-Agent Reinforcement Learning19 Sep 2021 0 repositories listed
-
Lifelong Robotic Reinforcement Learning by Retaining Experiences19 Sep 2021 0 repositories listed
-
Regularize! Don't Mix: Multi-Agent Reinforcement Learning without Explicit Centralized Structures19 Sep 2021 0 repositories listed
-
Accelerating Offline Reinforcement Learning Application in Real-Time Bidding and Recommendation: Potential Use of Simulation17 Sep 2021 0 repositories listed
-
Carl-Lead: Lidar-based End-to-End Autonomous Driving with Contrastive Deep Reinforcement Learning17 Sep 2021 0 repositories listed
-
Coordinated Random Access for Industrial IoT With Correlated Traffic By Reinforcement-Learning17 Sep 2021 0 repositories listed
-
Decentralized Global Connectivity Maintenance for Multi-Robot Navigation: A Reinforcement Learning Approach17 Sep 2021 0 repositories listed
-
Deep Reinforcement Learning Based Multidimensional Resource Management for Energy Harvesting Cognitive NOMA Communications17 Sep 2021 0 repositories listed
-
Soft Actor-Critic With Integer Actions17 Sep 2021 0 repositories listed
-
Comparison and Unification of Three Regularization Methods in Batch Reinforcement Learning16 Sep 2021 0 repositories listed
-
Conservative Data Sharing for Multi-Task Offline Reinforcement Learning16 Sep 2021 0 repositories listed
-
Enabling risk-aware Reinforcement Learning for medical interventions through uncertainty decomposition16 Sep 2021 0 repositories listed
-
Learning from Peers: Deep Transfer Reinforcement Learning for Joint Radio and Cache Resource Allocation in 5G RAN Slicing16 Sep 2021 0 repositories listed
-
RAPID-RL: A Reconfigurable Architecture with Preemptive-Exits for Efficient Deep-Reinforcement Learning16 Sep 2021 0 repositories listed
-
Reinforcement Learning on Encrypted Data16 Sep 2021 0 repositories listed
-
Convergence of a Human-in-the-Loop Policy-Gradient Algorithm With Eligibility Trace Under Reward, Policy, and Advantage Feedback15 Sep 2021 0 repositories listed
-
Optimal Cycling of a Heterogenous Battery Bank via Reinforcement Learning15 Sep 2021 0 repositories listed
-
Short Quantum Circuits in Reinforcement Learning Policies for the Vehicle Routing Problem15 Sep 2021 0 repositories listed
-
What Does The User Want? Information Gain for Hierarchical Dialogue Policy Optimisation15 Sep 2021 0 repositories listed
-
Continuous Homeostatic Reinforcement Learning for Self-Regulated Autonomous Agents14 Sep 2021 0 repositories listed
-
DSDF: An approach to handle stochastic agents in collaborative multi-agent reinforcement learning14 Sep 2021 0 repositories listed
-
Exploration in Deep Reinforcement Learning: From Single-Agent to Multiagent Domain14 Sep 2021 0 repositories listed
-
ROMAX: Certifiably Robust Deep Multiagent Reinforcement Learning via Convex Relaxation14 Sep 2021 0 repositories listed
-
A Practical Adversarial Attack on Contingency Detection of Smart Energy Systems13 Sep 2021 0 repositories listed
-
Achieving Zero Constraint Violation for Constrained Reinforcement Learning via Primal-Dual Approach13 Sep 2021 0 repositories listed
-
Computation Rate Maximum for Mobile Terminals in UAV-assisted Wireless Powered MEC Networks with Fairness Constraint13 Sep 2021 0 repositories listed
-
Learning-to-defer for sequential medical decision-making under uncertainty13 Sep 2021 0 repositories listed
-
RADARS: Memory Efficient Reinforcement Learning Aided Differentiable Neural Architecture Search13 Sep 2021 0 repositories listed
-
Reinforcement Learning for Load-balanced Parallel Particle Tracing13 Sep 2021 0 repositories listed
-
Theoretical Guarantees of Fictitious Discount Algorithms for Episodic Reinforcement Learning and Global Convergence of Policy Gradient Methods13 Sep 2021 0 repositories listed
-
A Socially Aware Reinforcement Learning Agent for The Single Track Road Problem12 Sep 2021 0 repositories listed
-
Concave Utility Reinforcement Learning with Zero-Constraint Violations12 Sep 2021 0 repositories listed
-
EMVLight: A Decentralized Reinforcement Learning Framework for Efficient Passage of Emergency Vehicles12 Sep 2021 0 repositories listed
-
Federated Ensemble Model-based Reinforcement Learning in Edge Computing12 Sep 2021 0 repositories listed
-
Financial Trading with Feature Preprocessing and Recurrent Reinforcement Learning11 Sep 2021 0 repositories listed
-
Data Generation Method for Learning a Low-dimensional Safe Region in Safe Reinforcement Learning10 Sep 2021 0 repositories listed
-
Multi-agent deep reinforcement learning (MADRL) meets multi-user MIMO systems10 Sep 2021 0 repositories listed
-
Optimizing a domestic battery and solar photovoltaic system with deep reinforcement learning10 Sep 2021 0 repositories listed
-
Projected State-action Balancing Weights for Offline Reinforcement Learning10 Sep 2021 0 repositories listed
-
Deep Reinforcement Learning for Equal Risk Pricing and Hedging under Dynamic Expectile Risk Measures9 Sep 2021 0 repositories listed