Browse State-of-the-Art › reinforcement-learning › Papers, page 69
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 69 of 135: papers 6,801 to 6,900 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Can we trust the evaluation on ChatGPT?22 Mar 2023 0 repositories listed
-
Communication Load Balancing via Efficient Inverse Reinforcement Learning22 Mar 2023 0 repositories listed
-
Deep Reinforcement Learning for Localizability-Enhanced Navigation in Dynamic Human Environments22 Mar 2023 0 repositories listed
-
HAPS-UAV-Enabled Heterogeneous Networks: A Deep Reinforcement Learning Approach22 Mar 2023 0 repositories listed
-
P³O: Transferring Visual Representations for Reinforcement Learning via Prompting22 Mar 2023 0 repositories listed
-
Reinforcement Learning with Exogenous States and Rewards22 Mar 2023 0 repositories listed
-
Strategy Synthesis in Markov Decision Processes Under Limited Sampling Access22 Mar 2023 0 repositories listed
-
Large-Scale Traffic Signal Control Using Constrained Network Partition and Adaptive Deep Reinforcement Learning21 Mar 2023 0 repositories listed
-
Bridging Imitation and Online Reinforcement Learning: An Optimistic Tale20 Mar 2023 0 repositories listed
-
Deceptive Reinforcement Learning in Model-Free Domains20 Mar 2023 0 repositories listed
-
Improved Sample Complexity for Reward-free Reinforcement Learning under Low-rank MDPs20 Mar 2023 0 repositories listed
-
Active hypothesis testing in unknown environments using recurrent neural networks and model free reinforcement learning19 Mar 2023 0 repositories listed
-
Boundary-aware Supervoxel-level Iteratively Refined Interactive 3D Image Segmentation with Multi-agent Reinforcement Learning19 Mar 2023 0 repositories listed
-
Cheap Talk Discovery and Utilization in Multi-Agent Reinforcement Learning19 Mar 2023 0 repositories listed
-
Major-Minor Mean Field Multi-Agent Reinforcement Learning19 Mar 2023 0 repositories listed
-
Multi-modal reward for visual relationships-based image captioning19 Mar 2023 0 repositories listed
-
Interpretable Reinforcement Learning via Neural Additive Models for Inventory Management18 Mar 2023 0 repositories listed
-
A Data-Driven Model-Reference Adaptive Control Approach Based on Reinforcement Learning17 Mar 2023 0 repositories listed
-
A New Policy Iteration Algorithm For Reinforcement Learning in Zero-Sum Markov Games17 Mar 2023 0 repositories listed
-
Comparing NARS and Reinforcement Learning: An Analysis of ONA and Q-Learning Algorithms17 Mar 2023 0 repositories listed
-
Measurement Optimization under Uncertainty using Deep Reinforcement Learning17 Mar 2023 0 repositories listed
-
Towards Real-World Applications of Personalized Anesthesia Using Policy Constraint Q Learning for Propofol Infusion Control17 Mar 2023 0 repositories listed
-
Goal-conditioned Offline Reinforcement Learning through State Space Partitioning16 Mar 2023 0 repositories listed
-
Learning Rewards to Optimize Global Performance Metrics in Deep Reinforcement Learning16 Mar 2023 0 repositories listed
-
Online Reinforcement Learning in Periodic MDP16 Mar 2023 0 repositories listed
-
Psychotherapy AI Companion with Reinforcement Learning Recommendations and Interpretable Policy Dynamics16 Mar 2023 0 repositories listed
-
Reinforcement Learning for Omega-Regular Specifications on Continuous-Time MDP16 Mar 2023 0 repositories listed
-
Self-Inspection Method of Unmanned Aerial Vehicles in Power Plants Using Deep Q-Network Reinforcement Learning16 Mar 2023 0 repositories listed
-
SVDE: Scalable Value-Decomposition Exploration for Cooperative Multi-Agent Reinforcement Learning16 Mar 2023 0 repositories listed
-
Latent-Conditioned Policy Gradient for Multi-Objective Deep Reinforcement Learning15 Mar 2023 0 repositories listed
-
Muti-Agent Proximal Policy Optimization For Data Freshness in UAV-assisted Networks15 Mar 2023 0 repositories listed
-
Real-Time Measurement-Driven Reinforcement Learning Control Approach for Uncertain Nonlinear Systems15 Mar 2023 0 repositories listed
-
Replay Buffer with Local Forgetting for Adapting to Local Environment Changes in Deep Model-Based Reinforcement Learning15 Mar 2023 0 repositories listed
-
Smoothed Q-learning15 Mar 2023 0 repositories listed
-
Optimizing Trading Strategies in Quantitative Markets using Multi-Agent Reinforcement Learning15 Mar 2023 0 repositories listed
-
Adaptive Policy Learning for Offline-to-Online Reinforcement Learning14 Mar 2023 0 repositories listed
-
Bi-directional personalization reinforcement learning-based architecture with active learning using a multi-model data service for the travel nursing industry14 Mar 2023 0 repositories listed
-
Actor-Critic learning for mean-field control in continuous time13 Mar 2023 0 repositories listed
-
Deploying Offline Reinforcement Learning with Human Feedback13 Mar 2023 0 repositories listed
-
Loss of Plasticity in Continual Deep Reinforcement Learning13 Mar 2023 0 repositories listed
-
Path Planning using Reinforcement Learning: A Policy Iteration Approach13 Mar 2023 0 repositories listed
-
The tree reconstruction game: phylogenetic reconstruction using reinforcement learning12 Mar 2023 0 repositories listed
-
Understanding the Synergies between Quality-Diversity and Deep Reinforcement Learning10 Mar 2023 0 repositories listed
-
A Framework for History-Aware Hyperparameter Optimisation in Reinforcement Learning9 Mar 2023 0 repositories listed
-
Beware of Instantaneous Dependence in Reinforcement Learning9 Mar 2023 0 repositories listed
-
Computably Continuous Reinforcement-Learning Objectives are PAC-learnable9 Mar 2023 0 repositories listed
-
Conceptual Reinforcement Learning for Language-Conditioned Tasks9 Mar 2023 0 repositories listed
-
Exploiting Contextual Structure to Generate Useful Auxiliary Tasks9 Mar 2023 0 repositories listed
-
GOATS: Goal Sampling Adaptation for Scooping with Curriculum Reinforcement Learning9 Mar 2023 0 repositories listed
-
Power and Interference Control for VLC-Based UDN: A Reinforcement Learning Approach9 Mar 2023 0 repositories listed
-
Real-time scheduling of renewable power systems through planning-based reinforcement learning9 Mar 2023 0 repositories listed
-
Recent Advances of Deep Robotic Affordance Learning: A Reinforcement Learning Perspective9 Mar 2023 0 repositories listed
-
Task Aware Dreamer for Task Generalization in Reinforcement Learning9 Mar 2023 0 repositories listed
-
Variance-aware robust reinforcement learning with linear function approximation under heavy-tailed rewards9 Mar 2023 0 repositories listed
-
Using Memory-Based Learning to Solve Tasks with State-Action Constraints8 Mar 2023 0 repositories listed
-
Deep Occupancy-Predictive Representations for Autonomous Driving7 Mar 2023 0 repositories listed
-
Domain Randomization for Robust, Affordable and Effective Closed-loop Control of Soft Robots7 Mar 2023 0 repositories listed
-
Environment Transformer and Policy Optimization for Model-Based Offline Reinforcement Learning7 Mar 2023 0 repositories listed
-
Evolutionary Reinforcement Learning: A Survey7 Mar 2023 0 repositories listed
-
On the Sample Complexity of Vanilla Model-Based Offline Reinforcement Learning with Dependent Samples7 Mar 2023 0 repositories listed
-
Real-World Humanoid Locomotion with Reinforcement Learning6 Mar 2023 0 repositories listed
-
MAESTRO: Open-Ended Environment Design for Multi-Agent Reinforcement Learning6 Mar 2023 0 repositories listed
-
Perspectives on the Social Impacts of Reinforcement Learning with Human Feedback6 Mar 2023 0 repositories listed
-
Dexterous In-hand Manipulation by Guiding Exploration with Simple Sub-skill Controllers6 Mar 2023 0 repositories listed
-
Ensemble Reinforcement Learning: A Survey5 Mar 2023 0 repositories listed
-
Local Environment Poisoning Attacks on Federated Reinforcement Learning5 Mar 2023 0 repositories listed
-
Double A3C: Deep Reinforcement Learning on OpenAI Gym Games4 Mar 2023 0 repositories listed
-
Look-Ahead AC Optimal Power Flow: A Model-Informed Reinforcement Learning Approach4 Mar 2023 0 repositories listed
-
Approximating Energy Market Clearing and Bidding With Model-Based Reinforcement Learning3 Mar 2023 0 repositories listed
-
Guarded Policy Optimization with Imperfect Online Demonstrations3 Mar 2023 0 repositories listed
-
Hindsight States: Blending Sim and Real Task Elements for Efficient Reinforcement Learning3 Mar 2023 0 repositories listed
-
Intelligent O-RAN Traffic Steering for URLLC Through Deep Reinforcement Learning3 Mar 2023 0 repositories listed
-
Learning to Influence Human Behavior with Offline Reinforcement Learning3 Mar 2023 0 repositories listed
-
RePreM: Representation Pre-training with Masked Model for Reinforcement Learning3 Mar 2023 0 repositories listed
-
Tile Networks: Learning Optimal Geometric Layout for Whole-page Recommendation3 Mar 2023 0 repositories listed
-
Toward Risk-based Optimistic Exploration for Cooperative Multi-Agent Reinforcement Learning3 Mar 2023 0 repositories listed
-
Co-learning Planning and Control Policies Constrained by Differentiable Logic Specifications2 Mar 2023 0 repositories listed
-
Domain Adaptation of Reinforcement Learning Agents based on Network Service Proximity2 Mar 2023 0 repositories listed
-
Expert-Free Online Transfer Learning in Multi-Agent Reinforcement Learning2 Mar 2023 0 repositories listed
-
Parameter Sharing with Network Pruning for Scalable Multi-Agent Deep Reinforcement Learning2 Mar 2023 0 repositories listed
-
Reinforced Labels: Multi-Agent Deep Reinforcement Learning for Point-Feature Label Placement2 Mar 2023 0 repositories listed
-
Resource-Constrained Station-Keeping for Helium Balloons using Reinforcement Learning2 Mar 2023 0 repositories listed
-
Self-Improving Robots: End-to-End Autonomous Visuomotor Reinforcement Learning2 Mar 2023 0 repositories listed
-
A Deep Reinforcement Learning Trader without Offline Training1 Mar 2023 0 repositories listed
-
A Variational Approach to Mutual Information-Based Coordination for Multi-Agent Reinforcement Learning1 Mar 2023 0 repositories listed
-
AR3n: A Reinforcement Learning-based Assist-As-Needed Controller for Robotic Rehabilitation28 Feb 2023 0 repositories listed
-
Auxiliary Task-based Deep Reinforcement Learning for Quantum Control28 Feb 2023 0 repositories listed
-
Graph Reinforcement Learning for Operator Selection in the ALNS Metaheuristic28 Feb 2023 0 repositories listed
-
Hierarchical Reinforcement Learning in Complex 3D Environments28 Feb 2023 0 repositories listed
-
Minimizing the Outage Probability in a Markov Decision Process28 Feb 2023 0 repositories listed
-
Multi-Agent Reinforcement Learning for Pragmatic Communication and Control28 Feb 2023 0 repositories listed
-
Parameter Optimization of LLC-Converter with multiple operation points using Reinforcement Learning28 Feb 2023 0 repositories listed
-
A Reinforcement Learning Approach for Scheduling Problems With Improved Generalization Through Order Swapping27 Feb 2023 0 repositories listed
-
Distributional Method for Risk Averse Reinforcement Learning27 Feb 2023 0 repositories listed
-
Dynamic Resource Allocation for Metaverse Applications with Deep Reinforcement Learning27 Feb 2023 0 repositories listed
-
Exposure-Based Multi-Agent Inspection of a Tumbling Target Using Deep Reinforcement Learning27 Feb 2023 0 repositories listed
-
Reinforcement Learning with Depreciating Assets27 Feb 2023 0 repositories listed
-
The Provable Benefits of Unsupervised Data Sharing for Offline Reinforcement Learning27 Feb 2023 0 repositories listed
-
Q-Cogni: An Integrated Causal Reinforcement Learning Framework26 Feb 2023 0 repositories listed
-
Revolutionizing Genomics with Reinforcement Learning Techniques26 Feb 2023 0 repositories listed