Browse State-of-the-Art › reinforcement-learning › Papers, page 59
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 59 of 135: papers 5,801 to 5,900 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
An Information Theoretic Approach to Interaction-Grounded Learning10 Jan 2024 0 repositories listed
-
Fully Decentralized Cooperative Multi-Agent Reinforcement Learning: A Survey10 Jan 2024 0 repositories listed
-
Innate-Values-driven Reinforcement Learning based Cooperative Multi-Agent Cognitive Modeling10 Jan 2024 0 repositories listed
-
ReACT: Reinforcement Learning for Controller Parametrization using B-Spline Geometries10 Jan 2024 0 repositories listed
-
Reinforcement Learning for Optimizing RAG for Domain Chatbots10 Jan 2024 0 repositories listed
-
Taming "data-hungry" reinforcement learning? Stability in continuous state-action spaces10 Jan 2024 0 repositories listed
-
Towards Safe Load Balancing based on Control Barrier Functions and Deep Reinforcement Learning10 Jan 2024 0 repositories listed
-
Fully Spiking Actor Network with Intra-layer Connections for Reinforcement Learning9 Jan 2024 0 repositories listed
-
A Minimaximalist Approach to Reinforcement Learning from Human Feedback8 Jan 2024 0 repositories listed
-
A Tensor Network Implementation of Multi Agent Reinforcement Learning8 Jan 2024 0 repositories listed
-
Guiding drones by information gain8 Jan 2024 0 repositories listed
-
Inverse Reinforcement Learning with Sub-optimal Experts8 Jan 2024 0 repositories listed
-
Long-term Safe Reinforcement Learning with Binary Feedback8 Jan 2024 0 repositories listed
-
ClusterComm: Discrete Communication in Decentralized MARL using Internal Representation Clustering7 Jan 2024 0 repositories listed
-
LLM-Powered Code Vulnerability Repair with Reinforcement Learning and Semantic Reward7 Jan 2024 0 repositories listed
-
Semi-supervised learning via DQN for log anomaly detection6 Jan 2024 0 repositories listed
-
Deep Reinforcement Learning for Local Path Following of an Autonomous Formula SAE Vehicle5 Jan 2024 0 repositories listed
-
Synergistic Formulaic Alpha Generation for Quantitative Trading based on Reinforcement Learning5 Jan 2024 0 repositories listed
-
A Survey Analyzing Generalization in Deep Reinforcement Learning4 Jan 2024 0 repositories listed
-
GLIDE-RL: Grounded Language Instruction through DEmonstration in RL3 Jan 2024 0 repositories listed
-
Reinforcement Learning for SAR View Angle Inversion with Differentiable SAR Renderer2 Jan 2024 0 repositories listed
-
Meta Reinforcement Learning for Multi-Task Offloading in Vehicular Edge Computing1 Jan 2024 0 repositories listed
-
Personalized Dynamic Pricing Policy for Electric Vehicles: Reinforcement learning approach1 Jan 2024 0 repositories listed
-
Regularized Parameter Uncertainty for Improving Generalization in Reinforcement Learning1 Jan 2024 0 repositories listed
-
Training Diffusion Models Towards Diverse Image Generation with Reinforcement Learning1 Jan 2024 0 repositories listed
-
Contrastive learning-based agent modeling for deep reinforcement learning30 Dec 2023 0 repositories listed
-
Two-Step Offline Preference-Based Reinforcement Learning with Constrained Actions30 Dec 2023 0 repositories listed
-
Design Space Exploration of Approximate Computing Techniques with a Reinforcement Learning Approach29 Dec 2023 0 repositories listed
-
Resilient Constrained Reinforcement Learning28 Dec 2023 0 repositories listed
-
RL-LOGO: Deep Reinforcement Learning Localization for Logo Recognition28 Dec 2023 0 repositories listed
-
RLPlanner: Reinforcement Learning based Floorplanning for Chiplets with Fast Thermal Analysis28 Dec 2023 0 repositories listed
-
Foundations of Reinforcement Learning and Interactive Decision Making27 Dec 2023 0 repositories listed
-
General Method for Solving Four Types of SAT Problems27 Dec 2023 0 repositories listed
-
A Closed-Loop Multi-perspective Visual Servoing Approach with Reinforcement Learning25 Dec 2023 0 repositories listed
-
A Target Detection Algorithm in Traffic Scenes Based on Deep Reinforcement Learning25 Dec 2023 0 repositories listed
-
Deep Reinforcement Learning for Quantitative Trading25 Dec 2023 0 repositories listed
-
Swap-based Deep Reinforcement Learning for Facility Location Problems in Networks25 Dec 2023 0 repositories listed
-
Agent based modelling for continuously varying supply chains24 Dec 2023 0 repositories listed
-
Discrete-Time Mean-Variance Strategy Based on Reinforcement Learning24 Dec 2023 0 repositories listed
-
Distributional Reinforcement Learning-based Energy Arbitrage Strategies in Imbalance Settlement Mechanism23 Dec 2023 0 repositories listed
-
Gradient Shaping for Multi-Constraint Safe Reinforcement Learning23 Dec 2023 0 repositories listed
-
Human-AI Collaboration in Real-World Complex Environment with Reinforcement Learning23 Dec 2023 0 repositories listed
-
Scaling Is All You Need: Autonomous Driving with JAX-Accelerated Reinforcement Learning23 Dec 2023 0 repositories listed
-
A Note on Stability in Asynchronous Stochastic Approximation without Communication Delays22 Dec 2023 0 repositories listed
-
A Survey of Reinforcement Learning from Human Feedback22 Dec 2023 0 repositories listed
-
Dynamic Programming-based Approximate Optimal Control for Model-Based Reinforcement Learning22 Dec 2023 0 repositories listed
-
Federated Q-Learning: Linear Regret Speedup with Low Communication Cost22 Dec 2023 0 repositories listed
-
REBEL: Reward Regularization-Based Approach for Robotic Reinforcement Learning from Human Feedback22 Dec 2023 0 repositories listed
-
Safe Reinforcement Learning with Instantaneous Constraints: The Role of Aggressive Exploration22 Dec 2023 0 repositories listed
-
A Reinforcement-Learning-Based Multiple-Column Selection Strategy for Column Generation21 Dec 2023 0 repositories listed
-
Automatic Curriculum Learning with Gradient Reward Signals21 Dec 2023 0 repositories listed
-
Incorporating Human Flexibility through Reward Preferences in Human-AI Teaming21 Dec 2023 0 repositories listed
-
CVA Hedging by Risk-Averse Stochastic-Horizon Reinforcement Learning21 Dec 2023 0 repositories listed
-
Optimal coordination of resources: A solution from reinforcement learning20 Dec 2023 0 repositories listed
-
PGN: A perturbation generation network against deep reinforcement learning20 Dec 2023 0 repositories listed
-
Sparse Mean Field Load Balancing in Large Localized Queueing Systems20 Dec 2023 0 repositories listed
-
Towards Machines that Trust: AI Agents Learn to Trust in the Trust Game20 Dec 2023 0 repositories listed
-
Curriculum Learning for Cooperation in Multi-Agent Reinforcement Learning19 Dec 2023 0 repositories listed
-
Neural Network Approximation for Pessimistic Offline Reinforcement Learning19 Dec 2023 0 repositories listed
-
Active search and coverage using point-cloud reinforcement learning18 Dec 2023 0 repositories listed
-
Contextual Reinforcement Learning for Offshore Wind Farm Bidding18 Dec 2023 0 repositories listed
-
Solving the swing-up and balance task for the Acrobot and Pendubot with SAC18 Dec 2023 0 repositories listed
-
Advancing RAN Slicing with Offline Reinforcement Learning16 Dec 2023 0 repositories listed
-
Fractional Deep Reinforcement Learning for Age-Minimal Mobile Edge Computing16 Dec 2023 0 repositories listed
-
Robust Communicative Multi-Agent Reinforcement Learning with Active Defense16 Dec 2023 0 repositories listed
-
Assume-Guarantee Reinforcement Learning15 Dec 2023 0 repositories listed
-
15 Dec 2023 0 repositories listed
-
Multi-agent Reinforcement Learning: A Comprehensive Survey15 Dec 2023 0 repositories listed
-
Multi-Objective Reinforcement Learning-based Approach for Pressurized Water Reactor Optimization15 Dec 2023 0 repositories listed
-
Situation-Dependent Causal Influence-Based Cooperative Multi-agent Reinforcement Learning15 Dec 2023 0 repositories listed
-
Small Dataset, Big Gains: Enhancing Reinforcement Learning by Offline Pre-Training with Model Based Augmentation15 Dec 2023 0 repositories listed
-
Toward Computationally Efficient Inverse Reinforcement Learning via Reward Shaping15 Dec 2023 0 repositories listed
-
Adaptive parameter sharing for multi-agent reinforcement learning14 Dec 2023 0 repositories listed
-
Auto MC-Reward: Automated Dense Reward Design with Large Language Models for Minecraft14 Dec 2023 0 repositories listed
-
Improve Robustness of Reinforcement Learning against Observation Perturbations via l_∞ Lipschitz Policy Networks14 Dec 2023 0 repositories listed
-
iOn-Profiler: intelligent Online multi-objective VNF Profiling with Reinforcement Learning14 Dec 2023 0 repositories listed
-
LiFT: Unsupervised Reinforcement Learning with Foundation Models as Teachers14 Dec 2023 0 repositories listed
-
Personalized Path Recourse for Reinforcement Learning Agents14 Dec 2023 0 repositories listed
-
Vision-Language Models as a Source of Rewards14 Dec 2023 0 repositories listed
-
An Invitation to Deep Reinforcement Learning13 Dec 2023 0 repositories listed
-
Enhancing Robotic Navigation: An Evaluation of Single and Multi-Objective Reinforcement Learning Strategies13 Dec 2023 0 repositories listed
-
Safe Exploration in Reinforcement Learning: Training Backup Control Barrier Functions with Zero Training Time Safety Violations13 Dec 2023 0 repositories listed
-
Noise Distribution Decomposition based Multi-Agent Distributional Reinforcement Learning12 Dec 2023 0 repositories listed
-
Real-time Network Intrusion Detection via Decision Transformers12 Dec 2023 0 repositories listed
-
Toward a Reinforcement-Learning-Based System for Adjusting Medication to Minimize Speech Disfluency12 Dec 2023 0 repositories listed
-
Scalable Decentralized Cooperative Platoon using Multi-Agent Deep Reinforcement Learning11 Dec 2023 0 repositories listed
-
Spreeze: High-Throughput Parallel Reinforcement Learning Framework11 Dec 2023 0 repositories listed
-
DCIR: Dynamic Consistency Intrinsic Reward for Multi-Agent Reinforcement Learning10 Dec 2023 0 repositories listed
-
Language-Conditioned Semantic Search-Based Policy for Robotic Manipulation Tasks10 Dec 2023 0 repositories listed
-
PerfRL: A Small Language Model Framework for Efficient Code Optimization9 Dec 2023 0 repositories listed
-
Position control of an acoustic cavitation bubble by reinforcement learning9 Dec 2023 0 repositories listed
-
Privacy Preserving Multi-Agent Reinforcement Learning in Supply Chains9 Dec 2023 0 repositories listed
-
Canaries and Whistles: Resilient Drone Communication Networks with (or without) Deep Reinforcement Learning8 Dec 2023 0 repositories listed
-
DARLEI: Deep Accelerated Reinforcement Learning with Evolutionary Intelligence8 Dec 2023 0 repositories listed
-
Modeling Risk in Reinforcement Learning: A Literature Mapping8 Dec 2023 0 repositories listed
-
Pruning Convolutional Filters via Reinforcement Learning with Entropy Minimization8 Dec 2023 0 repositories listed
-
Evaluation of Active Feature Acquisition Methods for Static Feature Settings6 Dec 2023 0 repositories listed
-
MACCA: Offline Multi-agent Reinforcement Learning with Causal Credit Assignment6 Dec 2023 0 repositories listed
-
A Q-learning approach to the continuous control problem of robot inverted pendulum balancing5 Dec 2023 0 repositories listed
-
Provable Reinforcement Learning for Networked Control Systems with Stochastic Packet Disordering5 Dec 2023 0 repositories listed