Browse State-of-the-Art › reinforcement-learning › Papers, page 65
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 65 of 135: papers 6,401 to 6,500 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Reinforcement Learning and Data-Generation for Syntax-Guided Synthesis13 Jul 2023 0 repositories listed
-
The complexity of non-stationary reinforcement learning13 Jul 2023 0 repositories listed
-
Machine Learning for Autonomous Vehicle's Trajectory Prediction: A comprehensive survey, Challenges, and Future Research Directions12 Jul 2023 0 repositories listed
-
Maneuver Decision-Making Through Automatic Curriculum Reinforcement Learning Without Handcrafted Reward functions12 Jul 2023 0 repositories listed
-
Prompt Generate Train (PGT): Few-shot Domain Adaption of Retrieval Augmented Generation Models for Open Book Question-Answering12 Jul 2023 0 repositories listed
-
Transformers in Reinforcement Learning: A Survey12 Jul 2023 0 repositories listed
-
11 Jul 2023 0 repositories listed
-
Multiobjective Hydropower Reservoir Operation Optimization with Transformer-Based Deep Reinforcement Learning11 Jul 2023 0 repositories listed
-
Scaling Distributed Multi-task Reinforcement Learning with Experience Sharing11 Jul 2023 0 repositories listed
-
Continual Learning as Computationally Constrained Reinforcement Learning10 Jul 2023 0 repositories listed
-
Diffusion Policies for Out-of-Distribution Generalization in Offline Reinforcement Learning10 Jul 2023 0 repositories listed
-
Learning Interpretable Heuristics for WalkSAT10 Jul 2023 0 repositories listed
-
Measuring and Mitigating Interference in Reinforcement Learning10 Jul 2023 0 repositories listed
-
A Personalized Reinforcement Learning Summarization Service for Learning Structure from Unstructured Data9 Jul 2023 0 repositories listed
-
A User Study on Explainable Online Reinforcement Learning for Adaptive Systems9 Jul 2023 0 repositories listed
-
Investigating the Edge of Stability Phenomenon in Reinforcement Learning9 Jul 2023 0 repositories listed
-
UAV Trajectory Optimization for Directional THz Links Using Deep Reinforcement Learning8 Jul 2023 0 repositories listed
-
Goal-Conditioned Predictive Coding for Offline Reinforcement Learning7 Jul 2023 0 repositories listed
-
Reinforcement and Deep Reinforcement Learning-based Solutions for Machine Maintenance Planning, Scheduling Policies, and Optimization7 Jul 2023 0 repositories listed
-
A Neuromorphic Architecture for Reinforcement Learning from Real-Valued Observations6 Jul 2023 0 repositories listed
-
Meta Federated Reinforcement Learning for Distributed Resource Allocation6 Jul 2023 0 repositories listed
-
Offline Reinforcement Learning with Imbalanced Datasets6 Jul 2023 0 repositories listed
-
Provably Efficient Iterated CVaR Reinforcement Learning with Function Approximation and Human Feedback6 Jul 2023 0 repositories listed
-
TGRL: An Algorithm for Teacher Guided Reinforcement Learning6 Jul 2023 0 repositories listed
-
LLQL: Logistic Likelihood Q-Learning for Reinforcement Learning5 Jul 2023 0 repositories listed
-
Surge Routing: Event-informed Multiagent Reinforcement Learning for Autonomous Rideshare5 Jul 2023 0 repositories listed
-
Beyond Conservatism: Diffusion Policies in Offline Multi-agent Reinforcement Learning4 Jul 2023 0 repositories listed
-
Causal Reinforcement Learning: A Survey4 Jul 2023 0 repositories listed
-
Emergent Resource Exchange and Tolerated Theft Behavior using Multi-Agent Reinforcement Learning4 Jul 2023 0 repositories listed
-
Option Market Making via Reinforcement Learning4 Jul 2023 0 repositories listed
-
Over-the-Counter Market Making via Reinforcement Learning4 Jul 2023 0 repositories listed
-
Achieving Stable Training of Reinforcement Learning Agents in Bimodal Environments through Batch Learning3 Jul 2023 0 repositories listed
-
Enhancing the Robustness of QMIX against State-adversarial Attacks3 Jul 2023 0 repositories listed
-
Theory of Mind as Intrinsic Motivation for Multi-Agent Reinforcement Learning3 Jul 2023 0 repositories listed
-
Is Risk-Sensitive Reinforcement Learning Properly Resolved?2 Jul 2023 0 repositories listed
-
Asset correlation based deep reinforcement learning for the portfolio selection1 Jul 2023 0 repositories listed
-
Comparing Reinforcement Learning and Human Learning using the Game of Hidden Rules30 Jun 2023 0 repositories listed
-
Design of Induction Machines using Reinforcement Learning30 Jun 2023 0 repositories listed
-
λ-models: Effective Decision-Aware Reinforcement Learning with Latent Models30 Jun 2023 0 repositories listed
-
Navigation of micro-robot swarms for targeted delivery using reinforcement learning30 Jun 2023 0 repositories listed
-
Risk-sensitive Actor-free Policy via Convex Optimization30 Jun 2023 0 repositories listed
-
ArrayBot: Reinforcement Learning for Generalizable Distributed Manipulation through Touch29 Jun 2023 0 repositories listed
-
Laxity-Aware Scalable Reinforcement Learning for HVAC Control29 Jun 2023 0 repositories listed
-
Probabilistic Constraint for Safety-Critical Reinforcement Learning29 Jun 2023 0 repositories listed
-
Safety-Aware Task Composition for Discrete and Continuous Reinforcement Learning29 Jun 2023 0 repositories listed
-
Action and Trajectory Planning for Urban Autonomous Driving with Hierarchical Reinforcement Learning28 Jun 2023 0 repositories listed
-
Evaluation of Reinforcement Learning Techniques for Trading on a Diverse Portfolio28 Jun 2023 0 repositories listed
-
Mastering Nordschleife -- A comprehensive race simulation for AI strategy decision-making in motorsports28 Jun 2023 0 repositories listed
-
Recent Advances in Optimal Transport for Machine Learning28 Jun 2023 0 repositories listed
-
Sharper Model-free Reinforcement Learning for Average-reward Markov Decision Processes28 Jun 2023 0 repositories listed
-
Structure in Deep Reinforcement Learning: A Survey and Open Problems28 Jun 2023 0 repositories listed
-
Optimizing Credit Limit Adjustments Under Adversarial Goals Using Reinforcement Learning27 Jun 2023 0 repositories listed
-
Prioritized Trajectory Replay: A Replay Memory for Data-driven Reinforcement Learning27 Jun 2023 0 repositories listed
-
Value-aware Importance Weighting for Off-policy Reinforcement Learning27 Jun 2023 0 repositories listed
-
Beyond dynamic programming26 Jun 2023 0 repositories listed
-
Decentralized Multi-Robot Formation Control Using Reinforcement Learning26 Jun 2023 0 repositories listed
-
Estimating player completion rate in mobile puzzle games using reinforcement learning26 Jun 2023 0 repositories listed
-
Supervised Pretraining Can Learn In-Context Reinforcement Learning26 Jun 2023 0 repositories listed
-
Is RLHF More Difficult than Standard RL?25 Jun 2023 0 repositories listed
-
Safety-Critical Scenario Generation Via Reinforcement Learning Based Editing25 Jun 2023 0 repositories listed
-
Fighting Uncertainty with Gradients: Offline Reinforcement Learning via Diffusion Score Matching24 Jun 2023 0 repositories listed
-
Multi-agent Deep Reinforcement Learning for Distributed Load Restoration24 Jun 2023 0 repositories listed
-
Offline Policy Evaluation for Reinforcement Learning with Adaptively Collected Data24 Jun 2023 0 repositories listed
-
Safe Reinforcement Learning with Dead-Ends Avoidance and Recovery24 Jun 2023 0 repositories listed
-
Waypoint Transformer: Reinforcement Learning via Supervised Learning with Intermediate Targets24 Jun 2023 0 repositories listed
-
Active Coverage for PAC Reinforcement Learning23 Jun 2023 0 repositories listed
-
CLUE: Calibrated Latent Guidance for Offline Reinforcement Learning23 Jun 2023 0 repositories listed
-
Offline Skill Graph (OSG): A Framework for Learning and Planning using Offline Reinforcement Learning Skills23 Jun 2023 0 repositories listed
-
Reinforcement Learning with Temporal-Logic-Based Causal Diagrams23 Jun 2023 0 repositories listed
-
Decentralized Multi-Agent Reinforcement Learning with Global State Prediction22 Jun 2023 0 repositories listed
-
Learning from Visual Observation via Offline Pretrained State-to-Go Transformer22 Jun 2023 0 repositories listed
-
Autonomous Driving with Deep Reinforcement Learning in CARLA Simulation20 Jun 2023 0 repositories listed
-
Evolutionary Strategy Guided Reinforcement Learning via MultiBuffer Communication20 Jun 2023 0 repositories listed
-
Int-HRL: Towards Intention-based Hierarchical Reinforcement Learning20 Jun 2023 0 repositories listed
-
Learning Profitable NFT Image Diffusions via Multiple Visual-Policy Guided Reinforcement Learning20 Jun 2023 0 repositories listed
-
Reinforcement Learning-based Virtual Fixtures for Teleoperation of Hydraulic Construction Machine20 Jun 2023 0 repositories listed
-
Reward Shaping via Diffusion Process in Reinforcement Learning20 Jun 2023 0 repositories listed
-
Benchmarking Robustness of Deep Reinforcement Learning approaches to Online Portfolio Management19 Jun 2023 0 repositories listed
-
Deep Reinforcement Learning for ESG financial portfolio management19 Jun 2023 0 repositories listed
-
Integrating Tick-level Data and Periodical Signal for High-frequency Market Making19 Jun 2023 0 repositories listed
-
LARG, Language-based Automatic Reward and Goal Generation19 Jun 2023 0 repositories listed
-
On the Model-Misspecification in Reinforcement Learning19 Jun 2023 0 repositories listed
-
Optimal Execution Using Reinforcement Learning19 Jun 2023 0 repositories listed
-
Vanishing Bias Heuristic-guided Reinforcement Learning Algorithm17 Jun 2023 0 repositories listed
-
Variational Sequential Optimal Experimental Design using Reinforcement Learning17 Jun 2023 0 repositories listed
-
Automatic Deduction Path Learning via Reinforcement Learning with Environmental Correction16 Jun 2023 0 repositories listed
-
Bootstrapped Representations in Reinforcement Learning16 Jun 2023 0 repositories listed
-
Fairness in Preference-based Reinforcement Learning16 Jun 2023 0 repositories listed
-
Meta Generative Flow Networks with Personalization for Task-Specific Adaptation16 Jun 2023 0 repositories listed
-
The Evolution theory of Learning: From Natural Selection to Reinforcement Learning16 Jun 2023 0 repositories listed
-
The False Dawn: Reevaluating Google's Reinforcement Learning for Chip Macro Placement16 Jun 2023 0 repositories listed
-
Attention-based Open RAN Slice Management using Deep Reinforcement Learning15 Jun 2023 0 repositories listed
-
Deep Generative Models for Decision-Making and Control15 Jun 2023 0 repositories listed
-
DiAReL: Reinforcement Learning with Disturbance Awareness for Robust Sim2Real Policy Transfer in Robot Control15 Jun 2023 0 repositories listed
-
Plug-in Hybrid Electric Vehicle Energy Management with Clutch Engagement Control via Continuous-Discrete Reinforcement Learning15 Jun 2023 0 repositories listed
-
Granger Causal Interaction Skill Chains15 Jun 2023 0 repositories listed
-
Inroads into Autonomous Network Defence using Explained Reinforcement Learning15 Jun 2023 0 repositories listed
-
Langevin Thompson Sampling with Logarithmic Communication: Bandits and Reinforcement Learning15 Jun 2023 0 repositories listed
-
Offline Multi-Agent Reinforcement Learning with Coupled Value Factorization15 Jun 2023 0 repositories listed
-
Predictive Maneuver Planning with Deep Reinforcement Learning (PMP-DRL) for comfortable and safe autonomous driving15 Jun 2023 0 repositories listed