Browse State-of-the-Art › Reinforcement Learning (RL) › Papers, page 57
Reinforcement Learning (RL)
Papers archive 2025-07-28
archive papers tagged: 15,113 · with a code link: 4,749 · where Syntology ran a sample: 1,416 (1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,416 of 15,113 tagged: 1,186 with a run with no instrument failure, 230 where every run was a failure of Syntology's instrument)
Page 57 of 152: papers 5,601 to 5,700 of 15,113, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Probing for Consciousness in Machines25 Nov 2024 0 repositories listed
-
Unsupervised Event Outlier Detection in Continuous Time25 Nov 2024 0 repositories listed
-
Broad Critic Deep Actor Reinforcement Learning for Continuous Control24 Nov 2024 0 repositories listed
-
From Laws to Motivation: Guiding Exploration through Law-Based Reasoning and Rewards24 Nov 2024 0 repositories listed
-
Reinforcement learning-enhanced genetic algorithm for wind farm layout optimization24 Nov 2024 0 repositories listed
-
Learning a local trading strategy: deep reinforcement learning for grid-scale renewable energy integration23 Nov 2024 0 repositories listed
-
Enhancing Molecular Design through Graph-based Topological Reinforcement Learning22 Nov 2024 0 repositories listed
-
Free Energy Projective Simulation (FEPS): Active inference with interpretability22 Nov 2024 0 repositories listed
-
Reward Fine-Tuning Two-Step Diffusion Models via Learning Differentiable Latent-Space Surrogate Reward22 Nov 2024 0 repositories listed
-
Segmenting Action-Value Functions Over Time-Scales in SARSA via TD(Δ)22 Nov 2024 0 repositories listed
-
GraCo -- A Graph Composer for Integrated Circuits21 Nov 2024 0 repositories listed
-
Model Checking for Reinforcement Learning in Autonomous Driving: One Can Do More Than You Think!21 Nov 2024 0 repositories listed
-
Time-Scale Separation in Q-Learning: Extending TD(△) for Action-Value Function Decomposition21 Nov 2024 0 repositories listed
-
A Survey On Enhancing Reinforcement Learning in Complex Environments: Insights from Human and LLM Feedback20 Nov 2024 0 repositories listed
-
Provably Efficient Action-Manipulation Attack Against Continuous Reinforcement Learning20 Nov 2024 0 repositories listed
-
GRL-Prompt: Towards Knowledge Graph based Prompt Optimization via Reinforcement Learning19 Nov 2024 0 repositories listed
-
Coarse-to-fine Q-Network with Action Sequence for Data-Efficient Robot Learning19 Nov 2024 0 repositories listed
-
Enhancing Decision Transformer with Diffusion-Based Trajectory Branch Generation18 Nov 2024 0 repositories listed
-
No-regret Exploration in Shuffle Private Reinforcement Learning18 Nov 2024 0 repositories listed
-
Preserving Expert-Level Privacy in Offline Reinforcement Learning18 Nov 2024 0 repositories listed
-
Regret-Free Reinforcement Learning for LTL Specifications18 Nov 2024 0 repositories listed
-
Robust Reinforcement Learning under Diffusion Models for Data with Jumps18 Nov 2024 0 repositories listed
-
Upside-Down Reinforcement Learning for More Interpretable Optimal Control18 Nov 2024 0 repositories listed
-
Financial News-Driven LLM Reinforcement Learning for Portfolio Management17 Nov 2024 0 repositories listed
-
Modulating Reservoir Dynamics via Reinforcement Learning for Efficient Robot Skill Synthesis17 Nov 2024 0 repositories listed
-
Robust Defense Against Extreme Grid Events Using Dual-Policy Reinforcement Learning Agents17 Nov 2024 0 repositories listed
-
Adaptive Learning of Design Strategies over Non-Hierarchical Multi-Fidelity Models via Policy Alignment16 Nov 2024 0 repositories listed
-
Stable Continual Reinforcement Learning via Diffusion-based Trajectory Replay16 Nov 2024 0 repositories listed
-
Continual Adversarial Reinforcement Learning (CARL) of False Data Injection detection: forgetting and explainability15 Nov 2024 0 repositories listed
-
Multi-agent Path Finding for Timed Tasks using Evolutionary Games15 Nov 2024 0 repositories listed
-
The Surprising Ineffectiveness of Pre-Trained Visual Representations for Model-Based Reinforcement Learning15 Nov 2024 0 repositories listed
-
Towards Sample-Efficiency and Generalization of Transfer and Inverse Reinforcement Learning: A Comprehensive Literature Review15 Nov 2024 0 repositories listed
-
Innate-Values-driven Reinforcement Learning based Cognitive Modeling14 Nov 2024 0 repositories listed
-
To bootstrap or to rollout? An optimal and adaptive interpolation14 Nov 2024 0 repositories listed
-
LLMStinger: Jailbreaking LLMs using RL fine-tuned LLMs13 Nov 2024 0 repositories listed
-
RLInspect: An Interactive Visual Approach to Assess Reinforcement Learning Algorithm13 Nov 2024 0 repositories listed
-
Robot See, Robot Do: Imitation Reward for Noisy Financial Environments13 Nov 2024 0 repositories listed
-
Towards Practical Deep Schedulers for Allocating Cellular Radio Resources13 Nov 2024 0 repositories listed
-
Navigation with QPHIL: Quantizing Planner for Hierarchical Implicit Q-Learning12 Nov 2024 0 repositories listed
-
Overcoming the Curse of Dimensionality in Reinforcement Learning Through Approximate Factorization12 Nov 2024 0 repositories listed
-
Reinforcement Learning Framework for Quantitative Trading12 Nov 2024 0 repositories listed
-
Robust Offline Reinforcement Learning for Non-Markovian Decision Processes12 Nov 2024 0 repositories listed
-
Test Where Decisions Matter: Importance-driven Testing for Deep Reinforcement Learning12 Nov 2024 0 repositories listed
-
QuadWBG: Generalizable Quadrupedal Whole-Body Grasping11 Nov 2024 0 repositories listed
-
CROPS: A Deployable Crop Management System Over All Possible State Availabilities9 Nov 2024 0 repositories listed
-
Emergent Cooperative Strategies for Multi-Agent Shepherding via Reinforcement Learning8 Nov 2024 0 repositories listed
-
Fine-Grained Reward Optimization for Machine Translation using Error Severity Mappings8 Nov 2024 0 repositories listed
-
Improving Multi-Domain Task-Oriented Dialogue System with Offline Reinforcement Learning8 Nov 2024 0 repositories listed
-
A Reinforcement Learning-Based Automatic Video Editing Method Using Pre-trained Vision-Language Model7 Nov 2024 0 repositories listed
-
Evaluating Robustness of Reinforcement Learning Algorithms for Autonomous Shipping7 Nov 2024 0 repositories listed
-
Interactive Dialogue Agents via Reinforcement Learning on Hindsight Regenerations7 Nov 2024 0 repositories listed
-
Plasticity Loss in Deep Reinforcement Learning: A Survey7 Nov 2024 0 repositories listed
-
Q-SFT: Q-Learning for Language Models via Supervised Fine-Tuning7 Nov 2024 0 repositories listed
-
Sharp Analysis for KL-Regularized Contextual Bandits and RLHF7 Nov 2024 0 repositories listed
-
A Comparative Study of Deep Reinforcement Learning for Crop Production Management6 Nov 2024 0 repositories listed
-
Approximate Equivariance in Reinforcement Learning6 Nov 2024 0 repositories listed
-
Interpretable and Efficient Data-driven Discovery and Control of Distributed Systems6 Nov 2024 0 repositories listed
-
Opportunities of Reinforcement Learning in South Africa's Just Transition6 Nov 2024 0 repositories listed
-
Embedding Safety into RL: A New Take on Trust Region Methods5 Nov 2024 0 repositories listed
-
Pre-trained Visual Dynamics Representations for Efficient Policy Learning5 Nov 2024 0 repositories listed
-
Transformer-Based Fault-Tolerant Control for Fixed-Wing UAVs Using Knowledge Distillation and In-Context Adaptation5 Nov 2024 0 repositories listed
-
When to Localize? A Risk-Constrained Reinforcement Learning Approach5 Nov 2024 0 repositories listed
-
N-Gram Induction Heads for In-Context RL: Improving Stability and Reducing Data Needs4 Nov 2024 0 repositories listed
-
Show, Don't Tell: Learning Reward Machines from Demonstrations for Reinforcement Learning-Based Cardiac Pacemaker Synthesis4 Nov 2024 0 repositories listed
-
So You Think You Can Scale Up Autonomous Robot Data Collection?4 Nov 2024 0 repositories listed
-
Diversity Progress for Goal Selection in Discriminability-Motivated RL3 Nov 2024 0 repositories listed
-
GITSR: Graph Interaction Transformer-based Scene Representation for Multi Vehicle Collaborative Decision-making3 Nov 2024 0 repositories listed
-
Hedging and Pricing Structured Products Featuring Multiple Underlying Assets2 Nov 2024 0 repositories listed
-
Prompt Tuning with Diffusion for Few-Shot Pre-trained Policy Generalization2 Nov 2024 0 repositories listed
-
A Review of Reinforcement Learning in Financial Applications1 Nov 2024 0 repositories listed
-
AI-based traffic analysis in digital twin networks1 Nov 2024 0 repositories listed
-
Effective ML Model Versioning in Edge Networks1 Nov 2024 0 repositories listed
-
Statistical Guarantees for Lifelong Reinforcement Learning using PAC-Bayes Theory1 Nov 2024 0 repositories listed
-
Towards Building Secure UAV Navigation with FHE-aware Knowledge Distillation1 Nov 2024 0 repositories listed
-
Deterministic Exploration via Stationary Bellman Error Maximization31 Oct 2024 0 repositories listed
-
EARL-BO: Reinforcement Learning for Multi-Step Lookahead, High-Dimensional Bayesian Optimization31 Oct 2024 0 repositories listed
-
Scalable Reinforcement Post-Training Beyond Static Human Prompts: Evolving Alignment via Asymmetric Self-Play31 Oct 2024 0 repositories listed
-
Local Linearity: the Key for No-regret Reinforcement Learning in Continuous MDPs31 Oct 2024 0 repositories listed
-
Maximum Entropy Hindsight Experience Replay31 Oct 2024 0 repositories listed
-
Noise as a Double-Edged Sword: Reinforcement Learning Exploits Randomized Defenses in Neural Networks31 Oct 2024 0 repositories listed
-
Offline Reinforcement Learning and Sequence Modeling for Downlink Link Adaptation30 Oct 2024 0 repositories listed
-
Resource Governance in Networked Systems via Integrated Variational Autoencoders and Reinforcement Learning30 Oct 2024 0 repositories listed
-
Return Augmented Decision Transformer for Off-Dynamics Reinforcement Learning30 Oct 2024 0 repositories listed
-
Self-Driving Car Racing: Application of Deep Reinforcement Learning30 Oct 2024 0 repositories listed
-
SoftCTRL: Soft conservative KL-control of Transformer Reinforcement Learning for Autonomous Driving30 Oct 2024 0 repositories listed
-
Stepping Out of the Shadows: Reinforcement Learning in Shadow Mode30 Oct 2024 0 repositories listed
-
Precise and Dexterous Robotic Manipulation via Human-in-the-Loop Reinforcement Learning29 Oct 2024 0 repositories listed
-
A Multi-Agent Reinforcement Learning Testbed for Cognitive Radio Applications28 Oct 2024 0 repositories listed
-
Bilevel Model for Electricity Market Mechanism Optimisation via Quantum Computing Enhanced Reinforcement Learning28 Oct 2024 0 repositories listed
-
Getting By Goal Misgeneralization With a Little Help From a Mentor28 Oct 2024 0 repositories listed
-
The Limits of Transfer Reinforcement Learning with Latent Low-rank Structure28 Oct 2024 0 repositories listed
-
Beyond Simple Sum of Delayed Rewards: Non-Markovian Reward Modeling for Reinforcement Learning26 Oct 2024 0 repositories listed
-
GFlowNet Fine-tuning for Diverse Correct Solutions in Mathematical Reasoning Tasks26 Oct 2024 0 repositories listed
-
Off-Policy Selection for Initiating Human-Centric Experimental Design26 Oct 2024 0 repositories listed
-
Adversarial Environment Design via Regret-Guided Diffusion Models25 Oct 2024 0 repositories listed
-
Humanizing the Machine: Proxy Attacks to Mislead LLM Detectors25 Oct 2024 0 repositories listed
-
On-Robot Reinforcement Learning with Goal-Contrastive Rewards25 Oct 2024 0 repositories listed
-
Provably Adaptive Average Reward Reinforcement Learning for Metric Spaces25 Oct 2024 0 repositories listed
-
Reinforcement Learning for Aligning Large Language Models Agents with Interactive Environments: Quantifying and Mitigating Prompt Overfitting25 Oct 2024 0 repositories listed
-
Random Policy Enables In-Context Reinforcement Learning within Trust Horizons25 Oct 2024 0 repositories listed