Browse State-of-the-Art › reinforcement-learning › Papers, page 80
reinforcement-learning
Papers archive 2025-07-28
archive papers tagged: 13,427 · with a code link: 4,119 · where Syntology ran a sample: 1,165 (973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (1,165 of 13,427 tagged: 973 with a run with no instrument failure, 192 where every run was a failure of Syntology's instrument)
Page 80 of 135: papers 7,901 to 8,000 of 13,427, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Offline Reinforcement Learning with Causal Structured World Models3 Jun 2022 0 repositories listed
-
Reinforcement Learning with Neural Radiance Fields3 Jun 2022 0 repositories listed
-
Equivariant Reinforcement Learning for Quadrotor UAV2 Jun 2022 0 repositories listed
-
HEX: Human-in-the-loop Explainability via Deep Reinforcement Learning2 Jun 2022 0 repositories listed
-
Incorporating Explicit Uncertainty Estimates into Deep Offline Reinforcement Learning2 Jun 2022 0 repositories listed
-
Incrementality Bidding via Reinforcement Learning under Mixed and Delayed Rewards2 Jun 2022 0 repositories listed
-
Offline Reinforcement Learning with Differential Privacy2 Jun 2022 0 repositories listed
-
Posterior Coreset Construction with Kernelized Stein Discrepancy for Model-Based Reinforcement Learning2 Jun 2022 0 repositories listed
-
Reinforcement learning based parameters adaption method for particle swarm optimization2 Jun 2022 0 repositories listed
-
Sample-Efficient Reinforcement Learning of Partially Observable Markov Games2 Jun 2022 0 repositories listed
-
Byzantine-Robust Online and Offline Distributed Reinforcement Learning1 Jun 2022 0 repositories listed
-
Efficient Scheduling of Data Augmentation for Deep Reinforcement Learning1 Jun 2022 0 repositories listed
-
Model Generation with Provable Coverability for Offline Reinforcement Learning1 Jun 2022 0 repositories listed
-
On Gap-dependent Bounds for Offline Reinforcement Learning1 Jun 2022 0 repositories listed
-
Predecessor Features1 Jun 2022 0 repositories listed
-
Provably Efficient Lifelong Reinforcement Learning with Linear Function Approximation1 Jun 2022 0 repositories listed
-
Provably Efficient Offline Multi-agent Reinforcement Learning via Strategy-wise Bonus1 Jun 2022 0 repositories listed
-
RLSS: A Deep Reinforcement Learning Algorithm for Sequential Scene Generation1 Jun 2022 0 repositories listed
-
The Phenomenon of Policy Churn1 Jun 2022 0 repositories listed
-
k-Means Maximum Entropy Exploration31 May 2022 0 repositories listed
-
Lessons Learned from Data-Driven Building Control Experiments: Contrasting Gaussian Process-based MPC, Bilevel DeePC, and Deep Reinforcement Learning31 May 2022 0 repositories listed
-
Multi-Agent Learning of Numerical Methods for Hyperbolic PDEs with Factored Dec-MDP31 May 2022 0 repositories listed
-
Robust Longitudinal Control for Vehicular Autonomous Platoons Using Deep Reinforcement Learning31 May 2022 0 repositories listed
-
Sample-Efficient, Exploration-Based Policy Optimisation for Routing Problems31 May 2022 0 repositories listed
-
A Simulation Environment and Reinforcement Learning Method for Waste Reduction30 May 2022 0 repositories listed
-
GraMeR: Graph Meta Reinforcement Learning for Multi-Objective Influence Maximization30 May 2022 0 repositories listed
-
Learning Open Domain Multi-hop Search Using Reinforcement Learning30 May 2022 0 repositories listed
-
Quantum Multi-Armed Bandits and Stochastic Linear Bandits Enjoy Logarithmic Regrets30 May 2022 0 repositories listed
-
Residual Q-Networks for Value Function Factorizing in Multi-Agent Reinforcement Learning30 May 2022 0 repositories listed
-
Stock Trading Optimization through Model-based Reinforcement Learning with Resistance Support Relative Strength30 May 2022 0 repositories listed
-
Independent and Decentralized Learning in Markov Potential Games29 May 2022 0 repositories listed
-
Frustratingly Easy Regularization on Representation Can Boost Deep Reinforcement Learning29 May 2022 0 repositories listed
-
Multi-Source Transfer Learning for Deep Model-Based Reinforcement Learning28 May 2022 0 repositories listed
-
Survival Analysis on Structured Data using Deep Reinforcement Learning28 May 2022 0 repositories listed
-
Deep Reinforcement Learning for Distributed and Uncoordinated Cognitive Radios Resource Allocation27 May 2022 0 repositories listed
-
Double Deep Q Networks for Sensor Management in Space Situational Awareness27 May 2022 0 repositories listed
-
Feudal Multi-Agent Reinforcement Learning with Adaptive Network Partition for Traffic Signal Control27 May 2022 0 repositories listed
-
GALOIS: Boosting Deep Reinforcement Learning via Generalizable Logic Synthesis27 May 2022 0 repositories listed
-
KL-Entropy-Regularized RL with a Generative Model is Minimax Optimal27 May 2022 0 repositories listed
-
Non-Markovian policies occupancy measures27 May 2022 0 repositories listed
-
Off-Beat Multi-Agent Reinforcement Learning27 May 2022 0 repositories listed
-
Provably Sample-Efficient RL with Side Information about Latent Dynamics27 May 2022 0 repositories listed
-
Tutorial on Course-of-Action (COA) Attack Search Methods in Computer Networks27 May 2022 0 repositories listed
-
A Fair Federated Learning Framework With Reinforcement Learning26 May 2022 0 repositories listed
-
Does DQN Learn?26 May 2022 0 repositories listed
-
Constrained Reinforcement Learning for Short Video Recommendation26 May 2022 0 repositories listed
-
Embed to Control Partially Observed Systems: Representation Learning with Provable Sample Efficiency26 May 2022 0 repositories listed
-
Physics-Guided Hierarchical Reward Mechanism for Learning-Based Robotic Grasping26 May 2022 0 repositories listed
-
RACE: A Reinforcement Learning Framework for Improved Adaptive Control of NoC Channel Buffers26 May 2022 0 repositories listed
-
SFP: State-free Priors for Exploration in Off-Policy Reinforcement Learning26 May 2022 0 repositories listed
-
An Experimental Comparison Between Temporal Difference and Residual Gradient with Neural Network Approximation25 May 2022 0 repositories listed
-
Fast Inference and Transfer of Compositional Task Structures for Few-shot Task Generalization25 May 2022 0 repositories listed
-
MAVIPER: Learning Decision Tree Policies for Interpretable Multi-Agent Reinforcement Learning25 May 2022 0 repositories listed
-
Near-Optimal Goal-Oriented Reinforcement Learning in Non-Stationary Environments25 May 2022 0 repositories listed
-
Robust Reinforcement Learning on Graphs for Logistics optimization25 May 2022 0 repositories listed
-
Transportation-Inequalities, Lyapunov Stability and Sampling for Dynamical Systems on Continuous State Space25 May 2022 0 repositories listed
-
Trust-based Consensus in Multi-Agent Reinforcement Learning Systems25 May 2022 0 repositories listed
-
Distributional Hamilton-Jacobi-Bellman Equations for Continuous-Time Reinforcement Learning24 May 2022 0 repositories listed
-
Graph Convolutional Reinforcement Learning for Collaborative Queuing Agents24 May 2022 0 repositories listed
-
Learning to Drive Using Sparse Imitation Reinforcement Learning24 May 2022 0 repositories listed
-
Penalized Proximal Policy Optimization for Safe Reinforcement Learning24 May 2022 0 repositories listed
-
Computationally Efficient Horizon-Free Reinforcement Learning for Linear Mixture MDPs23 May 2022 0 repositories listed
-
Cooperative Reinforcement Learning on Traffic Signal Control23 May 2022 0 repositories listed
-
Learning to Advise and Learning from Advice in Cooperative Multi-Agent Reinforcement Learning23 May 2022 0 repositories listed
-
Logarithmic regret bounds for continuous-time average-reward Markov decision processes23 May 2022 0 repositories listed
-
Multiple Domain Cyberspace Attack and Defense Game Based on Reward Randomization Reinforcement Learning23 May 2022 0 repositories listed
-
POLTER: Policy Trajectory Ensemble Regularization for Unsupervised Reinforcement Learning23 May 2022 0 repositories listed
-
Spreading Factor assisted LoRa Localization with Deep Reinforcement Learning23 May 2022 0 repositories listed
-
A Dirichlet Process Mixture of Robust Task Models for Scalable Lifelong Reinforcement Learning22 May 2022 0 repositories listed
-
Power and accountability in reinforcement learning applications to environmental policy22 May 2022 0 repositories listed
-
Coordinating Policies Among Multiple Agents via an Intelligent Communication Channel21 May 2022 0 repositories listed
-
De novo design of protein target specific scaffold-based Inhibitors via Reinforcement Learning21 May 2022 0 repositories listed
-
Reinforced Pedestrian Attribute Recognition with Group Optimization Reward21 May 2022 0 repositories listed
-
A Fully Controllable Agent in the Path Planning using Goal-Conditioned Reinforcement Learning20 May 2022 0 repositories listed
-
Adversarial joint attacks on legged robots20 May 2022 0 repositories listed
-
Long Run Incremental Cost (LRIC) Distribution Network Pricing in UK, advising China's Distribution Network20 May 2022 0 repositories listed
-
On Jointly Optimizing Partial Offloading and SFC Mapping: A Cooperative Dual-agent Deep Reinforcement Learning Approach20 May 2022 0 repositories listed
-
Prototyping three key properties of specific curiosity in computational reinforcement learning20 May 2022 0 repositories listed
-
Survey on Fair Reinforcement Learning: Theory and Practice20 May 2022 0 repositories listed
-
AIGenC: An AI generalisation model via creativity19 May 2022 0 repositories listed
-
Data Valuation for Offline Reinforcement Learning19 May 2022 0 repositories listed
-
Distributed Multi-Agent Deep Reinforcement Learning for Robust Coordination against Noise19 May 2022 0 repositories listed
-
IL-flOw: Imitation Learning from Observation using Normalizing Flows19 May 2022 0 repositories listed
-
Parallel bandit architecture based on laser chaos for reinforcement learning19 May 2022 0 repositories listed
-
Routing and Placement of Macros using Deep Reinforcement Learning19 May 2022 0 repositories listed
-
Sparse Adversarial Attack in Multi-agent Reinforcement Learning19 May 2022 0 repositories listed
-
Towards Applicable Reinforcement Learning: Improving the Generalization and Sample Efficiency with Policy Ensemble19 May 2022 0 repositories listed
-
Generating Explanations from Deep Reinforcement Learning Using Episodic Memory18 May 2022 0 repositories listed
-
Market Making via Reinforcement Learning in China Commodity Market18 May 2022 0 repositories listed
-
Slowly Changing Adversarial Bandit Algorithms are Efficient for Discounted MDPs18 May 2022 0 repositories listed
-
World Value Functions: Knowledge Representation for Multitask Reinforcement Learning18 May 2022 0 repositories listed
-
Moral reinforcement learning using actual causation17 May 2022 0 repositories listed
-
Multibit Tries Packet Classification with Deep Reinforcement Learning17 May 2022 0 repositories listed
-
Planning to Practice: Efficient Online Fine-Tuning by Composing Goals in Latent Space17 May 2022 0 repositories listed
-
A Deep Reinforcement Learning Blind AI in DareFightingICE16 May 2022 0 repositories listed
-
Attacking and Defending Deep Reinforcement Learning Policies16 May 2022 0 repositories listed
-
Deep Apprenticeship Learning for Playing Games16 May 2022 0 repositories listed
-
Enforcing KL Regularization in General Tsallis Entropy Reinforcement Learning via Advantage Learning16 May 2022 0 repositories listed
-
KGRGRL: A User's Permission Reasoning Method Based on Knowledge Graph Reward Guidance Reinforcement Learning16 May 2022 0 repositories listed
-
Many Field Packet Classification with Decomposition and Reinforcement Learning16 May 2022 0 repositories listed