Browse State-of-the-Art › OpenAI Gym › Papers, page 3
OpenAI Gym
Papers archive 2025-07-28
archive papers tagged: 382 · with a code link: 179 · where Syntology ran a sample: 43 (37 with a run with no instrument failure, 6 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (43 of 382 tagged: 37 with a run with no instrument failure, 6 where every run was a failure of Syntology's instrument)
Page 3 of 4: papers 201 to 300 of 382, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Airlift Challenge: A Competition for Optimizing Cargo Delivery26 Apr 2024 0 repositories listed
-
Enhancing Privacy and Security of Autonomous UAV Navigation26 Apr 2024 0 repositories listed
-
HomeLabGym: A real-world testbed for home energy management systems22 Apr 2024 0 repositories listed
-
Noisy Spiking Actor Network for Exploration7 Mar 2024 0 repositories listed
-
QF-tuner: Breaking Tradition in Reinforcement Learning26 Feb 2024 0 repositories listed
-
Easy as ABCs: Unifying Boltzmann Q-Learning and Counterfactual Regret Minimization19 Feb 2024 0 repositories listed
-
Scilab-RL: A software framework for efficient reinforcement learning and cognitive modeling research25 Jan 2024 0 repositories listed
-
MultiSlot ReRanker: A Generic Model-based Re-Ranking Framework in Recommendation Systems11 Jan 2024 0 repositories listed
-
A Closed-Loop Multi-perspective Visual Servoing Approach with Reinforcement Learning25 Dec 2023 0 repositories listed
-
Resilient Control of Networked Microgrids using Vertical Federated Reinforcement Learning: Designs and Real-Time Test-Bed Validations21 Nov 2023 0 repositories listed
-
Neural architecture impact on identifying temporally extended Reinforcement Learning tasks4 Oct 2023 0 repositories listed
-
Optimizing with Low Budgets: a Comparison on the Black-box Optimization Benchmarking Suite and OpenAI Gym29 Sep 2023 0 repositories listed
-
Implicit Sensing in Traffic Optimization: Advanced Deep Reinforcement Learning Techniques25 Sep 2023 0 repositories listed
-
gym-saturation: Gymnasium environments for saturation provers (System description)16 Sep 2023 0 repositories listed
-
Attention Loss Adjusted Prioritized Experience Replay13 Sep 2023 0 repositories listed
-
Distributionally Robust Statistical Verification with Imprecise Neural Networks28 Aug 2023 0 repositories listed
-
Statistically Efficient Variance Reduction with Double Policy Estimation for Off-Policy Evaluation in Sequence-Modeled Reinforcement Learning28 Aug 2023 0 repositories listed
-
On Combining Expert Demonstrations in Imitation Learning via Optimal Transport20 Jul 2023 0 repositories listed
-
Scaling Distributed Multi-task Reinforcement Learning with Experience Sharing11 Jul 2023 0 repositories listed
-
Learning Environment Models with Continuous Stochastic Dynamics29 Jun 2023 0 repositories listed
-
Correcting discount-factor mismatch in on-policy policy gradient methods23 Jun 2023 0 repositories listed
-
Deep Reinforcement Learning for ESG financial portfolio management19 Jun 2023 0 repositories listed
-
Active Inference in Hebbian Learning Networks8 Jun 2023 0 repositories listed
-
Discovering Individual Rewards in Collective Behavior through Inverse Multi-Agent Reinforcement Learning17 May 2023 0 repositories listed
-
Rethinking Population-assisted Off-policy Reinforcement Learning4 May 2023 0 repositories listed
-
Gym-preCICE: Reinforcement Learning Environments for Active Flow Control3 May 2023 0 repositories listed
-
Exact and Cost-Effective Automated Transformation of Neural Network Controllers to Decision Tree Controllers11 Apr 2023 0 repositories listed
-
Causal Repair of Learning-enabled Cyber-physical Systems6 Apr 2023 0 repositories listed
-
A Strategy-Oriented Bayesian Soft Actor-Critic Model7 Mar 2023 0 repositories listed
-
Graph Decision Transformer7 Mar 2023 0 repositories listed
-
Local Environment Poisoning Attacks on Federated Reinforcement Learning5 Mar 2023 0 repositories listed
-
Double A3C: Deep Reinforcement Learning on OpenAI Gym Games4 Mar 2023 0 repositories listed
-
2 Feb 2023 0 repositories listed Syntology 5 ran (of which 0 constructed an object rather than computing a result; 4 with no instrument failure: 0 honoured, 0 violated, 4 with no contract checked; 1 where Syntology's instrument failed) · 7 unverified (of 12 harvested samples) · 4 pointer-only (licence)
-
Neural Episodic Control with State Abstraction27 Jan 2023 0 repositories listed
-
Asynchronous Deep Double Duelling Q-Learning for Trading-Signal Execution in Limit Order Book Markets20 Jan 2023 0 repositories listed
-
Off-Policy Reinforcement Learning with Loss Function Weighted by Temporal Difference Error26 Dec 2022 0 repositories listed
-
Enhancing Cyber Resilience of Networked Microgrids using Vertical Federated Reinforcement Learning17 Dec 2022 0 repositories listed
-
CT-DQN: Control-Tutored Deep Reinforcement Learning2 Dec 2022 0 repositories listed
-
Sufficient Exploration for Convex Q-learning17 Oct 2022 0 repositories listed
-
Long N-step Surrogate Stage Reward to Reduce Variances of Deep Reinforcement Learning in Complex Problems10 Oct 2022 0 repositories listed
-
Elastic Step DQN: A novel multi-step algorithm to alleviate overestimation in Deep QNetworks7 Oct 2022 0 repositories listed
-
Reinforcement Learning Approach for Multi-Agent Flexible Scheduling Problems7 Oct 2022 0 repositories listed
-
A Deep Reinforcement Learning Strategy for UAV Autonomous Landing on a Platform7 Sep 2022 0 repositories listed
-
Distilling Deep RL Models Into Interpretable Neuro-Fuzzy Systems7 Sep 2022 0 repositories listed
-
Cluster-based Sampling in Hindsight Experience Replay for Robotic Tasks (Student Abstract)31 Aug 2022 0 repositories listed
-
MARTI-4: new model of human brain, considering neocortex and basal ganglia -- learns to play Atari game by reinforcement learning on a single CPU18 Aug 2022 0 repositories listed
-
Quality Diversity Evolutionary Learning of Decision Trees17 Aug 2022 0 repositories listed
-
Implicit Two-Tower Policies2 Aug 2022 0 repositories listed
-
RangL: A Reinforcement Learning Competition Platform28 Jul 2022 0 repositories listed
-
Modelling non-reinforced preferences using selective attention25 Jul 2022 0 repositories listed
-
Dealing with Sparse Rewards in Continuous Control Robotics via Heavy-Tailed Policies12 Jun 2022 0 repositories listed
-
Adversarial Body Shape Search for Legged Robots20 May 2022 0 repositories listed
-
Adversarial joint attacks on legged robots20 May 2022 0 repositories listed
-
MR-iNet Gym: Framework for Edge Deployment of Deep Reinforcement Learning on Embedded Software Defined Radio9 Apr 2022 0 repositories listed
-
Remember and Forget Experience Replay for Multi-Agent Reinforcement Learning24 Mar 2022 0 repositories listed
-
Multitask Neuroevolution for Reinforcement Learning with Long and Short Episodes21 Mar 2022 0 repositories listed
-
Gym-saturation: an OpenAI Gym environment for saturation provers9 Mar 2022 0 repositories listed
-
Provably Efficient Convergence of Primal-Dual Actor-Critic with Nonlinear Function Approximation28 Feb 2022 0 repositories listed
-
Soft Actor-Critic with Inhibitory Networks for Faster Retraining7 Feb 2022 0 repositories listed
-
Differentially Private Temporal Difference Learning with Stochastic Nonconvex-Strongly-Concave Optimization25 Jan 2022 0 repositories listed
-
Direct Mutation and Crossover in Genetic Algorithms Applied to Reinforcement Learning Tasks13 Jan 2022 0 repositories listed
-
A Surrogate-Assisted Controller for Expensive Evolutionary Reinforcement Learning1 Jan 2022 0 repositories listed
-
Multi-Agent Reinforcement Learning via Adaptive Kalman Temporal Difference and Successor Representation30 Dec 2021 0 repositories listed
-
Teaching a Robot to Walk Using Reinforcement Learning13 Dec 2021 0 repositories listed
-
Control-Tutored Reinforcement Learning: Towards the Integration of Data-Driven and Model-Based Control11 Dec 2021 0 repositories listed
-
VisualEnv: visual Gym environments with Blender15 Nov 2021 0 repositories listed
-
AWD3: Dynamic Reduction of the Estimation Bias12 Nov 2021 0 repositories listed
-
DriverGym: Democratising Reinforcement Learning for Autonomous Driving12 Nov 2021 0 repositories listed
-
Proximal Policy Optimization with Continuous Bounded Action Space via the Beta Distribution3 Nov 2021 0 repositories listed
-
Machine Learning aided Crop Yield Optimization1 Nov 2021 0 repositories listed
-
DESTA: A Framework for Safe Reinforcement Learning with Markov Games of Intervention27 Oct 2021 0 repositories listed
-
REIN-2: Giving Birth to Prepared Reinforcement Learning Agents Using Reinforcement Learning Agents11 Oct 2021 0 repositories listed
-
Compositional Q-learning for electrolyte repletion with imbalanced patient sub-populations6 Oct 2021 0 repositories listed
-
Imaginary Hindsight Experience Replay: Curious Model-based Learning for Sparse Reward Tasks5 Oct 2021 0 repositories listed
-
Benchmarking Algorithms from Machine Learning for Low-Budget Black-Box Optimization29 Sep 2021 0 repositories listed
-
CrowdPlay: Crowdsourcing human demonstration data for offline learning in Atari games29 Sep 2021 0 repositories listed
-
Experience Replay More When It's a Key Transition in Deep Reinforcement Learning29 Sep 2021 0 repositories listed
-
Hypothesis Driven Coordinate Ascent for Reinforcement Learning29 Sep 2021 0 repositories listed
-
Nested Policy Reinforcement Learning for Clinical Decision Support29 Sep 2021 0 repositories listed
-
Untangling Braids with Multi-agent Q-Learning29 Sep 2021 0 repositories listed
-
Membership Inference Attacks Against Temporally Correlated Data in Deep Reinforcement Learning8 Sep 2021 0 repositories listed
-
An Oracle and Observations for the OpenAI Gym / ALE Freeway Environment2 Sep 2021 0 repositories listed
-
Photonic Quantum Policy Learning in OpenAI Gym29 Aug 2021 0 repositories listed
-
Influence-Based Reinforcement Learning for Intrinsically-Motivated Agents28 Aug 2021 0 repositories listed
-
An Independent Study of Reinforcement Learning and Autonomous Driving20 Aug 2021 0 repositories listed
-
An Analysis of Reinforcement Learning for Malaria Control19 Jul 2021 0 repositories listed
-
Population-coding and Dynamic-neurons improved Spiking Actor Network for Reinforcement Learning15 Jun 2021 0 repositories listed
-
Offline Inverse Reinforcement Learning9 Jun 2021 0 repositories listed
-
Exploration and preference satisfaction trade-off in reward-free learning8 Jun 2021 0 repositories listed
-
AppBuddy: Learning to Accomplish Tasks in Mobile Apps via Reinforcement Learning31 May 2021 0 repositories listed
-
A Generalised Inverse Reinforcement Learning Framework25 May 2021 0 repositories listed
-
Affine Transport for Sim-to-Real Domain Adaptation25 May 2021 0 repositories listed
-
Controlling an Inverted Pendulum with Policy Gradient Methods-A Tutorial17 May 2021 0 repositories listed
-
RAIL: A modular framework for Reinforcement-learning-based Adversarial Imitation Learning8 May 2021 0 repositories listed
-
Utilizing Skipped Frames in Action Repeats via Pseudo-Actions7 May 2021 0 repositories listed
-
Implementing Reinforcement Learning Algorithms in Retail Supply Chains with OpenAI Gym Toolkit27 Apr 2021 0 repositories listed
-
Reinforcement Learning using Guided Observability22 Apr 2021 0 repositories listed
-
Optimism is All You Need: Model-Based Imitation Learning From Observation Alone9 Mar 2021 0 repositories listed
-
Transferring Domain Knowledge with an Adviser in Continuous Tasks16 Feb 2021 0 repositories listed
-
Learning from Demonstrations using Signal Temporal Logic15 Feb 2021 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.