Browse State-of-the-Art › OpenAI Gym › Papers, page 4
OpenAI Gym
Papers archive 2025-07-28
archive papers tagged: 382 · with a code link: 179 · where Syntology ran a sample: 43 (37 with a run with no instrument failure, 6 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (43 of 382 tagged: 37 with a run with no instrument failure, 6 where every run was a failure of Syntology's instrument)
Page 4 of 4: papers 301 to 382 of 382, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Improving Reinforcement Learning with Human Assistance: An Argument for Human Subject Studies with HIPPO Gym2 Feb 2021 0 repositories listed
-
Deep Q Learning from Dynamic Demonstration with Behavioral Cloning1 Jan 2021 0 repositories listed
-
Error Controlled Actor-Critic Method to Reinforcement Learning1 Jan 2021 0 repositories listed
-
Towards Understanding Asynchronous Advantage Actor-critic: Convergence and Linear Speedup31 Dec 2020 0 repositories listed
-
myGym: Modular Toolkit for Visuomotor Robotic Tasks21 Dec 2020 0 repositories listed
-
Evading Web Application Firewalls with Reinforcement Learning14 Dec 2020 0 repositories listed
-
LagNetViP: A Lagrangian Neural Network for Video Prediction24 Oct 2020 0 repositories listed
-
Proximal Policy Gradient: PPO with Policy Gradient20 Oct 2020 0 repositories listed
-
Deep Learning of Koopman Representation for Control15 Oct 2020 0 repositories listed
-
A Learning Approach to Robot-Agnostic Force-Guided High Precision Assembly15 Oct 2020 0 repositories listed
-
MADRaS : Multi Agent Driving Simulator2 Oct 2020 0 repositories listed
-
Deep Reinforcement Learning with Mixed Convolutional Network1 Oct 2020 0 repositories listed
-
MDP Playground: Controlling Orthogonal Dimensions of Hardness in Toy Environments28 Sep 2020 0 repositories listed
-
Evolutionary Selective Imitation: Interpretable Agents by Imitation Learning Without a Demonstrator17 Sep 2020 0 repositories listed
-
Extended Radial Basis Function Controller for Reinforcement Learning12 Sep 2020 0 repositories listed
-
Deep Q-Network Based Multi-agent Reinforcement Learning with Binary Action Agents6 Aug 2020 0 repositories listed
-
EasyRL: A Simple and Extensible Reinforcement Learning Framework4 Aug 2020 0 repositories listed
-
EVO-RL: Evolutionary-Driven Reinforcement Learning9 Jul 2020 0 repositories listed
-
Concept and the implementation of a tool to convert industry 4.0 environments modeled as FSM to an OpenAI Gym wrapper29 Jun 2020 0 repositories listed
-
Robust Reinforcement Learning using Least Squares Policy Iteration with Provable Performance Guarantees20 Jun 2020 0 repositories listed
-
WD3: Taming the Estimation Bias in Deep Reinforcement Learning18 Jun 2020 0 repositories listed
-
Data Driven Control with Learned Dynamics: Model-Based versus Model-Free Approach16 Jun 2020 0 repositories listed
-
Balancing a CartPole System with Reinforcement Learning -- A Tutorial8 Jun 2020 0 repositories listed
-
Refined Continuous Control of DDPG Actors via Parametrised Activation4 Jun 2020 0 repositories listed
-
An FPGA-Based On-Device Reinforcement Learning Approach using Online Sequential Learning10 May 2020 0 repositories listed
-
Policy Gradient using Weak Derivatives for Reinforcement Learning9 Apr 2020 0 repositories listed
-
Model-based actor-critic: GAN (model generator) + DRL (actor-critic) => AGI4 Apr 2020 0 repositories listed
-
Human AI interaction loop training: New approach for interactive reinforcement learning9 Mar 2020 0 repositories listed
-
Contextual Policy Transfer in Reinforcement Learning Domains via Deep Mixtures-of-Experts29 Feb 2020 0 repositories listed
-
Behavior Cloning in OpenAI using Case Based Reasoning23 Feb 2020 0 repositories listed
-
Adaptive Temporal Difference Learning with Linear Function Approximation20 Feb 2020 0 repositories listed
-
Adaptive Experience Selection for Policy Gradient17 Feb 2020 0 repositories listed
-
Sample-based Distributional Policy Gradient8 Jan 2020 0 repositories listed
-
Adaptive Droplet Routing in Digital Microfluidic Biochips Using Deep Reinforcement Learning1 Jan 2020 0 repositories listed
-
Way Off-Policy Batch Deep Reinforcement Learning of Human Preferences in Dialog1 Jan 2020 0 repositories listed
-
Taming an autonomous surface vehicle for path following and collision avoidance using deep reinforcement learning18 Dec 2019 0 repositories listed
-
Sepsis World Model: A MIMIC-based OpenAI Gym "World Model" Simulator for Sepsis Treatment15 Dec 2019 0 repositories listed
-
Accelerating Reinforcement Learning with Suboptimal Guidance21 Nov 2019 0 repositories listed
-
Challenging On Car Racing Problem from OpenAI gym2 Nov 2019 0 repositories listed
-
Zap Q-Learning With Nonlinear Function Approximation11 Oct 2019 0 repositories listed
-
SURREAL-System: Fully-Integrated Stack for Distributed Deep Reinforcement Learning27 Sep 2019 0 repositories listed
-
Advantage Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning25 Sep 2019 0 repositories listed
-
MoET: Interpretable and Verifiable Reinforcement Learning via Mixture of Expert Trees25 Sep 2019 0 repositories listed
-
Recommendation System-based Upper Confidence Bound for Online Advertising9 Sep 2019 0 repositories listed
-
A Dual Memory Structure for Efficient Use of Replay Memory in Deep Reinforcement Learning15 Jul 2019 0 repositories listed
-
Reward Prediction Error as an Exploration Objective in Deep RL19 Jun 2019 0 repositories listed
-
Decision-Making in Reinforcement Learning1 Jun 2019 0 repositories listed
-
Deep Q-Learning with Q-Matrix Transfer Learning for Novel Fire Evacuation Environment23 May 2019 0 repositories listed
-
In Support of Over-Parametrization in Deep Reinforcement Learning: an Empirical Study17 May 2019 0 repositories listed
-
Reinforcement Learning for Robotics and Control with Active Uncertainty Reduction15 May 2019 0 repositories listed
-
Design of Artificial Intelligence Agents for Games using Deep Reinforcement Learning10 May 2019 0 repositories listed
-
Adversarial Exploration Strategy for Self-Supervised Imitation Learning1 May 2019 0 repositories listed
-
SIMILE: Introducing Sequential Information towards More Effective Imitation Learning1 May 2019 0 repositories listed
-
Evolving Neural Networks in Reinforcement Learning by means of UMDAc24 Apr 2019 0 repositories listed
-
Towards Combining On-Off-Policy Methods for Real-World Applications24 Apr 2019 0 repositories listed
-
Towards Brain-inspired System: Deep Recurrent Reinforcement Learning for Simulated Self-driving Agent29 Mar 2019 0 repositories listed
-
DQN with model-based exploration: efficient learning on environments with sparse rewards22 Mar 2019 0 repositories listed
-
Towards Characterizing Divergence in Deep Q-Learning21 Mar 2019 0 repositories listed
-
Learning Gaussian Policies from Corrective Human Feedback12 Mar 2019 0 repositories listed
-
Curiosity-Driven Experience Prioritization via Density Estimation20 Feb 2019 0 repositories listed
-
Learn a Prior for RHEA for Better Online Planning14 Feb 2019 0 repositories listed
-
Towards Physically Safe Reinforcement Learning under Supervision19 Jan 2019 0 repositories listed
-
BlockPuzzle - A Challenge in Physical Reasoning and Generalization for Robot Learning30 Nov 2018 0 repositories listed
-
Relative Importance Sampling for off-Policy Actor-Critic in Deep Reinforcement Learning30 Oct 2018 0 repositories listed
-
Sequential Learning of Movement Prediction in Dynamic Environments using LSTM Autoencoder12 Oct 2018 0 repositories listed
-
Hybrid Policies Using Inverse Rewards for Reinforcement Learning27 Sep 2018 0 repositories listed
-
Switching Isotropic and Directional Exploration with Parameter Space Noise in Deep Reinforcement Learning18 Sep 2018 0 repositories listed
-
GeneSys: Enabling Continuous Learning through Neural Network Evolution in Hardware3 Aug 2018 0 repositories listed
-
FuzzerGym: A Competitive Framework for Fuzzing and Learning19 Jul 2018 0 repositories listed
-
Online Robust Policy Learning in the Presence of Unknown Adversaries16 Jul 2018 0 repositories listed
-
Qualitative Measurements of Policy Discrepancy for Return-Based Deep Q-Network14 Jun 2018 0 repositories listed
-
Continuous-time Value Function Approximation in Reproducing Kernel Hilbert Spaces8 Jun 2018 0 repositories listed
-
State Distribution-aware Sampling for Deep Q-learning23 Apr 2018 0 repositories listed
-
Structured Evolution with Compact Architectures for Scalable Policy Optimization6 Apr 2018 0 repositories listed
-
Combining Model-based and Model-free RL via Multi-step Control Variates1 Jan 2018 0 repositories listed
-
Exploring Deep Recurrent Models with Reinforcement Learning for Molecule Design1 Jan 2018 0 repositories listed
-
Neuron as an Agent1 Jan 2018 0 repositories listed
-
29 Nov 2017 0 repositories listed
-
Closing the loop between neural network simulators and the OpenAI Gym17 Sep 2017 0 repositories listed
-
Investigating Reinforcement Learning Agents for Continuous State Space Environments8 Aug 2017 0 repositories listed
-
Interpolated Policy Gradient: Merging On-Policy and Off-Policy Gradient Estimation for Deep Reinforcement Learning1 Jun 2017 0 repositories listed
-
Non-Markovian Control with Gated End-to-End Memory Policy Networks31 May 2017 0 repositories listed