Browse State-of-the-Art › Policy Gradient Methods › Papers, page 4
Policy Gradient Methods
Papers archive 2025-07-28
archive papers tagged: 382 · with a code link: 103 · where Syntology ran a sample: 33 (32 with a run with no instrument failure, 1 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (33 of 382 tagged: 32 with a run with no instrument failure, 1 where every run was a failure of Syntology's instrument)
Page 4 of 4: papers 301 to 382 of 382, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Optimal Resource Allocation in Wireless Control Systems via Deep Policy Gradient25 Oct 2019 0 repositories listed
-
All-Action Policy Gradient Methods: A Numerical Integration Approach21 Oct 2019 0 repositories listed
-
Policy Optimization for ℋ₂ Linear Control with ℋ_∞ Robustness Guarantee: Implicit Regularization and Global Convergence21 Oct 2019 0 repositories listed
-
Linear-Quadratic Mean-Field Reinforcement Learning: Convergence of Policy Gradient Methods9 Oct 2019 0 repositories listed
-
AUGMENTED POLICY GRADIENT METHODS FOR EFFICIENT REINFORCEMENT LEARNING25 Sep 2019 0 repositories listed
-
Guided Adaptive Credit Assignment for Sample Efficient Policy Optimization25 Sep 2019 0 repositories listed
-
Policy Tree Network25 Sep 2019 0 repositories listed
-
DeepGait: Planning and Control of Quadrupedal Gaits using Deep Reinforcement Learning18 Sep 2019 0 repositories listed
-
Transfer Reward Learning for Policy Gradient-Based Text Generation9 Sep 2019 0 repositories listed
-
Multi Pseudo Q-learning Based Deterministic Policy Gradient for Tracking Control of Autonomous Underwater Vehicles7 Sep 2019 0 repositories listed
-
Neural Policy Gradient Methods: Global Optimality and Rates of Convergence29 Aug 2019 0 repositories listed
-
Trajectory-wise Control Variates for Variance Reduction in Policy Gradient Methods8 Aug 2019 0 repositories listed
-
On the Theory of Policy Gradient Methods: Optimality, Approximation, and Distribution Shift1 Aug 2019 0 repositories listed
-
Variance Reduction in Actor Critic Methods (ACM)23 Jul 2019 0 repositories listed
-
Policy Optimization with Stochastic Mirror Descent25 Jun 2019 0 repositories listed
-
Entropic Risk Measure in Policy Search21 Jun 2019 0 repositories listed
-
Global Convergence of Policy Gradient Methods to (Almost) Locally Optimal Policies19 Jun 2019 0 repositories listed
-
Is the Policy Gradient a Gradient?17 Jun 2019 0 repositories listed
-
A Hybrid Approach Between Adversarial Generative Networks and Actor-Critic Policy Gradient for Low Rate High-Resolution Image Compression11 Jun 2019 0 repositories listed
-
Global Optimality Guarantees For Policy Gradient Methods5 Jun 2019 0 repositories listed
-
Diversity-Inducing Policy Gradient: Using Maximum Mean Discrepancy to Find a Set of Diverse Policies31 May 2019 0 repositories listed
-
Policy Search by Target Distribution Learning for Continuous Control27 May 2019 0 repositories listed
-
Learning Novel Policies For Tasks13 May 2019 0 repositories listed
-
Object Exchangeability in Reinforcement Learning: Extended Abstract7 May 2019 0 repositories listed
-
Similarities between policy gradient methods (PGM) in Reinforcement learning (RL) and supervised learning (SL)12 Apr 2019 0 repositories listed
-
Only Relevant Information Matters: Filtering Out Noisy Samples to Boost RL8 Apr 2019 0 repositories listed
-
StartNet: Online Detection of Action Start in Untrimmed Videos23 Mar 2019 0 repositories listed
-
Diverse Exploration via Conjugate Policies for Policy Gradient Methods10 Feb 2019 0 repositories listed
-
Communication-Efficient Policy Gradient Methods for Distributed Reinforcement Learning7 Dec 2018 0 repositories listed
-
AdaFrame: Adaptive Frame Selection for Fast Video Recognition29 Nov 2018 0 repositories listed
-
An Off-policy Policy Gradient Theorem Using Emphatic Weightings22 Nov 2018 0 repositories listed
-
Reward-estimation variance elimination in sequential decision processes15 Nov 2018 0 repositories listed
-
Risk-Sensitive Reinforcement Learning via Policy Gradient Search22 Oct 2018 0 repositories listed
-
Policy Gradient in Partially Observable Environments: Approximation and Convergence18 Oct 2018 0 repositories listed
-
CaLcs: Continuously Approximating Longest Common Subsequence for Sequence Level Optimization1 Oct 2018 0 repositories listed
-
Assumption Questioning: Latent Copying and Reward Exploitation in Question Generation27 Sep 2018 0 repositories listed
-
Countering Language Drift via Grounding27 Sep 2018 0 repositories listed
-
The wisdom of the crowd: reliable deep reinforcement learning through ensembles of Q-functions27 Sep 2018 0 repositories listed
-
Improvements on Hindsight Learning16 Sep 2018 0 repositories listed
-
Image Captioning based on Deep Reinforcement Learning13 Sep 2018 0 repositories listed
-
Learning to Interrupt: A Hierarchical Deep Reinforcement Learning Framework for Efficient Exploration30 Jul 2018 0 repositories listed
-
Variance Reduction for Reinforcement Learning in Input-Driven Environments6 Jul 2018 0 repositories listed
-
Policy Optimization with Demonstrations1 Jul 2018 0 repositories listed
-
12 Jun 2018 0 repositories listed
-
Fingerprint Policy Optimisation for Robust Reinforcement Learning27 May 2018 0 repositories listed
-
Learning Self-Imitating Diverse Policies25 May 2018 0 repositories listed
-
Multiagent Soft Q-Learning25 Apr 2018 0 repositories listed
-
Information Maximizing Exploration with a Latent Dynamics Model4 Apr 2018 0 repositories listed
-
Variance Reduction for Policy Gradient with Action-Dependent Factorized Baselines20 Mar 2018 0 repositories listed
-
Optimizing over a Restricted Policy Class in Markov Decision Processes26 Feb 2018 0 repositories listed
-
Asynchronous stochastic approximations with asymptotically biased errors and deep multi-agent learning22 Feb 2018 0 repositories listed
-
Policy Gradients for Contextual Recommendations12 Feb 2018 0 repositories listed
-
Global Convergence of Policy Gradient Methods for the Linear Quadratic Regulator15 Jan 2018 0 repositories listed
-
Expected Policy Gradients for Reinforcement Learning10 Jan 2018 0 repositories listed
-
Action-dependent Control Variates for Policy Optimization via Stein Identity1 Jan 2018 0 repositories listed
-
Adversarial Policy Gradient for Alternating Markov Games1 Jan 2018 0 repositories listed
-
Global Convergence of Policy Gradient Methods for Linearized Control Problems1 Jan 2018 0 repositories listed
-
Predicting Multiple Actions for Stochastic Continuous Control1 Jan 2018 0 repositories listed
-
Understanding Grounded Language Learning Agents1 Jan 2018 0 repositories listed
-
Adaptive Batch Size for Safe Policy Gradients1 Dec 2017 0 repositories listed
-
Policy Optimization by Genetic Distillation3 Nov 2017 0 repositories listed
-
Understanding Early Word Learning in Situated Artificial Agents26 Oct 2017 0 repositories listed
-
Accelerated Reinforcement Learning23 Oct 2017 0 repositories listed
-
Stochastic Variance Reduction for Policy Gradient Estimation17 Oct 2017 0 repositories listed
-
Manifold Regularization for Kernelized LSTD15 Oct 2017 0 repositories listed
-
Policy Gradient Methods for Reinforcement Learning with Function Approximation and Action-Dependent Baselines20 Jun 2017 0 repositories listed
-
A unified view of entropy-regularized Markov decision processes22 May 2017 0 repositories listed
-
Equivalence Between Policy Gradients and Soft Q-Learning21 Apr 2017 0 repositories listed
-
Stein Variational Policy Gradient7 Apr 2017 0 repositories listed
-
Batch Policy Gradient Methods for Improving Neural Conversation Models10 Feb 2017 0 repositories listed
-
A K-fold Method for Baseline Estimation in Policy Gradient Algorithms3 Jan 2017 0 repositories listed
-
Sample-efficient Deep Reinforcement Learning for Dialog Control18 Dec 2016 0 repositories listed
-
Policy Gradient Methods for Off-policy Control13 Dec 2015 0 repositories listed
-
Policy Gradient for Coherent Risk Measures13 Feb 2015 0 repositories listed
-
Efficient Baseline-free Sampling in Parameter Exploring Policy Gradients: Super Symmetric PGPE13 Dec 2013 0 repositories listed
-
Adaptive Step-Size for Policy Gradient Methods1 Dec 2013 0 repositories listed
-
Optimistic policy iteration and natural actor-critic: A unifying view and a non-optimality result1 Dec 2013 0 repositories listed
-
A reinterpretation of the policy oscillation phenomenon in approximate policy iteration1 Dec 2011 0 repositories listed
-
Analysis and Improvement of Policy Gradient Estimation1 Dec 2011 0 repositories listed
-
Natural Policy Gradient Methods with Parameter-based Exploration for Control Tasks1 Dec 2010 0 repositories listed
-
On a Connection between Importance Sampling and the Likelihood Ratio Policy Gradient1 Dec 2010 0 repositories listed
-
Policy Search for Motor Primitives in Robotics1 Dec 2008 0 repositories listed