Browse State-of-the-Art › Off-policy evaluation › Papers, page 2
Off-policy evaluation
Papers archive 2025-07-28
archive papers tagged: 265 · with a code link: 102 · where Syntology ran a sample: 40 (30 with a run with no instrument failure, 10 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (40 of 265 tagged: 30 with a run with no instrument failure, 10 where every run was a failure of Syntology's instrument)
Page 2 of 3: papers 101 to 200 of 265, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
10 Feb 2018 1 repository listed
-
16 May 2016 1 repository listed Syntology official (archive's flag): 2 ran · 2 ran (of which 0 constructed an object rather than computing a result; 2 with no instrument failure: 0 honoured, 0 violated, 2 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified (of 2 harvested samples)
-
Off-Policy Evaluation and Learning for the Future under Non-Stationarity25 Jun 2025 0 repositories listed
-
A Principled Path to Fitted Distributional Evaluation24 Jun 2025 0 repositories listed
-
Semi-gradient DICE for Offline Constrained Reinforcement Learning10 Jun 2025 0 repositories listed
-
STITCH-OPE: Trajectory Stitching with Guided Diffusion for Off-Policy Evaluation27 May 2025 0 repositories listed
-
Characterization of Efficient Influence Function for Off-Policy Evaluation Under Optimal Policies20 May 2025 0 repositories listed
-
Stabilizing Temporal Difference Learning via Implicit Stochastic Recursion2 May 2025 0 repositories listed
-
Off-Policy Evaluation for Sequential Persuasion Process with Unobserved Confounding1 Apr 2025 0 repositories listed
-
Enhancing Offline Model-Based RL via Active Model Selection: A Bayesian Optimization Perspective17 Feb 2025 0 repositories listed
-
Off-Policy Evaluation for Recommendations with Missing-Not-At-Random Rewards13 Feb 2025 0 repositories listed
-
Model Selection for Off-policy Evaluation: New Algorithms and Experimental Protocol11 Feb 2025 0 repositories listed
-
Off-policy Evaluation for Payments at Adyen15 Jan 2025 0 repositories listed
-
Off-Policy Evaluation and Counterfactual Methods in Dynamic Auction Environments9 Jan 2025 0 repositories listed
-
CANDOR: Counterfactual ANnotated DOubly Robust Off-Policy Evaluation11 Dec 2024 0 repositories listed
-
Concept-driven Off Policy Evaluation28 Nov 2024 0 repositories listed
-
Logarithmic Neyman Regret for Adaptive Estimation of the Average Treatment Effect21 Nov 2024 0 repositories listed
-
Off-policy estimation with adaptively collected data: the power of online learning19 Nov 2024 0 repositories listed
-
Primal-Dual Spectral Representation for Off-policy Evaluation23 Oct 2024 0 repositories listed
-
Development and Validation of Heparin Dosing Policies Using an Offline Reinforcement Learning Algorithm24 Sep 2024 0 repositories listed
-
Designing an Interpretable Interface for Contextual Bandits23 Sep 2024 0 repositories listed
-
Limit Order Book Simulation and Trade Evaluation with K-Nearest-Neighbor Resampling10 Sep 2024 0 repositories listed
-
IntOPE: Off-Policy Evaluation in the Presence of Interference24 Aug 2024 0 repositories listed
-
Effective Off-Policy Evaluation and Learning in Contextual Combinatorial Bandits20 Aug 2024 0 repositories listed
-
Empowering Clinicians with Medical Decision Transformers: A Framework for Sepsis Treatment28 Jul 2024 0 repositories listed
-
Balancing Immediate Revenue and Future Off-Policy Evaluation in Coupon Allocation6 Jul 2024 0 repositories listed
-
Automated Off-Policy Estimator Selection via Supervised Learning26 Jun 2024 0 repositories listed
-
Confident Natural Policy Gradient for Local Planning in q_π-realizable Constrained MDPs26 Jun 2024 0 repositories listed
-
Off-Policy Evaluation from Logged Human Feedback14 Jun 2024 0 repositories listed
-
A Fast Convergence Theory for Offline Decision Making3 Jun 2024 0 repositories listed
-
RL in Latent MDPs is Tractable: Online Guarantees via Off-Policy Evaluation3 Jun 2024 0 repositories listed
-
OPERA: Automatic Offline Policy Evaluation with Re-weighted Aggregates of Multiple Estimators27 May 2024 0 repositories listed
-
Data Poisoning Attacks on Off-Policy Policy Evaluation Methods6 Apr 2024 0 repositories listed
-
Methodology for Interpretable Reinforcement Learning for Optimizing Mechanical Ventilation3 Apr 2024 0 repositories listed
-
Doubly-Robust Off-Policy Evaluation with Estimated Logging Policy2 Apr 2024 0 repositories listed
-
Cramming Contextual Bandits for On-policy Statistical Evaluation11 Mar 2024 0 repositories listed
-
Bayesian Off-Policy Evaluation and Learning for Large Action Spaces22 Feb 2024 0 repositories listed
-
On the Curses of Future and History in Future-dependent Value Functions for Off-policy Evaluation22 Feb 2024 0 repositories listed
-
Off-Policy Evaluation in Markov Decision Processes under Weak Distributional Overlap13 Feb 2024 0 repositories listed
-
Probabilistic Offline Policy Ranking with Approximate Bayesian Computation17 Dec 2023 0 repositories listed
-
Unbiased Offline Evaluation for Learning to Rank with Business Rules3 Nov 2023 0 repositories listed
-
Off-Policy Evaluation for Large Action Spaces via Policy Convolution24 Oct 2023 0 repositories listed
-
Sample Complexity of Preference-Based Nonparametric Off-Policy Evaluation with Deep Networks16 Oct 2023 0 repositories listed
-
Robust Multi-Agent Reinforcement Learning by Mutual Information Regularization15 Oct 2023 0 repositories listed
-
Off-Policy Evaluation for Human Feedback11 Oct 2023 0 repositories listed
-
Distributional Shift-Aware Off-Policy Interval Estimation: A Unified Error Quantification Framework23 Sep 2023 0 repositories listed
-
Wasserstein Distributionally Robust Policy Evaluation and Learning for Contextual Bandits15 Sep 2023 0 repositories listed
-
Statistically Efficient Variance Reduction with Double Policy Estimation for Off-Policy Evaluation in Sequence-Modeled Reinforcement Learning28 Aug 2023 0 repositories listed
-
The Optimal Approximation Factors in Misspecified Off-Policy Value Function Estimation25 Jul 2023 0 repositories listed
-
Scalable and Safe Remediation of Defective Actions in Self-Learning Conversational Systems17 May 2023 0 repositories listed
-
Off-Policy Evaluation for Large Action Spaces via Conjunct Effect Modeling14 May 2023 0 repositories listed
-
Conformal Off-Policy Evaluation in Markov Decision Processes5 Apr 2023 0 repositories listed
-
On the Sample Complexity of Vanilla Model-Based Offline Reinforcement Learning with Dependent Samples7 Mar 2023 0 repositories listed
-
HOPE: Human-Centric Off-Policy Evaluation for E-Learning and Healthcare18 Feb 2023 0 repositories listed
-
STEEL: Singularity-aware Reinforcement Learning30 Jan 2023 0 repositories listed
-
Inference on Time Series Nonparametric Conditional Moment Restrictions Using General Sieves31 Dec 2022 0 repositories listed
-
An Instrumental Variable Approach to Confounded Off-Policy Evaluation29 Dec 2022 0 repositories listed
-
Quantile Off-Policy Evaluation via Deep Conditional Generative Learning29 Dec 2022 0 repositories listed
-
Offline Reinforcement Learning for Human-Guided Human-Machine Interaction with Private Information23 Dec 2022 0 repositories listed
-
Safe Evaluation For Offline Learning: Are We Ready To Deploy?16 Dec 2022 0 repositories listed
-
Scaling Marginalized Importance Sampling to High-Dimensional State-Spaces via State Abstraction14 Dec 2022 0 repositories listed
-
A Review of Off-Policy Evaluation in Reinforcement Learning13 Dec 2022 0 repositories listed
-
Counterfactual Learning with General Data-generating Policies4 Dec 2022 0 repositories listed
-
Offline Policy Evaluation and Optimization under Confounding29 Nov 2022 0 repositories listed
-
Bayesian Counterfactual Mean Embeddings and Off-Policy Evaluation2 Nov 2022 0 repositories listed
-
Beyond the Return: Off-policy Function Estimation under User-specified Error-measuring Distributions27 Oct 2022 0 repositories listed
-
Off-policy evaluation for learning-to-rank via interpolating the item-position model and the position-based model15 Oct 2022 0 repositories listed
-
Off-Policy Evaluation for Episodic Partially Observable Markov Decision Processes under Non-Parametric Models21 Sep 2022 0 repositories listed
-
Towards Robust Off-Policy Evaluation via Human Inputs18 Sep 2022 0 repositories listed
-
Towards A Unified Policy Abstraction Theory and Representation Learning Approach in Markov Decision Processes16 Sep 2022 0 repositories listed
-
Statistical Estimation of Confounded Linear MDPs: An Instrumental Variable Approach12 Sep 2022 0 repositories listed
-
Conformal Off-Policy Prediction in Contextual Bandits9 Jun 2022 0 repositories listed
-
Markovian Interference in Experiments6 Jun 2022 0 repositories listed
-
Sample Complexity of Nonparametric Off-Policy Evaluation on Low-Dimensional Manifolds using Deep Networks6 Jun 2022 0 repositories listed
-
Hybrid Value Estimation for Off-policy Evaluation and Offline Reinforcement Learning4 Jun 2022 0 repositories listed
-
Counterfactual Analysis in Dynamic Latent State Models27 May 2022 0 repositories listed
-
Scalable and Robust Self-Learning for Skill Routing in Large-Scale Conversational AI Systems14 Apr 2022 0 repositories listed
-
Off-Policy Evaluation with Online Adaptation for Robot Exploration in Challenging Environments7 Apr 2022 0 repositories listed
-
Marginalized Operators for Off-policy Reinforcement Learning30 Mar 2022 0 repositories listed
-
Bellman Residual Orthogonalization for Offline Reinforcement Learning24 Mar 2022 0 repositories listed
-
Off-Policy Evaluation in Embedded Spaces5 Mar 2022 0 repositories listed
-
Off-Policy Evaluation with Policy-Dependent Optimization Response25 Feb 2022 0 repositories listed
-
Off-Policy Fitted Q-Evaluation with Differentiable Function Approximators: Z-Estimation and Inference Theory10 Feb 2022 0 repositories listed
-
Generalizing Off-Policy Evaluation From a Causal Perspective For Sequential Decision-Making20 Jan 2022 0 repositories listed
-
On Well-posedness and Minimax Optimal Rates of Nonparametric Q-function Estimation in Off-policy Evaluation17 Jan 2022 0 repositories listed
-
Optimal discharge of patients from intensive care via a data-driven policy learning framework17 Dec 2021 0 repositories listed
-
Weighted model estimation for offline model-based reinforcement learning1 Dec 2021 0 repositories listed
-
Loss Functions for Discrete Contextual Pricing with Observational Data18 Nov 2021 0 repositories listed
-
Off-Policy Evaluation in Partially Observed Markov Decision Processes under Sequential Ignorability24 Oct 2021 0 repositories listed
-
Stateful Offline Contextual Policy Evaluation and Learning19 Oct 2021 0 repositories listed
-
Why Should I Trust You, Bellman? Evaluating the Bellman Objective with Off-Policy Data29 Sep 2021 0 repositories listed
-
A Spectral Approach to Off-Policy Evaluation for POMDPs22 Sep 2021 0 repositories listed
-
Accelerating Offline Reinforcement Learning Application in Real-Time Bidding and Recommendation: Potential Use of Simulation17 Sep 2021 0 repositories listed
-
Data-Driven Off-Policy Estimator Selection: An Application in User Marketing on An Online Content Delivery Service17 Sep 2021 0 repositories listed
-
Debiasing Samples from Online Learning Using Bootstrap31 Jul 2021 0 repositories listed
-
Online Learning for Recommendations at Grubhub15 Jul 2021 0 repositories listed
-
A Unified Off-Policy Evaluation Approach for General Value Function6 Jul 2021 0 repositories listed
-
Variance-Aware Off-Policy Evaluation with Linear Function Approximation22 Jun 2021 0 repositories listed
-
Autoregressive Dynamics Models for Offline Policy Evaluation and Optimization28 Apr 2021 0 repositories listed
Syntology lines on 2 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.