Browse State-of-the-Art › Thompson Sampling › Papers, page 6
Thompson Sampling
Papers archive 2025-07-28
archive papers tagged: 655 · with a code link: 135 · where Syntology ran a sample: 30 (23 with a run with no instrument failure, 7 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (30 of 655 tagged: 23 with a run with no instrument failure, 7 where every run was a failure of Syntology's instrument)
Page 6 of 7: papers 501 to 600 of 655, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Thompson Sampling in Non-Episodic Restless Bandits12 Oct 2019 0 repositories listed
-
Regret Analysis of Bandit Problems with Causal Background Knowledge11 Oct 2019 0 repositories listed
-
Robust Dynamic Assortment Optimization in the Presence of Outlier Customers9 Oct 2019 0 repositories listed
-
A Quantile-based Approach for Hyperparameter Transfer Learning30 Sep 2019 0 repositories listed
-
A Copula approach for hyperparameter transfer learning25 Sep 2019 0 repositories listed
-
Efficient Multivariate Bandit Algorithm with Path Planning6 Sep 2019 0 repositories listed
-
An Arm-Wise Randomization Approach to Combinatorial Linear Semi-Bandits5 Sep 2019 0 repositories listed
-
Online Causal Inference for Advertising in Real-Time Bidding Auctions22 Aug 2019 0 repositories listed
-
A Batched Multi-Armed Bandit Approach to News Headline Testing17 Aug 2019 0 repositories listed
-
A Bayesian Choice Model for Eliminating Feedback Loops15 Aug 2019 0 repositories listed
-
Thompson Sampling with Approximate Inference14 Aug 2019 0 repositories listed
-
Convergence Rates of Posterior Distributions in Markov Decision Process22 Jul 2019 0 repositories listed
-
Thompson Sampling on Symmetric α-Stable Bandits8 Jul 2019 0 repositories listed
-
Thompson Sampling for Combinatorial Network Optimization in Unknown Environments7 Jul 2019 0 repositories listed
-
Mixed-Variable Bayesian Optimization2 Jul 2019 0 repositories listed
-
Bandit Learning for Diversified Interactive Recommendation1 Jul 2019 0 repositories listed
-
Revised Progressive-Hedging-Algorithm Based Two-layer Solution Scheme for Bayesian Reinforcement Learning21 Jun 2019 0 repositories listed
-
Sparse Spectrum Gaussian Process for Bayesian Optimization21 Jun 2019 0 repositories listed
-
Thompson Sampling for Adversarial Bit Prediction21 Jun 2019 0 repositories listed
-
Stochastic Neural Network with Kronecker Flow10 Jun 2019 0 repositories listed
-
The Intrinsic Robustness of Stochastic Bandits to Strategic Manipulation4 Jun 2019 0 repositories listed
-
Connections Between Mirror Descent, Thompson Sampling and the Information Ratio28 May 2019 0 repositories listed
-
Feedback graph regret bounds for Thompson Sampling and UCB23 May 2019 0 repositories listed
-
Adaptive Model Selection Framework: An Application to Airline Pricing21 May 2019 0 repositories listed
-
Adaptive Sensor Placement for Continuous Spaces16 May 2019 0 repositories listed
-
On the Performance of Thompson Sampling on Logistic Bandits12 May 2019 0 repositories listed
-
AutoSeM: Automatic Task Selection and Mixing in Multi-Task Learning8 Apr 2019 0 repositories listed
-
Randomised Bayesian Least-Squares Policy Iteration6 Apr 2019 0 repositories listed
-
Sampling Acquisition Functions for Batch Bayesian Optimization22 Mar 2019 0 repositories listed
-
On Multi-Armed Bandit Designs for Dose-Finding Clinical Trials17 Mar 2019 0 repositories listed
-
Constrained Thompson Sampling for Wireless Link Optimization28 Feb 2019 0 repositories listed
-
Meta Dynamic Pricing: Transfer Learning Across Experiments28 Feb 2019 0 repositories listed
-
Fully Distributed Bayesian Optimization with Stochastic Policies26 Feb 2019 0 repositories listed
-
Multi-Armed Bandit Strategies for Non-Stationary Reward Distributions and Delayed Feedback Processes22 Feb 2019 0 repositories listed
-
Scalable Thompson Sampling via Optimal Transport19 Feb 2019 0 repositories listed
-
KLUCB Approach to Copeland Bandits7 Feb 2019 0 repositories listed
-
First-Order Bayesian Regret Analysis of Thompson Sampling2 Feb 2019 0 repositories listed
-
Contextual Multi-armed Bandit Algorithm for Semiparametric Reward Model31 Jan 2019 0 repositories listed
-
Parallel Contextual Bandits in Wireless Handover Optimization21 Jan 2019 0 repositories listed
-
Thompson Sampling for Noncompliant Bandits3 Dec 2018 0 repositories listed
-
Optimal Learning for Dynamic Coding in Deadline-Constrained Multi-Channel Networks27 Nov 2018 0 repositories listed
-
Thompson Sampling for Pursuit-Evasion Problems11 Nov 2018 0 repositories listed
-
A Unified Approach to Translate Classical Bandit Algorithms to the Structured Bandit Setting18 Oct 2018 0 repositories listed
-
Combining Bayesian Optimization and Lipschitz Optimization10 Oct 2018 0 repositories listed
-
Contextual Multi-Armed Bandits for Causal Marketing2 Oct 2018 0 repositories listed
-
Thompson Sampling Algorithms for Cascading Bandits2 Oct 2018 0 repositories listed
-
Efficient Linear Bandits through Matrix Sketching28 Sep 2018 0 repositories listed
-
Incorporating Behavioral Constraints in Online AI Systems15 Sep 2018 0 repositories listed
-
Analysis of Thompson Sampling for Combinatorial Multi-armed Bandit with Probabilistically Triggered Arms7 Sep 2018 0 repositories listed
-
Adaptive Grey-Box Fuzz-Testing with Thompson Sampling24 Aug 2018 0 repositories listed
-
Deep Contextual Multi-armed Bandits25 Jul 2018 0 repositories listed
-
Tsallis-INF: An Optimal Algorithm for Stochastic and Adversarial Bandits19 Jul 2018 0 repositories listed
-
Optimization of a SSP's Header Bidding Strategy using Thompson Sampling9 Jul 2018 0 repositories listed
-
Improved Regret Bounds for Thompson Sampling in Linear Quadratic Control Problems1 Jul 2018 0 repositories listed
-
On The Differential Privacy of Thompson Sampling With Gaussian Prior24 Jun 2018 0 repositories listed
-
Sequential Test for the Lowest Mean: From Thompson to Murphy Sampling4 Jun 2018 0 repositories listed
-
An Information-Theoretic Analysis for Thompson Sampling with Many Actions30 May 2018 0 repositories listed
-
New Insights into Bootstrapping for Bandits24 May 2018 0 repositories listed
-
Analysis of Thompson Sampling for Graphical Bandits Without the Graphs23 May 2018 0 repositories listed
-
PG-TS: Improved Thompson Sampling for Logistic Contextual Bandits18 May 2018 0 repositories listed
-
Profitable Bandits8 May 2018 0 repositories listed
-
Active Reinforcement Learning with Monte-Carlo Tree Search13 Mar 2018 0 repositories listed
-
Thompson Sampling for Combinatorial Semi-Bandits13 Mar 2018 0 repositories listed
-
Satisficing in Time-Sensitive Bandit Learning7 Mar 2018 0 repositories listed
-
Thompson Sampling for Dynamic Pricing8 Feb 2018 0 repositories listed
-
Information Directed Sampling and Bandits with Heteroscedastic Noise29 Jan 2018 0 repositories listed
-
Active Search for High Recall: a Non-Stationary Extension of Thompson Sampling27 Dec 2017 0 repositories listed
-
On Adaptive Estimation for Dynamic Bernoulli Bandits8 Dec 2017 0 repositories listed
-
Optimistic posterior sampling for reinforcement learning: worst-case regret bounds1 Dec 2017 0 repositories listed
-
Efficient exploration with Double Uncertain Value Networks29 Nov 2017 0 repositories listed
-
Customized Nonlinear Bandits for Online Response Selection in Neural Conversation Models22 Nov 2017 0 repositories listed
-
Bayesian Best-Arm Identification for Selecting Influenza Mitigation Strategies16 Nov 2017 0 repositories listed
-
BBQ-Networks: Efficient Exploration in Deep Reinforcement Learning for Task-Oriented Dialogue Systems15 Nov 2017 0 repositories listed
-
Estimating prediction error for complex samples13 Nov 2017 0 repositories listed
-
Efficient-UCBV: An Almost Optimal Algorithm using Variance Estimates9 Nov 2017 0 repositories listed
-
Information Directed Sampling for Stochastic Bandits with Graph Feedback8 Nov 2017 0 repositories listed
-
The Effect of Communication on Noncooperative Multiplayer Multi-Armed Bandit Problems5 Nov 2017 0 repositories listed
-
Generalized Probabilistic Bisection for Stochastic Root-Finding2 Nov 2017 0 repositories listed
-
Minimal Exploration in Structured Stochastic Bandits1 Nov 2017 0 repositories listed
-
Sequential Matrix Completion23 Oct 2017 0 repositories listed
-
A study of Thompson Sampling with Parameter h5 Oct 2017 0 repositories listed
-
Learning Unknown Markov Decision Processes: A Thompson Sampling Approach14 Sep 2017 0 repositories listed
-
Adaptive Exploration-Exploitation Tradeoff for Opportunistic Bandits12 Sep 2017 0 repositories listed
-
Learning to Price with Reference Effects29 Aug 2017 0 repositories listed
-
Racing Thompson: an Efficient Algorithm for Thompson Sampling with Non-conjugate Priors16 Aug 2017 0 repositories listed
-
Thompson Sampling Guided Stochastic Searching on the Line for Deceptive Environments with Applications to Root-Finding Problems5 Aug 2017 0 repositories listed
-
Reinforcement learning techniques for Outer Loop Link Adaptation in 4G/5G systems3 Aug 2017 0 repositories listed
-
Streaming kernel regression with provably adaptive mean, variance, and regularization2 Aug 2017 0 repositories listed
-
Counterfactual Data-Fusion for Online Reinforcement Learners1 Aug 2017 0 repositories listed
-
Taming Non-stationary Bandits: A Bayesian Approach31 Jul 2017 0 repositories listed
-
Combinatorial Multi-armed Bandit with Probabilistically Triggered Arms: A Case with Bounded Regret24 Jul 2017 0 repositories listed
-
Calibrated Fairness in Bandits6 Jul 2017 0 repositories listed
-
A Practical Method for Solving Contextual Bandit Problems Using Decision Trees14 Jun 2017 0 repositories listed
-
Bandit Models of Human Behavior: Reward Processing in Mental Disorders7 Jun 2017 0 repositories listed
-
Parallel and Distributed Thompson Sampling for Large-scale Accelerated Exploration of Chemical Space6 Jun 2017 0 repositories listed
-
Thompson Sampling for the MNL-Bandit3 Jun 2017 0 repositories listed
-
Scalable Generalized Linear Bandits: Online Computation and Hashing1 Jun 2017 0 repositories listed
-
A Multi-Armed Bandit to Smartly Select a Training Set from Big Medical Data23 May 2017 0 repositories listed
-
Ensemble Sampling20 May 2017 0 repositories listed
-
Posterior sampling for reinforcement learning: worst-case regret bounds19 May 2017 0 repositories listed