Browse State-of-the-Art › Thompson Sampling › Papers, page 4
Thompson Sampling
Papers archive 2025-07-28
archive papers tagged: 655 · with a code link: 135 · where Syntology ran a sample: 30 (23 with a run with no instrument failure, 7 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (30 of 655 tagged: 23 with a run with no instrument failure, 7 where every run was a failure of Syntology's instrument)
Page 4 of 7: papers 301 to 400 of 655, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
A Combinatorial Semi-Bandit Approach to Charging Station Selection for Electric Vehicles17 Jan 2023 0 repositories listed
-
Thompson Sampling with Diffusion Generative Prior12 Jan 2023 0 repositories listed
-
Reinforcement Learning in Credit Scoring and Underwriting15 Dec 2022 0 repositories listed
-
Online Learning-based Waveform Selection for Improved Vehicle Recognition in Automotive Radar1 Dec 2022 0 repositories listed
-
Monte Carlo Tree Search Algorithms for Risk-Aware and Multi-Objective Reinforcement Learning23 Nov 2022 0 repositories listed
-
Meta Learning of Interface Conditions for Multi-Domain Physics-Informed Neural Networks23 Oct 2022 0 repositories listed
-
Deep Active Ensemble Sampling For Image Classification11 Oct 2022 0 repositories listed
-
The Typical Behavior of Bandit Algorithms11 Oct 2022 0 repositories listed
-
Cost Aware Asynchronous Multi-Agent Active Search5 Oct 2022 0 repositories listed
-
Thompson Sampling with Virtual Helping Agents16 Sep 2022 0 repositories listed
-
Double Doubly Robust Thompson Sampling for Generalized Linear Contextual Bandits15 Sep 2022 0 repositories listed
-
A Nonparametric Contextual Bandit with Arm-level Eligibility Control for Customer Service Routing8 Sep 2022 0 repositories listed
-
Sample Efficient Learning of Factored Embeddings of Tensor Fields1 Sep 2022 0 repositories listed
-
Dynamic collaborative filtering Thompson Sampling for cross-domain advertisements recommendation25 Aug 2022 0 repositories listed
-
A Provably Efficient Model-Free Posterior Sampling Method for Episodic Reinforcement Learning23 Aug 2022 0 repositories listed
-
Non-Stationary Dynamic Pricing Via Actor-Critic Information-Directed Pricing19 Aug 2022 0 repositories listed
-
Increasing Students' Engagement to Reminder Emails Through Multi-Armed Bandits10 Aug 2022 0 repositories listed
-
Using Adaptive Experiments to Rapidly Help Students10 Aug 2022 0 repositories listed
-
Bayesian Optimization-Based Beam Alignment for MmWave MIMO Communication Systems28 Jul 2022 0 repositories listed
-
SPRT-based Efficient Best Arm Identification in Stochastic Bandits22 Jul 2022 0 repositories listed
-
Chimera: A Hybrid Machine Learning Driven Multi-Objective Design Space Exploration Tool for FPGA High-Level Synthesis3 Jul 2022 0 repositories listed
-
Risk-averse Contextual Multi-armed Bandit Problem with Linear Payoffs24 Jun 2022 0 repositories listed
-
Analysis of Thompson Sampling for Controlling Unknown Linear Diffusion Processes20 Jun 2022 0 repositories listed
-
Thompson Sampling for (Combinatorial) Pure Exploration18 Jun 2022 0 repositories listed
-
Thompson Sampling Achieves Õ(√(T)) Regret in Linear Quadratic Control17 Jun 2022 0 repositories listed
-
A Contextual Combinatorial Semi-Bandit Approach to Network Bottleneck Identification16 Jun 2022 0 repositories listed
-
Top Two Algorithms Revisited13 Jun 2022 0 repositories listed
-
Regret Bounds for Information-Directed Reinforcement Learning9 Jun 2022 0 repositories listed
-
A Simple and Optimal Policy Design with Safety against Heavy-Tailed Risk for Stochastic Bandits7 Jun 2022 0 repositories listed
-
Finite-Time Regret of Thompson Sampling Algorithms for Exponential Family Multi-Armed Bandits7 Jun 2022 0 repositories listed
-
Bandit Theory and Thompson Sampling-Guided Directed Evolution for Sequence Optimization5 Jun 2022 0 repositories listed
-
Incentivizing Combinatorial Bandit Exploration1 Jun 2022 0 repositories listed
-
Lifting the Information Ratio: An Information-Theoretic Analysis of Thompson Sampling for Contextual Bandits27 May 2022 0 repositories listed
-
Surrogate modeling for Bayesian optimization beyond a single Gaussian process27 May 2022 0 repositories listed
-
Fast Change Identification in Multi-Play Bandits and its Applications in Wireless Networks20 May 2022 0 repositories listed
-
Semi-Parametric Contextual Bandits with Graph-Laplacian Regularization17 May 2022 0 repositories listed
-
Adjusted Expected Improvement for Cumulative Regret Minimization in Noisy Bayesian Optimization10 May 2022 0 repositories listed
-
Non-Stationary Bandit Learning via Predictive Sampling4 May 2022 0 repositories listed
-
On Kernelized Multi-Armed Bandits with Constraints29 Mar 2022 0 repositories listed
-
Thompson Sampling on Asymmetric α-Stable Bandits19 Mar 2022 0 repositories listed
-
Regenerative Particle Thompson Sampling15 Mar 2022 0 repositories listed
-
Multi-Agent Active Search using Detection and Location Uncertainty9 Mar 2022 0 repositories listed
-
An Analysis of Ensemble Sampling2 Mar 2022 0 repositories listed
-
Partial Likelihood Thompson Sampling2 Mar 2022 0 repositories listed
-
Towards Scalable and Robust Structured Bandits: A Meta-Learning Framework26 Feb 2022 0 repositories listed
-
Thompson Sampling with Unrestricted Delays24 Feb 2022 0 repositories listed
-
Double Thompson Sampling in Finite stochastic Games21 Feb 2022 0 repositories listed
-
Adaptive Experimentation in the Presence of Exogenous Nonstationary Variation18 Feb 2022 0 repositories listed
-
Fast online inference for nonlinear contextual bandit based on Generative Adversarial Network17 Feb 2022 0 repositories listed
-
Synthetically Controlled Bandits14 Feb 2022 0 repositories listed
-
Remote Contextual Bandits10 Feb 2022 0 repositories listed
-
Fourier Representations for Black-Box Optimization over Categorical Variables8 Feb 2022 0 repositories listed
-
On learning Whittle index policy for restless bandits with scalable regret7 Feb 2022 0 repositories listed
-
Deep Hierarchy in Bandits3 Feb 2022 0 repositories listed
-
Augmented RBMLE-UCB Approach for Adaptive Control of Linear Quadratic Systems25 Jan 2022 0 repositories listed
-
IBAC: An Intelligent Dynamic Bandwidth Channel Access Avoiding Outside Warning Range Problem15 Jan 2022 0 repositories listed
-
On Dynamic Pricing with Covariates25 Dec 2021 0 repositories listed
-
Algorithms for Adaptive Experiments that Trade-off Statistical Analysis with Reward: Combining Uniform Random Assignment and Reward Maximization15 Dec 2021 0 repositories listed
-
Risk and optimal policies in bandit experiments13 Dec 2021 0 repositories listed
-
Safe Linear Leveling Bandits13 Dec 2021 0 repositories listed
-
Doubly Robust Thompson Sampling with Linear Payoffs1 Dec 2021 0 repositories listed
-
Observation-Free Attacks on Stochastic Bandits1 Dec 2021 0 repositories listed
-
Adaptive Gating for Single-Photon 3D Imaging30 Nov 2021 0 repositories listed
-
Hierarchical Bayesian Bandits12 Nov 2021 0 repositories listed
-
The Hardness Analysis of Thompson Sampling for Combinatorial Semi-bandits with Greedy Oracle8 Nov 2021 0 repositories listed
-
Maillard Sampling: Boltzmann Exploration Done Optimally5 Nov 2021 0 repositories listed
-
Online Learning of Energy Consumption for Navigation of Electric Vehicles3 Nov 2021 0 repositories listed
-
Efficient Inference Without Trading-off Regret in Bandits: An Allocation Probability Test for Thompson Sampling30 Oct 2021 0 repositories listed
-
Variational Bayesian Optimistic Sampling29 Oct 2021 0 repositories listed
-
Differentially Private Federated Bayesian Optimization with Distributed Exploration27 Oct 2021 0 repositories listed
-
Analysis of Thompson Sampling for Partially Observable Contextual Multi-Armed Bandits23 Oct 2021 0 repositories listed
-
Diversified Sampling for Batched Bayesian Optimization with Determinantal Point Processes22 Oct 2021 0 repositories listed
-
Feel-Good Thompson Sampling for Contextual Bandits and Reinforcement Learning2 Oct 2021 0 repositories listed
-
Asymptotic Performance of Thompson Sampling in the Batched Multi-Armed Bandits1 Oct 2021 0 repositories listed
-
Batched Thompson Sampling1 Oct 2021 0 repositories listed
-
Apple Tasting Revisited: Bayesian Approaches to Partially Monitored Online Binary Classification29 Sep 2021 0 repositories listed
-
Expected Improvement-based Contextual Bandits29 Sep 2021 0 repositories listed
-
Regularized-OFU: an efficient algorithm for general contextual bandit with optimization oracles29 Sep 2021 0 repositories listed
-
Deep Exploration for Recommendation Systems26 Sep 2021 0 repositories listed
-
Online Learning of Network Bottlenecks via Minimax Paths17 Sep 2021 0 repositories listed
-
Thompson Sampling for Bandits with Clustered Arms6 Sep 2021 0 repositories listed
-
A relaxed technical assumption for posterior sampling-based reinforcement learning for control of unknown linear systems19 Aug 2021 0 repositories listed
-
Scalable regret for learning to control network-coupled subsystems with unknown dynamics18 Aug 2021 0 repositories listed
-
Batched Thompson Sampling for Multi-Armed Bandits15 Aug 2021 0 repositories listed
-
Metadata-based Multi-Task Bandits with Bayesian Hierarchical Models13 Aug 2021 0 repositories listed
-
Debiasing Samples from Online Learning Using Bootstrap31 Jul 2021 0 repositories listed
-
Adaptively Optimize Content Recommendation Using Multi Armed Bandit Algorithms in E-commerce30 Jul 2021 0 repositories listed
-
From Predictions to Decisions: The Importance of Joint Predictive Distributions20 Jul 2021 0 repositories listed
-
GuideBoot: Guided Bootstrap for Deep Contextual Bandits18 Jul 2021 0 repositories listed
-
No Regrets for Learning the Prior in Bandits13 Jul 2021 0 repositories listed
-
Metalearning Linear Bandits by Prior Update12 Jul 2021 0 repositories listed
-
Bayesian decision-making under misspecified priors with applications to meta-learning3 Jul 2021 0 repositories listed
-
Markov Decision Process modeled with Bandits for Sequential Decision Making in Linear-flow1 Jul 2021 0 repositories listed
-
Random Effect Bandits23 Jun 2021 0 repositories listed
-
Thompson Sampling for Unimodal Bandits15 Jun 2021 0 repositories listed
-
Thompson Sampling with a Mixture Prior10 Jun 2021 0 repositories listed
-
Multi-armed Bandit Algorithms on System-on-Chip: Go Frequentist or Bayesian?5 Jun 2021 0 repositories listed
-
A Closer Look at the Worst-case Behavior of Multi-armed Bandit Algorithms3 Jun 2021 0 repositories listed
-
Parallelizing Thompson Sampling2 Jun 2021 0 repositories listed
-
Kolmogorov-Smirnov Test-Based Actively-Adaptive Thompson Sampling for Non-Stationary Bandits30 May 2021 0 repositories listed