Browse State-of-the-Art › Thompson Sampling › Papers, page 3
Thompson Sampling
Papers archive 2025-07-28
archive papers tagged: 655 · with a code link: 135 · where Syntology ran a sample: 30 (23 with a run with no instrument failure, 7 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (30 of 655 tagged: 23 with a run with no instrument failure, 7 where every run was a failure of Syntology's instrument)
Page 3 of 7: papers 201 to 300 of 655, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Graph Neural Thompson Sampling15 Jun 2024 0 repositories listed
-
A Federated Online Restless Bandit Framework for Cooperative Resource Allocation12 Jun 2024 0 repositories listed
-
DISCO: An End-to-End Bandit Framework for Personalised Discount Allocation10 Jun 2024 0 repositories listed
-
Two-Stage Resource Allocation in Reconfigurable Intelligent Surface Assisted Hybrid Networks via Multi-Player Bandits9 Jun 2024 0 repositories listed
-
Adaptively Learning to Select-Rank in Online Platforms7 Jun 2024 0 repositories listed
-
Speculative Decoding via Early-exiting for Faster LLM Inference with Thompson Sampling Control Mechanism6 Jun 2024 0 repositories listed
-
Approximate Thompson Sampling for Learning Linear Quadratic Regulators with O(√(T)) Regret29 May 2024 0 repositories listed
-
Posterior Sampling via Autoregressive Generation29 May 2024 0 repositories listed
-
Cost-efficient Knowledge-based Question Answering with Large Language Models27 May 2024 0 repositories listed
-
Code Repair with LLMs gives an Exploration-Exploitation Tradeoff26 May 2024 0 repositories listed
-
Indexed Minimum Empirical Divergence-Based Algorithms for Linear Bandits24 May 2024 0 repositories listed
-
No Algorithmic Collusion in Two-Player Blindfolded Game with Thompson Sampling23 May 2024 0 repositories listed
-
Understanding the Training and Generalization of Pretrained Transformer for Sequential Decision Making23 May 2024 0 repositories listed
-
Smart Routing with Precise Link Estimation: DSEE-Based Anypath Routing for Reliable Wireless Networking16 May 2024 0 repositories listed
-
Analyzing and Enhancing Queue Sampling for Energy-Efficient Remote Control of Bandits15 May 2024 0 repositories listed
-
Thompson Sampling for Infinite-Horizon Discounted Decision Processes14 May 2024 0 repositories listed
-
Bayesian Optimization with LLM-Based Acquisition Functions for Natural Language Preference Elicitation2 May 2024 0 repositories listed
-
Efficient and Adaptive Posterior Sampling Algorithms for Bandits2 May 2024 0 repositories listed
-
Bayesian-Guided Generation of Synthetic Microbiomes with Minimized Pathogenicity29 Apr 2024 0 repositories listed
-
Feel-Good Thompson Sampling for Contextual Dueling Bandits9 Apr 2024 0 repositories listed
-
A Reinforcement Learning based Reset Policy for CDCL SAT Solvers4 Apr 2024 0 repositories listed
-
On the Importance of Uncertainty in Decision-Making with Large Language Models3 Apr 2024 0 repositories listed
-
Meta Learning in Bandits within Shared Affine Subspaces31 Mar 2024 0 repositories listed
-
A resource-constrained stochastic scheduling algorithm for homeless street outreach and gleaning edible food15 Mar 2024 0 repositories listed
-
ε-Neural Thompson Sampling of Deep Brain Stimulation for Parkinson Disease Treatment11 Mar 2024 0 repositories listed
-
Cramming Contextual Bandits for On-policy Statistical Evaluation11 Mar 2024 0 repositories listed
-
TS-RSR: A provably efficient approach for batch Bayesian Optimization7 Mar 2024 0 repositories listed
-
Chained Information-Theoretic bounds and Tight Regret Rate for Linear Bandit Problems5 Mar 2024 0 repositories listed
-
Epsilon-Greedy Thompson Sampling to Bayesian Optimization1 Mar 2024 0 repositories listed
-
Influencing Bandits: Arm Selection for Preference Shaping29 Feb 2024 0 repositories listed
-
Towards Efficient and Optimal Covariance-Adaptive Algorithms for Combinatorial Semi-Bandits23 Feb 2024 0 repositories listed
-
Optimizing Adaptive Experiments: A Unified Approach to Regret Minimization and Best-Arm Identification16 Feb 2024 0 repositories listed
-
Diffusion Models Meet Contextual Bandits with Large Action Spaces15 Feb 2024 0 repositories listed
-
Thompson Sampling in Partially Observable Contextual Bandits15 Feb 2024 0 repositories listed
-
Tree Ensembles for Contextual Bandits10 Feb 2024 0 repositories listed
-
Context in Public Health for Underserved Communities: A Bayesian Approach to Online Restless Bandits7 Feb 2024 0 repositories listed
-
Optimistic Thompson Sampling for No-Regret Learning in Unknown Games7 Feb 2024 0 repositories listed
-
Efficient Exploration for LLMs1 Feb 2024 0 repositories listed
-
Thompson Sampling for Stochastic Bandits with Noisy Contexts: An Information-Theoretic Regret Analysis21 Jan 2024 0 repositories listed
-
Model-Free Approximate Bayesian Learning for Large-Scale Conversion Funnel Optimization12 Jan 2024 0 repositories listed
-
Decentralized Multi-Agent Active Search and Tracking when Targets Outnumber Agents6 Jan 2024 0 repositories listed
-
Improving sample efficiency of high dimensional Bayesian optimization with MCMC5 Jan 2024 0 repositories listed
-
Zero-Inflated Bandits25 Dec 2023 0 repositories listed
-
Best Arm Identification in Batched Multi-armed Bandit Problems21 Dec 2023 0 repositories listed
-
Bayesian Analysis of Combinatorial Gaussian Process Bandits20 Dec 2023 0 repositories listed
-
Sample-based Dynamic Hierarchical Transformer with Layer and Head Flexibility via Contextual Bandit5 Dec 2023 0 repositories listed
-
The Sliding Regret in Stochastic Bandits: Discriminating Index and Randomized Policies30 Nov 2023 0 repositories listed
-
Thompson sampling for zero-inflated count outcomes with an application to the Drink Less mobile health study24 Nov 2023 0 repositories listed
-
Probabilistic Inference in Reinforcement Learning Done Right22 Nov 2023 0 repositories listed
-
A Distributed Neural Linear Thompson Sampling Framework to Achieve URLLC in Industrial IoT21 Nov 2023 0 repositories listed
-
Exploration via linearly perturbed loss minimisation13 Nov 2023 0 repositories listed
-
Posterior Sampling-Based Bayesian Optimization with Tighter Bayesian Regret Bounds7 Nov 2023 0 repositories listed
-
Batch Bayesian Optimization for Replicable Experimental Design2 Nov 2023 0 repositories listed
-
Dual-Directed Algorithm Design for Efficient Pure Exploration30 Oct 2023 0 repositories listed
-
Improved Bayesian Regret Bounds for Thompson Sampling in Reinforcement Learning30 Oct 2023 0 repositories listed
-
Little Exploration is All You Need26 Oct 2023 0 repositories listed
-
Making RL with Preference-based Feedback Efficient via Randomization23 Oct 2023 0 repositories listed
-
Parallel Bayesian Optimization Using Satisficing Thompson Sampling for Time-Sensitive Black-Box Optimization19 Oct 2023 0 repositories listed
-
Optimal Exploration is no harder than Thompson Sampling9 Oct 2023 0 repositories listed
-
Module-wise Adaptive Distillation for Multimodality Foundation Models6 Oct 2023 0 repositories listed
-
From Bandits Model to Deep Deterministic Policy Gradient, Reinforcement Learning with Contextual Information1 Oct 2023 0 repositories listed
-
Thompson Exploration with Best Challenger Rule in Best Arm Identification1 Oct 2023 0 repositories listed
-
Monte-Carlo tree search with uncertainty propagation via optimal transport19 Sep 2023 0 repositories listed
-
Task Selection and Assignment for Multi-modal Multi-task Dialogue Act Classification with Non-stationary Multi-armed Bandits18 Sep 2023 0 repositories listed
-
gym-saturation: Gymnasium environments for saturation provers (System description)16 Sep 2023 0 repositories listed
-
Generalized Regret Analysis of Thompson Sampling using Fractional Posteriors12 Sep 2023 0 repositories listed
-
Thompson Sampling for Real-Valued Combinatorial Pure Exploration of Multi-Armed Bandit20 Aug 2023 0 repositories listed
-
AdaptEx: A Self-Service Contextual Bandit Platform8 Aug 2023 0 repositories listed
-
Bag of Policies for Distributional Deep Exploration3 Aug 2023 0 repositories listed
-
Approximate information for efficient exploration-exploitation strategies4 Jul 2023 0 repositories listed
-
Thompson Sampling under Bernoulli Rewards with Local Differential Privacy3 Jul 2023 0 repositories listed
-
Thompson sampling for improved exploration in GFlowNets30 Jun 2023 0 repositories listed
-
Geometry-Aware Approaches for Balancing Performance and Theoretical Guarantees in Linear Bandits26 Jun 2023 0 repositories listed
-
Scalable Neural Contextual Bandit for Recommender Systems26 Jun 2023 0 repositories listed
-
Langevin Thompson Sampling with Logarithmic Communication: Bandits and Reinforcement Learning15 Jun 2023 0 repositories listed
-
Bayesian Learning of Optimal Policies in Markov Decision Processes with Countably Infinite State-Space5 Jun 2023 0 repositories listed
-
Incentivizing Exploration with Linear Contexts and Combinatorial Actions3 Jun 2023 0 repositories listed
-
Combinatorial Neural Bandits31 May 2023 0 repositories listed
-
Practical Batch Bayesian Sampling Algorithms for Online Adaptive Traffic Experimentation24 May 2023 0 repositories listed
-
Discounted Thompson Sampling for Non-Stationary Bandit Problems18 May 2023 0 repositories listed
-
Sequential Best-Arm Identification with Application to Brain-Computer Interface17 May 2023 0 repositories listed
-
Thompson Sampling for Parameterized Markov Decision Processes with Uninformative Actions13 May 2023 0 repositories listed
-
An improved regret analysis for UCB-N and TS-N6 May 2023 0 repositories listed
-
Thompson Sampling Regret Bounds for Contextual Bandits with sub-Gaussian rewards26 Apr 2023 0 repositories listed
-
Efficiently Tackling Million-Dimensional Multiobjective Problems: A Direction Sampling and Fine-Tuning Approach8 Apr 2023 0 repositories listed
-
Sharp Deviations Bounds for Dirichlet Weighted Sums with Application to analysis of Bayesian algorithms6 Apr 2023 0 repositories listed
-
GUTS: Generalized Uncertainty-Aware Thompson Sampling for Multi-Agent Active Search4 Apr 2023 0 repositories listed
-
Adaptive Experimentation at Scale: A Computational Framework for Flexible Batches21 Mar 2023 0 repositories listed
-
Only Pay for What Is Uncertain: Variance-Adaptive Thompson Sampling16 Mar 2023 0 repositories listed
-
A General Recipe for the Analysis of Randomized Multi-Armed Bandit Algorithms10 Mar 2023 0 repositories listed
-
A Unified and Efficient Coordinating Framework for Autonomous DBMS Tuning10 Mar 2023 0 repositories listed
-
Thompson Sampling for Linear Bandit Problems with Normal-Gamma Priors6 Mar 2023 0 repositories listed
-
The Choice of Noninformative Priors for Thompson Sampling in Multiparameter Bandit Models28 Feb 2023 0 repositories listed
-
When Combinatorial Thompson Sampling meets Approximation Regret22 Feb 2023 0 repositories listed
-
Online Continuous Hyperparameter Optimization for Generalized Linear Contextual Bandits18 Feb 2023 0 repositories listed
-
A Bandit Approach to Online Pricing for Heterogeneous Edge Resource Allocation14 Feb 2023 0 repositories listed
-
Learning How to Infer Partial MDPs for In-Context Adaptation and Exploration8 Feb 2023 0 repositories listed
-
Leveraging Demonstrations to Improve Online Learning: Quality Matters7 Feb 2023 0 repositories listed
-
Optimality of Thompson Sampling with Noninformative Priors for Pareto Bandits3 Feb 2023 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.