Browse State-of-the-Art › Multi-Armed Bandits › Papers, page 6
Multi-Armed Bandits
Papers archive 2025-07-28
archive papers tagged: 1,262 · with a code link: 253 · where Syntology ran a sample: 55 (44 with a run with no instrument failure, 11 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (55 of 1,262 tagged: 44 with a run with no instrument failure, 11 where every run was a failure of Syntology's instrument)
Page 6 of 13: papers 501 to 600 of 1,262, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Thompson sampling for zero-inflated count outcomes with an application to the Drink Less mobile health study24 Nov 2023 0 repositories listed
-
Provably Efficient High-Dimensional Bandit Learning with Batched Feedbacks22 Nov 2023 0 repositories listed
-
Adversarial Attacks on Cooperative Multi-agent Bandits3 Nov 2023 0 repositories listed
-
Efficient Generalized Low-Rank Tensor Contextual Bandits3 Nov 2023 0 repositories listed
-
LLMs-augmented Contextual Bandit3 Nov 2023 0 repositories listed
-
Federated Linear Bandits with Finite Adversarial Actions2 Nov 2023 0 repositories listed
-
High-dimensional Linear Bandits with Knapsacks2 Nov 2023 0 repositories listed
-
An Improved Relaxation for Oracle-Efficient Adversarial Contextual Bandits29 Oct 2023 0 repositories listed
-
A Risk-Averse Framework for Non-Stationary Stochastic Multi-Armed Bandits24 Oct 2023 0 repositories listed
-
Contextual Bandits for Evaluating and Improving Inventory Control Policies24 Oct 2023 0 repositories listed
-
Off-Policy Evaluation for Large Action Spaces via Policy Convolution24 Oct 2023 0 repositories listed
-
Towards a Pretrained Model for Restless Bandits via Multi-arm Generalization23 Oct 2023 0 repositories listed
-
α-Fair Contextual Bandits22 Oct 2023 0 repositories listed
-
Pure Exploration in Asynchronous Federated Bandits17 Oct 2023 0 repositories listed
-
Leveraging heterogeneous spillover in maximizing contextual bandit rewards16 Oct 2023 0 repositories listed
-
Bad Values but Good Behavior: Learning Highly Misspecified Bandits and MDPs13 Oct 2023 0 repositories listed
-
Byzantine-Resilient Decentralized Multi-Armed Bandits11 Oct 2023 0 repositories listed
-
Non-Stationary Contextual Bandit Learning via Neural Predictive Ensemble Sampling11 Oct 2023 0 repositories listed
-
Ensemble Active Learning by Contextual Bandits for AI Incubation in Manufacturing10 Oct 2023 0 repositories listed
-
Finite-Time Analysis of Whittle Index based Q-Learning for Restless Multi-Armed Bandits with Neural Network Function Approximation3 Oct 2023 0 repositories listed
-
Improved Algorithms for Adversarial Bandits with Unbounded Losses3 Oct 2023 0 repositories listed
-
Adversarial Contextual Bandits Go Kernelized2 Oct 2023 0 repositories listed
-
Discrete Choice Multi-Armed Bandits1 Oct 2023 0 repositories listed
-
Diversify and Conquer: Bandits and Diversity for an Enhanced E-commerce Homepage Experience25 Sep 2023 0 repositories listed
-
Follow-ups Also Matter: Improving Contextual Bandits via Post-serving Contexts25 Sep 2023 0 repositories listed
-
Task Selection and Assignment for Multi-modal Multi-task Dialogue Act Classification with Non-stationary Multi-armed Bandits18 Sep 2023 0 repositories listed
-
Wasserstein Distributionally Robust Policy Evaluation and Learning for Contextual Bandits15 Sep 2023 0 repositories listed
-
Doubly High-Dimensional Contextual Bandits: An Interpretable Model for Joint Assortment-Pricing14 Sep 2023 0 repositories listed
-
The Best Arm Evades: Near-optimal Multi-pass Streaming Lower Bounds for Pure Exploration in Multi-armed Bandits6 Sep 2023 0 repositories listed
-
Bypassing the Simulator: Near-Optimal Adversarial Linear Contextual Bandits2 Sep 2023 0 repositories listed
-
Concentrated Differential Privacy for Bandits1 Sep 2023 0 repositories listed
-
Pure Exploration under Mediators' Feedback29 Aug 2023 0 repositories listed
-
Stochastic Graph Bandit Learning with Side-Observations29 Aug 2023 0 repositories listed
-
Learning How to Price Charging in Electric Ride-Hailing Markets25 Aug 2023 0 repositories listed
-
On Universally Optimal Algorithms for A/B Testing23 Aug 2023 0 repositories listed
-
Clustered Linear Contextual Bandits with Knapsacks21 Aug 2023 0 repositories listed
-
Graph Neural Bandits21 Aug 2023 0 repositories listed
-
AdaptEx: A Self-Service Contextual Bandit Platform8 Aug 2023 0 repositories listed
-
Cooperative Multi-agent Bandits: Distributed Algorithms with Optimal Individual Regret and Constant Communication Costs8 Aug 2023 0 repositories listed
-
Transfer Learning with Partially Observable Offline Data via Causal Bounds7 Aug 2023 0 repositories listed
-
Contextual Bandits and Imitation Learning via Preference-Based Active Queries24 Jul 2023 0 repositories listed
-
Provable Benefits of Policy Learning from Human Preferences in Contextual Bandit Problems24 Jul 2023 0 repositories listed
-
Preferences Evolve And So Should Your Bandits: Bandits with Evolving States for Online Platforms21 Jul 2023 0 repositories listed
-
Decentralized Smart Charging of Large-Scale EVs using Adaptive Multi-Agent Multi-Armed Bandits20 Jul 2023 0 repositories listed
-
On Interpolating Experts and Multi-Armed Bandits14 Jul 2023 0 repositories listed
-
Tracking Most Significant Shifts in Nonparametric Contextual Bandits11 Jul 2023 0 repositories listed
-
SHAP@k:Efficient and Probably Approximately Correct (PAC) Identification of Top-k Features10 Jul 2023 0 repositories listed
-
BOF-UCB: A Bayesian-Optimistic Frequentist Algorithm for Non-Stationary Contextual Bandits7 Jul 2023 0 repositories listed
-
Meta-Learning Adversarial Bandit Algorithms5 Jul 2023 0 repositories listed
-
Proportional Response: Contextual Bandits for Simple and Cumulative Regret Minimization5 Jul 2023 0 repositories listed
-
Thompson sampling for improved exploration in GFlowNets30 Jun 2023 0 repositories listed
-
Kernel ε-Greedy for Multi-Armed Bandits with Covariates29 Jun 2023 0 repositories listed
-
Pure exploration in multi-armed bandits with low rank structure using oblivious sampler28 Jun 2023 0 repositories listed
-
You Can Trade Your Experience in Distributed Multi-Agent Multi-Armed Bandits19 Jun 2023 0 repositories listed
-
Langevin Thompson Sampling with Logarithmic Communication: Bandits and Reinforcement Learning15 Jun 2023 0 repositories listed
-
Multi-Fidelity Multi-Armed Bandits Revisited13 Jun 2023 0 repositories listed
-
Oracle-Efficient Pessimism: Offline Policy Optimization in Contextual Bandits13 Jun 2023 0 repositories listed
-
Optimal Multitask Linear Regression and Contextual Bandits under Sparse Heterogeneity9 Jun 2023 0 repositories listed
-
Federated Linear Contextual Bandits with User-level Differential Privacy8 Jun 2023 0 repositories listed
-
Differentially Private Episodic Reinforcement Learning with Heavy-tailed Rewards1 Jun 2023 0 repositories listed
-
Representation-Driven Reinforcement Learning31 May 2023 0 repositories listed
-
Collaborative Multi-Agent Heterogeneous Multi-Armed Bandits30 May 2023 0 repositories listed
-
Contextual Bandits with Budgeted Information Reveal29 May 2023 0 repositories listed
-
Small Total-Cost Constraints in Contextual Bandits with Knapsacks, with Application to Fairness25 May 2023 0 repositories listed
-
Sequential Best-Arm Identification with Application to Brain-Computer Interface17 May 2023 0 repositories listed
-
Efficient Training of Multi-task Combinarotial Neural Solver with Multi-armed Bandits10 May 2023 0 repositories listed
-
Reward Teaching for Federated Multi-armed Bandits3 May 2023 0 repositories listed
-
Stochastic Contextual Bandits with Graph-based Contexts2 May 2023 0 repositories listed
-
First- and Second-Order Bounds for Adversarial Linear Contextual Bandits1 May 2023 0 repositories listed
-
Thompson Sampling Regret Bounds for Contextual Bandits with sub-Gaussian rewards26 Apr 2023 0 repositories listed
-
Optimal Activation of Halting Multi-Armed Bandit Models20 Apr 2023 0 repositories listed
-
Learning Personalized Decision Support Policies13 Apr 2023 0 repositories listed
-
SmartChoices: Augmenting Software with Learned Implementations12 Apr 2023 0 repositories listed
-
BanditQ: Fair Bandits with Guaranteed Rewards11 Apr 2023 0 repositories listed
-
Full Gradient Deep Reinforcement Learning for Average-Reward Criterion7 Apr 2023 0 repositories listed
-
Sharp Deviations Bounds for Dirichlet Weighted Sums with Application to analysis of Bayesian algorithms6 Apr 2023 0 repositories listed
-
Federated Learning for Heterogeneous Bandits with Unobserved Contexts29 Mar 2023 0 repositories listed
-
Adaptive Endpointing with Deep Contextual Multi-armed Bandits23 Mar 2023 0 repositories listed
-
On the Interplay Between Misspecification and Sub-optimality Gap in Linear Contextual Bandits16 Mar 2023 0 repositories listed
-
Only Pay for What Is Uncertain: Variance-Adaptive Thompson Sampling16 Mar 2023 0 repositories listed
-
Data Dependent Regret Guarantees Against General Comparators for Full or Bandit Feedback12 Mar 2023 0 repositories listed
-
Queue Scheduling with Adversarial Bandit Learning3 Mar 2023 0 repositories listed
-
Fairness for Workers Who Pull the Arms: An Index Based Policy for Allocation of Restless Bandit Tasks1 Mar 2023 0 repositories listed
-
Multi-Armed Bandits with Generalized Temporally-Partitioned Rewards1 Mar 2023 0 repositories listed
-
Approximately Stationary Bandits with Knapsacks28 Feb 2023 0 repositories listed
-
The Choice of Noninformative Priors for Thompson Sampling in Multiparameter Bandit Models28 Feb 2023 0 repositories listed
-
Improved Best-of-Both-Worlds Guarantees for Multi-Armed Bandits: FTRL with General Regularizers and Multiple Optimal Arms27 Feb 2023 0 repositories listed
-
On Differentially Private Federated Linear Contextual Bandits27 Feb 2023 0 repositories listed
-
Active Velocity Estimation using Light Curtains via Self-Supervised Multi-Armed Bandits24 Feb 2023 0 repositories listed
-
Asymptotically Unbiased Off-Policy Policy Evaluation when Reusing Old Data in Nonstationary Environments23 Feb 2023 0 repositories listed
-
Variance-Dependent Regret Bounds for Linear Bandits and Reinforcement Learning: Adaptivity and Computational Efficiency21 Feb 2023 0 repositories listed
-
A Blackbox Approach to Best of Both Worlds in Bandits and Beyond20 Feb 2023 0 repositories listed
-
Estimating Optimal Policy Value in General Linear Contextual Bandits19 Feb 2023 0 repositories listed
-
Improving Fairness in Adaptive Social Exergames via Shapley Bandits18 Feb 2023 0 repositories listed
-
Online Continuous Hyperparameter Optimization for Generalized Linear Contextual Bandits18 Feb 2023 0 repositories listed
-
Stochastic Approximation Approaches to Group Distributionally Robust Optimization and Beyond18 Feb 2023 0 repositories listed
-
Practical Contextual Bandits with Feedback Graphs17 Feb 2023 0 repositories listed
-
Bandit Social Learning: Exploration under Myopic Behavior15 Feb 2023 0 repositories listed
-
Genetic multi-armed bandits: a reinforcement learning approach for discrete optimization via simulation15 Feb 2023 0 repositories listed
-
Adversarial Rewards in Universal Learning for Contextual Bandits14 Feb 2023 0 repositories listed