Browse State-of-the-Art › Multi-Armed Bandits › Papers, page 9
Multi-Armed Bandits
Papers archive 2025-07-28
archive papers tagged: 1,262 · with a code link: 253 · where Syntology ran a sample: 55 (44 with a run with no instrument failure, 11 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (55 of 1,262 tagged: 44 with a run with no instrument failure, 11 where every run was a failure of Syntology's instrument)
Page 9 of 13: papers 801 to 900 of 1,262, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
From Predictions to Decisions: The Importance of Joint Predictive Distributions20 Jul 2021 0 repositories listed
-
An Analysis of Reinforcement Learning for Malaria Control19 Jul 2021 0 repositories listed
-
GuideBoot: Guided Bootstrap for Deep Contextual Bandits18 Jul 2021 0 repositories listed
-
Adapting to Misspecification in Contextual Bandits12 Jul 2021 0 repositories listed
-
Model Selection for Generic Contextual Bandits7 Jul 2021 0 repositories listed
-
Dueling Bandits with Adversarial Sleeping5 Jul 2021 0 repositories listed
-
Efficient First-Order Contextual Bandits: Prediction, Allocation, and Triangular Discrimination5 Jul 2021 0 repositories listed
-
Restless and Uncertain: Robust Policies for Restless Bandits via Deep Multi-Agent Reinforcement Learning4 Jul 2021 0 repositories listed
-
Bayesian decision-making under misspecified priors with applications to meta-learning3 Jul 2021 0 repositories listed
-
Regularized OFU: an Efficient UCB Estimator forNon-linear Contextual Bandit29 Jun 2021 0 repositories listed
-
Knowledge Infused Policy Gradients with Upper Confidence Bound for Relational Bandits25 Jun 2021 0 repositories listed
-
Multi-player Multi-armed Bandits with Collision-Dependent Reward Distributions25 Jun 2021 0 repositories listed
-
Random Effect Bandits23 Jun 2021 0 repositories listed
-
A Reduction-Based Framework for Conservative Bandits and Reinforcement Learning22 Jun 2021 0 repositories listed
-
BanditMF: Multi-Armed Bandit Based Matrix Factorization Recommender System21 Jun 2021 0 repositories listed
-
Smooth Sequential Optimisation with Delayed Feedback21 Jun 2021 0 repositories listed
-
Banker Online Mirror Descent16 Jun 2021 0 repositories listed
-
Guaranteed Fixed-Confidence Best Arm Identification in Multi-Armed Bandits: Simple Sequential Elimination Algorithms12 Jun 2021 0 repositories listed
-
Towards Costless Model Selection in Contextual Bandits: A Bias-Variance Perspective11 Jun 2021 0 repositories listed
-
A Central Limit Theorem, Loss Aversion and Multi-Armed Bandits10 Jun 2021 0 repositories listed
-
Fixed-Budget Best-Arm Identification in Structured Bandits9 Jun 2021 0 repositories listed
-
Cooperative Stochastic Multi-agent Multi-armed Bandits Robust to Adversarial Corruptions8 Jun 2021 0 repositories listed
-
Scale Free Adversarial Multi Armed Bandits8 Jun 2021 0 repositories listed
-
On Learning to Rank Long Sequences with Contextual Bandits7 Jun 2021 0 repositories listed
-
Differentially Private Multi-Armed Bandits in the Shuffle Model5 Jun 2021 0 repositories listed
-
Robust Stochastic Linear Contextual Bandits Under Adversarial Attacks5 Jun 2021 0 repositories listed
-
Fair Exploration via Axiomatic Bargaining4 Jun 2021 0 repositories listed
-
Optimal Rates of (Locally) Differentially Private Heavy-tailed Multi-Armed Bandits4 Jun 2021 0 repositories listed
-
Stochastic Multi-Armed Bandits with Unrestricted Delay Distributions4 Jun 2021 0 repositories listed
-
Parallelizing Contextual Bandits21 May 2021 0 repositories listed
-
Recurrent Submodular Welfare and Matroid Blocking Semi-Bandits21 May 2021 0 repositories listed
-
Diffusion Approximations for Thompson Sampling19 May 2021 0 repositories listed
-
Stochastic Multi-Armed Bandits with Control Variates9 May 2021 0 repositories listed
-
Contextual Bandits with Sparse Data in Web setting6 May 2021 0 repositories listed
-
Optimal Algorithms for Range Searching over Multi-Armed Bandits4 May 2021 0 repositories listed
-
Online certification of preference-based fairness for personalized recommender systems29 Apr 2021 0 repositories listed
-
Statistical Inference with M-Estimators on Adaptively Collected Data29 Apr 2021 0 repositories listed
-
Off-Policy Risk Assessment in Contextual Bandits18 Apr 2021 0 repositories listed
-
An Efficient Algorithm for Deep Stochastic Contextual Bandits12 Apr 2021 0 repositories listed
-
Censored Semi-Bandits for Resource Allocation12 Apr 2021 0 repositories listed
-
Leveraging Good Representations in Linear Contextual Bandits8 Apr 2021 0 repositories listed
-
Multinomial Logit Contextual Bandits: Provable Optimality and Practicality25 Mar 2021 0 repositories listed
-
Towards Optimal Algorithms for Multi-Player Bandits without Collision Sensing Information24 Mar 2021 0 repositories listed
-
Bridging Offline Reinforcement Learning and Imitation Learning: A Tale of Pessimism22 Mar 2021 0 repositories listed
-
Deep Contextual Bandits for Fast Neighbor-Aided Initial Access in mmWave Cell-Free Networks17 Mar 2021 0 repositories listed
-
Encrypted Linear Contextual Bandit17 Mar 2021 0 repositories listed
-
Efficient Algorithms for Finite Horizon and Streaming Restless Multi-Armed Bandit Problems8 Mar 2021 0 repositories listed
-
Nearest Neighbor Search Under Uncertainty8 Mar 2021 0 repositories listed
-
Selective Intervention Planning using Restless Multi-Armed Bandits to Improve Maternal and Child Health Outcomes7 Mar 2021 0 repositories listed
-
Fairness of Exposure in Stochastic Bandits3 Mar 2021 0 repositories listed
-
Adapting to Misspecification in Contextual Bandits with Offline Regression Oracles26 Feb 2021 0 repositories listed
-
Local Clustering in Contextual Multi-Armed Bandits26 Feb 2021 0 repositories listed
-
Online Multi-Armed Bandits with Adaptive Inference25 Feb 2021 0 repositories listed
-
Meta-Thompson Sampling11 Feb 2021 0 repositories listed
-
Multi-Agent Multi-Armed Bandits with Limited Communication10 Feb 2021 0 repositories listed
-
Non-stationary Reinforcement Learning without Prior Knowledge: An Optimal Black-box Approach10 Feb 2021 0 repositories listed
-
Player Modeling via Multi-Armed Bandits10 Feb 2021 0 repositories listed
-
Regression Oracles and Exploration Strategies for Short-Horizon Multi-Armed Bandits10 Feb 2021 0 repositories listed
-
Fine-Grained Gap-Dependent Bounds for Tabular MDPs via Adaptive Multi-Step Bootstrap9 Feb 2021 0 repositories listed
-
Bandits for Learning to Explain from Explanations7 Feb 2021 0 repositories listed
-
Confidence-Budget Matching for Sequential Budgeted Learning5 Feb 2021 0 repositories listed
-
Transfer Learning in Bandits with Latent Continuity4 Feb 2021 0 repositories listed
-
Recurrent Submodular Welfare and Matroid Blocking Bandits30 Jan 2021 0 repositories listed
-
Online and Scalable Model Selection with Multi-Armed Bandits25 Jan 2021 0 repositories listed
-
Personalization Paradox in Behavior Change Apps: Lessons from a Social Comparison-Based Personalized App for Physical Activity25 Jan 2021 0 repositories listed
-
Efficient Pure Exploration for Combinatorial Bandits with Semi-Bandit Feedback21 Jan 2021 0 repositories listed
-
Minimax Off-Policy Evaluation for Multi-Armed Bandits19 Jan 2021 0 repositories listed
-
Resource Allocation in NOMA-based Self-Organizing Networks using Stochastic Multi-Armed Bandits16 Jan 2021 0 repositories listed
-
Survival of the strictest: Stable and unstable equilibria under regularized learning with partial information12 Jan 2021 0 repositories listed
-
Be Greedy in Multi-Armed Bandits4 Jan 2021 0 repositories listed
-
Online Learning under Adversarial Corruptions1 Jan 2021 0 repositories listed
-
Online Limited Memory Neural-Linear Bandits1 Jan 2021 0 repositories listed
-
Combinatorial Pure Exploration with Full-bandit Feedback and Beyond: Solving Combinatorial Optimization under Uncertainty with Limited Observation31 Dec 2020 0 repositories listed
-
Learning to Optimize Energy Efficiency in Energy Harvesting Wireless Sensor Networks30 Dec 2020 0 repositories listed
-
Lifelong Learning in Multi-Armed Bandits28 Dec 2020 0 repositories listed
-
A Regret bound for Non-stationary Multi-Armed Bandits with Fairness Constraints24 Dec 2020 0 repositories listed
-
Expanding on Repeated Consumer Search Using Multi-Armed Bandits and Secretaries22 Dec 2020 0 repositories listed
-
A One-Size-Fits-All Solution to Conservative Bandit Problems14 Dec 2020 0 repositories listed
-
Adversarial Linear Contextual Bandits with Graph-Structured Side Observations10 Dec 2020 0 repositories listed
-
Streaming Algorithms for Stochastic Multi-armed Bandits9 Dec 2020 0 repositories listed
-
Efficient Automatic CASH via Rising Bandits8 Dec 2020 0 repositories listed
-
Accurate and Fast Federated Learning via Combinatorial Multi-Armed Bandits6 Dec 2020 0 repositories listed
-
Distributed Thompson Sampling3 Dec 2020 0 repositories listed
-
Neural Contextual Bandits with Deep Representation and Shallow Exploration3 Dec 2020 0 repositories listed
-
Batched Coarse Ranking in Multi-Armed Bandits1 Dec 2020 0 repositories listed
-
Finding All ϵ-Good Arms in Stochastic Bandits1 Dec 2020 0 repositories listed
-
A Tractable Online Learning Algorithm for the Multinomial Logit Contextual Bandit28 Nov 2020 0 repositories listed
-
Resonance: Replacing Software Constants with Context-Aware Models in Real-time Communication23 Nov 2020 0 repositories listed
-
Fully Gap-Dependent Bounds for Multinomial Logit Bandit19 Nov 2020 0 repositories listed
-
Reward Biased Maximum Likelihood Estimation for Reinforcement Learning16 Nov 2020 0 repositories listed
-
Active Reinforcement Learning: Observing Rewards at a Cost13 Nov 2020 0 repositories listed
-
Improving Offline Contextual Bandits with Distributional Robustness13 Nov 2020 0 repositories listed
-
Metric-Free Individual Fairness with Cooperative Contextual Bandits13 Nov 2020 0 repositories listed
-
Asymptotic Convergence of Thompson Sampling8 Nov 2020 0 repositories listed
-
Towards Fundamental Limits of Multi-armed Bandits with Random Walk Feedback3 Nov 2020 0 repositories listed
-
Multi-Armed Bandits with Censored Consumption of Resources2 Nov 2020 0 repositories listed
-
On No-Sensing Adversarial Multi-player Multi-armed Bandits with Collision Communications2 Nov 2020 0 repositories listed
-
Resource Allocation in Multi-armed Bandit Exploration: Overcoming Sublinear Scaling with Adaptive Parallelism31 Oct 2020 0 repositories listed
-
Learning to Actively Learn: A Robust Approach29 Oct 2020 0 repositories listed
-
Tractable contextual bandits beyond realizability25 Oct 2020 0 repositories listed