Browse State-of-the-Art › Multi-Armed Bandits › Papers, page 10
Multi-Armed Bandits
Papers archive 2025-07-28
archive papers tagged: 1,262 · with a code link: 253 · where Syntology ran a sample: 55 (44 with a run with no instrument failure, 11 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (55 of 1,262 tagged: 44 with a run with no instrument failure, 11 where every run was a failure of Syntology's instrument)
Page 10 of 13: papers 901 to 1,000 of 1,262, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Optimal Algorithms for Stochastic Multi-Armed Bandits with Heavy Tailed Rewards24 Oct 2020 0 repositories listed
-
Online Algorithm for Unsupervised Sequential Selection with Contextual Information23 Oct 2020 0 repositories listed
-
Online Semi-Supervised Learning with Bandit Feedback23 Oct 2020 0 repositories listed
-
Achieving User-Side Fairness in Contextual Bandits22 Oct 2020 0 repositories listed
-
DBA bandits: Self-driving index tuning under ad-hoc, analytical workloads with safety guarantees19 Oct 2020 0 repositories listed
-
Stochastic Bandits with Vector Losses: Minimizing ℓ^∞-Norm of Relative Losses15 Oct 2020 0 repositories listed
-
Asymptotic Randomised Control with applications to bandits14 Oct 2020 0 repositories listed
-
Multi-Armed Bandits with Dependent Arms13 Oct 2020 0 repositories listed
-
Adapting to Delays and Data in Adversarial Multi-Armed Bandits12 Oct 2020 0 repositories listed
-
Online and Distribution-Free Robustness: Regression and Contextual Bandits with Huber Contamination8 Oct 2020 0 repositories listed
-
Instance-Dependent Complexity of Contextual Bandits and Reinforcement Learning: A Disagreement-Based Perspective7 Oct 2020 0 repositories listed
-
CorrAttack: Black-box Adversarial Attack with Structured Search3 Oct 2020 0 repositories listed
-
Is Reinforcement Learning More Difficult Than Bandits? A Near-optimal Algorithm Escaping the Curse of Horizon28 Sep 2020 0 repositories listed
-
Contextual Bandits for adapting to changing User preferences over time21 Sep 2020 0 repositories listed
-
Regret Bounds and Reinforcement Learning Exploration of EXP-based Algorithms20 Sep 2020 0 repositories listed
-
Partial Bandit and Semi-Bandit: Making the Most Out of Scarce Users' Feedback16 Sep 2020 0 repositories listed
-
Thompson Sampling for Unsupervised Sequential Selection16 Sep 2020 0 repositories listed
-
Deep Contextual Bandits for Fast Initial Access in mmWave Based User-Centric Ultra-Dense Networks15 Sep 2020 0 repositories listed
-
Unifying Clustered and Non-stationary Bandits5 Sep 2020 0 repositories listed
-
Statistically Robust, Risk-Averse Best Arm Identification in Multi-Armed Bandits28 Aug 2020 0 repositories listed
-
Dynamic Batch Learning in High-Dimensional Sparse Linear Contextual Bandits27 Aug 2020 0 repositories listed
-
23 Aug 2020 0 repositories listed
-
Contextual Bandits for Advertising Budget Allocation22 Aug 2020 0 repositories listed
-
Offline Contextual Multi-armed Bandits for Mobile Health Interventions: A Case Study on Emotion Regulation21 Aug 2020 0 repositories listed
-
Kernel Methods for Cooperative Multi-Agent Contextual Bandits14 Aug 2020 0 repositories listed
-
Lenient Regret for Multi-Armed Bandits10 Aug 2020 0 repositories listed
-
A framework for optimizing COVID-19 testing policy using a Multi Armed Bandit approach28 Jul 2020 0 repositories listed
-
Greedy Bandits with Sampled Context27 Jul 2020 0 repositories listed
-
Multi-Armed Bandits for Minesweeper: Profiting from Exploration-Exploitation Synergy25 Jul 2020 0 repositories listed
-
Competing Bandits: The Perils of Exploration Under Competition20 Jul 2020 0 repositories listed
-
Minimax Policy for Heavy-tailed Bandits20 Jul 2020 0 repositories listed
-
Self-Tuning Bandits over Unknown Covariate-Shifts16 Jul 2020 0 repositories listed
-
Upper Counterfactual Confidence Bounds: a New Optimism Principle for Contextual Bandits15 Jul 2020 0 repositories listed
-
Fair Algorithms for Multi-Agent Multi-Armed Bandits13 Jul 2020 0 repositories listed
-
Robust Multi-Agent Multi-Armed Bandits7 Jul 2020 0 repositories listed
-
Multi-Armed Bandits with Local Differential Privacy6 Jul 2020 0 repositories listed
-
Linear Bandits with Limited Adaptivity and Learning Distributional Optimal Design4 Jul 2020 0 repositories listed
-
Continuous-Time Multi-Armed Bandits with Controlled Restarts30 Jun 2020 0 repositories listed
-
Online learning with Corrupted context: Corrupted Contextual Bandits26 Jun 2020 0 repositories listed
-
Approximating a Target Distribution using Weight Queries24 Jun 2020 0 repositories listed
-
Adaptive Discretization against an Adversary: Lipschitz bandits, Dynamic Pricing, and Auction Tuning22 Jun 2020 0 repositories listed
-
Towards Tractable Optimism in Model-Based Reinforcement Learning21 Jun 2020 0 repositories listed
-
Open Problem: Model Selection for Contextual Bandits19 Jun 2020 0 repositories listed
-
Learning by Repetition: Stochastic Multi-armed Bandits under Priming Effect18 Jun 2020 0 repositories listed
-
Stochastic Bandits with Linear Constraints17 Jun 2020 0 repositories listed
-
Stochastic Network Utility Maximization with Unknown Utilities: Multi-Armed Bandits Approach17 Jun 2020 0 repositories listed
-
Non-Stationary Off-Policy Optimization15 Jun 2020 0 repositories listed
-
Explicit Best Arm Identification in Linear Bandits Using No-Regret Learners13 Jun 2020 0 repositories listed
-
Bandits with Partially Observable Confounded Data11 Jun 2020 0 repositories listed
-
Quantile Multi-Armed Bandits: Optimal Best-Arm Identification and a Differentially Private Scheme11 Jun 2020 0 repositories listed
-
TS-UCB: Improving on Thompson Sampling With Little to No Additional Computation11 Jun 2020 0 repositories listed
-
Distributionally Robust Batch Contextual Bandits10 Jun 2020 0 repositories listed
-
Simultaneously Learning Stochastic and Adversarial Episodic MDPs with Known Transition10 Jun 2020 0 repositories listed
-
Meta-Learning Bandit Policies by Gradient Ascent9 Jun 2020 0 repositories listed
-
Contextual Bandits with Side-Observations6 Jun 2020 0 repositories listed
-
Concurrent Decentralized Channel Allocation and Access Point Selection using Multi-Armed Bandits in multi BSS WLANs5 Jun 2020 0 repositories listed
-
(Locally) Differentially Private Combinatorial Semi-Bandits1 Jun 2020 0 repositories listed
-
To update or not to update? Delayed Nonparametric Bandits with Randomized Allocation26 May 2020 0 repositories listed
-
Greedy Algorithm almost Dominates in Smoothed Contextual Bandits19 May 2020 0 repositories listed
-
Neural Network Retraining for Model Serving29 Apr 2020 0 repositories listed
-
Learning to Rank in the Position Based Model with Bandit Feedback27 Apr 2020 0 repositories listed
-
Sequential Batch Learning in Finite-Action Linear Contextual Bandits14 Apr 2020 0 repositories listed
-
Exploration with Limited Memory: Streaming Algorithms for Coin Tossing, Noisy Comparisons, and Multi-Armed Bandits9 Apr 2020 0 repositories listed
-
Hawkes Process Multi-armed Bandits for Disaster Search and Rescue3 Apr 2020 0 repositories listed
-
Bypassing the Monster: A Faster and Simpler Optimal Algorithm for Contextual Bandits under Realizability28 Mar 2020 0 repositories listed
-
Optimal No-regret Learning in Repeated First-price Auctions22 Mar 2020 0 repositories listed
-
Self-Supervised Contextual Bandits in Computer Vision18 Mar 2020 0 repositories listed
-
Learning and Fairness in Energy Harvesting: A Maximin Multi-Armed Bandits Approach13 Mar 2020 0 repositories listed
-
Delay-Adaptive Learning in Generalized Linear Contextual Bandits11 Mar 2020 0 repositories listed
-
Convex Hull Monte-Carlo Tree Search9 Mar 2020 0 repositories listed
-
Online Residential Demand Response via Contextual Multi-Armed Bandits7 Mar 2020 0 repositories listed
-
A Farewell to Arms: Sequential Reward Maximization on a Budget with a Giving Up Option6 Mar 2020 0 repositories listed
-
Generalized Policy Elimination: an efficient algorithm for Nonparametric Contextual Bandits5 Mar 2020 0 repositories listed
-
Robustness Guarantees for Mode Estimation with an Application to Bandits5 Mar 2020 0 repositories listed
-
Stochastic Linear Contextual Bandits with Diverse Contexts5 Mar 2020 0 repositories listed
-
Taking a hint: How to leverage loss predictors in contextual bandits?4 Mar 2020 0 repositories listed
-
Bounded Regret for Finitely Parameterized Multi-Armed Bandits3 Mar 2020 0 repositories listed
-
Distributed Cooperative Decision Making in Multi-agent Multi-armed Bandits3 Mar 2020 0 repositories listed
-
Model Selection in Contextual Stochastic Bandit Problems3 Mar 2020 0 repositories listed
-
Decentralized Multi-player Multi-armed Bandits with No Collision Information29 Feb 2020 0 repositories listed
-
Designing Truthful Contextual Multi-Armed Bandits based Sponsored Search Auctions26 Feb 2020 0 repositories listed
-
Structured Linear Contextual Bandits: A Sharp and Geometric Smoothed Analysis26 Feb 2020 0 repositories listed
-
Bandit Learning with Delayed Impact of Actions24 Feb 2020 0 repositories listed
-
Survey Bandits with Regret Guarantees23 Feb 2020 0 repositories listed
-
Online Learning in Contextual Bandits using Gated Linear Networks21 Feb 2020 0 repositories listed
-
On conditional versus marginal bias in multi-armed bandits19 Feb 2020 0 repositories listed
-
Residual Bootstrap Exploration for Bandit Algorithms19 Feb 2020 0 repositories listed
-
Coordination without communication: optimal regret in two players multi-armed bandits14 Feb 2020 0 repositories listed
-
Tight Lower Bounds for Combinatorial Multi-Armed Bandits13 Feb 2020 0 repositories listed
-
A General Theory of the Stochastic Linear Bandit and Its Applications12 Feb 2020 0 repositories listed
-
Beyond UCB: Optimal and Efficient Contextual Bandits with Regression Oracles12 Feb 2020 0 repositories listed
-
Adversarial Attacks on Linear Contextual Bandits10 Feb 2020 0 repositories listed
-
Inference for Batched Bandits8 Feb 2020 0 repositories listed
-
Selfish Robustness and Equilibria in Multi-Player Bandits4 Feb 2020 0 repositories listed
-
The Price of Incentivizing Exploration: A Characterization via Thompson Sampling and Sample Complexity3 Feb 2020 0 repositories listed
-
A Closer Look at Small-loss Bounds for Bandits with Graph Feedback2 Feb 2020 0 repositories listed
-
Bandits with Knapsacks beyond the Worst-Case1 Feb 2020 0 repositories listed
-
Efficient and Robust Algorithms for Adversarial Linear Contextual Bandits1 Feb 2020 0 repositories listed
-
Ballooning Multi-Armed Bandits24 Jan 2020 0 repositories listed
-
Incentivising Exploration and Recommendations for Contextual Bandits with Payments22 Jan 2020 0 repositories listed