Browse State-of-the-Art › Sequential Decision Making › Papers, page 9
Sequential Decision Making
Papers archive 2025-07-28
archive papers tagged: 1,210 · with a code link: 351 · where Syntology ran a sample: 107 (90 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (107 of 1,210 tagged: 90 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument)
Page 9 of 13: papers 801 to 900 of 1,210, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Hierarchical Constrained Stochastic Shortest Path Planning via Cost Budget Allocation11 May 2022 0 repositories listed
-
Federated Multi-Armed Bandits Under Byzantine Attacks9 May 2022 0 repositories listed
-
Towards Flexible Inference in Sequential Decision Problems via Bidirectional Transformers28 Apr 2022 0 repositories listed
-
Integrating Reward Maximization and Population Estimation: Sequential Decision-Making for Internal Revenue Service Audit Selection25 Apr 2022 0 repositories listed
-
GFCL: A GRU-based Federated Continual Learning Framework against Data Poisoning Attacks in IoV23 Apr 2022 0 repositories listed
-
SAAC: Safe Reinforcement Learning as an Adversarial Game of Actor-Critics20 Apr 2022 0 repositories listed
-
Training and Evaluation of Deep Policies using Reinforcement Learning and Generative Models18 Apr 2022 0 repositories listed
-
Worst-case Performance of Greedy Policies in Bandits with Imperfect Context Observations10 Apr 2022 0 repositories listed
-
Actual Causality and Responsibility Attribution in Decentralized Partially Observable Markov Decision Processes1 Apr 2022 0 repositories listed
-
An Online Approach to Solve the Dynamic Vehicle Routing Problem with Stochastic Trip Requests for Paratransit Services28 Mar 2022 0 repositories listed
-
NovGrid: A Flexible Grid World for Evaluating Agent Response to Novelty23 Mar 2022 0 repositories listed
-
Model-based Multi-agent Reinforcement Learning: Recent Progress and Prospects20 Mar 2022 0 repositories listed
-
The price of unfairness in linear bandits with biased feedback18 Mar 2022 0 repositories listed
-
Near-optimal Offline Reinforcement Learning with Linear Representation: Leveraging Variance Information with Pessimism11 Mar 2022 0 repositories listed
-
A Trainable Approach to Zero-delay Smoothing Spline Interpolation7 Mar 2022 0 repositories listed
-
Reinforcement Learning in Modern Biostatistics: Constructing Optimal Adaptive Interventions4 Mar 2022 0 repositories listed
-
Linear Stochastic Bandits over a Bit-Constrained Channel2 Mar 2022 0 repositories listed
-
Simulating Network Paths with Recurrent Buffering Units23 Feb 2022 0 repositories listed
-
A Survey of Explainable Reinforcement Learning17 Feb 2022 0 repositories listed
-
MuZero with Self-competition for Rate Control in VP9 Video Compression14 Feb 2022 0 repositories listed
-
Provably Efficient Causal Model-Based Reinforcement Learning for Systematic Generalization14 Feb 2022 0 repositories listed
-
Sequential Bayesian experimental designs via reinforcement learning14 Feb 2022 0 repositories listed
-
Provable Reinforcement Learning with a Short-Term Memory8 Feb 2022 0 repositories listed
-
Improved Regret for Differentially Private Exploration in Linear MDP2 Feb 2022 0 repositories listed
-
Meta-Learning Hypothesis Spaces for Sequential Decision-making1 Feb 2022 0 repositories listed
-
Generalizing Off-Policy Evaluation From a Causal Perspective For Sequential Decision-Making20 Jan 2022 0 repositories listed
-
Active Learning-Based Multistage Sequential Decision-Making Model with Application on Common Bile Duct Stone Evaluation13 Jan 2022 0 repositories listed
-
Automated Reinforcement Learning: An Overview13 Jan 2022 0 repositories listed
-
Multi-echelon Supply Chains with Uncertain Seasonal Demands and Lead Times Using Deep Reinforcement Learning12 Jan 2022 0 repositories listed
-
Subgoal-Based Explanations for Unreliable Intelligent Decision Support Systems11 Jan 2022 0 repositories listed
-
State of the Art of User Simulation approaches for conversational information retrieval10 Jan 2022 0 repositories listed
-
Temporal Detection of Anomalies via Actor-Critic Based Controlled Sensing3 Jan 2022 0 repositories listed
-
Socially-Optimal Mechanism Design for Incentivized Online Learning29 Dec 2021 0 repositories listed
-
Reducing Planning Complexity of General Reinforcement Learning with Non-Markovian Abstractions26 Dec 2021 0 repositories listed
-
A Survey on Interpretable Reinforcement Learning24 Dec 2021 0 repositories listed
-
Revisiting Game Representations: The Hidden Costs of Efficiency in Sequential Decision-making Algorithms20 Dec 2021 0 repositories listed
-
Application of Deep Reinforcement Learning to Payment Fraud8 Dec 2021 0 repositories listed
-
First-Order Regret in Reinforcement Learning with Linear Function Approximation: A Robust Estimation Approach7 Dec 2021 0 repositories listed
-
MDPFuzz: Testing Models Solving Markov Decision Processes6 Dec 2021 0 repositories listed
-
Temporal-Spatial Causal Interpretations for Vision-Based Reinforcement Learning6 Dec 2021 0 repositories listed
-
Improving Zero-shot Generalization in Offline Reinforcement Learning using Generalized Similarity Functions29 Nov 2021 0 repositories listed
-
Pessimistic Model Selection for Offline Deep Reinforcement Learning29 Nov 2021 0 repositories listed
-
Identification of Subgroups With Similar Benefits in Off-Policy Policy Evaluation28 Nov 2021 0 repositories listed
-
Efficient and Optimal Algorithms for Contextual Dueling Bandits under Realizability24 Nov 2021 0 repositories listed
-
Neural Column Generation for Capacitated Vehicle Routing24 Nov 2021 0 repositories listed
-
Adversarial Deep Learning for Online Resource Allocation19 Nov 2021 0 repositories listed
-
Deep Reinforcement Learning for Entity Alignment16 Nov 2021 0 repositories listed
-
Route Optimization via Environment-Aware Deep Network and Reinforcement Learning16 Nov 2021 0 repositories listed
-
Automatic Goal Generation using Dynamical Distance Learning7 Nov 2021 0 repositories listed
-
Regular Decision Processes for Grid Worlds5 Nov 2021 0 repositories listed
-
Partial-Adaptive Submodular Maximization1 Nov 2021 0 repositories listed
-
A Law of Iterated Logarithm for Multi-Agent Reinforcement Learning27 Oct 2021 0 repositories listed
-
The Value of Information When Deciding What to Learn26 Oct 2021 0 repositories listed
-
HSVI for zs-POSGs using Concavity, Convexity and Lipschitz Properties25 Oct 2021 0 repositories listed
-
Analysis of Thompson Sampling for Partially Observable Contextual Multi-Armed Bandits23 Oct 2021 0 repositories listed
-
Anti-Concentrated Confidence Bonuses for Scalable Exploration21 Oct 2021 0 repositories listed
-
SS-MAIL: Self-Supervised Multi-Agent Imitation Learning18 Oct 2021 0 repositories listed
-
Learning Cooperation and Online Planning Through Simulation and Graph Convolutional Network16 Oct 2021 0 repositories listed
-
Human-Aware Robot Navigation via Reinforcement Learning with Hindsight Experience Replay and Curriculum Learning9 Oct 2021 0 repositories listed
-
When to Call Your Neighbor? Strategic Communication in Cooperative Stochastic Bandits8 Oct 2021 0 repositories listed
-
Compositional Q-learning for electrolyte repletion with imbalanced patient sub-populations6 Oct 2021 0 repositories listed
-
Gambits: Theory and Evidence5 Oct 2021 0 repositories listed
-
Partner-Aware Algorithms in Decentralized Cooperative Bandit Teams2 Oct 2021 0 repositories listed
-
CrowdPlay: Crowdsourcing human demonstration data for offline learning in Atari games29 Sep 2021 0 repositories listed
-
Decentralized Cross-Entropy Method for Model-Based Reinforcement Learning29 Sep 2021 0 repositories listed
-
Generalizing Successor Features to continuous domains for Multi-task Learning29 Sep 2021 0 repositories listed
-
Goal Randomization for Playing Text-based Games without a Reward Function29 Sep 2021 0 repositories listed
-
Maximizing Ensemble Diversity in Deep Reinforcement Learning29 Sep 2021 0 repositories listed
-
Neural Bootstrapping Attention for Neural Processes29 Sep 2021 0 repositories listed
-
PDQN - A Deep Reinforcement Learning Method for Planning with Long Delays: Optimization of Manufacturing Dispatching29 Sep 2021 0 repositories listed
-
Deep Reinforcement Learning Versus Evolution Strategies: A Comparative Survey28 Sep 2021 0 repositories listed
-
Reinforcement Learning for Quantitative Trading28 Sep 2021 0 repositories listed
-
The f-Divergence Reinforcement Learning Framework24 Sep 2021 0 repositories listed
-
Dimension-Free Rates for Natural Policy Gradient in Multi-Agent Reinforcement Learning23 Sep 2021 0 repositories listed
-
On Optimal Robustness to Adversarial Corruption in Online Decision Problems22 Sep 2021 0 repositories listed
-
Deep Bayesian Estimation for Dynamic Treatment Regimes with a Long Follow-up Time20 Sep 2021 0 repositories listed
-
Accelerating Offline Reinforcement Learning Application in Real-Time Bidding and Recommendation: Potential Use of Simulation17 Sep 2021 0 repositories listed
-
Learning-to-defer for sequential medical decision-making under uncertainty13 Sep 2021 0 repositories listed
-
Federated Ensemble Model-based Reinforcement Learning in Edge Computing12 Sep 2021 0 repositories listed
-
Optimal Path Planning of Autonomous Marine Vehicles in Stochastic Dynamic Ocean Flows using a GPU-Accelerated Algorithm2 Sep 2021 0 repositories listed
-
No DBA? No regret! Multi-armed bandits for index tuning of analytical and HTAP workloads with provable guarantees23 Aug 2021 0 repositories listed
-
Sequential Stochastic Optimization in Separable Learning Environments21 Aug 2021 0 repositories listed
-
Explainable Reinforcement Learning for Broad-XAI: A Conceptual Framework and Survey20 Aug 2021 0 repositories listed
-
Improving Human Sequential Decision-Making with Reinforcement Learning19 Aug 2021 0 repositories listed
-
TDM: Trustworthy Decision-Making via Interpretability Enhancement13 Aug 2021 0 repositories listed
-
Joint AP Probing and Scheduling: A Contextual Bandit Approach6 Aug 2021 0 repositories listed
-
Lyapunov-based uncertainty-aware safe reinforcement learning29 Jul 2021 0 repositories listed
-
On Blame Attribution for Accountable Multi-Agent Sequential Decision Making26 Jul 2021 0 repositories listed
-
Robust Adaptive Submodular Maximization23 Jul 2021 0 repositories listed
-
Reinforcement Learning Agent Training with Goals for Real World Tasks21 Jul 2021 0 repositories listed
-
High-Accuracy Model-Based Reinforcement Learning, a Survey17 Jul 2021 0 repositories listed
-
Recent Advances in Leveraging Human Guidance for Sequential Decision-Making Tasks13 Jul 2021 0 repositories listed
-
Metalearning Linear Bandits by Prior Update12 Jul 2021 0 repositories listed
-
Bayesian decision-making under misspecified priors with applications to meta-learning3 Jul 2021 0 repositories listed
-
Markov Decision Process modeled with Bandits for Sequential Decision Making in Linear-flow1 Jul 2021 0 repositories listed
-
Decision making with dynamic probabilistic forecasts30 Jun 2021 0 repositories listed
-
Action Set Based Policy Optimization for Safe Power Grid Management29 Jun 2021 0 repositories listed
-
UAV-assisted Online Machine Learning over Multi-Tiered Networks: A Hierarchical Nested Personalized Federated Learning Approach29 Jun 2021 0 repositories listed
-
A Reinforcement Learning Approach for Sequential Spatial Transformer Networks27 Jun 2021 0 repositories listed
-
Building Intelligent Autonomous Navigation Agents25 Jun 2021 0 repositories listed