Browse State-of-the-Art › Sequential Decision Making › Papers, page 8
Sequential Decision Making
Papers archive 2025-07-28
archive papers tagged: 1,210 · with a code link: 351 · where Syntology ran a sample: 107 (90 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (107 of 1,210 tagged: 90 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument)
Page 8 of 13: papers 701 to 800 of 1,210, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Linear Partial Monitoring for Sequential Decision-Making: Algorithms, Regret Bounds and Applications7 Feb 2023 0 repositories listed
-
A Strong Baseline for Batch Imitation Learning6 Feb 2023 0 repositories listed
-
A Reduction-based Framework for Sequential Decision Making with Delayed Feedback3 Feb 2023 0 repositories listed
-
31 Jan 2023 0 repositories listed
-
Safe Posterior Sampling for Constrained MDPs with Bounded Constraint Violation27 Jan 2023 0 repositories listed
-
On the Global Convergence of Risk-Averse Policy Gradient Methods with Expected Conditional Risk Measures26 Jan 2023 0 repositories listed
-
Inducing Point Allocation for Sparse Gaussian Processes in High-Throughput Bayesian Optimisation24 Jan 2023 0 repositories listed
-
SMART: Self-supervised Multi-task pretrAining with contRol Transformers24 Jan 2023 0 repositories listed
-
GBOSE: Generalized Bandit Orthogonalized Semiparametric Estimation20 Jan 2023 0 repositories listed
-
Decision-Focused Evaluation: Analyzing Performance of Deployed Restless Multi-Arm Bandits19 Jan 2023 0 repositories listed
-
Neuro-Symbolic World Models for Adapting to Open World Novelty16 Jan 2023 0 repositories listed
-
Neuro-symbolic Meta Reinforcement Learning for Trading15 Jan 2023 0 repositories listed
-
Fairness and Sequential Decision Making: Limits, Lessons, and Opportunities13 Jan 2023 0 repositories listed
-
Asynchronous training of quantum reinforcement learning12 Jan 2023 0 repositories listed
-
Sequential Fair Resource Allocation under a Markov Decision Process Framework10 Jan 2023 0 repositories listed
-
7 Jan 2023 0 repositories listed
-
Value Enhancement of Reinforcement Learning via Efficient and Robust Trust Region Optimization5 Jan 2023 0 repositories listed
-
Local Differential Privacy for Sequential Decision Making in a Changing Environment2 Jan 2023 0 repositories listed
-
Online Statistical Inference for Contextual Bandits via Stochastic Gradient Descent30 Dec 2022 0 repositories listed
-
Quantile Off-Policy Evaluation via Deep Conditional Generative Learning29 Dec 2022 0 repositories listed
-
Offline Reinforcement Learning via Linear-Programming with Error-Bound Induced Constraints28 Dec 2022 0 repositories listed
-
Linear Combinatorial Semi-Bandit with Causally Related Rewards25 Dec 2022 0 repositories listed
-
Online Statistical Inference in Decision-Making with Matrix Context21 Dec 2022 0 repositories listed
-
Invariant Lipschitz Bandits: A Side Observation Approach14 Dec 2022 0 repositories listed
-
Reinforced Approximate Exploratory Data Analysis12 Dec 2022 0 repositories listed
-
Model-based trajectory stitching for improved behavioural cloning and its applications8 Dec 2022 0 repositories listed
-
Automaton-Based Representations of Task Knowledge from Generative Language Models4 Dec 2022 0 repositories listed
-
Winning the CityLearn Challenge: Adaptive Optimization with Evolutionary Search under Trajectory-based Guidance4 Dec 2022 0 repositories listed
-
Distributed Deep Reinforcement Learning: A Survey and A Multi-Player Multi-Agent Learning Toolbox1 Dec 2022 0 repositories listed
-
Continuous Episodic Control28 Nov 2022 0 repositories listed
-
Is Conditional Generative Modeling all you need for Decision-Making?28 Nov 2022 0 repositories listed
-
Multi-Environment Pretraining Enables Transfer to Action Limited Datasets23 Nov 2022 0 repositories listed
-
A Deep Reinforcement Learning Approach to Rare Event Estimation22 Nov 2022 0 repositories listed
-
Don't Watch Me: A Spatio-Temporal Trojan Attack on Deep-Reinforcement-Learning-Augment Autonomous Driving22 Nov 2022 0 repositories listed
-
A Survey on Reinforcement Learning in Aviation Applications3 Nov 2022 0 repositories listed
-
Teacher-student curriculum learning for reinforcement learning31 Oct 2022 0 repositories listed
-
HSVI can solve zero-sum Partially Observable Stochastic Games26 Oct 2022 0 repositories listed
-
Quantum deep recurrent reinforcement learning26 Oct 2022 0 repositories listed
-
Sequential Decision Making on Unmatched Data using Bayesian Kernel Embeddings25 Oct 2022 0 repositories listed
-
Integrating Policy Summaries with Reward Decomposition for Explaining Reinforcement Learning Agents21 Oct 2022 0 repositories listed
-
Fine-Grained Session Recommendations in E-commerce using Deep Reinforcement Learning20 Oct 2022 0 repositories listed
-
Movement Penalized Bayesian Optimization with Application to Wind Energy Systems14 Oct 2022 0 repositories listed
-
Learning on the Edge: Online Learning with Stochastic Feedback Graphs9 Oct 2022 0 repositories listed
-
Advice Conformance Verification by Reinforcement Learning agents for Human-in-the-Loop7 Oct 2022 0 repositories listed
-
Reinforcement Learning Approach for Multi-Agent Flexible Scheduling Problems7 Oct 2022 0 repositories listed
-
Generalizing Bayesian Optimization with Decision-theoretic Entropies4 Oct 2022 0 repositories listed
-
Hyperbolic Deep Reinforcement Learning4 Oct 2022 0 repositories listed
-
Offline Reinforcement Learning with Differentiable Function Approximation is Provably Efficient3 Oct 2022 0 repositories listed
-
Blessing from Human-AI Interaction: Super Reinforcement Learning in Confounded Environments29 Sep 2022 0 repositories listed
-
Modeling driver's evasive behavior during safety-critical lane changes:Two-dimensional time-to-collision and deep reinforcement learning29 Sep 2022 0 repositories listed
-
Optimistic MLE -- A Generic Model-based Algorithm for Partially Observable Sequential Decision Making29 Sep 2022 0 repositories listed
-
Reinforcement Learning with Non-Exponential Discounting27 Sep 2022 0 repositories listed
-
On Efficient Online Imitation Learning via Classification26 Sep 2022 0 repositories listed
-
Deep Reinforcement Learning for Adaptive Mesh Refinement25 Sep 2022 0 repositories listed
-
Graph Neural Networks for Multi-Robot Active Information Acquisition24 Sep 2022 0 repositories listed
-
Thompson Sampling with Virtual Helping Agents16 Sep 2022 0 repositories listed
-
A Survey on Large-Population Systems and Scalable Multi-Agent Reinforcement Learning8 Sep 2022 0 repositories listed
-
Sequential Information Design: Learning to Persuade in the Dark8 Sep 2022 0 repositories listed
-
MetaTrader: An Reinforcement Learning Approach Integrating Diverse Policies for Portfolio Optimization1 Sep 2022 0 repositories listed
-
JARVIS: A Neuro-Symbolic Commonsense Reasoning Framework for Conversational Embodied Agents28 Aug 2022 0 repositories listed
-
Entropy Regularization for Population Estimation24 Aug 2022 0 repositories listed
-
Sampling Through the Lens of Sequential Decision Making17 Aug 2022 0 repositories listed
-
Streaming Adaptive Submodular Maximization17 Aug 2022 0 repositories listed
-
Understanding the stochastic dynamics of sequential decision-making processes: A path-integral analysis of multi-armed bandits11 Aug 2022 0 repositories listed
-
Deep VULMAN: A Deep Reinforcement Learning-Enabled Cyber Vulnerability Management Framework3 Aug 2022 0 repositories listed
-
A Bayesian Approach to Learning Bandit Structure in Markov Decision Processes30 Jul 2022 0 repositories listed
-
Sample-efficient Safe Learning for Online Nonlinear Control with Control Barrier Functions29 Jul 2022 0 repositories listed
-
Branch Ranking for Efficient Mixed-Integer Programming via Offline Ranking-based Policy Learning26 Jul 2022 0 repositories listed
-
Partial-Monotone Adaptive Submodular Maximization26 Jul 2022 0 repositories listed
-
Adaptive Asynchronous Control Using Meta-learned Neural Ordinary Differential Equations25 Jul 2022 0 repositories listed
-
High dimensional stochastic linear contextual bandit with missing covariates22 Jul 2022 0 repositories listed
-
Learn Continuously, Act Discretely: Hybrid Action-Space Reinforcement Learning For Optimal Execution22 Jul 2022 0 repositories listed
-
Delayed Feedback in Generalised Linear Bandits Revisited21 Jul 2022 0 repositories listed
-
Strategising template-guided needle placement for MR-targeted prostate biopsy21 Jul 2022 0 repositories listed
-
Online Learning with Off-Policy Feedback18 Jul 2022 0 repositories listed
-
Guaranteed Discovery of Control-Endogenous Latent States with Multi-Step Inverse Models17 Jul 2022 0 repositories listed
-
Scaling up ML-based Black-box Planning with Partial STRIPS Models10 Jul 2022 0 repositories listed
-
Improving saliency models' predictions of the next fixation with humans' intrinsic cost of gaze shifts9 Jul 2022 0 repositories listed
-
Learning Optimal Solutions via an LSTM-Optimization Framework6 Jul 2022 0 repositories listed
-
Reinforcement Learning Approaches for the Orienteering Problem with Stochastic and Dynamic Release Dates2 Jul 2022 0 repositories listed
-
Reinforcement Learning Based Dynamic Model Combination for Time Series Forecasting28 Jun 2022 0 repositories listed
-
Utility Theory for Sequential Decision Making27 Jun 2022 0 repositories listed
-
Estimating Link Flows in Road Networks with Synthetic Trajectory Data Generation: Reinforcement Learning-based Approaches26 Jun 2022 0 repositories listed
-
A Survey on Model-based Reinforcement Learning19 Jun 2022 0 repositories listed
-
Federated Learning with Uncertainty via Distilled Predictive Distributions15 Jun 2022 0 repositories listed
-
Adaptive Rollout Length for Model-Based RL Using Model-Free Deep RL6 Jun 2022 0 repositories listed
-
Convergence and sample complexity of natural policy gradient primal-dual methods for constrained MDPs6 Jun 2022 0 repositories listed
-
Between Rate-Distortion Theory & Value Equivalence in Model-Based Reinforcement Learning4 Jun 2022 0 repositories listed
-
Deciding What to Model: Value-Equivalent Sampling for Reinforcement Learning4 Jun 2022 0 repositories listed
-
Interpolating Between Softmax Policy Gradient and Neural Replicator Dynamics with Capped Implicit Exploration4 Jun 2022 0 repositories listed
-
A Deep Reinforcement Learning Framework For Column Generation3 Jun 2022 0 repositories listed
-
Adaptive Robust Online Portfolio Selection2 Jun 2022 0 repositories listed
-
A Near-Optimal Best-of-Both-Worlds Algorithm for Online Learning with Feedback Graphs1 Jun 2022 0 repositories listed
-
Multi-Agent Learning of Numerical Methods for Hyperbolic PDEs with Factored Dec-MDP31 May 2022 0 repositories listed
-
Causal Explanations for Sequential Decision Making Under Uncertainty30 May 2022 0 repositories listed
-
Adaptive Sampling for Discovery30 May 2022 0 repositories listed
-
Flow-based Recurrent Belief State Learning for POMDPs23 May 2022 0 repositories listed
-
Survey on Fair Reinforcement Learning: Theory and Practice20 May 2022 0 repositories listed
-
Marginal and Joint Cross-Entropies & Predictives for Online Bayesian Inference, Active Learning, and Active Sampling18 May 2022 0 repositories listed
-
Representation Learning for Context-Dependent Decision-Making12 May 2022 0 repositories listed