Browse State-of-the-Art › Sequential Decision Making › Papers, page 7
Sequential Decision Making
Papers archive 2025-07-28
archive papers tagged: 1,210 · with a code link: 351 · where Syntology ran a sample: 107 (90 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (107 of 1,210 tagged: 90 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument)
Page 7 of 13: papers 601 to 700 of 1,210, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Online Restless Multi-Armed Bandits with Long-Term Fairness Constraints16 Dec 2023 0 repositories listed
-
A Customizable Generator for Comic-Style Visual Narrative14 Dec 2023 0 repositories listed
-
Learning adaptive planning representations with natural language guidance13 Dec 2023 0 repositories listed
-
A Review of Cooperation in Multi-agent Learning8 Dec 2023 0 repositories listed
-
Distributed Optimization via Kernelized Multi-armed Bandits7 Dec 2023 0 repositories listed
-
Visual Encoders for Data-Efficient Imitation Learning in Modern Video Games4 Dec 2023 0 repositories listed
-
AI in Pharma for Personalized Sequential Decision-Making: Methods, Applications and Opportunities30 Nov 2023 0 repositories listed
-
History Filtering in Imperfect Information Games: Algorithms and Complexity24 Nov 2023 0 repositories listed
-
Code Models are Zero-shot Precondition Reasoners16 Nov 2023 0 repositories listed
-
An advantage based policy transfer algorithm for reinforcement learning with measures of transferability12 Nov 2023 0 repositories listed
-
An Expandable Machine Learning-Optimization Framework to Sequential Decision-Making12 Nov 2023 0 repositories listed
-
Likelihood Ratio Confidence Sets for Sequential Decision Making8 Nov 2023 0 repositories listed
-
Finding Increasingly Large Extremal Graphs with AlphaZero and Tabu Search6 Nov 2023 0 repositories listed
-
Safe Sequential Optimization for Switching Environments3 Nov 2023 0 repositories listed
-
Using General Value Functions to Learn Domain-Backed Inventory Management Policies3 Nov 2023 0 repositories listed
-
Rethinking Decision Transformer via Hierarchical Reinforcement Learning1 Nov 2023 0 repositories listed
-
Safety-aware Causal Representation for Trustworthy Offline Reinforcement Learning in Autonomous Driving31 Oct 2023 0 repositories listed
-
Regret-Minimization Algorithms for Multi-Agent Cooperative Learning Systems30 Oct 2023 0 repositories listed
-
High-Dimensional Prediction for Sequential Decision Making26 Oct 2023 0 repositories listed
-
O3D: Offline Data-driven Discovery and Distillation for Sequential Decision-Making with Large Language Models22 Oct 2023 0 repositories listed
-
Robust Visual Imitation Learning with Inverse Dynamics Representations22 Oct 2023 0 repositories listed
-
Provable Benefits of Multi-task RL under Non-Markovian Decision Making Processes20 Oct 2023 0 repositories listed
-
Auction-Based Scheduling18 Oct 2023 0 repositories listed
-
Keep Various Trajectories: Promoting Exploration of Ensemble Policies in Continuous Control17 Oct 2023 0 repositories listed
-
Partially Observable Stochastic Games with Neural Perception Mechanisms17 Oct 2023 0 repositories listed
-
Autonomous Tree-search Ability of Large Language Models14 Oct 2023 0 repositories listed
-
Evaluating Explanation Methods for Vision-and-Language Navigation10 Oct 2023 0 repositories listed
-
Global Convergence of Policy Gradient Methods in Reinforcement Learning, Games and Control8 Oct 2023 0 repositories listed
-
Optimal Sequential Decision-Making in Geosteering: A Reinforcement Learning Approach7 Oct 2023 0 repositories listed
-
Beyond Stationarity: Convergence Analysis of Stochastic Softmax Policy Gradient Methods4 Oct 2023 0 repositories listed
-
Towards a Unified Framework for Sequential Decision Making3 Oct 2023 0 repositories listed
-
Learning to Make Adherence-Aware Advice1 Oct 2023 0 repositories listed
-
State2Explanation: Concept-Based Explanations to Benefit Agent Learning and User Understanding21 Sep 2023 0 repositories listed
-
Delays in Reinforcement Learning20 Sep 2023 0 repositories listed
-
Safe POMDP Online Planning via Shielding19 Sep 2023 0 repositories listed
-
Efficient quantum recurrent reinforcement learning via quantum reservoir computing13 Sep 2023 0 repositories listed
-
Fidelity-Induced Interpretable Policy Extraction for Reinforcement Learning12 Sep 2023 0 repositories listed
-
Bootstrapping Adaptive Human-Machine Interfaces with Offline Reinforcement Learning7 Sep 2023 0 repositories listed
-
INTAGS: Interactive Agent-Guided Simulation4 Sep 2023 0 repositories listed
-
Pure Exploration under Mediators' Feedback29 Aug 2023 0 repositories listed
-
Bayesian Exploration Networks24 Aug 2023 0 repositories listed
-
A Robust Policy Bootstrapping Algorithm for Multi-objective Reinforcement Learning in Non-stationary Environments18 Aug 2023 0 repositories listed
-
Intrinsically Motivated Hierarchical Policy Learning in Multi-objective Markov Decision Processes18 Aug 2023 0 repositories listed
-
IMM: An Imitative Reinforcement Learning Approach with Predictive Representation Learning for Automatic Market Making17 Aug 2023 0 repositories listed
-
Multimodal Pretrained Models for Verifiable Sequential Decision-Making: Planning, Grounding, and Perception10 Aug 2023 0 repositories listed
-
Bayesian Inverse Transition Learning for Offline Settings9 Aug 2023 0 repositories listed
-
Deep Reinforcement Learning for Robust Goal-Based Wealth Management25 Jul 2023 0 repositories listed
-
DIP-RL: Demonstration-Inferred Preference Learning in Minecraft22 Jul 2023 0 repositories listed
-
On the Expressivity of Multidimensional Markov Reward22 Jul 2023 0 repositories listed
-
Selective Perception: Optimizing State Descriptions with Reinforcement Learning for Language Model Actors21 Jul 2023 0 repositories listed
-
Non-stationary Delayed Combinatorial Semi-Bandit with Causally Related Rewards18 Jul 2023 0 repositories listed
-
Multi-Player Zero-Sum Markov Games with Networked Separable Interactions13 Jul 2023 0 repositories listed
-
FAIRO: Fairness-aware Adaptation in Sequential-Decision Making for Human-in-the-Loop Systems12 Jul 2023 0 repositories listed
-
BOF-UCB: A Bayesian-Optimistic Frequentist Algorithm for Non-Stationary Contextual Bandits7 Jul 2023 0 repositories listed
-
TGRL: An Algorithm for Teacher Guided Reinforcement Learning6 Jul 2023 0 repositories listed
-
Generative Flow Networks: a Markov Chain Perspective4 Jul 2023 0 repositories listed
-
Provably Efficient UCB-type Algorithms For Learning Predictive State Representations1 Jul 2023 0 repositories listed
-
Thompson sampling for improved exploration in GFlowNets30 Jun 2023 0 repositories listed
-
A General Framework for Sequential Decision-Making under Adaptivity Constraints26 Jun 2023 0 repositories listed
-
Proportional Aggregation of Preferences for Sequential Decision Making26 Jun 2023 0 repositories listed
-
Large Sequence Models for Sequential Decision-Making: A Survey24 Jun 2023 0 repositories listed
-
You Can Trade Your Experience in Distributed Multi-Agent Multi-Armed Bandits19 Jun 2023 0 repositories listed
-
IF2Net: Innately Forgetting-Free Networks for Continual Learning18 Jun 2023 0 repositories listed
-
Langevin Thompson Sampling with Logarithmic Communication: Bandits and Reinforcement Learning15 Jun 2023 0 repositories listed
-
Provably Learning Nash Policies in Constrained Markov Potential Games13 Jun 2023 0 repositories listed
-
Bring Your Own (Non-Robust) Algorithm to Solve Robust MDPs by Estimating The Worst Kernel9 Jun 2023 0 repositories listed
-
Federated Linear Contextual Bandits with User-level Differential Privacy8 Jun 2023 0 repositories listed
-
AI-based Identification of Most Critical Cyberattacks in Industrial Systems7 Jun 2023 0 repositories listed
-
Data-Driven Online Model Selection With Regret Guarantees5 Jun 2023 0 repositories listed
-
Adversarial Attacks on Online Learning to Rank with Click Feedback26 May 2023 0 repositories listed
-
Self-Supervised Reinforcement Learning that Transfers using Random Features26 May 2023 0 repositories listed
-
Stability-penalty-adaptive follow-the-regularized-leader: Sparsity, game-dependency, and best-of-both-worlds26 May 2023 0 repositories listed
-
A Mini Review on the utilization of Reinforcement Learning with OPC UA24 May 2023 0 repositories listed
-
Evaluating Dynamic Conditional Quantile Treatment Effects with Applications in Ridesharing17 May 2023 0 repositories listed
-
Optimizing Memory Mapping Using Deep Reinforcement Learning11 May 2023 0 repositories listed
-
Replicating Complex Dialogue Policy of Humans via Offline Imitation Learning with Supervised Regularization6 May 2023 0 repositories listed
-
Knowledge Transfer from Teachers to Learners in Growing-Batch Reinforcement Learning5 May 2023 0 repositories listed
-
A Review of Symbolic, Subsymbolic and Hybrid Methods for Sequential Decision Making20 Apr 2023 0 repositories listed
-
Inducing Stackelberg Equilibrium through Spatio-Temporal Sequential Decision-Making in Multi-Agent Reinforcement Learning20 Apr 2023 0 repositories listed
-
Model Based Reinforcement Learning for Personalized Heparin Dosing19 Apr 2023 0 repositories listed
-
AoI-Delay Tradeoff in Mobile Edge Caching: A Mixed-Order Drift-Plus-Penalty Algorithm18 Apr 2023 0 repositories listed
-
Synthetically Generating Human-like Data for Sequential Decision Making Tasks via Reward-Shaped Imitation Learning14 Apr 2023 0 repositories listed
-
Experimentation Platforms Meet Reinforcement Learning: Bayesian Sequential Decision-Making for Continuous Monitoring2 Apr 2023 0 repositories listed
-
Risk-Sensitive and Robust Model-Based Reinforcement Learning and Planning2 Apr 2023 0 repositories listed
-
Accelerating exploration and representation learning with offline pre-training31 Mar 2023 0 repositories listed
-
Boosting Reinforcement Learning and Planning with Demonstrations: A Survey23 Mar 2023 0 repositories listed
-
Welfare Maximization Algorithm for Solving Budget-Constrained Multi-Component POMDPs18 Mar 2023 0 repositories listed
-
Reinforcement Learning for Omega-Regular Specifications on Continuous-Time MDP16 Mar 2023 0 repositories listed
-
Latent-Conditioned Policy Gradient for Multi-Objective Deep Reinforcement Learning15 Mar 2023 0 repositories listed
-
Sample-efficient Adversarial Imitation Learning14 Mar 2023 0 repositories listed
-
Variance-aware robust reinforcement learning with linear function approximation under heavy-tailed rewards9 Mar 2023 0 repositories listed
-
Automated Cyber Defence: A Review8 Mar 2023 0 repositories listed
-
adaPARL: Adaptive Privacy-Aware Reinforcement Learning for Sequential-Decision Making Human-in-the-Loop Systems7 Mar 2023 0 repositories listed
-
Exploration via Epistemic Value Estimation7 Mar 2023 0 repositories listed
-
Deep Offline Reinforcement Learning for Real-world Treatment Optimization Applications15 Feb 2023 0 repositories listed
-
Effective Dimension in Bandit Problems under Censorship14 Feb 2023 0 repositories listed
-
Statistical Complexity and Optimal Algorithms for Non-linear Ridge Bandits12 Feb 2023 0 repositories listed
-
A Survey on Causal Reinforcement Learning10 Feb 2023 0 repositories listed
-
Multi-task Representation Learning for Pure Exploration in Linear Bandits9 Feb 2023 0 repositories listed
-
A Scale-Independent Multi-Objective Reinforcement Learning with Convergence Analysis8 Feb 2023 0 repositories listed