Browse State-of-the-Art › Sequential Decision Making › Papers, page 5
Sequential Decision Making
Papers archive 2025-07-28
archive papers tagged: 1,210 · with a code link: 351 · where Syntology ran a sample: 107 (90 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (107 of 1,210 tagged: 90 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument)
Page 5 of 13: papers 401 to 500 of 1,210, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
A Framework of decision-relevant observability: Reinforcement Learning converges under relative ignorability10 Apr 2025 0 repositories listed
-
RAISE: Reinforenced Adaptive Instruction Selection For Large Language Models9 Apr 2025 0 repositories listed
-
A Classification View on Meta Learning Bandits6 Apr 2025 0 repositories listed
-
From Automation to Autonomy in Smart Manufacturing: A Bayesian Optimization Framework for Modeling Multi-Objective Experimentation and Sequential Decision Making5 Apr 2025 0 repositories listed
-
MORAL: A Multimodal Reinforcement Learning Framework for Decision Making in Autonomous Laboratories4 Apr 2025 0 repositories listed
-
Counterfactual Inference under Thompson Sampling3 Apr 2025 0 repositories listed
-
Towards Enabling Learning for Time-Varying finite horizon Sequential Decision-Making Problems*2 Apr 2025 0 repositories listed
-
Off-Policy Evaluation for Sequential Persuasion Process with Unobserved Confounding1 Apr 2025 0 repositories listed
-
Remember, but also, Forget: Bridging Myopic and Perfect Recall Fairness with Past-Discounting1 Apr 2025 0 repositories listed
-
Exploring Explainable Multi-player MCTS-minimax Hybrids in Board Game Using Process Mining30 Mar 2025 0 repositories listed
-
Offline Action-Free Learning of Ex-BMDPs by Comparing Diverse Datasets26 Mar 2025 0 repositories listed
-
Observation Adaptation via Annealed Importance Resampling for Partially Observable Markov Decision Processes25 Mar 2025 0 repositories listed
-
VIPER: Visual Perception and Explainable Reasoning for Sequential Decision-Making19 Mar 2025 0 repositories listed
-
Reasoning in visual navigation of end-to-end trained agents: a dynamical systems approach11 Mar 2025 0 repositories listed
-
Zero-Shot Action Generalization with Limited Observations11 Mar 2025 0 repositories listed
-
Graph-Dependent Regret Bounds in Multi-Armed Bandits with Interference10 Mar 2025 0 repositories listed
-
GFlowVLM: Enhancing Multi-step Reasoning in Vision-Language Models with Generative Flow Networks9 Mar 2025 0 repositories listed
-
Bayesian Graph Traversal7 Mar 2025 0 repositories listed
-
Adversarial Agents: Black-Box Evasion Attacks with Reinforcement Learning3 Mar 2025 0 repositories listed
-
Semi-Parametric Batched Global Multi-Armed Bandits with Covariates1 Mar 2025 0 repositories listed
-
Shaping Laser Pulses with Reinforcement Learning1 Mar 2025 0 repositories listed
-
The Evolving Landscape of LLM- and VLM-Integrated Reinforcement Learning21 Feb 2025 0 repositories listed
-
Reinforcement Learning for Ultrasound Image Analysis A Comprehensive Review of Advances and Applications20 Feb 2025 0 repositories listed
-
Learning Fair Policies for Infectious Diseases Mitigation using Path Integral Control14 Feb 2025 0 repositories listed
-
Self-Evaluation for Job-Shop Scheduling12 Feb 2025 0 repositories listed
-
Advancing Autonomous VLM Agents via Variational Subgoal-Conditioned Reinforcement Learning11 Feb 2025 0 repositories listed
-
A Survey on Explainable Deep Reinforcement Learning8 Feb 2025 0 repositories listed
-
Unifying and Optimizing Data Values for Selection via Sequential-Decision-Making6 Feb 2025 0 repositories listed
-
Online Clustering of Dueling Bandits4 Feb 2025 0 repositories listed
-
VLA-Cache: Towards Efficient Vision-Language-Action Model via Adaptive Token Caching in Robotic Manipulation4 Feb 2025 0 repositories listed
-
Meta-Prompt Optimization for LLM-Based Sequential Decision Making2 Feb 2025 0 repositories listed
-
Offline Learning for Combinatorial Multi-armed Bandits31 Jan 2025 0 repositories listed
-
Contextual Online Decision Making with Infinite-Dimensional Functional Regression30 Jan 2025 0 repositories listed
-
Deceptive Sequential Decision-Making via Regularized Policy Optimization30 Jan 2025 0 repositories listed
-
HD-CB: The First Exploration of Hyperdimensional Computing for Contextual Bandits Problems28 Jan 2025 0 repositories listed
-
27 Jan 2025 0 repositories listed Syntology 0 ran · 1 unverified (of 1 harvested sample) · 1 pointer-only (licence)
-
Bridging Visualization and Optimization: Multimodal Large Language Models on Graph-Structured Combinatorial Optimization21 Jan 2025 0 repositories listed
-
Embodied Scene Understanding for Vision Language Models via MetaVQA15 Jan 2025 0 repositories listed
-
All AI Models are Wrong, but Some are Optimal10 Jan 2025 0 repositories listed
-
Counterfactually Fair Reinforcement Learning via Sequential Data Preprocessing10 Jan 2025 0 repositories listed
-
Generative Flow Networks: Theory and Applications to Structure Learning9 Jan 2025 0 repositories listed
-
Explainable Reinforcement Learning via Temporal Policy Decomposition7 Jan 2025 0 repositories listed
-
Beyond 𝒪(√(T)) Regret: Decoupling Learning and Decision-making in Online Linear Programming6 Jan 2025 0 repositories listed
-
Demystifying Online Clustering of Bandits: Enhanced Exploration Under Stochastic and Smoothed Adversarial Contexts1 Jan 2025 0 repositories listed
-
SeqMvRL: A Sequential Fusion Framework for Multi-view Representation Learning1 Jan 2025 0 repositories listed
-
Optimizing Fantasy Sports Team Selection with Deep Reinforcement Learning26 Dec 2024 0 repositories listed
-
HyperQ-Opt: Q-learning for Hyperparameter Optimization23 Dec 2024 0 repositories listed
-
Fairness in Reinforcement Learning with Bisimulation Metrics22 Dec 2024 0 repositories listed
-
GAS: Generative Auto-bidding with Post-training Search22 Dec 2024 0 repositories listed
-
Subgoal Discovery Using a Free Energy Paradigm and State Aggregations21 Dec 2024 0 repositories listed
-
DriveGPT: Scaling Autoregressive Behavior Models for Driving19 Dec 2024 0 repositories listed
-
Threshold UCT: Cost-Constrained Monte Carlo Tree Search with Pareto Curves18 Dec 2024 0 repositories listed
-
Active Reinforcement Learning Strategies for Offline Policy Improvement17 Dec 2024 0 repositories listed
-
Solving Robust Markov Decision Processes: Generic, Reliable, Efficient13 Dec 2024 0 repositories listed
-
Effective Reward Specification in Deep Reinforcement Learning10 Dec 2024 0 repositories listed
-
Optimizing Sensor Redundancy in Sequential Decision-Making Problems10 Dec 2024 0 repositories listed
-
Swarm Behavior Cloning10 Dec 2024 0 repositories listed
-
A Note on Sample Complexity of Interactive Imitation Learning with Log Loss9 Dec 2024 0 repositories listed
-
Conservative Contextual Bandits: Beyond Linear Representations9 Dec 2024 0 repositories listed
-
Integrated Sensing and Communications for Low-Altitude Economy: A Deep Reinforcement Learning Approach5 Dec 2024 0 repositories listed
-
Failure Probability Estimation for Black-Box Autonomous Systems using State-Dependent Importance Sampling Proposals3 Dec 2024 0 repositories listed
-
Selective Reviews of Bandit Problems in AI via a Statistical View3 Dec 2024 0 repositories listed
-
Technical Report on Reinforcement Learning Control on the Lucas-Nülle Inverted Pendulum3 Dec 2024 0 repositories listed
-
Time-Series-Informed Closed-loop Learning for Sequential Decision Making and Control3 Dec 2024 0 repositories listed
-
STEVE-Audio: Expanding the Goal Conditioning Modalities of Embodied Agents in Minecraft1 Dec 2024 0 repositories listed
-
Market Making without Regret21 Nov 2024 0 repositories listed
-
Robust Markov Decision Processes: A Place Where AI and Formal Methods Meet18 Nov 2024 0 repositories listed
-
Towards Sample-Efficiency and Generalization of Transfer and Inverse Reinforcement Learning: A Comprehensive Literature Review15 Nov 2024 0 repositories listed
-
Fair Resource Allocation in Weakly Coupled Markov Decision Processes14 Nov 2024 0 repositories listed
-
Collaborative and Federated Black-box Optimization: A Bayesian Optimization Perspective12 Nov 2024 0 repositories listed
-
EARL-BO: Reinforcement Learning for Multi-Step Lookahead, High-Dimensional Bayesian Optimization31 Oct 2024 0 repositories listed
-
Quantum Reinforcement Learning-Based Two-Stage Unit Commitment Framework for Enhanced Power Systems Robustness28 Oct 2024 0 repositories listed
-
Annotation Efficiency: Identifying Hard Samples via Blocked Sparse Linear Bandits26 Oct 2024 0 repositories listed
-
Reinforcement Learning for Aligning Large Language Models Agents with Interactive Environments: Quantifying and Mitigating Prompt Overfitting25 Oct 2024 0 repositories listed
-
Robust Thompson Sampling Algorithms Against Reward Poisoning Attacks25 Oct 2024 0 repositories listed
-
Convex Markov Games: A New Frontier for Multi-Agent Reinforcement Learning22 Oct 2024 0 repositories listed
-
Hierarchical Upper Confidence Bounds for Constrained Online Learning22 Oct 2024 0 repositories listed
-
SAC-GLAM: Improving Online RL for LLM agents with Soft Actor-Critic and Hindsight Relabeling16 Oct 2024 0 repositories listed
-
Communication-Control Codesign for Large-Scale Wireless Networked Control Systems15 Oct 2024 0 repositories listed
-
Burning RED: Unlocking Subtask-Driven Reinforcement Learning and Risk-Awareness in Average-Reward Markov Decision Processes14 Oct 2024 0 repositories listed
-
Efficient Reinforcement Learning with Large Language Model Priors10 Oct 2024 0 repositories listed
-
Offline Hierarchical Reinforcement Learning via Inverse Optimization10 Oct 2024 0 repositories listed
-
On the Modeling Capabilities of Large Language Models for Sequential Decision Making8 Oct 2024 0 repositories listed
-
7 Oct 2024 0 repositories listed Syntology 6 ran (of which 0 constructed an object rather than computing a result; 2 with no instrument failure: 2 honoured, 0 violated, 0 with no contract checked; 4 where Syntology's instrument failed) · 1 unverified (of 7 harvested samples) · 7 pointer-only (licence)
-
Preference Optimization as Probabilistic Inference5 Oct 2024 0 repositories listed
-
Minimax-optimal trust-aware multi-armed bandits4 Oct 2024 0 repositories listed
-
Safe Time-Varying Optimization based on Gaussian Processes with Spatio-Temporal Kernel26 Sep 2024 0 repositories listed
-
Learning Utilities from Demonstrations in Markov Decision Processes25 Sep 2024 0 repositories listed
-
Reference Points, Risk-Taking Behavior, and Competitive Outcomes in Sequential Settings20 Sep 2024 0 repositories listed
-
Visual Language Tracking with Multi-modal Interaction: A Robust Benchmark13 Sep 2024 0 repositories listed
-
Hierarchical Reinforcement Learning for Temporal Abstraction of Listwise Recommendation11 Sep 2024 0 repositories listed
-
HierLLM: Hierarchical Large Language Model for Question Recommendation10 Sep 2024 0 repositories listed
-
An Introduction to Quantum Reinforcement Learning (QRL)9 Sep 2024 0 repositories listed
-
Bridging Rested and Restless Bandits with Graph-Triggering: Rising and Rotting9 Sep 2024 0 repositories listed
-
Forward KL Regularized Preference Optimization for Aligning Diffusion Policies9 Sep 2024 0 repositories listed
-
Sliding-Window Thompson Sampling for Non-Stationary Settings8 Sep 2024 0 repositories listed
-
A naive aggregation algorithm for improving generalization in a class of learning problems6 Sep 2024 0 repositories listed
-
InfraLib: Enabling Reinforcement Learning and Decision-Making for Large-Scale Infrastructure Management5 Sep 2024 0 repositories listed
-
A Sequential Decision-Making Model for Perimeter Identification4 Sep 2024 0 repositories listed
-
Temporal Elections: Welfare, Strategyproofness, and Proportionality24 Aug 2024 0 repositories listed
Syntology lines on 2 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.