Browse State-of-the-Art › Sequential Decision Making › Papers, page 10
Sequential Decision Making
Papers archive 2025-07-28
archive papers tagged: 1,210 · with a code link: 351 · where Syntology ran a sample: 107 (90 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (107 of 1,210 tagged: 90 with a run with no instrument failure, 17 where every run was a failure of Syntology's instrument)
Page 10 of 13: papers 901 to 1,000 of 1,210, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Not all users are the same: Providing personalized explanations for sequential decision making problems23 Jun 2021 0 repositories listed
-
Lorenz System State Stability Identification using Neural Networks16 Jun 2021 0 repositories listed
-
Probabilistic DAG Search16 Jun 2021 0 repositories listed
-
A modular framework for object-based saccadic decisions in dynamic scenes10 Jun 2021 0 repositories listed
-
Information Avoidance and Overvaluation in Sequential Decision Making under Epistemic Constraints9 Jun 2021 0 repositories listed
-
Meta-Learning Reliable Priors in the Function Space6 Jun 2021 0 repositories listed
-
Heuristic-Guided Reinforcement Learning5 Jun 2021 0 repositories listed
-
Be Considerate: Objectives, Side Effects, and Deciding How to Act4 Jun 2021 0 repositories listed
-
Learning to schedule job-shop problems: Representation and policy learning using graph neural network and reinforcement learning2 Jun 2021 0 repositories listed
-
Learning MDPs from Features: Predict-Then-Optimize for Sequential Decision Making by Reinforcement Learning21 May 2021 0 repositories listed
-
Techniques Toward Optimizing Viewability in RTB Ad Campaigns Using Reinforcement Learning21 May 2021 0 repositories listed
-
Robust optimal policies for team Markov games16 May 2021 0 repositories listed
-
Bandit based centralized matching in two-sided markets for peer to peer lending6 May 2021 0 repositories listed
-
Data-Efficient Reinforcement Learning for Malaria Control4 May 2021 0 repositories listed
-
Regret and Cumulative Constraint Violation Analysis for Distributed Online Constrained Convex Optimization1 May 2021 0 repositories listed
-
Statistical Inference with M-Estimators on Adaptively Collected Data29 Apr 2021 0 repositories listed
-
Reinforcement Learning using Guided Observability22 Apr 2021 0 repositories listed
-
Discovering an Aid Policy to Minimize Student Evasion Using Offline Reinforcement Learning20 Apr 2021 0 repositories listed
-
Visual Comfort Aware-Reinforcement Learning for Depth Adjustment of Stereoscopic 3D Images14 Apr 2021 0 repositories listed
-
Jamming-Resilient Path Planning for Multiple UAVs via Deep Reinforcement Learning9 Apr 2021 0 repositories listed
-
Learning-Based UAV Trajectory Optimization with Collision Avoidance and Connectivity Constraints3 Apr 2021 0 repositories listed
-
Online Convex Optimization with Continuous Switching Constraint21 Mar 2021 0 repositories listed
-
Forward and Backward Bellman equations improve the efficiency of EM algorithm for DEC-POMDP19 Mar 2021 0 repositories listed
-
Situated Language Learning via Interactive Narratives18 Mar 2021 0 repositories listed
-
Encrypted Linear Contextual Bandit17 Mar 2021 0 repositories listed
-
Meta-Learning for Planning: Automatic Synthesis of Sample Based Planners13 Mar 2021 0 repositories listed
-
Optimal sequential decision making with probabilistic digital twins12 Mar 2021 0 repositories listed
-
Automatic Goal Generation using Dynamical Distance Learning9 Mar 2021 0 repositories listed
-
Bandit Linear Optimization for Sequential Decision Making and Extensive-Form Games8 Mar 2021 0 repositories listed
-
Model-Free Online Learning in Unknown Sequential Decision Making Problems and Games8 Mar 2021 0 repositories listed
-
Batched Neural Bandits25 Feb 2021 0 repositories listed
-
Hyperparameter Transfer Learning with Adaptive Complexity25 Feb 2021 0 repositories listed
-
SENTINEL: Taming Uncertainty with Ensemble-based Distributional Reinforcement Learning22 Feb 2021 0 repositories listed
-
Model-based Meta Reinforcement Learning using Graph Structured Surrogate Models16 Feb 2021 0 repositories listed
-
Causal Markov Decision Processes: Learning Good Interventions Efficiently15 Feb 2021 0 repositories listed
-
Deep Reinforcement Learning for Portfolio Optimization using Latent Feature State Space (LFSS) Module11 Feb 2021 0 repositories listed
-
Representation Matters: Offline Pretraining for Sequential Decision Making11 Feb 2021 0 repositories listed
-
Patterns, predictions, and actions: A story about machine learning10 Feb 2021 0 repositories listed
-
An Analysis of Frame-skipping in Reinforcement Learning7 Feb 2021 0 repositories listed
-
MSPM: A Modularized and Scalable Multi-Agent Reinforcement Learning-based System for Financial Portfolio Management6 Feb 2021 0 repositories listed
-
Improving Human Decision-Making by Discovering Efficient Strategies for Hierarchical Planning31 Jan 2021 0 repositories listed
-
Reinforcement Learning for Freight Booking Control Problems29 Jan 2021 0 repositories listed
-
CoordiQ : Coordinated Q-learning for Electric Vehicle Charging Recommendation28 Jan 2021 0 repositories listed
-
The MineRL 2020 Competition on Sample Efficient Reinforcement Learning using Human Priors26 Jan 2021 0 repositories listed
-
High-Confidence Off-Policy (or Counterfactual) Variance Estimation25 Jan 2021 0 repositories listed
-
GST: Group-Sparse Training for Accelerating Deep Reinforcement Learning24 Jan 2021 0 repositories listed
-
Deciding What to Learn: A Rate-Distortion Approach15 Jan 2021 0 repositories listed
-
Reinforced Imitative Graph Representation Learning for Mobile User Profiling: An Adversarial Training Perspective7 Jan 2021 0 repositories listed
-
Computing Preimages of Deep Neural Networks with Applications to Safety1 Jan 2021 0 repositories listed
-
Divide-and-Conquer Monte Carlo Tree Search1 Jan 2021 0 repositories listed
-
Learning to Make Decisions via Submodular Regularization1 Jan 2021 0 repositories listed
-
Learning to Recover from Failures using Memory1 Jan 2021 0 repositories listed
-
Understanding and Leveraging Causal Relations in Deep Reinforcement Learning1 Jan 2021 0 repositories listed
-
Privacy-Constrained Policies via Mutual Information Regularized Policy Gradients30 Dec 2020 0 repositories listed
-
A Regret bound for Non-stationary Multi-Armed Bandits with Fairness Constraints24 Dec 2020 0 repositories listed
-
Autonomous Charging of Electric Vehicle Fleets to Enhance Renewable Generation Dispatchability22 Dec 2020 0 repositories listed
-
Demystify Painting with RL14 Dec 2020 0 repositories listed
-
Learning Mobile Robot Navigation in the Dense Crowd with Deep Reinforcement Learning14 Dec 2020 0 repositories listed
-
Delay and Cooperation in Nonstochastic Linear Bandits1 Dec 2020 0 repositories listed
-
Improving Online Rent-or-Buy Algorithms with Sequential Decision Making and ML Predictions1 Dec 2020 0 repositories listed
-
Natural Policy Gradient Primal-Dual Method for Constrained Markov Decision Processes1 Dec 2020 0 repositories listed
-
On Efficiency in Hierarchical Reinforcement Learning1 Dec 2020 0 repositories listed
-
Planning with General Objective Functions: Going Beyond Total Rewards1 Dec 2020 0 repositories listed
-
R-learning in actor-critic model offers a biologically relevant mechanism for sequential decision-making1 Dec 2020 0 repositories listed
-
Modality-Buffet for Real-Time Object Detection17 Nov 2020 0 repositories listed
-
Robust Batch Policy Learning in Markov Decision Processes9 Nov 2020 0 repositories listed
-
Reliable Off-policy Evaluation for Reinforcement Learning8 Nov 2020 0 repositories listed
-
Single and Multi-Agent Deep Reinforcement Learning for AI-Enabled Wireless Networks: A Tutorial6 Nov 2020 0 repositories listed
-
Multi-IRS-assisted Multi-Cell Uplink MIMO Communications under Imperfect CSI: A Deep Reinforcement Learning Approach2 Nov 2020 0 repositories listed
-
Reinforcement Learning with Efficient Active Feature Acquisition2 Nov 2020 0 repositories listed
-
Bandits in Matching Markets: Ideas and Proposals for Peer Lending30 Oct 2020 0 repositories listed
-
What are the Statistical Limits of Offline RL with Linear Function Approximation?22 Oct 2020 0 repositories listed
-
Deep Q-Network-based Adaptive Alert Threshold Selection Policy for Payment Fraud Systems in Retail Banking21 Oct 2020 0 repositories listed
-
DBA bandits: Self-driving index tuning under ad-hoc, analytical workloads with safety guarantees19 Oct 2020 0 repositories listed
-
A Generative Machine Learning Approach to Policy Optimization in Pursuit-Evasion Games4 Oct 2020 0 repositories listed
-
Mean-Variance Efficient Reinforcement Learning with Applications to Dynamic Financial Investment3 Oct 2020 0 repositories listed
-
Is Reinforcement Learning More Difficult Than Bandits? A Near-optimal Algorithm Escaping the Curse of Horizon28 Sep 2020 0 repositories listed
-
A Sample-Efficient Algorithm for Episodic Finite-Horizon MDP with Constraints23 Sep 2020 0 repositories listed
-
Causal Bandits without prior knowledge using separating sets16 Sep 2020 0 repositories listed
-
Transfer Learning in Deep Reinforcement Learning: A Survey16 Sep 2020 0 repositories listed
-
Toward the Fundamental Limits of Imitation Learning13 Sep 2020 0 repositories listed
-
Optimal Inspection and Maintenance Planning for Deteriorating Structural Components through Dynamic Bayesian Networks and Markov Decision Processes9 Sep 2020 0 repositories listed
-
Inverse Policy Evaluation for Value-based Sequential Decision-making26 Aug 2020 0 repositories listed
-
Spatial Privacy Pricing: The Interplay between Privacy, Utility and Price in Geo-Marketplaces25 Aug 2020 0 repositories listed
-
A Survey of Knowledge-based Sequential Decision Making under Uncertainty19 Aug 2020 0 repositories listed
-
Deep Model-Based Reinforcement Learning for High-Dimensional Problems, a Survey11 Aug 2020 0 repositories listed
-
A Machine of Few Words -- Interactive Speaker Recognition with Reinforcement Learning7 Aug 2020 0 repositories listed
-
Dynamics Generalization via Information Bottleneck in Deep Reinforcement Learning3 Aug 2020 0 repositories listed
-
Tracking the Race Between Deep Reinforcement Learning and Imitation Learning -- Extended Version3 Aug 2020 0 repositories listed
-
Compare and Select: Video Summarization with Multi-Agent Reinforcement Learning29 Jul 2020 0 repositories listed
-
Data-efficient visuomotor policy training using reinforcement learning and generative models26 Jul 2020 0 repositories listed
-
AirCapRL: Autonomous Aerial Human Motion Capture using Deep Reinforcement Learning13 Jul 2020 0 repositories listed
-
Text-based RL Agents with Commonsense Knowledge: New Challenges, Environments and Approaches12 Jul 2020 0 repositories listed
-
GraphOpt: Learning Optimization Models of Graph Formation7 Jul 2020 0 repositories listed
-
Learning "What-if" Explanations for Sequential Decision-Making2 Jul 2020 0 repositories listed
-
Convex Regularization in Monte-Carlo Tree Search1 Jul 2020 0 repositories listed
-
Falsification-Based Robust Adversarial Reinforcement Learning1 Jul 2020 0 repositories listed
-
Model-based Reinforcement Learning: A Survey30 Jun 2020 0 repositories listed
-
On Bellman's Optimality Principle for zs-POSGs29 Jun 2020 0 repositories listed
-
A Unifying Framework for Reinforcement Learning and Planning26 Jun 2020 0 repositories listed