Browse State-of-the-Art › Efficient Exploration › Papers, page 3
Efficient Exploration
Papers archive 2025-07-28
archive papers tagged: 514 · with a code link: 189 · where Syntology ran a sample: 57 (48 with a run with no instrument failure, 9 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (57 of 514 tagged: 48 with a run with no instrument failure, 9 where every run was a failure of Syntology's instrument)
Page 3 of 6: papers 201 to 300 of 514, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Interpretable SHAP-bounded Bayesian Optimization for Underwater Acoustic Metamaterial Coating Design10 May 2025 0 repositories listed
-
An Explainable Nature-Inspired Framework for Monkeypox Diagnosis: Xception Features Combined with NGBoost and African Vultures Optimization Algorithm24 Apr 2025 0 repositories listed
-
Aerial Active STAR-RIS-assisted Satellite-Terrestrial Covert Communications22 Apr 2025 0 repositories listed
-
Lumos: Efficient Performance Modeling and Estimation for Large-scale LLM Training12 Apr 2025 0 repositories listed
-
Memetic Search for Green Vehicle Routing Problem with Private Capacitated Refueling Stations6 Apr 2025 0 repositories listed
-
From Automation to Autonomy in Smart Manufacturing: A Bayesian Optimization Framework for Modeling Multi-Objective Experimentation and Sequential Decision Making5 Apr 2025 0 repositories listed
-
Entropy-guided sequence weighting for efficient exploration in RL-based LLM fine-tuning28 Mar 2025 0 repositories listed
-
Maya: Optimizing Deep Learning Training Workloads using Emulated Virtual Accelerators26 Mar 2025 0 repositories listed
-
FALCONEye: Finding Answers and Localizing Content in ONE-hour-long videos with multi-modal LLMs25 Mar 2025 0 repositories listed
-
CAE: Repurposing the Critic as an Explorer in Deep Reinforcement Learning23 Mar 2025 0 repositories listed
-
KEA: Keeping Exploration Alive by Proactively Coordinating Exploration Strategies23 Mar 2025 0 repositories listed
-
Contextual Similarity Distillation: Ensemble Uncertainties with a Single Model14 Mar 2025 0 repositories listed
-
HyperArm Bandit Optimization: A Novel approach to Hyperparameter Optimization and an Analysis of Bandit Algorithms in Stochastic and Adversarial Settings13 Mar 2025 0 repositories listed
-
Is a Good Foundation Necessary for Efficient Reinforcement Learning? The Computational Role of the Base Model in Exploration10 Mar 2025 0 repositories listed
-
Probabilistic Insights for Efficient Exploration Strategies in Reinforcement Learning5 Mar 2025 0 repositories listed
-
A Transformer Model for Predicting Chemical Reaction Products from Generic Templates4 Mar 2025 0 repositories listed
-
On Space-Filling Input Design for Nonlinear Dynamic Model Learning: A Gaussian Process Approach24 Feb 2025 0 repositories listed
-
Mem2Ego: Empowering Vision-Language Models with Global-to-Ego Memory for Long-Horizon Embodied Navigation20 Feb 2025 0 repositories listed
-
Synergistic Fusion of Multi-Source Knowledge via Evidence Theory for High-Entropy Alloy Discovery20 Feb 2025 0 repositories listed
-
DiffExp: Efficient Exploration in Reward Fine-tuning for Text-to-Image Diffusion Models19 Feb 2025 0 repositories listed
-
19 Feb 2025 0 repositories listed Syntology 8 ran (of which 0 constructed an object rather than computing a result; 8 with no instrument failure: 0 honoured, 0 violated, 8 with no contract checked; 0 where Syntology's instrument failed) · 6 unverified (of 14 harvested samples) · 2 pointer-only (licence)
-
Finedeep: Mitigating Sparse Activation in Dense LLMs via Multi-Layer Fine-Grained Experts18 Feb 2025 0 repositories listed
-
Massively Scaling Explicit Policy-conditioned Value Functions17 Feb 2025 0 repositories listed
-
Causal Information Prioritization for Efficient Reinforcement Learning14 Feb 2025 0 repositories listed
-
Exploratory Diffusion Model for Unsupervised Reinforcement Learning11 Feb 2025 0 repositories listed
-
10 Feb 2025 0 repositories listed
-
Adaptive Exploration for Multi-Reward Multi-Policy Evaluation4 Feb 2025 0 repositories listed
-
Constrained Hybrid Metaheuristic Algorithm for Probabilistic Neural Networks Learning26 Jan 2025 0 repositories listed
-
Bridging Text and Crystal Structures: Literature-driven Contrastive Learning for Materials Science22 Jan 2025 0 repositories listed
-
ActiveGAMER: Active GAussian Mapping through Efficient Rendering12 Jan 2025 0 repositories listed
-
β-DQN: Improving Deep Q-Learning By Evolving the Behavior1 Jan 2025 0 repositories listed
-
Provably Efficient Exploration in Reward Machines with Low Regret26 Dec 2024 0 repositories listed
-
GraphEQA: Using 3D Semantic Scene Graphs for Real-time Embodied Question Answering19 Dec 2024 0 repositories listed
-
A Temporally Correlated Latent Exploration for Reinforcement Learning6 Dec 2024 0 repositories listed
-
Hyper: Hyperparameter Robust Efficient Exploration in Reinforcement Learning4 Dec 2024 0 repositories listed
-
Sample Efficient Robot Learning in Supervised Effect Prediction Tasks3 Dec 2024 0 repositories listed
-
CBOL-Tuner: Classifier-pruned Bayesian optimization to explore temporally structured latent spaces for particle accelerator tuning2 Dec 2024 0 repositories listed
-
Adaptformer: Sequence models as adaptive iterative planners30 Nov 2024 0 repositories listed
-
Randomized-Grid Search for Hyperparameter Tuning in Decision Tree Model to Improve Performance of Cardiovascular Disease Classification27 Nov 2024 0 repositories listed
-
BPP-Search: Enhancing Tree of Thought Reasoning for Mathematical Modeling Problem Solving26 Nov 2024 0 repositories listed
-
EfficientEQA: An Efficient Approach for Open Vocabulary Embodied Question Answering26 Oct 2024 0 repositories listed
-
Overcoming the Sim-to-Real Gap: Leveraging Simulation to Learn to Explore for Real-World RL26 Oct 2024 0 repositories listed
-
Offline-to-Online Multi-Agent Reinforcement Learning with Offline Value Function Memory and Sequential Exploration25 Oct 2024 0 repositories listed
-
Scattered Forest Search: Smarter Code Space Exploration with LLMs22 Oct 2024 0 repositories listed
-
ActSafe: Active Exploration with Safety Constraints for Reinforcement Learning12 Oct 2024 0 repositories listed
-
Latent Action Priors for Locomotion with Deep Reinforcement Learning4 Oct 2024 0 repositories listed
-
BayesCNS: A Unified Bayesian Approach to Address Cold Start and Non-Stationarity in Search Systems at Scale3 Oct 2024 0 repositories listed
-
Provably Efficient Exploration in Inverse Constrained Reinforcement Learning24 Sep 2024 0 repositories listed
-
QueryBuilder: Human-in-the-Loop Query Development for Information Retrieval7 Sep 2024 0 repositories listed
-
Targeting the partition function of chemically disordered materials with a generative approach based on inverse variational autoencoders27 Aug 2024 0 repositories listed
-
Reinforcement Learning for Causal Discovery without Acyclicity Constraints24 Aug 2024 0 repositories listed
-
Emotion-Agent: Unsupervised Deep Reinforcement Learning with Distribution-Prototype Reward for Continuous Emotional EEG Analysis22 Aug 2024 0 repositories listed
-
Efficient Exploration and Discriminative World Model Learning with an Object-Centric Abstraction21 Aug 2024 0 repositories listed
-
Efficient Exploration in Deep Reinforcement Learning: A Novel Bayesian Actor-Critic Algorithm19 Aug 2024 0 repositories listed
-
Modeling Multi-Step Scientific Processes with Graph Transformer Networks10 Aug 2024 0 repositories listed
-
KOI: Accelerating Online Imitation Learning via Hybrid Key-state Guidance6 Aug 2024 0 repositories listed
-
Image-Based Deep Reinforcement Learning with Intrinsically Motivated Stimuli: On the Execution of Complex Robotic Tasks31 Jul 2024 0 repositories listed
-
Diffusion Augmented Agents: A Framework for Efficient Exploration and Transfer Learning30 Jul 2024 0 repositories listed
-
Online Learning for Autonomous Management of Intent-based 6G Networks25 Jul 2024 0 repositories listed
-
ParamsDrag: Interactive Parameter Space Exploration via Image-Space Dragging19 Jul 2024 0 repositories listed
-
AutoRAG-HP: Automatic Online Hyper-Parameter Tuning for Retrieval-Augmented Generation27 Jun 2024 0 repositories listed
-
Efficient gPC-based quantification of probabilistic robustness for systems in neuroscience19 Jun 2024 0 repositories listed
-
Exploration by Learning Diverse Skills through Successor State Measures14 Jun 2024 0 repositories listed
-
World Models with Hints of Large Language Models for Goal Achieving11 Jun 2024 0 repositories listed
-
NeoRL: Efficient Exploration for Nonepisodic RL3 Jun 2024 0 repositories listed
-
Computing low-thrust transfers in the asteroid belt, a comparison between astrodynamical manipulations and a machine learning approach29 May 2024 0 repositories listed
-
Opinion-Guided Reinforcement Learning27 May 2024 0 repositories listed
-
GLaD: Synergizing Molecular Graphs and Language Descriptors for Enhanced Power Conversion Efficiency Prediction in Organic Photovoltaic Devices23 May 2024 0 repositories listed
-
Intrinsic Rewards for Exploration without Harm from Observational Noise: A Simulation Study Based on the Free Energy Principle13 May 2024 0 repositories listed
-
MESA: Cooperative Meta-Exploration in Multi-Agent Learning through Exploiting State-Action Space Structure1 May 2024 0 repositories listed
-
Efficient Exploration of Image Classifier Failures with Bayesian Optimization and Text-to-Image Models26 Apr 2024 0 repositories listed
-
Evolutionary Reinforcement Learning via Cooperative Coevolution23 Apr 2024 0 repositories listed
-
An Offline Reinforcement Learning Algorithm Customized for Multi-Task Fusion in Large-Scale Recommender Systems19 Apr 2024 0 repositories listed
-
Sampling for Model Predictive Trajectory Planning in Autonomous Driving using Normalizing Flows15 Apr 2024 0 repositories listed
-
Learning Off-policy with Model-based Intrinsic Motivation For Active Online Exploration31 Mar 2024 0 repositories listed
-
Cognitive Planning for Object Goal Navigation using Generative AI Models30 Mar 2024 0 repositories listed
-
VDSC: Enhancing Exploration Timing with Value Discrepancy and State Counts26 Mar 2024 0 repositories listed
-
Explore until Confident: Efficient Exploration for Embodied Question Answering23 Mar 2024 0 repositories listed
-
Safe Reinforcement Learning for Constrained Markov Decision Processes with Stochastic Stopping Time23 Mar 2024 0 repositories listed
-
A Straightforward Gradient-Based Approach for High-Tc Superconductor Design: Leveraging Domain Knowledge via Adaptive Constraints20 Mar 2024 0 repositories listed
-
Beyond Joint Demonstrations: Personalized Expert Guidance for Efficient Multi-Agent Reinforcement Learning13 Mar 2024 0 repositories listed
-
A Natural Extension To Online Algorithms For Hybrid RL With Limited Coverage7 Mar 2024 0 repositories listed
-
Finding Waldo: Towards Efficient Exploration of NeRF Scene Spaces7 Mar 2024 0 repositories listed
-
Noisy Spiking Actor Network for Exploration7 Mar 2024 0 repositories listed
-
Vlearn: Off-Policy Learning with Efficient State-Value Function Estimation7 Mar 2024 0 repositories listed
-
ACE : Off-Policy Actor-Critic with Causality-Aware Entropy Regularization22 Feb 2024 0 repositories listed
-
Diffusion Models Meet Contextual Bandits with Large Action Spaces15 Feb 2024 0 repositories listed
-
TopoNav: Topological Navigation for Efficient Exploration in Sparse Reward Environments6 Feb 2024 0 repositories listed
-
Efficient Exploration for LLMs1 Feb 2024 0 repositories listed
-
Scheduled Curiosity-Deep Dyna-Q: Efficient Exploration for Dialog Policy Learning31 Jan 2024 0 repositories listed
-
FIT-SLAM -- Fisher Information and Traversability estimation-based Active SLAM for exploration in 3D environments17 Jan 2024 0 repositories listed
-
Go-Explore for Residential Energy Management15 Jan 2024 0 repositories listed
-
Mutual Enhancement of Large Language and Reinforcement Learning Models through Bi-Directional Feedback Mechanisms: A Case Study12 Jan 2024 0 repositories listed
-
Diffusion-ES: Gradient-free Planning with Diffusion for Autonomous and Instruction-guided Driving1 Jan 2024 0 repositories listed
-
A Bayesian Framework of Deep Reinforcement Learning for Joint O-RAN/MEC Orchestration26 Dec 2023 0 repositories listed
-
Joint channel estimation and data detection in massive MIMO systems based on diffusion models17 Nov 2023 0 repositories listed
-
Virtual Action Actor-Critic Framework for Exploration (Student Abstract)6 Nov 2023 0 repositories listed
-
Regret Analysis of Learning-Based Linear Quadratic Gaussian Control with Additive Exploration5 Nov 2023 0 repositories listed
-
Visual Analytics for Efficient Image Exploration and User-Guided Image Captioning2 Nov 2023 0 repositories listed
-
Efficient Exploration in Continuous-time Model-based Reinforcement Learning30 Oct 2023 0 repositories listed
Syntology lines on 1 of the papers shown; no Syntology record for the others (a paper without an arXiv id cannot be joined to the graph, and absence from the graph layer is not a recorded non-run). “Ran” means the sample executed on a synthesized fixture, not that the paper's result was reproduced; each line links to that paper's sample list. Syntology's record for this page has not changed since , the first build that kept a record date for it; when this build read Syntology's graph is in the build record. For agents: get_harvested_code_for_paper(arxiv_id) lists each paper's samples; how to connect.