{"url":"/dataset/darai","name":"DARai","full_name":"Daily Activity Recordings for AI and ML applications","description_markdown":"Daily Activity Recordings for Artificial Intelligence (DARai, pronounced \"Dahr-ree\") is a multimodal, hierarchically annotated dataset constructed to understand human activities in real-world settings. DARai consists of continuous scripted and unscripted recordings of 50 participants in 10 different environments, totaling over 200 hours of data from 20 sensors including multiple camera views, depth and radar sensors, wearable inertial measurement units (IMUs), electromyography (EMG), insole pressure sensors, biomonitor sensors, and gaze tracker.\r\nTo capture the complexity in human activities, DARai is annotated at three levels of hierarchy: (i) high-level activities (L1) that are independent tasks, (ii) lower-level actions (L2) that are patterns shared between activities, and (iii) fine-grained procedures (L3) that detail the exact execution steps for actions. The dataset annotations and recordings are designed so that 22.7% of L2 actions are shared between L1 activities and 14.2% of L3 procedures are shared between L2 actions. The overlap and unscripted nature of DARai allows counterfactual activities in the dataset.\r\nExperiments with various machine learning models showcase the value of DARai in uncovering important challenges in human-centered applications. Specifically, we conduct unimodal and multimodal sensor fusion experiments for recognition, temporal localization, and future action anticipation across all hierarchical annotation levels. To highlight the limitations of individual sensors, we also conduct domain-variant experiments that are enabled by DARai's multi-sensor and counterfactual activity design setup.\r\nThe code, documentation, and dataset are available at the dedicated DARai website.","description_withheld":null,"homepage":"https://alregib.ece.gatech.edu/software-and-datasets/darai-daily-activity-recordings-for-artificial-intelligence-and-machine-learning/","introduced_date":"2025-04-24","introduced_date_note":null,"introduced_by":{"paper":"/paper/hierarchical-and-multimodal-data-for-daily","title":"Hierarchical and Multimodal Data for Daily Activity Understanding","first_author":"Ghazal Kaviani","url":null},"license":{"name":"Creative Commons Attribution CCBY 4.0","url":null},"modalities":[{"name":"Images","url":"/datasets/modality/images"},{"name":"Videos","url":"/datasets/modality/videos"},{"name":"Biomedical","url":"/datasets/modality/biomedical"},{"name":"Environment","url":"/datasets/modality/environment"},{"name":"Time series","url":"/datasets/modality/time-series"},{"name":"RGB-D","url":"/datasets/modality/rgb-d"},{"name":"LiDAR","url":"/datasets/modality/lidar"}],"tasks":[{"name":"Object Detection","url":"/task/object-detection","datasets_with_task":"/datasets/task/object-detection"},{"name":"2D Semantic Segmentation","url":"/task/2d-semantic-segmentation","datasets_with_task":"/datasets/task/2d-semantic-segmentation"},{"name":"3D Action Recognition","url":"/task/3d-human-action-recognition","datasets_with_task":"/datasets/task/3d-human-action-recognition"},{"name":"Scene Segmentation","url":"/task/scene-segmentation","datasets_with_task":"/datasets/task/scene-segmentation"},{"name":"2D Pose Estimation","url":"/task/2d-pose-estimation","datasets_with_task":"/datasets/task/2d-pose-estimation"},{"name":"Human-Object Interaction Detection","url":"/task/human-object-interaction-detection","datasets_with_task":"/datasets/task/human-object-interaction-detection"},{"name":"Action Anticipation","url":"/task/action-anticipation","datasets_with_task":"/datasets/task/action-anticipation"},{"name":"Trajectory Planning","url":"/task/trajectory-planning","datasets_with_task":"/datasets/task/trajectory-planning"},{"name":"Action Parsing","url":"/task/action-parsing","datasets_with_task":"/datasets/task/action-parsing"},{"name":"Human Behavior Forecasting","url":"/task/human-behavior-forecasting","datasets_with_task":"/datasets/task/human-behavior-forecasting"},{"name":"Long Form Question Answering","url":"/task/long-form-question-answering","datasets_with_task":"/datasets/task/long-form-question-answering"}],"languages":[{"name":"English","url":"/datasets/language/english"}],"variants":["DARai"],"data_loaders":[{"repo":"https://github.com/olivesgatech/DARai","url":"https://github.com/olivesgatech/DARai","frameworks":["pytorch"]}],"num_papers_in_archive":1,"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28"},"benchmarks":[],"papers_with_a_benchmark_row":[],"syntology_totals":{"read_at":"2026-09-24T18:15:14+00:00","papers_with_samples":0,"samples_harvested":0,"samples_ran":0,"samples_unverified":0,"pointer_only_for_licence":0,"papers_with_no_sample_that_ran":0,"note":"the per-paper counts above, summed; not a rate"},"papers_note":"The archive never published its papers-using-dataset list; these are papers with a leaderboard row on this dataset's benchmarks."}