{"url":"/dataset/thvd","name":"THVD","full_name":"Talking Head Video Dataset","description_markdown":"**About**\r\n\r\nWe provide a comprehensive talking-head video dataset with over 50,000 videos, totaling more than 500+ hours of footage and featuring 20,841 unique identities from around the world.\r\n\r\n\r\n**Distribution**\r\n\r\nDetailing the format, size, and structure of the dataset:\r\n\r\n-Total Size: 2.7TB\r\n\r\n-Total Videos: 47,547\r\n\r\n-Identities Covered: 20,841\r\n\r\n-Resolution: 60% 4k(1980), 33% fullHD(1080)\r\n\r\n-Formats: MP4\r\n\r\n-Full-length videos with visible mouth movements in every frame.\r\n\r\n-Minimum face size of 400 pixels.\r\n\r\n-Video durations range from 20 seconds to 5 minutes.\r\n\r\n-Faces have not been cut out, full screen videos including backgrounds.\r\n\r\n\r\n**Usage**\r\n\r\n**This dataset is ideal for a variety of applications**:\r\n\r\nFace Recognition & Verification: Training and benchmarking facial recognition models.\r\n\r\nAction Recognition: Identifying human activities and behaviors.\r\n\r\nRe-Identification (Re-ID): Tracking identities across different videos and environments.\r\n\r\nDeepfake Detection: Developing methods to detect manipulated videos.\r\n\r\nGenerative AI: Training high-resolution video generation models.\r\n\r\nLip Syncing Applications: Enhancing AI-driven lip-syncing models for dubbing and virtual avatars.\r\n\r\nBackground AI Applications: Developing AI models for automated background replacement, segmentation, and enhancement.\r\n\r\n\r\n**Coverage**\r\n\r\nExplaining the scope and coverage of the dataset:\r\n\r\nGeographic Coverage: Worldwide\r\n\r\nTime Range: Time range and size of the videos have been noted in the CSV file.\r\n\r\nDemographics: Includes information about age, gender, ethnicity, format, resolution, and file size.\r\n\r\n\r\n**Languages Covered (Videos):**\r\n\r\nEnglish: 23,038 videos\r\n\r\nPortuguese: 1,346 videos\r\n\r\nSpanish: 677 videos\r\n\r\nNorwegian: 1,266 videos\r\n\r\nSwedish: 1,056 videos\r\n\r\nKorean: 848 videos\r\n\r\nPolish: 1,807 videos\r\n\r\nIndonesian: 1,163 videos\r\n\r\nFrench: 1,102 videos\r\n\r\nGerman: 1,276 videos\r\n\r\nJapanese: 1,433 videos\r\n\r\nDutch: 1,666 videos\r\n\r\nIndian: 1,163 videos\r\n\r\nCzech: 590 videos\r\n\r\nChinese: 685 videos\r\n\r\nItalian: 975 videos\r\n\r\nPhilipeans: 920 videos\r\n\r\nBulgaria: 340 videos\r\n\r\nRomanian: 1144 videos\r\n\r\nArabic: 1691 videos\r\n\r\n\r\n![image/png](https://cdn-uploads.huggingface.co/production/uploads/67da9f23315e9f2244208bb2/Ix4N_uK_-Bv6dhosoRhrr.png) \r\n\r\n![image/png](https://cdn-uploads.huggingface.co/production/uploads/67da9f23315e9f2244208bb2/bBgxchcuVBD_S6BpJsQcv.png)\r\n\r\n![image/png](https://cdn-uploads.huggingface.co/production/uploads/67da9f23315e9f2244208bb2/ZpJm-ViYt4IqqnlDMWID8.png)\r\n\r\n![image/png](https://cdn-uploads.huggingface.co/production/uploads/67da9f23315e9f2244208bb2/u5yEc2PVvykqOkNQ_WY3y.png)\r\n\r\n**Who Can Use It**\r\n\r\nList examples of intended users and their use cases:\r\n\r\nData Scientists: Training machine learning models for video-based AI applications.\r\n\r\nResearchers: Studying human behavior, facial analysis, or video AI advancements.\r\n\r\nBusinesses: Developing facial recognition systems, video analytics, or AI-driven media applications.\r\n\r\n\r\n**Additional Notes**\r\n\r\nEnsure ethical usage and compliance with privacy regulations.\r\nThe dataset’s quality and scale make it valuable for high-performance AI training.\r\nPotential preprocessing (cropping, down sampling) may be needed for different use cases.\r\nDataset has not been completed yet and expands daily, please contact for most up to date CSV file.\r\nThe dataset has been divided into 100GB zipped files and is hosted on a private server (with the option to upload to the cloud if needed).\r\nTo verify the dataset's quality, please contact me for the full CSV file. I’d be happy to provide example videos selected by the potential buyer.\r\n\r\nhttps://lipsynthesis.com/dataset","description_withheld":null,"homepage":"https://lipsynthesis.com/dataset","introduced_date":"2025-02-27","introduced_date_note":null,"introduced_by":null,"license":{"name":"CC0","url":null},"modalities":[{"name":"Videos","url":"/datasets/modality/videos"},{"name":"3D","url":"/datasets/modality/3d"},{"name":"Audio","url":"/datasets/modality/audio"},{"name":"Environment","url":"/datasets/modality/environment"},{"name":"Speech","url":"/datasets/modality/speech"},{"name":"Actions","url":"/datasets/modality/actions"}],"tasks":[{"name":"3D Face Modelling","url":"/task/3d-face-modeling","datasets_with_task":"/datasets/task/3d-face-modeling"},{"name":"3DGS","url":"/task/3dgs","datasets_with_task":"/datasets/task/3dgs"}],"languages":[{"name":"English","url":"/datasets/language/english"},{"name":"French","url":"/datasets/language/french"},{"name":"Spanish","url":"/datasets/language/spanish"},{"name":"German","url":"/datasets/language/german"},{"name":"Italian","url":"/datasets/language/italian"},{"name":"Chinese","url":"/datasets/language/chinese"},{"name":"Japanese","url":"/datasets/language/japanese"},{"name":"Portuguese","url":"/datasets/language/portuguese"},{"name":"Arabic","url":"/datasets/language/arabic"},{"name":"Czech","url":"/datasets/language/czech"},{"name":"Dutch","url":"/datasets/language/dutch"},{"name":"Hindi","url":"/datasets/language/hindi"},{"name":"Indonesian","url":"/datasets/language/indonesian"},{"name":"Korean","url":"/datasets/language/korean"},{"name":"Polish","url":"/datasets/language/polish"},{"name":"Thai","url":"/datasets/language/thai"},{"name":"Turkish","url":"/datasets/language/turkish"},{"name":"Vietnamese","url":"/datasets/language/vietnamese"},{"name":"Filipino","url":"/datasets/language/filipino"}],"variants":["THVD"],"data_loaders":[],"num_papers_in_archive":0,"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28"},"benchmarks":[],"papers_with_a_benchmark_row":[],"syntology_totals":{"read_at":"2026-09-24T18:15:14+00:00","papers_with_samples":0,"samples_harvested":0,"samples_ran":0,"samples_unverified":0,"pointer_only_for_licence":0,"papers_with_no_sample_that_ran":0,"note":"the per-paper counts above, summed; not a rate"},"papers_note":"The archive never published its papers-using-dataset list; these are papers with a leaderboard row on this dataset's benchmarks."}