{"url":"/dataset/digital","name":"DIGITal","full_name":"Digitally Generated Numerals","description_markdown":"# Digitally Generated Numerals (DIGITal)\r\n\r\n## Description\r\nThe **Digitally Generated Numerals (DIGITal)** dataset consists of 100,000 image pairs representing digits from 0 to 9. These image pairs include both low and high-quality versions, with a resolution of 128x128 pixels.\r\n\r\n## Languages\r\nThe dataset is generated from fonts in the following languages:\r\n\r\n- Arabic\r\n- Chinese (Simplified)\r\n- Farsi and Urdu\r\n- Gurmukhi\r\n- Gujarati\r\n- Tibetan\r\n- ARDIS (Sweden)\r\n- ISI Bangla\r\n- Bangla Lekha\r\n- Kannada\r\n- English\r\n\r\n## Image Resolution\r\n- resolution: 128x128 pixels\r\n\r\n## Image Pairs\r\n- Each digit (0 to 9) has 1000 associated images.\r\n\r\n## Total Images\r\n- Total images: 100,000\r\n\r\n## Samples\r\n\r\n| !Image 1 | !Image 2 | !Image 3 | !Image 4 | !Image 5 |\r\n|:-----------------------:|:-----------------------:|\r\n|     Arabic       |      ARDIS      |      Chinese      |      Farsi & Urdu     |      Gujarati       |        \r\n\r\n| !Image 5 | !Image 6 | !Image 7 | !Image 8 | !Image 5 |\r\n|:-----------------------:|:-----------------------:|\r\n|     ISI Bangla & BanglaLekha      |      Kannada       |      Tibetan      |      English       |      Gurmukhi\r\n\r\n\r\nThis dataset is a valuable resource for tasks related to digit recognition, font analysis, and super-resolution. Researchers and practitioners can utilize it for various applications in computer vision and machine learning.","description_withheld":null,"homepage":"","introduced_date":"2024-03-18","introduced_date_note":null,"introduced_by":{"paper":"/paper/advancing-multilingual-handwritten-numeral","title":"Advancing Multilingual Handwritten Numeral Recognition with Attention-driven Transfer Learning","first_author":"Amirreza Fateh","url":null},"license":{"name":"Shahrood University of Technology","url":"https://github.com/CVLab-SHUT/HandWrittenDigitRecognition/tree/main?tab=readme-ov-file#License"},"modalities":[{"name":"Images","url":"/datasets/modality/images"}],"tasks":[{"name":"Classification","url":"/task/classification-1","datasets_with_task":"/datasets/task/classification-1"},{"name":"Super-Resolution","url":"/task/super-resolution","datasets_with_task":"/datasets/task/super-resolution"}],"languages":[{"name":"English","url":"/datasets/language/english"},{"name":"Chinese","url":"/datasets/language/chinese"},{"name":"Arabic","url":"/datasets/language/arabic"},{"name":"Persian","url":"/datasets/language/persian"},{"name":"Swedish","url":"/datasets/language/swedish"},{"name":"Urdu","url":"/datasets/language/urdu"},{"name":"Tibetan","url":"/datasets/language/tibetan"},{"name":"Bangala","url":"/datasets/language/bangala"},{"name":"Gujarati","url":"/datasets/language/gujarati"},{"name":"Kannada","url":"/datasets/language/kannada"}],"variants":["DIGITal"],"data_loaders":[],"num_papers_in_archive":1,"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28"},"benchmarks":[],"papers_with_a_benchmark_row":[],"syntology_totals":{"read_at":"2026-09-24T18:15:14+00:00","papers_with_samples":0,"samples_harvested":0,"samples_ran":0,"samples_unverified":0,"pointer_only_for_licence":0,"papers_with_no_sample_that_ran":0,"note":"the per-paper counts above, summed; not a rate"},"papers_note":"The archive never published its papers-using-dataset list; these are papers with a leaderboard row on this dataset's benchmarks."}