{"url":"/dataset/open-images-v7","name":"Open Images V7","full_name":null,"description_markdown":"Open Images is a computer vision dataset covering ~9 million images with labels spanning thousands of object categories. A subset of 1.9M includes diverse annotations types.\r\n\r\n- 15,851,536 boxes on 600 classes\r\n- 2,785,498 instance segmentations on 350 classes\r\n- 3,284,280 relationship annotations on 1,466 relationships\r\n- 675,155 localized narratives (synchronized voice, mouse trace, and text caption)\r\n- 66,391,027 point-level annotations on 5,827 classes\r\n- 61,404,966 image-level labels on 20,638 classes\r\n\r\nImages are under a  CC BY 2.0 license, annotations under  CC BY 4.0 license.","description_withheld":null,"homepage":"https://g.co/dataset/open-images","introduced_date":"2022-10-25","introduced_date_note":null,"introduced_by":{"paper":"/paper/from-colouring-in-to-pointillism-revisiting","title":"From colouring-in to pointillism: revisiting semantic segmentation supervision","first_author":"Rodrigo Benenson","url":null},"license":{"name":"CC BY 4.0","url":"https://storage.googleapis.com/openimages/web/factsfigures_v7.html#licenses"},"modalities":[{"name":"Images","url":"/datasets/modality/images"},{"name":"Texts","url":"/datasets/modality/texts"},{"name":"Speech","url":"/datasets/modality/speech"}],"tasks":[{"name":"Image Classification","url":"/task/image-classification","datasets_with_task":"/datasets/task/image-classification"},{"name":"2D Object Detection","url":"/task/2d-object-detection","datasets_with_task":"/datasets/task/2d-object-detection"},{"name":"Object Detection","url":"/task/object-detection","datasets_with_task":"/datasets/task/object-detection"},{"name":"Semantic Segmentation","url":"/task/semantic-segmentation","datasets_with_task":"/datasets/task/semantic-segmentation"},{"name":"Speech Recognition","url":"/task/speech-recognition","datasets_with_task":"/datasets/task/speech-recognition"},{"name":"2D Semantic Segmentation","url":"/task/2d-semantic-segmentation","datasets_with_task":"/datasets/task/2d-semantic-segmentation"},{"name":"Instance Segmentation","url":"/task/instance-segmentation","datasets_with_task":"/datasets/task/instance-segmentation"},{"name":"Image Captioning","url":"/task/image-captioning","datasets_with_task":"/datasets/task/image-captioning"},{"name":"Visual Relationship Detection","url":"/task/visual-relationship-detection","datasets_with_task":"/datasets/task/visual-relationship-detection"}],"languages":[{"name":"English","url":"/datasets/language/english"}],"variants":["Open Images V7"],"data_loaders":[{"repo":"https://github.com/voxel51/fiftyone","url":"https://docs.voxel51.com/user_guide/dataset_zoo/datasets.html#open-images-v7","frameworks":["tf","pytorch"]}],"num_papers_in_archive":6,"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28"},"benchmarks":[],"papers_with_a_benchmark_row":[],"syntology_totals":{"read_at":"2026-09-24T18:15:14+00:00","papers_with_samples":0,"samples_harvested":0,"samples_ran":0,"samples_unverified":0,"pointer_only_for_licence":0,"papers_with_no_sample_that_ran":0,"note":"the per-paper counts above, summed; not a rate"},"papers_note":"The archive never published its papers-using-dataset list; these are papers with a leaderboard row on this dataset's benchmarks."}