{"url":"/dataset/maestro","name":"MAESTRO","full_name":"MAESTRO","description_markdown":"The **MAESTRO** dataset contains over 200 hours of paired audio and MIDI recordings from ten years of International Piano-e-Competition. The MIDI data includes key strike velocities and sustain/sostenuto/una corda pedal positions. Audio and MIDI files are aligned with ∼3 ms accuracy and sliced to individual musical pieces, which are annotated with composer, title, and year of performance. Uncompressed audio is of CD quality or higher (44.1–48 kHz 16-bit PCM stereo).\r\n\r\nSource: [https://magenta.tensorflow.org/datasets/maestro](https://magenta.tensorflow.org/datasets/maestro)\r\nImage Source: [https://www.researchgate.net/figure/Results-generated-with-the-MAESTRO-dataset_fig3_333392458](https://www.researchgate.net/figure/Results-generated-with-the-MAESTRO-dataset_fig3_333392458)","description_withheld":null,"homepage":"https://magenta.tensorflow.org/datasets/maestro","introduced_date":"2019-01-01","introduced_date_note":null,"introduced_by":{"paper":"/paper/enabling-factorized-piano-music-modeling-and","title":"Enabling Factorized Piano Music Modeling and Generation with the MAESTRO Dataset","first_author":"Curtis Hawthorne","url":null},"license":{"name":"Unknown","url":null},"modalities":[{"name":"Audio","url":"/datasets/modality/audio"},{"name":"Interactive","url":"/datasets/modality/interactive"},{"name":"Midi","url":"/datasets/modality/midi"},{"name":"Music","url":"/datasets/modality/music"}],"tasks":[{"name":"Audio Generation","url":"/task/audio-generation","datasets_with_task":"/datasets/task/audio-generation"},{"name":"Music Transcription","url":"/task/music-transcription","datasets_with_task":"/datasets/task/music-transcription"},{"name":"Music Generation","url":"/task/music-generation","datasets_with_task":"/datasets/task/music-generation"}],"languages":[],"variants":["MAESTRO"],"data_loaders":[],"num_papers_in_archive":118,"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28"},"benchmarks":[{"leaderboard":"/sota/music-transcription-on-maestro","task":"Music Transcription","dataset_variant":"MAESTRO","rows":9,"metrics":["Onset F1"],"first_row_in_archive_order":{"model":"Transkun V2 (SemiCRF)","paper":"/paper/scoring-intervals-using-non-hierarchical","metrics":{"Onset F1":"98.32"},"code_links":[{"title":"yujia-yan/transkun","url":"https://github.com/yujia-yan/transkun"},{"title":"yujia-yan/skipping-the-frame-level","url":"https://github.com/yujia-yan/skipping-the-frame-level"}]},"note":"rows are the archive's own order at snapshot; nothing here re-ranks them"}],"papers_with_a_benchmark_row":[{"paper":"/paper/polyphonic-piano-music-transcription-system","title":"Polyphonic Piano Music Transcription System Exploiting Mutual Correlations of Different Musical Note States","date":"2024-07-08","rows_on_this_dataset":1,"code_links":0,"syntology":null},{"paper":"/paper/yourmt3-multi-instrument-music-transcription","title":"YourMT3+: Multi-instrument Music Transcription with Enhanced Transformer Architectures and Cross-dataset Stem Augmentation","date":"2024-07-05","rows_on_this_dataset":2,"code_links":1,"syntology":null},{"paper":"/paper/scoring-intervals-using-non-hierarchical","title":"Scoring Time Intervals using Non-Hierarchical Transformer For Automatic Piano Transcription","date":"2024-04-15","rows_on_this_dataset":1,"code_links":2,"syntology":null},{"paper":"/paper/automatic-piano-transcription-with","title":"Automatic Piano Transcription with Hierarchical Frequency-Time Transformer","date":"2023-07-10","rows_on_this_dataset":1,"code_links":1,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":5,"samples_ran":5,"samples_unverified":0,"pointer_only_for_licence":0,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/skipping-the-frame-level-event-based-piano","title":"Skipping the Frame-Level: Event-Based Piano Transcription With Neural Semi-CRFs","date":"2021-12-01","rows_on_this_dataset":1,"code_links":1,"syntology":null},{"paper":"/paper/mt3-multi-task-multitrack-music-transcription-1","title":"MT3: Multi-Task Multitrack Music Transcription","date":"2021-11-04","rows_on_this_dataset":2,"code_links":3,"syntology":{"read_at":"2026-09-24T18:15:14+00:00","samples_harvested":6,"samples_ran":0,"samples_unverified":6,"pointer_only_for_licence":0,"claim":"Per-sample execution on synthesized fixtures; not a correctness claim."}},{"paper":"/paper/high-resolution-piano-transcription-with-1","title":"High-resolution Piano Transcription with Pedals by Regressing Onset and Offset Times","date":null,"rows_on_this_dataset":1,"code_links":3,"syntology":null}],"syntology_totals":{"read_at":"2026-09-24T18:15:14+00:00","papers_with_samples":2,"samples_harvested":11,"samples_ran":5,"samples_unverified":6,"pointer_only_for_licence":0,"papers_with_no_sample_that_ran":1,"note":"the per-paper counts above, summed; not a rate"},"papers_note":"The archive never published its papers-using-dataset list; these are papers with a leaderboard row on this dataset's benchmarks."}