{"url":"/dataset/jamendomaxcapshttps-arxiv-org-abs-2502-07461","name":"JamendoMaxCaps","full_name":null,"description_markdown":"## 📊 Dataset Details\r\n- **Name:** JamendoMaxCaps  \r\n- **URL:** https://huggingface.co/datasets/amaai-lab/JamendoMaxCaps  \r\n- **Content:** 362,238 songs with captions generated by Qwen2-Audio  \r\n\r\n### Metadata Fields\r\n- genre\r\n- speed  \r\n- variable tags  \r\n\r\n## 🎯 Rationale\r\n1. **Scale:** Over a quarter-million tracks, offering a rich multimodal corpus.  \r\n2. **Quality:** Captions generated by the state-of-the-art Qwen2-Audio model.  \r\n3. **Use cases:** Supports audio captioning, retrieval, genre classification, tempo/speed analysis, and more.","description_withheld":null,"homepage":"https://huggingface.co/datasets/amaai-lab/JamendoMaxCaps","introduced_date":"2025-02-11","introduced_date_note":null,"introduced_by":{"paper":"/paper/jamendomaxcaps-a-large-scale-music-caption","title":"JamendoMaxCaps: A Large Scale Music-caption Dataset with Imputed Metadata","first_author":"Abhinaba Roy","url":null},"license":{"name":"Creative Commons Attribution Share Alike 3.0","url":"http://creativecommons.org/licenses/by-nc-nd/3.0/"},"modalities":[{"name":"Texts","url":"/datasets/modality/texts"},{"name":"Audio","url":"/datasets/modality/audio"},{"name":"Music","url":"/datasets/modality/music"}],"tasks":[{"name":"Text-to-Music Generation","url":"/task/text-to-music-generation","datasets_with_task":"/datasets/task/text-to-music-generation"},{"name":"Music Generation","url":"/task/music-generation","datasets_with_task":"/datasets/task/music-generation"},{"name":"Music Captioning","url":"/task/music-captioning","datasets_with_task":"/datasets/task/music-captioning"}],"languages":[],"variants":["JamendoMaxCaps"],"data_loaders":[],"num_papers_in_archive":1,"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28"},"benchmarks":[],"papers_with_a_benchmark_row":[],"syntology_totals":{"read_at":"2026-09-24T18:15:14+00:00","papers_with_samples":0,"samples_harvested":0,"samples_ran":0,"samples_unverified":0,"pointer_only_for_licence":0,"papers_with_no_sample_that_ran":0,"note":"the per-paper counts above, summed; not a rate"},"papers_note":"The archive never published its papers-using-dataset list; these are papers with a leaderboard row on this dataset's benchmarks."}