Methods › Natural Language Processing › Language Models › mT5
mT5
archive 2025-07-28 Description, source and code snippet are the archive's method entry.
mt5 is a multilingual variant of T5 that was pre-trained on a new Common Crawl-based dataset covering $101$ languages.
Papers archive 2025-07-28
30 shown of 104, newest first. Repository counts are the archive's code-links table. A Syntology line states what Syntology ran from that paper's harvested code; it is per sample and not a correctness claim.
-
Advancing Sentiment Analysis in Tamil-English Code-Mixed Texts: Challenges and Transformer-Based Solutions 30 Mar 2025 · 0 repositories · arXiv:2503.23295
-
Exploring Robustness of Multilingual LLMs on Real-World Noisy Data 14 Jan 2025 · 1 repository · arXiv:2501.08322
-
Bridging Dialects: Translating Standard Bangla to Regional Variants Using Neural Models 10 Jan 2025 · 0 repositories · arXiv:2501.05749
-
Empowering Bengali Education with AI: Solving Bengali Math Word Problems through Transformer Models 5 Jan 2025 · 0 repositories · arXiv:2501.02599
-
BeliN: A Novel Corpus for Bengali Religious News Headline Generation using Contextual Feature Fusion 2 Jan 2025 · 1 repository · arXiv:2501.01069
-
HAND: Hierarchical Attention Network for Multi-Scale Handwritten Document Recognition and Layout Analysis 25 Dec 2024 · 0 repositories · arXiv:2412.18981
-
Advancing Explainability in Neural Machine Translation: Analytical Metrics for Attention and Alignment Consistency 24 Dec 2024 · 0 repositories · arXiv:2412.18669
-
The First Multilingual Model For The Detection of Suicide Texts 20 Dec 2024 · 0 repositories · arXiv:2412.15498
-
Neural Text Normalization for Luxembourgish using Real-Life Variation Data 12 Dec 2024 · 0 repositories · arXiv:2412.09383
-
SiTSE: Sinhala Text Simplification Dataset and Evaluation 2 Dec 2024 · 1 repository · arXiv:2412.01293
-
Towards Santali Linguistic Inclusion: Building the First Santali-to-English Translation Model using mT5 Transformer and Data Augmentation 29 Nov 2024 · 0 repositories · arXiv:2411.19726
-
Unlocking Legal Knowledge: A Multilingual Dataset for Judicial Summarization in Switzerland 17 Oct 2024 · 0 repositories · arXiv:2410.13456
-
Tokenization and Morphology in Multilingual Language Models: A Comparative Analysis of mT5 and ByT5 15 Oct 2024 · 0 repositories · arXiv:2410.11627
-
Abstractive Summarization of Low resourced Nepali language using Multilingual Transformers 29 Sep 2024 · 0 repositories · arXiv:2409.19566
-
MURI: High-Quality Instruction Tuning Datasets for Low-Resource Languages via Reverse Instructions 19 Sep 2024 · 1 repository · arXiv:2409.12958
-
Exploring Fine-tuned Generative Models for Keyphrase Selection: A Case Study for Russian 16 Sep 2024 · 0 repositories · arXiv:2409.10640
-
On Initializing Transformers with Pre-trained Embeddings 17 Jul 2024 · 0 repositories · arXiv:2407.12514
-
Segment-Based Interactive Machine Translation for Pre-trained Models 9 Jul 2024 · 0 repositories · arXiv:2407.06990
-
Vision-Braille: An End-to-End Tool for Chinese Braille Image-to-Text Translation 8 Jul 2024 · 0 repositories · arXiv:2407.06048
-
The Model Arena for Cross-lingual Sentiment Analysis: A Comparative Study in the Era of Large Language Models 27 Jun 2024 · 0 repositories · arXiv:2406.19358
-
UQA: Corpus for Urdu Question Answering 2 May 2024 · 3 repositories · arXiv:2405.01458
-
TuBA: Cross-Lingual Transferability of Backdoor Attacks in LLMs with Instruction Tuning 30 Apr 2024 · 0 repositories · arXiv:2404.19597
-
IndicGenBench: A Multilingual Benchmark to Evaluate Generation Capabilities of LLMs on Indic Languages 25 Apr 2024 · 1 repository · arXiv:2404.16816
-
HLTCOE at TREC 2023 NeuCLIR Track 11 Apr 2024 · 0 repositories · arXiv:2404.08118
-
Medical mT5: An Open-Source Multilingual Text-to-Text LLM for The Medical Domain 11 Apr 2024 · 0 repositories · arXiv:2404.07613
-
Data Bias According to Bipol: Men are Naturally Right and It is the Role of Women to Follow Their Lead 7 Apr 2024 · 1 repository · arXiv:2404.04838
-
Adaptive Cross-lingual Text Classification through In-Context One-Shot Demonstrations 3 Apr 2024 · 1 repository · arXiv:2404.02452Syntology ran 2 of 2 samples · 0 unverified · 2 pointer-only (licence)
-
Transcribing Bengali Text with Regional Dialects to IPA using District Guided Tokens 26 Mar 2024 · 0 repositories · arXiv:2403.17407
-
Evaluating Named Entity Recognition: A comparative analysis of mono- and multilingual transformer models on a novel Brazilian corporate earnings call transcripts dataset 18 Mar 2024 · 2 repositories · arXiv:2403.12212
-
Basque and Spanish Counter Narrative Generation: Data Creation and Evaluation 14 Mar 2024 · 0 repositories · arXiv:2403.09159
Tasks archive 2025-07-28
20 shown of 133 tasks the archive attaches to papers tagged with this method, by distinct papers. A task without a page in the catalog is plain text.
Usage over time archive 2025-07-28
Components: the archive holds no method-to-method composition, so PwC's Components table cannot be rebuilt; the Papers list carries no Results column for the same reason (the archive does not join its leaderboard rows to method tags).
Categories archive 2025-07-28
Report a problem or propose a change · a person checks every report against the paper or source before anything changes; decisions are listed on /corrections