{"url":"/task/transfer-learning","name":"Transfer Learning","slug":"transfer-learning","description_markdown":"**Transfer Learning** is a machine learning technique where a model trained on one task is re-purposed and fine-tuned for a related, but different task. The idea behind transfer learning is to leverage the knowledge learned from a pre-trained model to solve a new, but related problem. This can be useful in situations where there is limited data available to train a new model from scratch, or when the new task is similar enough to the original task that the pre-trained model can be adapted to the new problem with only minor modifications.\r\n\r\n<span style=\"color:grey; opacity: 0.6\">( Image credit: [Subodh Malgonde](https://medium.com/@subodh.malgonde/transfer-learning-using-tensorflow-52a4f6bcde3e) )</span>","categories":[{"name":"Methodology","url":"/area/methodology"},{"name":"Miscellaneous","url":"/area/miscellaneous"}],"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","slug_source":"archive_url"},"counts":{"papers_tagged":10307,"papers_with_code":3502,"benchmarks":6,"benchmark_tables_in_archive":6,"benchmark_tables_shown":6,"benchmark_tables_withheld_as_spam":0,"benchmark_definition":"a leaderboard table with at least one row; benchmark_tables_shown also counts the zero-row tables; benchmark_tables_in_archive adds the tables withheld as spam","datasets":18,"subtasks":4,"parent_tasks":0},"benchmarks":[{"leaderboard":"/sota/transfer-learning-on-office-home","slug":"transfer-learning-on-office-home","dataset":"Office-Home","dataset_url":"/dataset/office-home","rows_in_archive":5,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"APCLIP","paper_title":"Domain Prompt Learning for Efficiently Adapting CLIP to Unseen Domains","paper_url":"/paper/amortized-prompt-lightweight-fine-tuning-for","paper_date":"2021-11-25","arxiv_id":"2111.12853","code_links":[{"title":"shogi880/DPLCLIP","url":"https://github.com/shogi880/DPLCLIP"}],"syntology":{"n":17,"n_ran":11,"n_unverified":6,"n_pointer_only":17}}},{"leaderboard":"/sota/transfer-learning-on-100-sleep-nights-of-8","slug":"transfer-learning-on-100-sleep-nights-of-8","dataset":"100 sleep nights of 8 caregivers","dataset_url":null,"rows_in_archive":1,"metrics":["10-20% Mask PSNR"],"first_row_in_archive_order":{"model":"CNN","paper_title":"Plant Disease Detection from Images","paper_url":"/paper/plant-disease-detection-from-images","paper_date":"2020-03-05","arxiv_id":"2003.05379","code_links":[],"syntology":null}},{"leaderboard":"/sota/transfer-learning-on-banglalekha-isolated","slug":"transfer-learning-on-banglalekha-isolated","dataset":"BanglaLekha Isolated Dataset","dataset_url":"/dataset/banglalekha-isolated","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Chatterjee, Dutta et al.[1]","paper_title":"AKHCRNet: Bengali Handwritten Character Recognition Using Deep Learning","paper_url":"/paper/akhcrnet-bengali-handwritten-character","paper_date":"2020-08-29","arxiv_id":"2008.12995","code_links":[{"title":"theroyakash/AKHCRNet","url":"https://github.com/theroyakash/AKHCRNet"}],"syntology":null}},{"leaderboard":"/sota/transfer-learning-on-coco70","slug":"transfer-learning-on-coco70","dataset":"COCO70","dataset_url":null,"rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"Co-Tuning","paper_title":"Co-Tuning for Transfer Learning","paper_url":"/paper/co-tuning-for-transfer-learning","paper_date":"2020-12-01","arxiv_id":null,"code_links":[{"title":"thuml/Transfer-Learning-Library","url":"https://github.com/thuml/Transfer-Learning-Library"},{"title":"thuml/CoTuning","url":"https://github.com/thuml/CoTuning"}],"syntology":null}},{"leaderboard":"/sota/transfer-learning-on-kitti-object-tracking","slug":"transfer-learning-on-kitti-object-tracking","dataset":"KITTI Object Tracking Evaluation 2012","dataset_url":"/dataset/kitti","rows_in_archive":1,"metrics":["EER"],"first_row_in_archive_order":{"model":"Physical Access","paper_title":"Audio Spoofing Verification using Deep Convolutional Neural Networks by Transfer Learning","paper_url":"/paper/audio-spoofing-verification-using-deep","paper_date":"2020-08-08","arxiv_id":"2008.03464","code_links":[{"title":"rahul-t-p/ASVspoof-2019","url":"https://github.com/rahul-t-p/ASVspoof-2019"}],"syntology":null}},{"leaderboard":"/sota/transfer-learning-on-retinal-fundus","slug":"transfer-learning-on-retinal-fundus","dataset":"Retinal Fundus MultiDisease Image Dataset (RFMiD)","dataset_url":"/dataset/retinal-fundus-multidisease-image-dataset","rows_in_archive":1,"metrics":["AUROC"],"first_row_in_archive_order":{"model":"riadd.aucmedi","paper_title":"Multi-Disease Detection in Retinal Imaging based on Ensembling Heterogeneous Deep Learning Models","paper_url":"/paper/multi-disease-detection-in-retinal-imaging","paper_date":"2021-03-26","arxiv_id":"2103.14660","code_links":[{"title":"frankkramer-lab/riadd.aucmedi","url":"https://github.com/frankkramer-lab/riadd.aucmedi"},{"title":"ashokkumar-kola/FYP","url":"https://github.com/ashokkumar-kola/FYP"}],"syntology":null}}],"datasets":[{"url":"/dataset/kitti","name":"KITTI","full_name":"","num_papers_in_archive":3661},{"url":"/dataset/office-home","name":"Office-Home","full_name":"","num_papers_in_archive":1074},{"url":"/dataset/mfrc","name":"MFRC","full_name":"Moral Foundations Reddit Corpus","num_papers_in_archive":9},{"url":"/dataset/sims4action","name":"Sims4Action","full_name":"","num_papers_in_archive":5},{"url":"/dataset/spartun","name":"SpaRTUN","full_name":"","num_papers_in_archive":5},{"url":"/dataset/bioscan-5m","name":"BIOSCAN-5M","full_name":"","num_papers_in_archive":4},{"url":"/dataset/carlane-benchmark","name":"CARLANE Benchmark","full_name":"","num_papers_in_archive":4},{"url":"/dataset/banglalekha-isolated","name":"BanglaLekha-Isolated","full_name":"","num_papers_in_archive":3},{"url":"/dataset/fluocells","name":"fluocells","full_name":"Fluorescent Neuronal Cells","num_papers_in_archive":3},{"url":"/dataset/retinal-fundus-multidisease-image-dataset","name":"Retinal Fundus MultiDisease Image Dataset (RFMiD)","full_name":"","num_papers_in_archive":3},{"url":"/dataset/digital-twin-supported-deep-learning-for","name":"Digital twin-supported deep learning for fault diagnosis","full_name":"","num_papers_in_archive":2},{"url":"/dataset/m2qa","name":"M2QA","full_name":"Multi-domain Multilingual Question Answering","num_papers_in_archive":2},{"url":"/dataset/baitbuster-bangla","name":"BaitBuster-Bangla: A Comprehensive Dataset for Clickbait Detection in Bangla with Multi-Feature and Multi-Modal Analysis","full_name":"","num_papers_in_archive":1},{"url":"/dataset/indian-party-symbol-dataset","name":"Indian Party Symbol Dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/reefset","name":"ReefSet","full_name":"","num_papers_in_archive":1},{"url":"/dataset/tfix-s-code-patch-data","name":"TFix's Code Patches Data","full_name":"","num_papers_in_archive":1},{"url":"/dataset/applescabfds","name":"AppleScabFDs","full_name":"","num_papers_in_archive":0},{"url":"/dataset/applescablds","name":"AppleScabLDs","full_name":"","num_papers_in_archive":0}],"subtasks":[{"url":"/task/auxiliary-learning","name":"Auxiliary Learning"},{"url":"/task/multi-task-learning","name":"Multi-Task Learning"},{"url":"/task/transfer-reinforcement-learning","name":"Transfer Reinforcement Learning"},{"url":"/task/unsupervised-domain-expansion","name":"Unsupervised Domain Expansion"}],"parent_tasks":[],"papers":{"order":"repositories listed in the archive (desc), then date (desc); the archive holds no stars","population":"papers tagged with this task that list at least one repository in the archive","shown":30,"of":3502,"tagged_in_all":10307,"items":[{"url":"/paper/efficientnet-rethinking-model-scaling-for","title":"EfficientNet: Rethinking Model Scaling for Convolutional Neural Networks","date":"2019-05-28","arxiv_id":"1905.11946","repositories_listed":144,"syntology":{"n":302,"n_ran":171,"n_unverified":131,"n_pointer_only":112}},{"url":"/paper/universal-language-model-fine-tuning-for-text","title":"Universal Language Model Fine-tuning for Text Classification","date":"2018-01-18","arxiv_id":"1801.06146","repositories_listed":66,"syntology":{"n":5,"n_ran":2,"n_unverified":3,"n_pointer_only":3}},{"url":"/paper/sentence-bert-sentence-embeddings-using","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","date":"2019-08-27","arxiv_id":"1908.10084","repositories_listed":64,"syntology":{"n":58,"n_ran":20,"n_unverified":38,"n_pointer_only":11}},{"url":"/paper/exploring-the-limits-of-transfer-learning","title":"Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer","date":"2019-10-23","arxiv_id":"1910.10683","repositories_listed":57,"syntology":{"n":31,"n_ran":2,"n_unverified":29,"n_pointer_only":0}},{"url":"/paper/high-quality-monocular-depth-estimation-via","title":"High Quality Monocular Depth Estimation via Transfer Learning","date":"2018-12-31","arxiv_id":"1812.11941","repositories_listed":45,"syntology":{"n":23,"n_ran":5,"n_unverified":18,"n_pointer_only":3}},{"url":"/paper/distilbert-a-distilled-version-of-bert","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","date":"2019-10-02","arxiv_id":"1910.01108","repositories_listed":37,"syntology":{"n":27,"n_ran":19,"n_unverified":8,"n_pointer_only":0}},{"url":"/paper/resnest-split-attention-networks","title":"ResNeSt: Split-Attention Networks","date":"2020-04-19","arxiv_id":"2004.08955","repositories_listed":36,"syntology":{"n":48,"n_ran":8,"n_unverified":40,"n_pointer_only":23}},{"url":"/paper/bag-of-tricks-for-image-classification-with","title":"Bag of Tricks for Image Classification with Convolutional Neural Networks","date":"2018-12-04","arxiv_id":"1812.01187","repositories_listed":28,"syntology":{"n":15,"n_ran":4,"n_unverified":11,"n_pointer_only":5}},{"url":"/paper/universal-sentence-encoder","title":"Universal Sentence Encoder","date":"2018-03-29","arxiv_id":"1803.11175","repositories_listed":24,"syntology":{"n":22,"n_ran":1,"n_unverified":21,"n_pointer_only":1}},{"url":"/paper/transfertransfo-a-transfer-learning-approach","title":"TransferTransfo: A Transfer Learning Approach for Neural Network Based Conversational Agents","date":"2019-01-23","arxiv_id":"1901.08149","repositories_listed":23,"syntology":{"n":26,"n_ran":8,"n_unverified":18,"n_pointer_only":7}},{"url":"/paper/supervised-learning-of-universal-sentence","title":"Supervised Learning of Universal Sentence Representations from Natural Language Inference Data","date":"2017-05-05","arxiv_id":"1705.02364","repositories_listed":23,"syntology":{"n":7,"n_ran":6,"n_unverified":1,"n_pointer_only":7}},{"url":"/paper/unsupervised-domain-adaptation-by","title":"Unsupervised Domain Adaptation by Backpropagation","date":"2014-09-26","arxiv_id":"1409.7495","repositories_listed":22,"syntology":{"n":41,"n_ran":34,"n_unverified":7,"n_pointer_only":14}},{"url":"/paper/going-deeper-with-image-transformers","title":"Going deeper with Image Transformers","date":"2021-03-31","arxiv_id":"2103.17239","repositories_listed":21,"syntology":{"n":11,"n_ran":5,"n_unverified":6,"n_pointer_only":2}},{"url":"/paper/unsupervised-data-augmentation-1","title":"Unsupervised Data Augmentation for Consistency Training","date":"2019-04-29","arxiv_id":"1904.12848","repositories_listed":20,"syntology":{"n":52,"n_ran":15,"n_unverified":37,"n_pointer_only":9}},{"url":"/paper/parameter-efficient-transfer-learning-for-nlp","title":"Parameter-Efficient Transfer Learning for NLP","date":"2019-02-02","arxiv_id":"1902.00751","repositories_listed":17,"syntology":{"n":22,"n_ran":8,"n_unverified":14,"n_pointer_only":3}},{"url":"/paper/deit-iii-revenge-of-the-vit","title":"DeiT III: Revenge of the ViT","date":"2022-04-14","arxiv_id":"2204.07118","repositories_listed":12,"syntology":null},{"url":"/paper/fnet-mixing-tokens-with-fourier-transforms","title":"FNet: Mixing Tokens with Fourier Transforms","date":"2021-05-09","arxiv_id":"2105.03824","repositories_listed":12,"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":1}},{"url":"/paper/transfer-learning-from-speaker-verification","title":"Transfer Learning from Speaker Verification to Multispeaker Text-To-Speech Synthesis","date":"2018-06-12","arxiv_id":"1806.04558","repositories_listed":11,"syntology":null},{"url":"/paper/glue-a-multi-task-benchmark-and-analysis","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","date":"2018-04-20","arxiv_id":"1804.07461","repositories_listed":11,"syntology":{"n":14,"n_ran":5,"n_unverified":9,"n_pointer_only":1}},{"url":"/paper/rexnet-diminishing-representational","title":"Rethinking Channel Dimensions for Efficient Model Design","date":"2020-07-02","arxiv_id":"2007.00992","repositories_listed":10,"syntology":{"n":8,"n_ran":1,"n_unverified":7,"n_pointer_only":0}},{"url":"/paper/winogrande-an-adversarial-winograd-schema","title":"WinoGrande: An Adversarial Winograd Schema Challenge at Scale","date":"2019-07-24","arxiv_id":"1907.10641","repositories_listed":10,"syntology":null},{"url":"/paper/towards-compact-single-image-super-resolution","title":"Towards Compact Single Image Super-Resolution via Contrastive Self-distillation","date":"2021-05-25","arxiv_id":"2105.11683","repositories_listed":9,"syntology":{"n":2,"n_ran":0,"n_unverified":2,"n_pointer_only":2}},{"url":"/paper/goemotions-a-dataset-of-fine-grained-emotions","title":"GoEmotions: A Dataset of Fine-Grained Emotions","date":"2020-05-01","arxiv_id":"2005.00547","repositories_listed":9,"syntology":{"n":10,"n_ran":0,"n_unverified":10,"n_pointer_only":0}},{"url":"/paper/unveiling-covid-19-from-chest-x-ray-with-deep","title":"Unveiling COVID-19 from Chest X-ray with deep learning: a hurdles race with small data","date":"2020-04-11","arxiv_id":"2004.05405","repositories_listed":9,"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}},{"url":"/paper/transformers-state-of-the-art-natural","title":"HuggingFace's Transformers: State-of-the-art Natural Language Processing","date":"2019-10-09","arxiv_id":"1910.03771","repositories_listed":9,"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":0}},{"url":"/paper/190600695","title":"Continual learning with hypernetworks","date":"2019-06-03","arxiv_id":"1906.00695","repositories_listed":9,"syntology":{"n":1,"n_ran":1,"n_unverified":0,"n_pointer_only":1}},{"url":"/paper/unsupervised-learning-of-visual-1","title":"Unsupervised Learning of Visual Representations by Solving Jigsaw Puzzles","date":"2016-03-30","arxiv_id":"1603.09246","repositories_listed":9,"syntology":{"n":13,"n_ran":10,"n_unverified":3,"n_pointer_only":7}},{"url":"/paper/fashionpedia-ontology-segmentation-and-an","title":"Fashionpedia: Ontology, Segmentation, and an Attribute Localization Dataset","date":"2020-04-26","arxiv_id":"2004.12276","repositories_listed":8,"syntology":null},{"url":"/paper/tapas-weakly-supervised-table-parsing-via-pre","title":"TAPAS: Weakly Supervised Table Parsing via Pre-training","date":"2020-04-05","arxiv_id":"2004.02349","repositories_listed":8,"syntology":{"n":14,"n_ran":0,"n_unverified":14,"n_pointer_only":0}},{"url":"/paper/a-simple-baseline-for-bayesian-uncertainty-in","title":"A Simple Baseline for Bayesian Uncertainty in Deep Learning","date":"2019-02-07","arxiv_id":"1902.02476","repositories_listed":8,"syntology":{"n":17,"n_ran":6,"n_unverified":11,"n_pointer_only":0}}],"syntology_records":26,"syntology_note":"a paper without a record is not a recorded non-run: it may lack an arXiv id or simply be absent from the graph layer"},"description_links":{"kept":0,"unwrapped_to_text":0,"bare_urls_linked":0,"relative_images_dropped":0,"rule":"internal links are kept only when the target slug exists in the catalog"},"syntology":{"read_at":"2026-09-24T18:15:14+00:00","claim":"Per-sample execution status on synthesized fixtures ('ran N of M samples'); not a correctness claim and not a ranking signal.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"}},"not_shown":{"libraries":"the archive has no per-task library table","trend_sparklines":"the Trend column of the benchmarks table was a rendered image; it is not in the archive","social_and_latest_sorts":"stars and social signals are not in the archive"}}