{"url":"/method/embracenet","slug":"embracenet","name":"EmbraceNet","full_name":"EmbraceNet: A robust deep learning architecture for multimodal classification","full_name_withheld":false,"description_markdown":null,"description_state":"absent","introduced_year":null,"introduced_by":{"title":"EmbraceNet: A robust deep learning architecture for multimodal classification","paper":"/paper/embracenet-a-robust-deep-learning","first_author":"Jun-Ho Choi","n_authors":2,"url_abs":null,"archive_paper_url":"https://paperswithcode.com/paper/embracenet-a-robust-deep-learning"},"source":{"url":"http://arxiv.org/abs/1904.09078v1","title":"EmbraceNet: A robust deep learning architecture for multimodal classification","url_on_a_paper_host":true},"code_snippet_url":null,"code_snippet_url_on_a_code_host":false,"categories":[{"area":"Computer Vision","area_id":"computer-vision","collection":"Multi-Modal Methods","url":"/methods/category/multi-modal-methods","pwc_aliases":[]}],"n_papers_tagged":4,"archive_num_papers":4,"papers_newest_first":[{"paper":null,"title":"Using Scene and Semantic Features for Multi-modal Emotion Recognition","date":"2023-08-01","arxiv_id":"2308.00228","n_code_links":0,"syntology":null},{"paper":"/paper/glami-1m-a-multilingual-image-text-fashion-1","title":"GLAMI-1M: A Multilingual Image-Text Fashion Dataset","date":"2022-11-17","arxiv_id":"2211.14451","n_code_links":1,"syntology":null},{"paper":null,"title":"EmbraceNet for Activity: A Deep Multimodal Fusion Architecture for Activity Recognition","date":"2020-04-29","arxiv_id":"2004.13918","n_code_links":0,"syntology":null},{"paper":"/paper/embracenet-a-robust-deep-learning","title":"EmbraceNet: A robust deep learning architecture for multimodal classification","date":"2019-04-19","arxiv_id":"1904.09078","n_code_links":2,"syntology":null}],"papers_shown":4,"tasks":[{"task":"/task/classification-1","name":"Classification","papers":2},{"task":"/task/activity-recognition","name":"Activity Recognition","papers":1},{"task":"/task/deep-learning","name":"Deep Learning","papers":1},{"task":"/task/emotion-recognition","name":"Emotion Recognition","papers":1},{"task":"/task/classification","name":"General Classification","papers":1},{"task":"/task/human-activity-recognition","name":"Human Activity Recognition","papers":1},{"task":"/task/image-generation","name":"Image Generation","papers":1},{"task":"/task/image-text-classification","name":"Image-text Classification","papers":1},{"task":"/task/multi-lingual-image-text-classification","name":"Multilingual Image-Text Classification","papers":1},{"task":"/task/text-classification","name":"Text Classification","papers":1},{"task":"/task/text-classification-1","name":"text-classification","papers":1}],"tasks_shown":11,"n_tasks":11,"usage_by_year":[{"year":"2019","papers":1},{"year":"2020","papers":1},{"year":"2022","papers":1},{"year":"2023","papers":1}],"row_source":"methods_table","archive":{"source":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","archive_url":"https://paperswithcode.com/method/embracenet"},"syntology_read_at":"2026-09-24T18:15:14+00:00"}