{"url":"/task/emotion-classification","name":"Emotion Classification","slug":"emotion-classification","description_markdown":"Emotion classification, or emotion categorization, is the task of recognising emotions to classify them into the corresponding category. Given an input, classify it as 'neutral or no emotion' or as one, or more, of several given emotions that best represent the mental state of the subject's facial expression, words, and so on. Some example benchmarks include ROCStories, Many Faces of Anger (MFA), and GoEmotions. Models can be evaluated using metrics such as the Concordance Correlation Coefficient (CCC) and the Mean Squared Error (MSE).","categories":[{"name":"Computer Vision","url":"/area/computer-vision"},{"name":"Natural Language Processing","url":"/area/natural-language-processing"}],"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","slug_source":"archive_url"},"counts":{"papers_tagged":458,"papers_with_code":117,"benchmarks":9,"benchmark_tables_in_archive":9,"benchmark_tables_shown":9,"benchmark_tables_withheld_as_spam":0,"benchmark_definition":"a leaderboard table with at least one row; benchmark_tables_shown also counts the zero-row tables; benchmark_tables_in_archive adds the tables withheld as spam","datasets":27,"subtasks":0,"parent_tasks":1},"benchmarks":[{"leaderboard":"/sota/emotion-classification-on-cmu-mosei","slug":"emotion-classification-on-cmu-mosei","dataset":"CMU-MOSEI","dataset_url":"/dataset/cmu-mosei","rows_in_archive":4,"metrics":["Accuracy","Weighted Accuracy"],"first_row_in_archive_order":{"model":"MARLIN (ViT-L)","paper_title":"MARLIN: Masked Autoencoder for facial video Representation LearnINg","paper_url":"/paper/marlin-masked-autoencoder-for-facial-video","paper_date":"2022-11-12","arxiv_id":"2211.06627","code_links":[{"title":"ControlNet/MARLIN","url":"https://github.com/ControlNet/MARLIN"}],"syntology":null}},{"leaderboard":"/sota/emotion-classification-on-semeval-2018-task","slug":"emotion-classification-on-semeval-2018-task","dataset":"SemEval 2018 Task 1E-c","dataset_url":null,"rows_in_archive":4,"metrics":["Accuracy","Micro-F1","Macro-F1"],"first_row_in_archive_order":{"model":"SpanEmo","paper_title":"SpanEmo: Casting Multi-label Emotion Classification as Span-prediction","paper_url":"/paper/spanemo-casting-multi-label-emotion","paper_date":"2021-01-25","arxiv_id":"2101.10038","code_links":[{"title":"hasanhuz/SpanEmo","url":"https://github.com/hasanhuz/SpanEmo"}],"syntology":null}},{"leaderboard":"/sota/emotion-classification-on-ewalk","slug":"emotion-classification-on-ewalk","dataset":"EWALK","dataset_url":null,"rows_in_archive":3,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"ProxEmo (ours)","paper_title":"ProxEmo: Gait-based Emotion Learning and Multi-view Proxemic Fusion for Socially-Aware Robot Navigation","paper_url":"/paper/proxemo-gait-based-emotion-learning-and-multi","paper_date":"2020-03-02","arxiv_id":"2003.01062","code_links":[{"title":"vijay4313/proxemo","url":"https://github.com/vijay4313/proxemo"}],"syntology":null}},{"leaderboard":"/sota/emotion-classification-on-mfa","slug":"emotion-classification-on-mfa","dataset":"MFA","dataset_url":"/dataset/mfa","rows_in_archive":2,"metrics":["F-F1 score (Comb.)","F-F1 score (Persian)","V-F1 score (Comb.)","V-F1 score (NA)","F-F1 score (NA)","V-F1 score (Persian)"],"first_row_in_archive_order":{"model":"MLKNN","paper_title":"The Many Faces of Anger: A Multicultural Video Dataset of Negative Emotions in the Wild (MFA-Wild)","paper_url":"/paper/the-many-faces-of-anger-a-multicultural-video","paper_date":"2021-12-10","arxiv_id":"2112.05267","code_links":[{"title":"rjavadi/social-signal-project","url":"https://github.com/rjavadi/social-signal-project"}],"syntology":null}},{"leaderboard":"/sota/emotion-classification-on-rocstories","slug":"emotion-classification-on-rocstories","dataset":"ROCStories","dataset_url":"/dataset/rocstories","rows_in_archive":2,"metrics":["F1"],"first_row_in_archive_order":{"model":"Semi-supervision","paper_title":"Modeling Label Semantics for Predicting Emotional Reactions","paper_url":"/paper/modeling-label-semantics-for-predicting","paper_date":"2020-06-09","arxiv_id":"2006.05489","code_links":[{"title":"StonyBrookNLP/emotion-label-semantics","url":"https://github.com/StonyBrookNLP/emotion-label-semantics"}],"syntology":null}},{"leaderboard":"/sota/emotion-classification-on-armanemo","slug":"emotion-classification-on-armanemo","dataset":"ArmanEmo","dataset_url":"/dataset/armanemo","rows_in_archive":1,"metrics":["Macro F1"],"first_row_in_archive_order":{"model":"Deep ParsBERT","paper_title":"Investigating Shallow and Deep Learning Techniques for Emotion Classification in Short Persian Texts","paper_url":"/paper/investigating-shallow-and-deep-learning","paper_date":"2023-12-16","arxiv_id":null,"code_links":[{"title":"vkiani/ShortPersianEmo","url":"https://github.com/vkiani/ShortPersianEmo"}],"syntology":null}},{"leaderboard":"/sota/emotion-classification-on-caer-dynamic","slug":"emotion-classification-on-caer-dynamic","dataset":"CAER-Dynamic","dataset_url":"/dataset/caer-dynamic","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"CAERNet","paper_title":"Context-Aware Emotion Recognition Networks","paper_url":"/paper/context-aware-emotion-recognition-networks","paper_date":"2019-08-16","arxiv_id":"1908.05913","code_links":[{"title":"ankurbhatia24/MULTIMODAL-EMOTION-RECOGNITION","url":"https://github.com/ankurbhatia24/MULTIMODAL-EMOTION-RECOGNITION"}],"syntology":null}},{"leaderboard":"/sota/emotion-classification-on-ravdess","slug":"emotion-classification-on-ravdess","dataset":"RAVDESS","dataset_url":"/dataset/ravdess","rows_in_archive":1,"metrics":["Top-1 Accuracy"],"first_row_in_archive_order":{"model":"ERANN-0-4","paper_title":"ERANNs: Efficient Residual Audio Neural Networks for Audio Pattern Recognition","paper_url":null,"paper_date":"2021-06-03","arxiv_id":"2106.01621","code_links":[],"syntology":null}},{"leaderboard":"/sota/emotion-classification-on-shortpersianemo","slug":"emotion-classification-on-shortpersianemo","dataset":"ShortPersianEmo","dataset_url":"/dataset/shortpersianemo","rows_in_archive":1,"metrics":["Macro F1"],"first_row_in_archive_order":{"model":"Deep ParsBERT","paper_title":"Investigating Shallow and Deep Learning Techniques for Emotion Classification in Short Persian Texts","paper_url":"/paper/investigating-shallow-and-deep-learning","paper_date":"2023-12-16","arxiv_id":null,"code_links":[{"title":"vkiani/ShortPersianEmo","url":"https://github.com/vkiani/ShortPersianEmo"}],"syntology":null}}],"datasets":[{"url":"/dataset/cmu-mosei","name":"CMU-MOSEI","full_name":"","num_papers_in_archive":190},{"url":"/dataset/rocstories","name":"ROCStories","full_name":"","num_papers_in_archive":152},{"url":"/dataset/msp-improv","name":"MSP-IMPROV","full_name":"MSP-IMPROV: An Acted Corpus of Dyadic Interactions to Study Emotion Perception","num_papers_in_archive":70},{"url":"/dataset/isear","name":"ISEAR","full_name":"International Survey on Emotion Antecedents and Reactions","num_papers_in_archive":55},{"url":"/dataset/emotionlines","name":"EmotionLines","full_name":"EmotionLines","num_papers_in_archive":44},{"url":"/dataset/emobank","name":"EmoBank","full_name":"","num_papers_in_archive":32},{"url":"/dataset/ravdess","name":"RAVDESS","full_name":"Ryerson Audio-Visual Database of Emotional Speech and Song","num_papers_in_archive":27},{"url":"/dataset/emopia","name":"EMOPIA","full_name":"A Multi-Modal Pop Piano Dataset For Emotion Recognition and Emotion-based Music Generation","num_papers_in_archive":23},{"url":"/dataset/story-commonsense","name":"Story Commonsense","full_name":"","num_papers_in_archive":13},{"url":"/dataset/deap","name":"DEAP","full_name":"","num_papers_in_archive":11},{"url":"/dataset/armanemo","name":"ArmanEmo","full_name":"","num_papers_in_archive":6},{"url":"/dataset/stockemotions","name":"StockEmotions","full_name":"","num_papers_in_archive":3},{"url":"/dataset/avcaffe","name":"AVCAffe","full_name":"A Large Scale Audio-Visual Dataset of Cognitive Load and Affect for Remote Work","num_papers_in_archive":2},{"url":"/dataset/emopars","name":"EmoPars","full_name":"","num_papers_in_archive":2},{"url":"/dataset/nemo-1","name":"nEMO","full_name":"","num_papers_in_archive":2},{"url":"/dataset/reactiongif","name":"ReactionGIF","full_name":"","num_papers_in_archive":2},{"url":"/dataset/banglaemotion","name":"BanglaEmotion","full_name":"BanglaEmotion: A Benchmark Dataset for Bangla Textual Emotion Analysis","num_papers_in_archive":1},{"url":"/dataset/caer-dynamic","name":"CAER-Dynamic","full_name":"","num_papers_in_archive":1},{"url":"/dataset/event-focused-emotion-corpora-for-german-and","name":"Event-focused Emotion Corpora for German and English","full_name":"","num_papers_in_archive":1},{"url":"/dataset/mfa","name":"MFA","full_name":"Many Faces of Anger","num_papers_in_archive":1},{"url":"/dataset/ren-20k-dataset","name":"REN-20k Dataset","full_name":"","num_papers_in_archive":1},{"url":"/dataset/shortpersianemo","name":"ShortPersianEmo","full_name":"","num_papers_in_archive":1},{"url":"/dataset/silicone-benchmark","name":"SILICONE Benchmark","full_name":"SILICONE","num_papers_in_archive":1},{"url":"/dataset/vnemos","name":"VNEMOS","full_name":"Vietnamese Speech Emotion Dataset","num_papers_in_archive":1},{"url":"/dataset/human-faces-with-mixed-race-various-emotions","name":"Human faces with mixed-race & various emotions","full_name":"","num_papers_in_archive":0},{"url":"/dataset/l-svd","name":"L-SVD","full_name":"Large-Scale Selfie Video Dataset (L-SVD): A Benchmark for Emotion Recognition","num_papers_in_archive":0},{"url":"/dataset/phymer","name":"PhyMER","full_name":"PhyMER: Physiological Dataset for Multimodal Emotion Recognition With Personality as a Context","num_papers_in_archive":0}],"subtasks":[],"parent_tasks":[{"url":"/task/text-classification","name":"Text Classification"}],"papers":{"order":"repositories listed in the archive (desc), then date (desc); the archive holds no stars","population":"papers tagged with this task that list at least one repository in the archive","shown":30,"of":117,"tagged_in_all":458,"items":[{"url":"/paper/real-time-convolutional-neural-networks-for","title":"Real-time Convolutional Neural Networks for Emotion and Gender Classification","date":"2017-10-20","arxiv_id":"1710.07557","repositories_listed":18,"syntology":{"n":17,"n_ran":1,"n_unverified":16,"n_pointer_only":0}},{"url":"/paper/goemotions-a-dataset-of-fine-grained-emotions","title":"GoEmotions: A Dataset of Fine-Grained Emotions","date":"2020-05-01","arxiv_id":"2005.00547","repositories_listed":9,"syntology":{"n":10,"n_ran":0,"n_unverified":10,"n_pointer_only":0}},{"url":"/paper/emotion-classification-in-a-resource","title":"Emotion Classification in a Resource Constrained Language Using Transformer-based Approach","date":"2021-04-17","arxiv_id":"2104.08613","repositories_listed":4,"syntology":null},{"url":"/paper/multimodal-speech-emotion-recognition-using","title":"Multimodal Speech Emotion Recognition Using Audio and Text","date":"2018-10-10","arxiv_id":"1810.04635","repositories_listed":4,"syntology":null},{"url":"/paper/ntua-slp-at-semeval-2018-task-1-predicting","title":"NTUA-SLP at SemEval-2018 Task 1: Predicting Affective Content in Tweets with Deep Attentive RNNs and Transfer Learning","date":"2018-04-18","arxiv_id":"1804.06658","repositories_listed":3,"syntology":null},{"url":"/paper/stockemotions-discover-investor-emotions-for","title":"StockEmotions: Discover Investor Emotions for Financial Sentiment Analysis and Multivariate Time Series","date":"2023-01-23","arxiv_id":"2301.09279","repositories_listed":2,"syntology":null},{"url":"/paper/uncovering-the-limits-of-text-based-emotion","title":"Uncovering the Limits of Text-based Emotion Detection","date":"2021-09-04","arxiv_id":"2109.01900","repositories_listed":2,"syntology":null},{"url":"/paper/musicbert-symbolic-music-understanding-with","title":"MusicBERT: Symbolic Music Understanding with Large-Scale Pre-Training","date":"2021-06-10","arxiv_id":"2106.05630","repositories_listed":2,"syntology":{"n":7,"n_ran":3,"n_unverified":4,"n_pointer_only":0}},{"url":"/paper/facial-expression-and-attributes-recognition","title":"Facial expression and attributes recognition based on multi-task learning of lightweight neural networks","date":"2021-03-31","arxiv_id":null,"repositories_listed":2,"syntology":null},{"url":"/paper/facial-expression-and-attributes-recognition-1","title":"Facial expression and attributes recognition based on multi-task learning of lightweight neural networks","date":"2021-03-31","arxiv_id":"2103.17107","repositories_listed":2,"syntology":null},{"url":"/paper/sentibert-a-transferable-transformer-based","title":"SentiBERT: A Transferable Transformer-Based Architecture for Compositional Sentiment Semantics","date":"2020-05-08","arxiv_id":"2005.04114","repositories_listed":2,"syntology":null},{"url":"/paper/cross-lingual-emotion-intensity-prediction","title":"Cross-lingual Emotion Intensity Prediction","date":"2020-04-08","arxiv_id":"2004.04103","repositories_listed":2,"syntology":null},{"url":"/paper/emotion-recognition-from-speech","title":"Emotion Recognition from Speech","date":"2019-12-22","arxiv_id":"1912.10458","repositories_listed":2,"syntology":null},{"url":"/paper/enriching-existing-conversational-emotion","title":"EDA: Enriching Emotional Dialogue Acts using an Ensemble of Neural Annotators","date":"2019-12-02","arxiv_id":"1912.00819","repositories_listed":2,"syntology":null},{"url":"/paper/dialoguegcn-a-graph-convolutional-neural","title":"DialogueGCN: A Graph Convolutional Neural Network for Emotion Recognition in Conversation","date":"2019-08-30","arxiv_id":"1908.11540","repositories_listed":2,"syntology":{"n":4,"n_ran":0,"n_unverified":4,"n_pointer_only":0}},{"url":"/paper/190410788","title":"Speech Emotion Recognition Using Multi-hop Attention Mechanism","date":"2019-04-23","arxiv_id":"1904.10788","repositories_listed":2,"syntology":null},{"url":"/paper/dialoguernn-an-attentive-rnn-for-emotion","title":"DialogueRNN: An Attentive RNN for Emotion Detection in Conversations","date":"2018-11-01","arxiv_id":"1811.00405","repositories_listed":2,"syntology":null},{"url":"/paper/classifying-and-visualizing-emotions-with","title":"Classifying and Visualizing Emotions with Emotional DAN","date":"2018-10-23","arxiv_id":"1810.10529","repositories_listed":2,"syntology":null},{"url":"/paper/emotxt-a-toolkit-for-emotion-recognition-from","title":"EmoTxt: A Toolkit for Emotion Recognition from Text","date":"2017-08-13","arxiv_id":"1708.03892","repositories_listed":2,"syntology":null},{"url":"/paper/mmaffben-a-multilingual-and-multimodal","title":"MMAFFBen: A Multilingual and Multimodal Affective Analysis Benchmark for Evaluating LLMs and VLMs","date":"2025-05-30","arxiv_id":"2505.24423","repositories_listed":1,"syntology":null},{"url":"/paper/what-about-emotions-guiding-fine-grained","title":"What About Emotions? Guiding Fine-Grained Emotion Extraction from Mobile App Reviews","date":"2025-05-29","arxiv_id":"2505.23452","repositories_listed":1,"syntology":null},{"url":"/paper/emometa-a-multimodal-dataset-for-fine-grained","title":"EmoMeta: A Multimodal Dataset for Fine-grained Emotion Classification in Chinese Metaphors","date":"2025-05-12","arxiv_id":"2505.13483","repositories_listed":1,"syntology":null},{"url":"/paper/mellm-exploring-llm-powered-micro-expression","title":"MELLM: Exploring LLM-Powered Micro-Expression Understanding Enhanced by Subtle Motion Perception","date":"2025-05-11","arxiv_id":"2505.07007","repositories_listed":1,"syntology":null},{"url":"/paper/a-novel-fourier-adjacency-transformer-for","title":"A novel Fourier Adjacency Transformer for advanced EEG emotion recognition","date":"2025-02-28","arxiv_id":"2503.13465","repositories_listed":1,"syntology":{"n":14,"n_ran":1,"n_unverified":13,"n_pointer_only":0}},{"url":"/paper/lotus-at-semeval-2025-task-11-roberta-with","title":"Lotus at SemEval-2025 Task 11: RoBERTa with Llama-3 Generated Explanations for Multi-Label Emotion Classification","date":"2025-02-27","arxiv_id":"2502.19935","repositories_listed":1,"syntology":null},{"url":"/paper/vanpy-voice-analysis-framework","title":"VANPY: Voice Analysis Framework","date":"2025-02-17","arxiv_id":"2502.17579","repositories_listed":1,"syntology":null},{"url":"/paper/large-vision-language-models-for-knowledge","title":"Large Vision-Language Models for Knowledge-Grounded Data Annotation of Memes","date":"2025-01-23","arxiv_id":"2501.13851","repositories_listed":1,"syntology":null},{"url":"/paper/aima-at-semeval-2024-task-3-simple-yet","title":"AIMA at SemEval-2024 Task 3: Simple Yet Powerful Emotion Cause Pair Analysis","date":"2025-01-19","arxiv_id":"2501.11170","repositories_listed":1,"syntology":null},{"url":"/paper/deep-learning-based-feature-fusion-for","title":"Deep Learning-Based Feature Fusion for Emotion Analysis and Suicide Risk Differentiation in Chinese Psychological Support Hotlines","date":"2025-01-15","arxiv_id":"2501.08696","repositories_listed":1,"syntology":null},{"url":"/paper/emonext-an-adapted-convnext-for-facial-1","title":"EmoNeXt: an Adapted ConvNeXt for Facial Emotion Recognition","date":"2025-01-14","arxiv_id":"2501.08199","repositories_listed":1,"syntology":null}],"syntology_records":5,"syntology_note":"a paper without a record is not a recorded non-run: it may lack an arXiv id or simply be absent from the graph layer"},"description_links":{"kept":0,"unwrapped_to_text":0,"bare_urls_linked":0,"relative_images_dropped":0,"rule":"internal links are kept only when the target slug exists in the catalog"},"syntology":{"read_at":"2026-09-24T18:15:14+00:00","claim":"Per-sample execution status on synthesized fixtures ('ran N of M samples'); not a correctness claim and not a ranking signal.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"}},"not_shown":{"libraries":"the archive has no per-task library table","trend_sparklines":"the Trend column of the benchmarks table was a rendered image; it is not in the archive","social_and_latest_sorts":"stars and social signals are not in the archive"}}