{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/emotion-recognition/papers/8","list_of":"/task/emotion-recognition","task":"Emotion Recognition","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":8,"pages_in_order":21,"rows_per_page":100,"rows":[701,800],"of":2041,"counts":{"archive_papers_tagged":2041,"with_a_code_link":614,"where_syntology_ran_a_sample":69,"not_listed_spam_title":0,"listed":2041,"listed_where_code_ran":69,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":60,"every_run_a_failure_of_syntologys_instrument":9,"listed_with_a_run_with_no_instrument_failure":60,"listed_every_run_a_failure_of_syntologys_instrument":9,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/emotion-recognition","prev":"/task/emotion-recognition/papers/7","next":"/task/emotion-recognition/papers/9","papers":[{"url":null,"slug":"bimodal-connection-attention-fusion-for","title":"Bimodal Connection Attention Fusion for Speech Emotion Recognition","date":"2025-03-08","arxiv_id":"2503.05858","repositories_listed":0,"syntology":null},{"url":null,"slug":"personalized-emotion-detection-from-floor","title":"Personalized Emotion Detection from Floor Vibrations Induced by Footsteps","date":"2025-03-06","arxiv_id":"2503.04190","repositories_listed":0,"syntology":null},{"url":null,"slug":"qieemo-speech-is-all-you-need-in-the-emotion","title":"Qieemo: Speech Is All You Need in the Emotion Recognition in Conversations","date":"2025-03-05","arxiv_id":"2503.22687","repositories_listed":0,"syntology":null},{"url":null,"slug":"ecg-emotionnet-nested-mixture-of-expert-nmoe","title":"ECG-EmotionNet: Nested Mixture of Expert (NMoE) Adaptation of ECG-Foundation Model for Driver Emotion Recognition","date":"2025-03-03","arxiv_id":"2503.01750","repositories_listed":0,"syntology":null},{"url":null,"slug":"teleology-driven-affective-computing-a-causal","title":"Teleology-Driven Affective Computing: A Causal Framework for Sustained Well-Being","date":"2025-02-24","arxiv_id":"2502.17172","repositories_listed":0,"syntology":null},{"url":null,"slug":"akan-cinematic-emotions-ace-a-multimodal","title":"Akan Cinematic Emotions (ACE): A Multimodal Multi-party Dataset for Emotion Recognition in Movie Dialogues","date":"2025-02-16","arxiv_id":"2502.10973","repositories_listed":0,"syntology":null},{"url":null,"slug":"interpretable-concept-based-deep-learning","title":"Interpretable Concept-based Deep Learning Framework for Multimodal Human Behavior Modeling","date":"2025-02-14","arxiv_id":"2502.10145","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-novel-dialect-aware-framework-for-the","title":"A Novel Dialect-Aware Framework for the Classification of Arabic Dialects and Emotions","date":"2025-02-13","arxiv_id":"2502.09128","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-novel-approach-to-for-multimodal-emotion","title":"A Novel Approach to for Multimodal Emotion Recognition : Multimodal semantic information fusion","date":"2025-02-12","arxiv_id":"2502.08573","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-higher-education-with-generative-ai","title":"Enhancing Higher Education with Generative AI: A Multimodal Approach for Personalised Learning","date":"2025-02-11","arxiv_id":"2502.07401","repositories_listed":0,"syntology":null},{"url":null,"slug":"emobench-m-benchmarking-emotional","title":"EmoBench-M: Benchmarking Emotional Intelligence for Multimodal Large Language Models","date":"2025-02-06","arxiv_id":"2502.04424","repositories_listed":0,"syntology":null},{"url":null,"slug":"emotion-recognition-and-generation-a","title":"Emotion Recognition and Generation: A Comprehensive Review of Face, Speech, and Text Modalities","date":"2025-02-02","arxiv_id":"2502.06803","repositories_listed":0,"syntology":null},{"url":"/paper/mini-resemotenet-leveraging-knowledge","slug":"mini-resemotenet-leveraging-knowledge","title":"Mini-ResEmoteNet: Leveraging Knowledge Distillation for Human-Centered Design","date":"2025-01-30","arxiv_id":"2501.18538","repositories_listed":0,"syntology":null},{"url":null,"slug":"divergent-emotional-patterns-in","title":"Divergent Emotional Patterns in Disinformation on Social Media? An Analysis of Tweets and TikToks about the DANA in Valencia","date":"2025-01-28","arxiv_id":"2501.18640","repositories_listed":0,"syntology":null},{"url":null,"slug":"linguistic-analysis-of-sinhala-youtube","title":"Linguistic Analysis of Sinhala YouTube Comments on Sinhala Music Videos: A Dataset Study","date":"2025-01-28","arxiv_id":"2501.18633","repositories_listed":0,"syntology":null},{"url":null,"slug":"whispers-of-sound-enhancing-information","title":"Multimodal Magic Elevating Depression Detection with a Fusion of Text and Audio Intelligence","date":"2025-01-28","arxiv_id":"2501.16813","repositories_listed":0,"syntology":null},{"url":null,"slug":"fuzzy-aware-loss-for-source-free-domain","title":"Fuzzy-aware Loss for Source-free Domain Adaptation in Visual Emotion Recognition","date":"2025-01-26","arxiv_id":"2501.15519","repositories_listed":0,"syntology":null},{"url":null,"slug":"cross-modal-context-fusion-and-adaptive-graph","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","date":"2025-01-25","arxiv_id":"2501.15063","repositories_listed":0,"syntology":null},{"url":null,"slug":"humanomni-a-large-vision-speech-language","title":"HumanOmni: A Large Vision-Speech Language Model for Human-Centric Video Understanding","date":"2025-01-25","arxiv_id":"2501.15111","repositories_listed":0,"syntology":null},{"url":null,"slug":"adaptive-progressive-attention-graph-neural","title":"Adaptive Progressive Attention Graph Neural Network for EEG Emotion Recognition","date":"2025-01-24","arxiv_id":"2501.14246","repositories_listed":0,"syntology":null},{"url":null,"slug":"emoformer-a-text-independent-speech-emotion","title":"EmoFormer: A Text-Independent Speech Emotion Recognition using a Hybrid Transformer-CNN model","date":"2025-01-22","arxiv_id":"2501.12682","repositories_listed":0,"syntology":null},{"url":null,"slug":"emotech-a-multi-modal-speech-emotion","title":"EmoTech: A Multi-modal Speech Emotion Recognition Using Multi-source Low-level Information with Hybrid Recurrent Network","date":"2025-01-22","arxiv_id":"2501.12674","repositories_listed":0,"syntology":null},{"url":null,"slug":"why-disentanglement-based-speaker","title":"Why disentanglement-based speaker anonymization systems fail at preserving emotions?","date":"2025-01-22","arxiv_id":"2501.13000","repositories_listed":0,"syntology":null},{"url":null,"slug":"parameterised-quantum-circuits-for-novel","title":"Representation Learning with Parameterised Quantum Circuits for Advancing Speech Emotion Recognition","date":"2025-01-21","arxiv_id":"2501.12050","repositories_listed":0,"syntology":null},{"url":null,"slug":"llm-supervised-pre-training-for-multimodal","title":"LLM supervised Pre-training for Multimodal Emotion Recognition in Conversations","date":"2025-01-20","arxiv_id":"2501.11468","repositories_listed":0,"syntology":null},{"url":null,"slug":"uncertainty-estimation-in-the-real-world-a","title":"Uncertainty Estimation in the Real World: A Study on Music Emotion Recognition","date":"2025-01-20","arxiv_id":"2501.11570","repositories_listed":0,"syntology":null},{"url":null,"slug":"aima-at-semeval-2024-task-10-history-based","title":"AIMA at SemEval-2024 Task 10: History-Based Emotion Recognition in Hindi-English Code-Mixed Conversations","date":"2025-01-19","arxiv_id":"2501.11166","repositories_listed":0,"syntology":null},{"url":null,"slug":"omni-emotion-extending-video-mllm-with","title":"Omni-Emotion: Extending Video MLLM with Detailed Face and Audio Modeling for Multimodal Emotion Analysis","date":"2025-01-16","arxiv_id":"2501.09502","repositories_listed":0,"syntology":null},{"url":"/paper/xmusic-towards-a-generalized-and-controllable","slug":"xmusic-towards-a-generalized-and-controllable","title":"XMusic: Towards a Generalized and Controllable Symbolic Music Generation Framework","date":"2025-01-15","arxiv_id":"2501.08809","repositories_listed":0,"syntology":null},{"url":null,"slug":"cg-mer-a-card-game-based-multimodal-dataset","title":"CG-MER: A Card Game-based Multimodal dataset for Emotion Recognition","date":"2025-01-14","arxiv_id":"2501.08182","repositories_listed":0,"syntology":null},{"url":null,"slug":"empathetic-conversational-agents-utilizing","title":"Empathetic Conversational Agents: Utilizing Neural and Physiological Signals for Enhanced Empathetic Interactions","date":"2025-01-14","arxiv_id":"2501.08393","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-heterogeneous-multimodal-graph-learning","title":"A Heterogeneous Multimodal Graph Learning Framework for Recognizing User Emotions in Social Networks","date":"2025-01-13","arxiv_id":"2501.07746","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-face-emotion-detection-for-effective","title":"Multi-face emotion detection for effective Human-Robot Interaction","date":"2025-01-13","arxiv_id":"2501.07213","repositories_listed":0,"syntology":null},{"url":null,"slug":"emoticrafter-text-to-emotional-image","title":"EmotiCrafter: Text-to-Emotional-Image Generation based on Valence-Arousal Model","date":"2025-01-10","arxiv_id":"2501.05710","repositories_listed":0,"syntology":null},{"url":null,"slug":"jelly-joint-emotion-recognition-and-context","title":"JELLY: Joint Emotion Recognition and Context Reasoning with LLMs for Conversational Speech Synthesis","date":"2025-01-09","arxiv_id":"2501.04904","repositories_listed":0,"syntology":null},{"url":null,"slug":"leveraging-cross-attention-transformer-and","title":"Leveraging Cross-Attention Transformer and Multi-Feature Fusion for Cross-Linguistic Speech Emotion Recognition","date":"2025-01-06","arxiv_id":"2501.10408","repositories_listed":0,"syntology":null},{"url":null,"slug":"mvp-multimodal-emotion-recognition-based-on","title":"MVP: Multimodal Emotion Recognition based on Video and Physiological Signals","date":"2025-01-06","arxiv_id":"2501.03103","repositories_listed":0,"syntology":null},{"url":null,"slug":"fitting-different-interactive-information","title":"Fitting Different Interactive Information: Joint Classification of Emotion and Intention","date":"2025-01-05","arxiv_id":"2501.06215","repositories_listed":0,"syntology":null},{"url":null,"slug":"is-it-still-fair-investigating-gender","title":"Is It Still Fair? Investigating Gender Fairness in Cross-Corpus Speech Emotion Recognition","date":"2025-01-02","arxiv_id":"2501.00995","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-discriminative-features-from","title":"learning discriminative features from spectrograms using center loss for speech emotion recognition","date":"2025-01-02","arxiv_id":"2501.01103","repositories_listed":0,"syntology":null},{"url":null,"slug":"ted-turn-emphasis-with-dialogue-feature","title":"TED: Turn Emphasis with Dialogue Feature Attention for Emotion Recognition in Conversation","date":"2025-01-02","arxiv_id":"2501.01123","repositories_listed":0,"syntology":null},{"url":null,"slug":"cocoer-aligning-multi-level-feature-by","title":"CocoER: Aligning Multi-Level Feature by Competition and Coordination for Emotion Recognition","date":"2025-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"emoe-modality-specific-enhanced-dynamic","title":"EMOE: Modality-Specific Enhanced Dynamic Emotion Experts","date":"2025-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-discovery-of-facial-landmarks","title":"Unsupervised Discovery of Facial Landmarks and Head Pose","date":"2025-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-multimodal-emotion-recognition","title":"Enhancing Multimodal Emotion Recognition through Multi-Granularity Cross-Modal Alignment","date":"2024-12-30","arxiv_id":"2412.20821","repositories_listed":0,"syntology":null},{"url":null,"slug":"metadata-enhanced-speech-emotion-recognition","title":"Metadata-Enhanced Speech Emotion Recognition: Augmented Residual Integration and Co-Attention in Two-Stage Fine-Tuning","date":"2024-12-30","arxiv_id":"2412.20707","repositories_listed":0,"syntology":null},{"url":null,"slug":"mouth-articulation-based-anchoring-for","title":"Mouth Articulation-Based Anchoring for Improved Cross-Corpus Speech Emotion Recognition","date":"2024-12-27","arxiv_id":"2412.19909","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-multimodal-emotion-recognition-system","title":"A Multimodal Emotion Recognition System: Integrating Facial Expressions, Body Movement, Speech, and Spoken Language","date":"2024-12-23","arxiv_id":"2412.17907","repositories_listed":0,"syntology":null},{"url":null,"slug":"effective-context-modeling-framework-for","title":"Effective Context Modeling Framework for Emotion Recognition in Conversations","date":"2024-12-21","arxiv_id":"2412.16444","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhanced-speech-emotion-recognition-with","title":"Enhanced Speech Emotion Recognition with Efficient Channel Attention Guided Deep CNN-BiLSTM Framework","date":"2024-12-13","arxiv_id":"2412.10011","repositories_listed":0,"syntology":null},{"url":null,"slug":"multimodal-sentiment-analysis-based-on-video","title":"Multimodal Sentiment Analysis based on Video and Audio Inputs","date":"2024-12-12","arxiv_id":"2412.09317","repositories_listed":0,"syntology":null},{"url":null,"slug":"my-words-imply-your-opinion-reader-agent","title":"My Words Imply Your Opinion: Reader Agent-Based Propagation Enhancement for Personalized Implicit Emotion Analysis","date":"2024-12-10","arxiv_id":"2412.07367","repositories_listed":0,"syntology":null},{"url":null,"slug":"depression-detection-from-social-media-bangla","title":"Depression detection from Social Media Bangla Text Using Recurrent Neural Networks","date":"2024-12-08","arxiv_id":"2412.05861","repositories_listed":0,"syntology":null},{"url":null,"slug":"wavfusion-towards-wav2vec-2-0-multimodal","title":"WavFusion: Towards wav2vec 2.0 Multimodal Speech Emotion Recognition","date":"2024-12-07","arxiv_id":"2412.05558","repositories_listed":0,"syntology":null},{"url":null,"slug":"dynamic-graph-neural-ordinary-differential","title":"Dynamic Graph Neural ODE Network for Multi-modal Emotion Recognition in Conversation","date":"2024-12-04","arxiv_id":"2412.02935","repositories_listed":0,"syntology":null},{"url":null,"slug":"vr-based-emotion-recognition-using-deep","title":"VR Based Emotion Recognition Using Deep Multimodal Fusion With Biosignals Across Multiple Anatomical Domains","date":"2024-12-03","arxiv_id":"2412.02283","repositories_listed":0,"syntology":null},{"url":null,"slug":"cross-task-inconsistency-based-active","title":"Cross-Task Inconsistency Based Active Learning (CTIAL) for Emotion Recognition","date":"2024-12-02","arxiv_id":"2412.01171","repositories_listed":0,"syntology":null},{"url":null,"slug":"pairwise-discernment-of-affectnet-expressions","title":"Pairwise Discernment of AffectNet Expressions with ArcFace","date":"2024-12-01","arxiv_id":"2412.01860","repositories_listed":0,"syntology":null},{"url":null,"slug":"dual-prototyping-with-domain-and-class","title":"Dual Prototyping with Domain and Class Prototypes for Affective Brain-Computer Interface in Unseen Target Conditions","date":"2024-11-27","arxiv_id":"2412.00082","repositories_listed":0,"syntology":null},{"url":null,"slug":"oris-online-active-learning-using","title":"ORIS: Online Active Learning Using Reinforcement Learning-based Inclusive Sampling for Robust Streaming Analytics System","date":"2024-11-27","arxiv_id":"2411.18060","repositories_listed":0,"syntology":null},{"url":null,"slug":"multimodal-alignment-and-fusion-a-survey","title":"Multimodal Alignment and Fusion: A Survey","date":"2024-11-26","arxiv_id":"2411.17040","repositories_listed":0,"syntology":null},{"url":null,"slug":"push-the-limit-of-multi-modal-emotion","title":"Push the Limit of Multi-modal Emotion Recognition by Prompting LLMs with Receptive-Field-Aware Attention Weighting","date":"2024-11-26","arxiv_id":"2411.17674","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-cross-corpus-speech-emotion-recognition","title":"A Cross-Corpus Speech Emotion Recognition Method Based on Supervised Contrastive Learning","date":"2024-11-25","arxiv_id":"2411.19803","repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-advanced-speech-signal-processing-a","title":"Towards Advanced Speech Signal Processing: A Statistical Perspective on Convolution-Based Architectures and its Applications","date":"2024-11-20","arxiv_id":"2411.18636","repositories_listed":0,"syntology":null},{"url":null,"slug":"bias-free-sentiment-analysis","title":"Eradicating Social Biases in Sentiment Analysis using Semantic Blinding and Semantic Propagation Graph Neural Networks","date":"2024-11-19","arxiv_id":"2411.12493","repositories_listed":0,"syntology":null},{"url":null,"slug":"hybrid-quantum-deep-learning-model-for","title":"Hybrid Quantum Deep Learning Model for Emotion Detection using raw EEG Signal Analysis","date":"2024-11-19","arxiv_id":"2411.17715","repositories_listed":0,"syntology":null},{"url":null,"slug":"memo-bench-a-multiple-benchmark-for-text-to","title":"MEMO-Bench: A Multiple Benchmark for Text-to-Image and Multimodal Large Language Models on Human Emotion Analysis","date":"2024-11-18","arxiv_id":"2411.11235","repositories_listed":0,"syntology":null},{"url":null,"slug":"cmath-cross-modality-augmented-transformer","title":"CMATH: Cross-Modality Augmented Transformer with Hierarchical Variational Distillation for Multimodal Emotion Recognition in Conversation","date":"2024-11-15","arxiv_id":"2411.10060","repositories_listed":0,"syntology":null},{"url":null,"slug":"emotion-detection-in-reddit-comparative-study","title":"Emotion Detection in Reddit: Comparative Study of Machine Learning and Deep Learning Techniques","date":"2024-11-15","arxiv_id":"2411.10328","repositories_listed":0,"syntology":null},{"url":null,"slug":"once-more-with-feeling-measuring-emotion-of","title":"Once More, With Feeling: Measuring Emotion of Acting Performances in Contemporary American Film","date":"2024-11-15","arxiv_id":"2411.10018","repositories_listed":0,"syntology":null},{"url":null,"slug":"improvement-and-implementation-of-a-speech","title":"Improvement and Implementation of a Speech Emotion Recognition Model Based on Dual-Layer LSTM","date":"2024-11-14","arxiv_id":"2411.09189","repositories_listed":0,"syntology":null},{"url":null,"slug":"re-parameterization-of-lightweight","title":"Re-Parameterization of Lightweight Transformer for On-Device Speech Emotion Recognition","date":"2024-11-14","arxiv_id":"2411.09339","repositories_listed":0,"syntology":null},{"url":null,"slug":"emotion-classification-of-children","title":"Emotion Classification of Children Expressions","date":"2024-11-12","arxiv_id":"2411.07708","repositories_listed":0,"syntology":null},{"url":null,"slug":"emotion-aware-interaction-design-in","title":"Emotion-Aware Interaction Design in Intelligent User Interface Using Multi-Modal Deep Learning","date":"2024-11-10","arxiv_id":"2411.06326","repositories_listed":0,"syntology":null},{"url":null,"slug":"emotional-images-assessing-emotions-in-images","title":"Emotional Images: Assessing Emotions in Images and Potential Biases in Generative Models","date":"2024-11-08","arxiv_id":"2411.05985","repositories_listed":0,"syntology":null},{"url":null,"slug":"smile-upon-the-face-but-sadness-in-the-eyes","title":"Smile upon the Face but Sadness in the Eyes: Emotion Recognition based on Facial Expressions and Eye Behaviors","date":"2024-11-08","arxiv_id":"2411.05879","repositories_listed":0,"syntology":null},{"url":null,"slug":"speaker-emotion-recognition-leveraging-self","title":"Speaker Emotion Recognition: Leveraging Self-Supervised Models for Feature Extraction Using Wav2Vec2 and HuBERT","date":"2024-11-05","arxiv_id":"2411.02964","repositories_listed":0,"syntology":null},{"url":null,"slug":"exploring-vision-language-models-for-facial","title":"Exploring Vision Language Models for Facial Attribute Recognition: Emotion, Race, Gender, and Age","date":"2024-10-31","arxiv_id":"2410.24148","repositories_listed":0,"syntology":null},{"url":null,"slug":"eeg-based-multimodal-representation-learning","title":"EEG-based Multimodal Representation Learning for Emotion Recognition","date":"2024-10-29","arxiv_id":"2411.00822","repositories_listed":0,"syntology":null},{"url":null,"slug":"semi-supervised-self-learning-enhanced-music","title":"Semi-Supervised Self-Learning Enhanced Music Emotion Recognition","date":"2024-10-29","arxiv_id":"2410.21897","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-speech-based-emotion-recognition","title":"Improving Speech-based Emotion Recognition with Contextual Utterance Analysis and LLMs","date":"2024-10-27","arxiv_id":"2410.20334","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-survey-on-speech-large-language-models","title":"A Survey on Speech Large Language Models","date":"2024-10-24","arxiv_id":"2410.18908","repositories_listed":0,"syntology":null},{"url":null,"slug":"emotion-recognition-with-facial-attention-and","title":"Emotion Recognition with Facial Attention and Objective Activation Functions","date":"2024-10-23","arxiv_id":"2410.17740","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-multimodal-affective-analysis-with","title":"Enhancing Multimodal Affective Analysis with Learned Live Comment Features","date":"2024-10-21","arxiv_id":"2410.16407","repositories_listed":0,"syntology":null},{"url":null,"slug":"mmcs-a-multimodal-medical-diagnosis-system","title":"MMDS: A Multimodal Medical Diagnosis System Integrating Image Analysis and Knowledge-based Departmental Consultation","date":"2024-10-20","arxiv_id":"2410.15403","repositories_listed":0,"syntology":null},{"url":null,"slug":"investigating-effective-speaker-property","title":"Investigating Effective Speaker Property Privacy Protection in Federated Learning for Speech Emotion Recognition","date":"2024-10-17","arxiv_id":"2410.13221","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-speech-emotion-recognition-through","title":"Enhancing Speech Emotion Recognition through Segmental Average Pooling of Self-Supervised Learning Features","date":"2024-10-16","arxiv_id":"2410.12416","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-view-multi-task-modeling-with-speech","title":"Multi-View Multi-Task Modeling with Speech Foundation Models for Speech Forensic Tasks","date":"2024-10-16","arxiv_id":"2410.12947","repositories_listed":0,"syntology":null},{"url":null,"slug":"sequifi-mitigating-catastrophic-forgetting-in","title":"SeQuiFi: Mitigating Catastrophic Forgetting in Speech Emotion Recognition with Sequential Class-Finetuning","date":"2024-10-16","arxiv_id":"2410.12567","repositories_listed":0,"syntology":null},{"url":null,"slug":"emotioncaps-enhancing-audio-captioning","title":"EmotionCaps: Enhancing Audio Captioning Through Emotion-Augmented Data Generation","date":"2024-10-15","arxiv_id":"2410.12028","repositories_listed":0,"syntology":null},{"url":null,"slug":"empowering-dysarthric-speech-leveraging","title":"Empowering Dysarthric Speech: Leveraging Advanced LLMs for Accurate Speech Correction and Multimodal Emotion Analysis","date":"2024-10-13","arxiv_id":"2410.12867","repositories_listed":0,"syntology":null},{"url":null,"slug":"can-we-estimate-purchase-intention-based-on","title":"Can We Estimate Purchase Intention Based on Zero-shot Speech Emotion Recognition?","date":"2024-10-12","arxiv_id":"2410.09636","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-cross-lingual-meta-learning-method-based-on","title":"A Cross-Lingual Meta-Learning Method Based on Domain Adaptation for Speech Emotion Recognition","date":"2024-10-06","arxiv_id":"2410.04633","repositories_listed":0,"syntology":null},{"url":null,"slug":"visual-prompting-in-llms-for-enhancing","title":"Visual Prompting in LLMs for Enhancing Emotion Recognition","date":"2024-10-03","arxiv_id":"2410.02244","repositories_listed":0,"syntology":null},{"url":null,"slug":"gcm-net-graph-enhanced-cross-modal-infusion","title":"GCM-Net: Graph-enhanced Cross-Modal Infusion with a Metaheuristic-Driven Network for Video Sentiment and Emotion Analysis","date":"2024-10-02","arxiv_id":"2410.12828","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-scale-temporal-transformer-for-speech","title":"Multi-Scale Temporal Transformer For Speech Emotion Recognition","date":"2024-10-01","arxiv_id":"2410.00390","repositories_listed":0,"syntology":null},{"url":null,"slug":"eeg-emotion-copilot-pruning-llms-for","title":"EEG Emotion Copilot: Optimizing Lightweight LLMs for Emotional EEG Interpretation with Assisted Medical Record Generation","date":"2024-09-30","arxiv_id":"2410.00166","repositories_listed":0,"syntology":null},{"url":null,"slug":"self-supervised-auxiliary-learning-for","title":"Self-supervised Auxiliary Learning for Texture and Model-based Hybrid Robust and Fair Featuring in Face Analysis","date":"2024-09-29","arxiv_id":"2409.19582","repositories_listed":0,"syntology":null},{"url":null,"slug":"two-stage-framework-for-robust-speech-emotion","title":"Two-stage Framework for Robust Speech Emotion Recognition Using Target Speaker Extraction in Human Speech Noise Conditions","date":"2024-09-29","arxiv_id":"2409.19585","repositories_listed":0,"syntology":null},{"url":null,"slug":"evaluation-of-openai-o1-opportunities-and","title":"Evaluation of OpenAI o1: Opportunities and Challenges of AGI","date":"2024-09-27","arxiv_id":"2409.18486","repositories_listed":0,"syntology":null}],"record_sha256":"7a4d5ec5ae86c1d01669b1f0a2f70a2ab75acc5f0224550d4112dd121d92fc4b","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}