{"url":"/method/attention-pooling","slug":"attention-pooling","name":"Attention Pooling","full_name":"Attention Pooling","full_name_withheld":false,"description_markdown":null,"description_state":"absent","introduced_year":null,"introduced_by":{"title":"Network Level Spatial Temporal Traffic State Forecasting with Hierarchical Attention LSTM (HierAttnLSTM)","paper":"/paper/big-data-application-for-network-level-travel","first_author":"Tianya Terry Zhang","n_authors":1,"url_abs":null,"archive_paper_url":"https://paperswithcode.com/paper/big-data-application-for-network-level-travel"},"source":{"url":"https://arxiv.org/abs/2201.05760v4","title":"Network Level Spatial Temporal Traffic State Forecasting with Hierarchical Attention LSTM (HierAttnLSTM)","url_on_a_paper_host":true},"code_snippet_url":null,"code_snippet_url_on_a_code_host":false,"categories":[{"area":"Computer Vision","area_id":"computer-vision","collection":"Feature Pyramid Blocks","url":"/methods/category/feature-pyramid-blocks","pwc_aliases":[]}],"n_papers_tagged":46,"archive_num_papers":46,"papers_newest_first":[{"paper":null,"title":"Frequency Dynamic Convolutions for Sound Event Detection","date":"2025-06-15","arxiv_id":"2506.12785","n_code_links":0,"syntology":null},{"paper":null,"title":"BioLangFusion: Multimodal Fusion of DNA, mRNA, and Protein Language Models","date":"2025-06-10","arxiv_id":"2506.08936","n_code_links":0,"syntology":null},{"paper":"/paper/using-diffusion-ensembles-to-estimate","title":"Using Diffusion Ensembles to Estimate Uncertainty for End-to-End Autonomous Driving","date":"2025-05-31","arxiv_id":"2506.00560","n_code_links":0,"syntology":null},{"paper":null,"title":"Triple Attention Transformer Architecture for Time-Dependent Concrete Creep Prediction","date":"2025-05-28","arxiv_id":"2506.04243","n_code_links":0,"syntology":null},{"paper":null,"title":"SETransformer: A Hybrid Attention-Based Architecture for Robust Human Activity Recognition","date":"2025-05-25","arxiv_id":"2505.19369","n_code_links":0,"syntology":null},{"paper":null,"title":"Beyond Node Attention: Multi-Scale Harmonic Encoding for Feature-Wise Graph Message Passing","date":"2025-05-21","arxiv_id":"2505.15015","n_code_links":0,"syntology":null},{"paper":"/paper/recdap-relation-based-conditional-diffusion","title":"ReCDAP: Relation-Based Conditional Diffusion with Attention Pooling for Few-Shot Knowledge Graph Completion","date":"2025-05-12","arxiv_id":"2505.07171","n_code_links":1,"syntology":null},{"paper":"/paper/efficient-document-retrieval-with-g-retriever","title":"Efficient Document Retrieval with G-Retriever","date":"2025-04-21","arxiv_id":"2504.14955","n_code_links":1,"syntology":null},{"paper":"/paper/temporal-attention-pooling-for-frequency","title":"Temporal Attention Pooling for Frequency Dynamic Convolution in Sound Event Detection","date":"2025-04-17","arxiv_id":"2504.12670","n_code_links":1,"syntology":null},{"paper":"/paper/biox-cpath-biologically-driven-explainable","title":"BioX-CPath: Biologically-driven Explainable Diagnostics for Multistain IHC Computational Pathology","date":"2025-03-26","arxiv_id":"2503.20880","n_code_links":1,"syntology":null},{"paper":null,"title":"LLaVA-MLB: Mitigating and Leveraging Attention Bias for Training-Free Video LLMs","date":"2025-03-14","arxiv_id":"2503.11205","n_code_links":0,"syntology":null},{"paper":null,"title":"A Comprehensive Framework for Semantic Similarity Analysis of Human and AI-Generated Text Using Transformer Architectures and Ensemble Techniques","date":"2025-01-24","arxiv_id":"2501.14288","n_code_links":0,"syntology":null},{"paper":"/paper/flair-vlm-with-fine-grained-language-informed","title":"FLAIR: VLM with Fine-grained Language-informed Image Representations","date":"2024-12-04","arxiv_id":"2412.03561","n_code_links":2,"syntology":{"ran":3,"of":20,"unverified":17,"pointer_only":20}},{"paper":null,"title":"InfantCryNet: A Data-driven Framework for Intelligent Analysis of Infant Cries","date":"2024-09-29","arxiv_id":"2409.19689","n_code_links":0,"syntology":null},{"paper":null,"title":"Efficiently Expanding Receptive Fields: Local Split Attention and Parallel Aggregation for Enhanced Large-scale Point Cloud Semantic Segmentation","date":"2024-09-03","arxiv_id":"2409.01662","n_code_links":0,"syntology":null},{"paper":"/paper/bsc-upc-at-emospeech-iberlef2024-attention","title":"BSC-UPC at EmoSPeech-IberLEF2024: Attention Pooling for Emotion Recognition","date":"2024-07-17","arxiv_id":"2407.12467","n_code_links":1,"syntology":null},{"paper":"/paper/auto-vocabulary-segmentation-for-lidar-points","title":"3D-AVS: LiDAR-based 3D Auto-Vocabulary Segmentation","date":"2024-06-13","arxiv_id":"2406.09126","n_code_links":1,"syntology":null},{"paper":null,"title":"Transformer-Based Self-Supervised Learning for Histopathological Classification of Ischemic Stroke Clot Origin","date":"2024-05-01","arxiv_id":"2405.00908","n_code_links":0,"syntology":null},{"paper":"/paper/ki-gan-knowledge-informed-generative","title":"KI-GAN: Knowledge-Informed Generative Adversarial Networks for Enhanced Multi-Vehicle Trajectory Forecasting at Signalized Intersections","date":"2024-04-17","arxiv_id":"2404.11181","n_code_links":1,"syntology":null},{"paper":null,"title":"Pathology-genomic fusion via biologically informed cross-modality graph learning for survival analysis","date":"2024-04-11","arxiv_id":"2404.08023","n_code_links":0,"syntology":null},{"paper":null,"title":"Advancing Graph Neural Networks with HL-HGAT: A Hodge-Laplacian and Attention Mechanism Approach for Heterogeneous Graph-Structured Data","date":"2024-03-11","arxiv_id":"2403.06687","n_code_links":0,"syntology":null},{"paper":"/paper/masked-attention-is-all-you-need-for-graphs","title":"An end-to-end attention-based approach for learning on graphs","date":"2024-02-16","arxiv_id":"2402.10793","n_code_links":1,"syntology":null},{"paper":null,"title":"TTMFN: Two-stream Transformer-based Multimodal Fusion Network for Survival Prediction","date":"2023-11-13","arxiv_id":"2311.07033","n_code_links":0,"syntology":null},{"paper":null,"title":"Enhancing Few-shot CLIP with Semantic-Aware Fine-Tuning","date":"2023-11-08","arxiv_id":"2311.04464","n_code_links":0,"syntology":null},{"paper":"/paper/reference-based-restoration-of-digitized","title":"Reference-based Restoration of Digitized Analog Videotapes","date":"2023-10-20","arxiv_id":"2310.14926","n_code_links":2,"syntology":null},{"paper":null,"title":"A New Multimodal Medical Image Fusion based on Laplacian Autoencoder with Channel Attention","date":"2023-10-18","arxiv_id":"2310.11896","n_code_links":0,"syntology":null},{"paper":null,"title":"Multi-modal Medical Neurological Image Fusion using Wavelet Pooled Edge Preserving Autoencoder","date":"2023-10-18","arxiv_id":"2310.11910","n_code_links":0,"syntology":null},{"paper":"/paper/rethinking-transfer-and-auxiliary-learning","title":"Rethinking Transfer and Auxiliary Learning for Improving Audio Captioning Transformer","date":"2023-08-20","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/explainable-2d-vision-models-for-3d-medical","title":"Interpretable 2D Vision Models for 3D Medical Images","date":"2023-07-13","arxiv_id":"2307.06614","n_code_links":1,"syntology":null},{"paper":null,"title":"Towards Effective and Compact Contextual Representation for Conformer Transducer Speech Recognition Systems","date":"2023-06-23","arxiv_id":"2306.13307","n_code_links":0,"syntology":null}],"papers_shown":30,"tasks":[{"task":"/task/semantic-textual-similarity","name":"Semantic Textual Similarity","papers":5},{"task":"/task/diagnostic","name":"Diagnostic","papers":4},{"task":"/task/language-modeling","name":"Language Modeling","papers":4},{"task":"/task/language-modelling","name":"Language Modelling","papers":4},{"task":"/task/retrieval","name":"Retrieval","papers":4},{"task":"/task/sentence","name":"Sentence","papers":4},{"task":"/task/autonomous-driving","name":"Autonomous Driving","papers":3},{"task":"/task/event-detection","name":"Event Detection","papers":3},{"task":"/task/graph-neural-network","name":"Graph Neural Network","papers":3},{"task":"/task/sts","name":"STS","papers":3},{"task":"/task/transfer-learning","name":"Transfer Learning","papers":3},{"task":"/task/activity-recognition","name":"Activity Recognition","papers":2},{"task":"/task/automatic-speech-recognition-2","name":"Automatic Speech Recognition","papers":2},{"task":"/task/contrastive-learning","name":"Contrastive Learning","papers":2},{"task":"/task/decision-making","name":"Decision Making","papers":2},{"task":"/task/graph-regression","name":"Graph Regression","papers":2},{"task":"/task/molecular-property-prediction","name":"Molecular Property Prediction","papers":2},{"task":"/task/multiple-instance-learning","name":"Multiple Instance Learning","papers":2},{"task":"/task/node-classification","name":"Node Classification","papers":2},{"task":"/task/prediction","name":"Prediction","papers":2}],"tasks_shown":20,"n_tasks":108,"usage_by_year":[{"year":"2022","papers":11},{"year":"2023","papers":13},{"year":"2024","papers":10},{"year":"2025","papers":12}],"row_source":"methods_table","archive":{"source":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","archive_url":"https://paperswithcode.com/method/attention-pooling"},"syntology_read_at":"2026-09-24T18:15:14+00:00"}