{"url":"/task/community-question-answering","name":"Community Question Answering","slug":"community-question-answering","description_markdown":null,"categories":[{"name":"Adversarial","url":"/area/adversarial"},{"name":"Audio","url":"/area/audio"},{"name":"Computer Code","url":"/area/computer-code"},{"name":"Computer Vision","url":"/area/computer-vision"},{"name":"Graphs","url":"/area/graphs"},{"name":"Knowledge Base","url":"/area/knowledge-base"},{"name":"Medical","url":"/area/medical"},{"name":"Methodology","url":"/area/methodology"},{"name":"Miscellaneous","url":"/area/miscellaneous"},{"name":"Music","url":"/area/music"},{"name":"Natural Language Processing","url":"/area/natural-language-processing"},{"name":"Playing Games","url":"/area/playing-games"},{"name":"Reasoning","url":"/area/reasoning"},{"name":"Robots","url":"/area/robots"},{"name":"Speech","url":"/area/speech"},{"name":"Time Series","url":"/area/time-series"}],"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","slug_source":"archive_url"},"counts":{"papers_tagged":236,"papers_with_code":50,"benchmarks":2,"benchmark_tables_in_archive":2,"benchmark_tables_shown":2,"benchmark_tables_withheld_as_spam":0,"benchmark_definition":"a leaderboard table with at least one row; benchmark_tables_shown also counts the zero-row tables; benchmark_tables_in_archive adds the tables withheld as spam","datasets":6,"subtasks":0,"parent_tasks":3},"benchmarks":[{"leaderboard":"/sota/community-question-answering-on-crowdsource-1","slug":"community-question-answering-on-crowdsource-1","dataset":"CrowdSource QA","dataset_url":null,"rows_in_archive":1,"metrics":["MSE"],"first_row_in_archive_order":{"model":"BERT","paper_title":"Predicting Subjective Features of Questions of QA Websites using BERT","paper_url":"/paper/predicting-subjective-features-from-questions","paper_date":"2020-02-24","arxiv_id":"2002.10107","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers"},{"title":"tensorflow/models","url":"https://github.com/tensorflow/models/tree/master/official/nlp"},{"title":"google-research/bert","url":"https://github.com/google-research/bert"},{"title":"graykode/nlp-tutorial","url":"https://github.com/graykode/nlp-tutorial"},{"title":"Moradnejad/Predicting-Subjective-Features-on-QA-Websites","url":"https://github.com/Moradnejad/Predicting-Subjective-Features-on-QA-Websites"}],"syntology":null}},{"leaderboard":"/sota/community-question-answering-on-quora","slug":"community-question-answering-on-quora","dataset":"Quora Question Pairs","dataset_url":"/dataset/quora-question-pairs","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":"MFAE","paper_title":"What Do Questions Exactly Ask? MFAE: Duplicate Question Identification with Multi-Fusion Asking Emphasis","paper_url":"/paper/what-do-questions-exactly-ask-mfae-duplicate","paper_date":"2020-05-07","arxiv_id":null,"code_links":[{"title":"rzhangpku/MFAE","url":"https://github.com/rzhangpku/MFAE"}],"syntology":null}}],"datasets":[{"url":"/dataset/quora-question-pairs","name":"Quora Question Pairs","full_name":"","num_papers_in_archive":55},{"url":"/dataset/amazonqa","name":"AmazonQA","full_name":"","num_papers_in_archive":14},{"url":"/dataset/antique","name":"ANTIQUE","full_name":"","num_papers_in_archive":13},{"url":"/dataset/cqasumm","name":"CQASUMM","full_name":"","num_papers_in_archive":9},{"url":"/dataset/percqa","name":"PerCQA","full_name":"","num_papers_in_archive":2},{"url":"/dataset/se-pqa","name":"SE-PQA","full_name":"SE-PQA: a Resource for Personalized Community Question Answering","num_papers_in_archive":1}],"subtasks":[],"parent_tasks":[{"url":"/task/10-shot-image-generation","name":"10-shot image generation"},{"url":"/task/2d-human-pose-estimation","name":"2D Human Pose Estimation"},{"url":"/task/question-answering","name":"Question Answering"}],"papers":{"order":"repositories listed in the archive (desc), then date (desc); the archive holds no stars","population":"papers tagged with this task that list at least one repository in the archive","shown":30,"of":50,"tagged_in_all":236,"items":[{"url":"/paper/predicting-subjective-features-from-questions","title":"Predicting Subjective Features of Questions of QA Websites using BERT","date":"2020-02-24","arxiv_id":"2002.10107","repositories_listed":5,"syntology":null},{"url":"/paper/fact-checking-in-community-forums","title":"Fact Checking in Community Forums","date":"2018-03-08","arxiv_id":"1803.03178","repositories_listed":3,"syntology":null},{"url":"/paper/tip-of-the-tongue-query-elicitation-for","title":"Tip of the Tongue Query Elicitation for Simulated Evaluation","date":"2025-02-25","arxiv_id":"2502.17776","repositories_listed":2,"syntology":null},{"url":"/paper/community-question-answering-entity-linking","title":"Community Question Answering Entity Linking via Leveraging Auxiliary Data","date":"2022-05-24","arxiv_id":"2205.11917","repositories_listed":2,"syntology":{"n":1,"n_ran":0,"n_unverified":1,"n_pointer_only":1}},{"url":"/paper/yalenlp-peranssumm-2025-multi-perspective-1","title":"YaleNLP @ PerAnsSumm 2025: Multi-Perspective Integration via Mixture-of-Agents for Enhanced Healthcare QA Summarization","date":"2025-04-04","arxiv_id":"2504.03932","repositories_listed":1,"syntology":null},{"url":"/paper/towards-robust-expert-finding-in-community","title":"Towards Robust Expert Finding in Community Question Answering Platforms","date":"2025-03-04","arxiv_id":"2503.02674","repositories_listed":1,"syntology":null},{"url":"/paper/multi-scale-heterogeneous-text-attributed","title":"Multi-Scale Heterogeneous Text-Attributed Graph Datasets From Diverse Domains","date":"2024-12-12","arxiv_id":"2412.08937","repositories_listed":1,"syntology":null},{"url":"/paper/synthetic-data-generation-with-large-language-1","title":"Synthetic Data Generation with Large Language Models for Personalized Community Question Answering","date":"2024-10-29","arxiv_id":"2410.22182","repositories_listed":1,"syntology":null},{"url":"/paper/leveraging-topic-specificity-and-social","title":"Leveraging Topic Specificity and Social Relationships for Expert Finding in Community Question Answering Platforms","date":"2024-07-04","arxiv_id":"2407.04018","repositories_listed":1,"syntology":null},{"url":"/paper/no-perspective-no-perception-perspective","title":"No perspective, no perception!! Perspective-aware Healthcare Answer Summarization","date":"2024-06-13","arxiv_id":"2406.08881","repositories_listed":1,"syntology":null},{"url":"/paper/answer-retrieval-in-legal-community-question","title":"Answer Retrieval in Legal Community Question Answering","date":"2024-01-09","arxiv_id":"2401.04852","repositories_listed":1,"syntology":null},{"url":"/paper/reference-free-domain-adaptation-for","title":"Reference Free Domain Adaptation for Translation of Noisy Questions with Question Specific Rewards","date":"2023-10-23","arxiv_id":"2310.15259","repositories_listed":1,"syntology":null},{"url":"/paper/se-pqa-personalized-community-question","title":"SE-PQA: Personalized Community Question Answering","date":"2023-06-28","arxiv_id":"2306.16261","repositories_listed":1,"syntology":null},{"url":"/paper/chq-summ-a-dataset-for-consumer-healthcare","title":"CHQ-Summ: A Dataset for Consumer Healthcare Question Summarization","date":"2022-06-14","arxiv_id":"2206.06581","repositories_listed":1,"syntology":null},{"url":"/paper/divide-and-conquer-text-semantic-matching-1","title":"Divide and Conquer: Text Semantic Matching with Disentangled Keywords and Intents","date":"2022-03-06","arxiv_id":"2203.02898","repositories_listed":1,"syntology":null},{"url":"/paper/expert-finding-in-legal-community-question","title":"Expert Finding in Legal Community Question Answering","date":"2022-01-19","arxiv_id":"2201.07667","repositories_listed":1,"syntology":null},{"url":"/paper/heteroqa-learning-towards-question-and","title":"HeteroQA: Learning towards Question-and-Answering through Multiple Information Sources via Heterogeneous Graph Modeling","date":"2021-12-27","arxiv_id":"2112.13597","repositories_listed":1,"syntology":null},{"url":"/paper/answersumm-a-manually-curated-dataset-and","title":"AnswerSumm: A Manually-Curated Dataset and Pipeline for Answer Summarization","date":"2021-11-11","arxiv_id":"2111.06474","repositories_listed":1,"syntology":null},{"url":"/paper/question-answering-over-electronic-devices-a","title":"Question Answering over Electronic Devices: A New Benchmark Dataset and a Multi-Task Learning based QA Framework","date":"2021-09-13","arxiv_id":"2109.05897","repositories_listed":1,"syntology":{"n":9,"n_ran":1,"n_unverified":8,"n_pointer_only":0}},{"url":"/paper/convosumm-conversation-summarization","title":"ConvoSumm: Conversation Summarization Benchmark and Improved Abstractive Summarization with Argument Mining","date":"2021-06-01","arxiv_id":"2106.00829","repositories_listed":1,"syntology":null},{"url":"/paper/match-ignition-plugging-pagerank-into","title":"Match-Ignition: Plugging PageRank into Transformer for Long-form Text Matching","date":"2021-01-16","arxiv_id":"2101.06423","repositories_listed":1,"syntology":null},{"url":"/paper/utilizing-bidirectional-encoder","title":"Utilizing Bidirectional Encoder Representations from Transformers for Answer Selection","date":"2020-11-14","arxiv_id":"2011.07208","repositories_listed":1,"syntology":null},{"url":"/paper/multicqa-zero-shot-transfer-of-self","title":"MultiCQA: Zero-Shot Transfer of Self-Supervised Text Matching Models on a Massive Scale","date":"2020-10-02","arxiv_id":"2010.00980","repositories_listed":1,"syntology":null},{"url":"/paper/less-is-more-rejecting-unreliable-reviews-for","title":"Less is More: Rejecting Unreliable Reviews for Product Question Answering","date":"2020-07-09","arxiv_id":"2007.04526","repositories_listed":1,"syntology":null},{"url":"/paper/improving-quality-of-a-post-s-set-of-answers","title":"Improving Quality of a Post's Set of Answers in Stack Overflow","date":"2020-05-30","arxiv_id":"2006.00341","repositories_listed":1,"syntology":null},{"url":"/paper/what-do-questions-exactly-ask-mfae-duplicate","title":"What Do Questions Exactly Ask? MFAE: Duplicate Question Identification with Multi-Fusion Asking Emphasis","date":"2020-05-07","arxiv_id":null,"repositories_listed":1,"syntology":null},{"url":"/paper/review-guided-helpful-answer-identification","title":"Review-guided Helpful Answer Identification in E-commerce","date":"2020-03-13","arxiv_id":"2003.06209","repositories_listed":1,"syntology":null},{"url":"/paper/semeval-2017-task-3-community-question-1","title":"SemEval-2017 Task 3: Community Question Answering","date":"2019-12-02","arxiv_id":"1912.00730","repositories_listed":1,"syntology":null},{"url":"/paper/interactive-text-ranking-with-bayesian","title":"Interactive Text Ranking with Bayesian Optimisation: A Case Study on Community QA and Summarisation","date":"2019-11-22","arxiv_id":"1911.10183","repositories_listed":1,"syntology":null},{"url":"/paper/joint-learning-of-answer-selection-and-answer","title":"Joint Learning of Answer Selection and Answer Summary Generation in Community Question Answering","date":"2019-11-22","arxiv_id":"1911.09801","repositories_listed":1,"syntology":null}],"syntology_records":2,"syntology_note":"a paper without a record is not a recorded non-run: it may lack an arXiv id or simply be absent from the graph layer"},"description_links":{"kept":0,"unwrapped_to_text":0,"bare_urls_linked":0,"relative_images_dropped":0,"rule":"internal links are kept only when the target slug exists in the catalog"},"syntology":{"read_at":"2026-09-24T18:15:14+00:00","claim":"Per-sample execution status on synthesized fixtures ('ran N of M samples'); not a correctness claim and not a ranking signal.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"}},"not_shown":{"libraries":"the archive has no per-task library table","trend_sparklines":"the Trend column of the benchmarks table was a rendered image; it is not in the archive","social_and_latest_sorts":"stars and social signals are not in the archive"}}