{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/method/layer-normalization/papers/219","list_of":"/method/layer-normalization","method":"Layer Normalization","archive":{"snapshot":"2025-07-28"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"date (newest first), then slug","page":219,"pages_in_order":250,"rows_per_page":100,"rows":[21801,21900],"of":24980,"counts":{"archive_papers_tagged":24980,"with_a_code_link":11273,"where_syntology_ran_a_sample":3471,"not_listed_spam_title":0,"listed":24980,"listed_where_code_ran":3471,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":2923,"every_run_a_failure_of_syntologys_instrument":548,"listed_with_a_run_with_no_instrument_failure":2923,"listed_every_run_a_failure_of_syntologys_instrument":548,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/method/layer-normalization","prev":"/method/layer-normalization/papers/218","next":"/method/layer-normalization/papers/220","papers":[{"paper":"/paper/cogltx-applying-bert-to-long-texts","slug":"cogltx-applying-bert-to-long-texts","title":"CogLTX: Applying BERT to Long Texts","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"comparing-probabilistic-distributional-and","title":"Comparing Probabilistic, Distributional and Transformer-Based Models on Logical Metonymy Interpretation","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/constituency-lattice-encoding-for-aspect-term","slug":"constituency-lattice-encoding-for-aspect-term","title":"Constituency Lattice Encoding for Aspect Term Extraction","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"contextualized-embeddings-for-enriching","title":"Contextualized Embeddings for Enriching Linguistic Analyses on Politeness","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/cpm-a-large-scale-generative-chinese-pre","slug":"cpm-a-large-scale-generative-chinese-pre","title":"CPM: A Large-scale Generative Chinese Pre-trained Language Model","date":"2020-12-01","arxiv_id":"2012.00413","n_code_links":10,"syntology":null},{"paper":null,"slug":"data-selection-for-bilingual-lexicon","title":"Data Selection for Bilingual Lexicon Induction from Specialized Comparable Corpora","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"deep-learning-brasil-nlp-at-semeval-2020-task-1","title":"Deep Learning Brasil - NLP at SemEval-2020 Task 9: Sentiment Analysis of Code-Mixed Tweets Using Ensemble of Language Models","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"deepyang-at-semeval-2020-task-4-using-the","title":"DEEPYANG at SemEval-2020 Task 4: Using the Hidden Layer State of BERT Model for Differentiating Common Sense","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"denoising-pre-training-and-data-augmentation","title":"Denoising Pre-Training and Data Augmentation Strategies for Enhanced RDF Verbalization with Transformers","date":"2020-12-01","arxiv_id":"2012.00571","n_code_links":0,"syntology":null},{"paper":"/paper/detecting-urgency-status-of-crisis-tweets-a","slug":"detecting-urgency-status-of-crisis-tweets-a","title":"Detecting Urgency Status of Crisis Tweets: A Transfer Learning Approach for Low Resource Languages","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"discovery-team-at-semeval-2020-task-1-context","title":"Discovery Team at SemEval-2020 Task 1: Context-sensitive Embeddings Not Always Better than Static for Semantic Change Detection","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"diverse-dialogue-generation-with-context","title":"Diverse dialogue generation with context dependent dynamic loss function","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"document-level-neural-machine-translation-3","title":"Document-Level Neural Machine Translation Using BERT as Context Encoder","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"domain-transfer-based-data-augmentation-for","title":"Domain Transfer based Data Augmentation for Neural Query Translation","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"don-t-invite-bert-to-drink-a-bottle-modeling","title":"Don't Invite BERT to Drink a Bottle: Modeling the Interpretation of Metonymies Using BERT and Distributional Representations","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"emotion-classification-by-jointly-learning-to","title":"Emotion Classification by Jointly Learning to Lexiconize and Classify","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"evaluating-pretrained-transformer-based","title":"Evaluating Pretrained Transformer-based Models on the Task of Fine-Grained Named Entity Recognition","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"evaluating-unsupervised-representation","title":"Evaluating Unsupervised Representation Learning for Detecting Stances of Fake News","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"exploring-statistical-and-neural-models-for","title":"Exploring Statistical and Neural Models for Noun Ellipsis Detection and Resolution in English","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"fastmatch-accelerating-the-inference-of-bert","title":"FASTMATCH: Accelerating the Inference of BERT-based Text Matching","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/fbk-dh-at-semeval-2020-task-12-using-multi","slug":"fbk-dh-at-semeval-2020-task-12-using-multi","title":"FBK-DH at SemEval-2020 Task 12: Using Multi-channel BERT for Multilingual Offensive Language Detection","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"federated-learning-for-spoken-language","title":"Federated Learning for Spoken Language Understanding","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"ferryman-at-semeval-2020-task-12-bert-based","title":"Ferryman at SemEval-2020 Task 12: BERT-Based Model with Advanced Improvement Methods for Multilingual Offensive Language Identification","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"ferryman-at-semeval-2020-task-7-ensemble","title":"Ferryman at SemEval-2020 Task 7: Ensemble Model for Assessing Humor in Edited News Headlines","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"fine-tuning-bert-with-focus-words-for","title":"Fine-tuning BERT with Focus Words for Explanation Regeneration","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/flight-of-the-pegasus-comparing-transformers","slug":"flight-of-the-pegasus-comparing-transformers","title":"Flight of the PEGASUS? Comparing Transformers on Few-shot and Zero-shot Multi-document Abstractive Summarization","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"forcereader-a-bert-based-interactive-machine","title":"ForceReader: a BERT-based Interactive Machine Reading Comprehension Model with Attention Separation","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/formality-style-transfer-with-shared-latent","slug":"formality-style-transfer-with-shared-latent","title":"Formality Style Transfer with Shared Latent Space","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/from-hero-to-z-eroe-a-benchmark-of-low-level","slug":"from-hero-to-z-eroe-a-benchmark-of-low-level","title":"From Hero to Z\\'eroe: A Benchmark of Low-Level Adversarial Attacks","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"generalized-shortest-paths-encoders-for-amr","title":"Generalized Shortest-Paths Encoders for AMR-to-Text Generation","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"go-simple-and-pre-train-on-domain-specific","title":"Go Simple and Pre-Train on Domain-Specific Corpora: On the Role of Training Data for Text Classification","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/grubert-a-gru-based-method-to-fuse-bert","slug":"grubert-a-gru-based-method-to-fuse-bert","title":"GRUBERT: A GRU-Based Method to Fuse BERT Hidden Layers for Twitter Sentiment Analysis","date":"2020-12-01","arxiv_id":null,"n_code_links":2,"syntology":null},{"paper":"/paper/hinglishnlp-at-semeval-2020-task-9-fine-tuned","slug":"hinglishnlp-at-semeval-2020-task-9-fine-tuned","title":"HinglishNLP at SemEval-2020 Task 9: Fine-tuned Language Models for Hinglish Sentiment Detection","date":"2020-12-01","arxiv_id":null,"n_code_links":2,"syntology":null},{"paper":null,"slug":"hitachi-at-semeval-2020-task-11-an-empirical","title":"Hitachi at SemEval-2020 Task 11: An Empirical Study of Pre-Trained Transformer Family for Propaganda Detection","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"hitachi-at-semeval-2020-task-7-stacking-at","title":"Hitachi at SemEval-2020 Task 7: Stacking at Scale with Heterogeneous Language Models for Humor Recognition","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"hitachi-at-semeval-2020-task-8-simple-but","title":"Hitachi at SemEval-2020 Task 8: Simple but Effective Modality Ensemble for Meme Emotion Recognition","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/hitrans-a-transformer-based-context-and","slug":"hitrans-a-transformer-based-context-and","title":"HiTrans: A Transformer-Based Context- and Speaker-Sensitive Model for Emotion Detection in Conversations","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"how-far-does-bert-look-at-distance-based-1","title":"How Far Does BERT Look At: Distance-based Clustering and Analysis of BERT's Attention","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/how-relevant-are-selectional-preferences-for","slug":"how-relevant-are-selectional-preferences-for","title":"How Relevant Are Selectional Preferences for Transformer-based Language Models?","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"hr-just-team-at-semeval-2020-task-4-the","title":"HR@JUST Team at SemEval-2020 Task 4: The Impact of RoBERTa Transformer for Evaluation Common Sense Understanding","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/hy-nli-a-hybrid-system-for-natural-language","slug":"hy-nli-a-hybrid-system-for-natural-language","title":"Hy-NLI: a Hybrid system for Natural Language Inference","date":"2020-12-01","arxiv_id":null,"n_code_links":2,"syntology":null},{"paper":null,"slug":"i2c-at-semeval-2020-task-12-simple-but","title":"I2C at SemEval-2020 Task 12: Simple but Effective Approaches to Offensive Speech Detection in Twitter","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"icompass-at-semeval-2020-task-12-from-a","title":"iCompass at SemEval-2020 Task 12: From a Syntax-ignorant N-gram Embeddings Model to a Deep Bidirectional Language Model","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"iiitg-adbu-at-semeval-2020-task-12-comparison","title":"IIITG-ADBU at SemEval-2020 Task 12: Comparison of BERT and BiLSTM in Detecting Offensive Language","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"iiitg-adbu-at-semeval-2020-task-8-a","title":"IIITG-ADBU at SemEval-2020 Task 8: A Multimodal Approach to Detect Offensive, Sarcastic and Humorous Memes","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"iiitg-adbu-at-semeval-2020-task-9-svm-for","title":"IIITG-ADBU at SemEval-2020 Task 9: SVM for Sentiment Analysis of English-Hindi Code-Mixed Text","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/image-caption-generation-for-news-articles","slug":"image-caption-generation-for-news-articles","title":"Image Caption Generation for News Articles","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"incorporating-noisy-length-constraints-into","title":"Incorporating Noisy Length Constraints into Transformer with Length-aware Positional Encodings","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/increasing-learning-efficiency-of-self","slug":"increasing-learning-efficiency-of-self","title":"Increasing Learning Efficiency of Self-Attention Networks through Direct Position Interactions, Learnable Temperature, and Convoluted Attention","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/incremental-neural-lexical-coherence-modeling","slug":"incremental-neural-lexical-coherence-modeling","title":"Incremental Neural Lexical Coherence Modeling","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"investigating-gender-bias-in-language-models","title":"Investigating Gender Bias in Language Models Using Causal Mediation Analysis","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"investigating-learning-dynamics-of-bert-fine","title":"Investigating Learning Dynamics of BERT Fine-Tuning","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"irlab-daiict-at-semeval-2020-task-12-machine","title":"IRLab\\_DAIICT at SemEval-2020 Task 12: Machine Learning and Deep Learning Methods for Offensive Language Identification","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"irlab-daiict-at-semeval-2020-task-9-machine","title":"IRLab\\_DAIICT at SemEval-2020 Task 9: Machine Learning and Deep Learning Methods for Sentiment Analysis of Code-Mixed Tweets","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"jbnu-at-semeval-2020-task-4-bert-and-unilm","title":"JBNU at SemEval-2020 Task 4: BERT and UniLM for Commonsense Validation and Explanation","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/jointly-learning-aspect-focused-and-inter","slug":"jointly-learning-aspect-focused-and-inter","title":"Jointly Learning Aspect-Focused and Inter-Aspect Relations with Graph Convolutional Networks for Aspect Sentiment Analysis","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"judge-me-by-my-size-noun-do-you-yodalib-a-1","title":"``Judge me by my size (noun), do you?'' YodaLib: A Demographic-Aware Humor Generation Framework","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"just-at-semeval-2020-task-11-detecting","title":"JUST at SemEval-2020 Task 11: Detecting Propaganda Techniques Using BERT Pre-trained Model","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/kafk-at-semeval-2020-task-8-extracting","slug":"kafk-at-semeval-2020-task-8-extracting","title":"KAFK at SemEval-2020 Task 8: Extracting Features from Pre-trained Neural Networks to Classify Internet Memes","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"knowledge-aware-emotion-recognition-in","title":"Knowledge Aware Emotion Recognition in Textual Conversations via Multi-Task Incremental Transformer","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/kungfupanda-at-semeval-2020-task-12-bert-1","slug":"kungfupanda-at-semeval-2020-task-12-bert-1","title":"Kungfupanda at SemEval-2020 Task 12: BERT-Based Multi-TaskLearning for Offensive Language Detection","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"label-representations-in-modeling","title":"Label Representations in Modeling Classification as Text Generation","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"last-at-semeval-2020-task-10-finding-tokens","title":"LAST at SemEval-2020 Task 10: Finding Tokens to Emphasise in Short Written Texts with Precomputed Embedding Models and LightGBM","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"lee-at-semeval-2020-task-12-a-bert-model","title":"Lee at SemEval-2020 Task 12: A BERT Model Based on the Maximum Self-ensemble Strategy for Identifying Offensive Language","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"lee-at-semeval-2020-task-5-albert-model-based","title":"Lee at SemEval-2020 Task 5: ALBERT Model Based on the Maximum Ensemble Strategy and Different Data Sampling Methods for Detecting Counterfactual Statements","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"lijunyi-at-semeval-2020-task-4-an-albert","title":"Lijunyi at SemEval-2020 Task 4: An ALBERT Model Based Maximum Ensemble with Different Training Sizes and Depths for Commonsense Validation and Explanation","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"lmml-at-semeval-2020-task-7-siamese","title":"LMML at SemEval-2020 Task 7: Siamese Transformers for Rating Humor in Edited News Headlines","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"lt3-at-semeval-2020-task-7-comparing-feature","title":"LT3 at SemEval-2020 Task 7: Comparing Feature-Based and Transformer-Based Approaches to Detect Funny Headlines","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/manyent-a-dataset-for-few-shot-entity-typing","slug":"manyent-a-dataset-for-few-shot-entity-typing","title":"ManyEnt: A Dataset for Few-shot Entity Typing","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"masked-reasoner-at-semeval-2020-task-4-fine","title":"Masked Reasoner at SemEval-2020 Task 4: Fine-Tuning RoBERTa for Commonsense Reasoning","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/max-deeplab-end-to-end-panoptic-segmentation","slug":"max-deeplab-end-to-end-panoptic-segmentation","title":"MaX-DeepLab: End-to-End Panoptic Segmentation with Mask Transformers","date":"2020-12-01","arxiv_id":"2012.00759","n_code_links":3,"syntology":null},{"paper":null,"slug":"memosys-at-semeval-2020-task-8-multimodal","title":"MemoSYS at SemEval-2020 Task 8: Multimodal Emotion Analysis in Memes","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"modifying-memories-in-transformer-models-1","title":"Modifying Memories in Transformer Models","date":"2020-12-01","arxiv_id":"2012.00363","n_code_links":0,"syntology":null},{"paper":"/paper/monolingual-and-multilingual-reduction-of","slug":"monolingual-and-multilingual-reduction-of","title":"Monolingual and Multilingual Reduction of Gender Bias in Contextualized Representations","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"mrc-examples-answerable-by-bert-without-a","title":"MRC Examples Answerable by BERT without a Question Are Less Effective in MRC Model Training","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/named-entity-recognition-for-chinese","slug":"named-entity-recognition-for-chinese","title":"Named Entity Recognition for Chinese biomedical patents","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"neural-language-models-for-text","title":"Neural language models for text classification in evidence-based medicine","date":"2020-12-01","arxiv_id":"2012.00584","n_code_links":0,"syntology":null},{"paper":"/paper/neural-networks-approaches-focused-on-french","slug":"neural-networks-approaches-focused-on-french","title":"Neural Networks approaches focused on French Spoken Language Understanding: application to the MEDIA Evaluation Task","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"new-benchmark-corpus-and-models-for-fine","title":"New Benchmark Corpus and Models for Fine-grained Event Classification: To BERT or not to BERT?","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"nlp-just-at-semeval-2020-task-4-ensemble","title":"NLP@JUST at SemEval-2020 Task 4: Ensemble Technique for BERT and Roberta to Evaluate Commonsense Validation","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"nlpup-at-semeval-2020-task-12-a-blazing-fast","title":"nlpUP at SemEval-2020 Task 12 : A Blazing Fast System for Offensive Language Detection","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"nova-wang-at-semeval-2020-task-12","title":"Nova-Wang at SemEval-2020 Task 12: OffensEmblert: An Ensemble ofOffensive Language Classifiers","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"o-n-connections-are-expressive-enough-1","title":"O(n) Connections are Expressive Enough: Universal Approximability of Sparse Transformers","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/on-the-systematicity-of-probing","slug":"on-the-systematicity-of-probing","title":"On the Systematicity of Probing Contextualized Word Representations: The Case of Hypernymy in BERT","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/pg-gsql-pointer-generator-network-with-guide","slug":"pg-gsql-pointer-generator-network-with-guide","title":"PG-GSQL: Pointer-Generator Network with Guide Decoding for Cross-Domain Context-Dependent Text-to-SQL Generation","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"pgsg-at-semeval-2020-task-12-bert-lstm-with","title":"PGSG at SemEval-2020 Task 12: BERT-LSTM with Tweets' Pretrained Model and Noisy Student Training Method","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"pheonix-at-semeval-2020-task-5-masking-the","title":"Pheonix at SemEval-2020 Task 5: Masking the Labels Lubricates Models for Sequence Labeling","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"porous-lattice-transformer-encoder-for","title":"Porous Lattice Transformer Encoder for Chinese NER","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/pre-trained-image-processing-transformer","slug":"pre-trained-image-processing-transformer","title":"Pre-Trained Image Processing Transformer","date":"2020-12-01","arxiv_id":"2012.00364","n_code_links":6,"syntology":null},{"paper":null,"slug":"predicting-stance-change-using-modular","title":"Predicting Stance Change Using Modular Architectures","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"prhlt-upv-at-semeval-2020-task-12-bert-for","title":"PRHLT-UPV at SemEval-2020 Task 12: BERT for Multilingual Offensive Language Detection","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"prhlt-upv-at-semeval-2020-task-8-study-of","title":"PRHLT-UPV at SemEval-2020 Task 8: Study of Multimodal Techniques for Memes Analysis","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"query-distillation-bert-based-distillation","title":"Query Distillation: BERT-based Distillation for Ensemble Ranking","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/retrieving-skills-from-job-descriptions-a","slug":"retrieving-skills-from-job-descriptions-a","title":"Retrieving Skills from Job Descriptions: A Language Model Based Extreme Multi-label Classification Framework","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"robert-a-romanian-bert-model","title":"RoBERT -- A Romanian BERT Model","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"robust-machine-reading-comprehension-by","title":"Robust Machine Reading Comprehension by Learning Soft labels","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"scalable-cross-lingual-treebank-synthesis-for","title":"Scalable Cross-lingual Treebank Synthesis for Improved Production Dependency Parsers","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/scale-down-transformer-by-grouping-features","slug":"scale-down-transformer-by-grouping-features","title":"Scale down Transformer by Grouping Features for a Lightweight Character-level Language Model","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"scientific-keyphrase-identification-and","title":"Scientific Keyphrase Identification and Classification by Pre-Trained Language Models Intermediate Task Transfer Learning","date":"2020-12-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/semantic-structural-decomposition-for-neural","slug":"semantic-structural-decomposition-for-neural","title":"Semantic Structural Decomposition for Neural Machine Translation","date":"2020-12-01","arxiv_id":null,"n_code_links":1,"syntology":null}],"record_sha256":"607050cc07bf526e8296f1ffe947301548489a1e9c2aebfef852ea0f41b297c6","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}