{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/method/residual-connection/papers/266","list_of":"/method/residual-connection","method":"Residual Connection","archive":{"snapshot":"2025-07-28"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"date (newest first), then slug","page":266,"pages_in_order":285,"rows_per_page":100,"rows":[26501,26600],"of":28401,"counts":{"archive_papers_tagged":28401,"with_a_code_link":12847,"where_syntology_ran_a_sample":3897,"not_listed_spam_title":0,"listed":28401,"listed_where_code_ran":3897,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":3291,"every_run_a_failure_of_syntologys_instrument":606,"listed_with_a_run_with_no_instrument_failure":3291,"listed_every_run_a_failure_of_syntologys_instrument":606,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/method/residual-connection","prev":"/method/residual-connection/papers/265","next":"/method/residual-connection/papers/267","papers":[{"paper":null,"slug":"bas-an-answer-selection-method-using-bert","title":"BAS: An Answer Selection Method Using BERT Language Model","date":"2019-11-04","arxiv_id":"1911.01528","n_code_links":0,"syntology":null},{"paper":"/paper/adversarial-target-invariant-representation","slug":"adversarial-target-invariant-representation","title":"Generalizing to unseen domains via distribution matching","date":"2019-11-03","arxiv_id":"1911.00804","n_code_links":2,"syntology":{"ran":0,"of":1,"n_ran_checked":0,"n_instrument":0,"unverified":1,"pointer_only":0,"phrase":"0 ran · 1 unverified","official":null}},{"paper":"/paper/an-algorithm-for-routing-capsules-in-all","slug":"an-algorithm-for-routing-capsules-in-all","title":"An Algorithm for Routing Capsules in All Domains","date":"2019-11-02","arxiv_id":"1911.00792","n_code_links":1,"syntology":null},{"paper":null,"slug":"machine-translation-evaluation-using-bi","title":"Machine Translation Evaluation using Bi-directional Entailment","date":"2019-11-02","arxiv_id":"1911.00681","n_code_links":0,"syntology":null},{"paper":null,"slug":"sentence-level-bert-and-multi-task-learning","title":"Sentence-Level BERT and Multi-Task Learning of Age and Gender in Social Media","date":"2019-11-02","arxiv_id":"1911.00637","n_code_links":0,"syntology":null},{"paper":null,"slug":"a-deep-learning-based-system-for-pharmaconer","title":"A Deep Learning-Based System for PharmaCoNER","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"a-multi-task-learning-framework-for-2","title":"A Multi-Task Learning Framework for Extracting Bacteria Biotope Information","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/a-recurrent-bert-based-model-for-question","slug":"a-recurrent-bert-based-model-for-question","title":"A Recurrent BERT-based Model for Question Generation","date":"2019-11-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"aggregating-bidirectional-encoder","title":"Aggregating Bidirectional Encoder Representations Using MatchLSTM for Sequence Matching","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"applying-bert-to-document-retrieval-with","title":"Applying BERT to Document Retrieval with Birch","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"automatically-extracting-challenge-sets-for-1","title":"Automatically Extracting Challenge Sets for Non-Local Phenomena in Neural Machine Translation","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"bert-goes-to-law-school-quantifying-the","title":"BERT Goes to Law School: Quantifying the Competitive Advantage of Access to Large Legal Corpora in Contract Understanding","date":"2019-11-01","arxiv_id":"1911.00473","n_code_links":0,"syntology":null},{"paper":"/paper/bert-is-not-an-interlingua-and-the-bias-of","slug":"bert-is-not-an-interlingua-and-the-bias-of","title":"BERT is Not an Interlingua and the Bias of Tokenization","date":"2019-11-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/biomedical-named-entity-recognition-with","slug":"biomedical-named-entity-recognition-with","title":"Biomedical Named Entity Recognition with Multilingual BERT","date":"2019-11-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"blcu-nlp-at-coin-shared-task1-stagewise-fine","title":"BLCU-NLP at COIN-Shared Task1: Stagewise Fine-tuning BERT for Commonsense Inference in Everyday Narrations","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"caunlp-at-nlp4if-2019-shared-task-context","title":"CAUnLP at NLP4IF 2019 Shared Task: Context-Dependent BERT for Sentence-Level Propaganda Detection","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"cler-cross-task-learning-with-expert","title":"CLER: Cross-task Learning with Expert Representation to Generalize Reading and Understanding","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"comb-convolution-for-efficient-convolutional","title":"Comb Convolution for Efficient Convolutional Architecture","date":"2019-11-01","arxiv_id":"1911.00387","n_code_links":0,"syntology":null},{"paper":null,"slug":"combining-global-sparse-gradients-with-local","title":"Combining Global Sparse Gradients with Local Gradients in Distributed Neural Network Training","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"combining-unsupervised-pre-training-and","title":"Combining Unsupervised Pre-training and Annotator Rationales to Improve Low-shot Text Classification","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"contextualized-cross-lingual-event-trigger","title":"Contextualized Cross-Lingual Event Trigger Extraction with Minimal Resources","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"cost-sensitive-bert-for-generalisable","title":"Cost-Sensitive BERT for Generalisable Sentence Classification on Imbalanced Data","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"cross-domain-modeling-of-sentence-level","title":"Cross-Domain Modeling of Sentence-Level Evidence for Document Retrieval","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"cvits-submissions-to-wat-2019","title":"CVIT's submissions to WAT-2019","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"deep-bidirectional-transformers-for-relation-1","title":"Deep Bidirectional Transformers for Relation Extraction without Supervision","date":"2019-11-01","arxiv_id":"1911.00313","n_code_links":0,"syntology":null},{"paper":null,"slug":"detection-of-propaganda-using-logistic","title":"Detection of Propaganda Using Logistic Regression","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/dialect-text-normalization-to-normative","slug":"dialect-text-normalization-to-normative","title":"Dialect Text Normalization to Normative Standard Finnish","date":"2019-11-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":"/paper/dialogpt-large-scale-generative-pre-training","slug":"dialogpt-large-scale-generative-pre-training","title":"DialoGPT: Large-Scale Generative Pre-training for Conversational Response Generation","date":"2019-11-01","arxiv_id":"1911.00536","n_code_links":6,"syntology":{"ran":6,"of":12,"n_ran_checked":5,"n_instrument":1,"unverified":6,"pointer_only":12,"phrase":"6 ran (of which 0 constructed an object rather than computing a result; 5 with no instrument failure: 1 honoured, 0 violated, 4 with no contract checked; 1 where Syntology's instrument failed) · 6 unverified","official":{"repos":["microsoft/DialoGPT"],"state":"community repositories only","n_ran":0,"n_constructed":0,"n_ran_no_instrument_failure":0,"n_unverified":0,"ran_from_kinds":["listed"]}}},{"paper":null,"slug":"divisive-language-and-propaganda-detection","title":"Divisive Language and Propaganda Detection using Multi-head Attention Transformers with Deep Learning BERT-based Language Models for Binary Classification","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"domain-adaptation-with-bert-based-domain","title":"Domain Adaptation with BERT-based Domain Classification and Data Selection","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"english-to-hindi-multi-modal-neural-machine","title":"English to Hindi Multi-modal Neural Machine Translation and Hindi Image Captioning","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"enhanced-transformer-model-for-data-to-text","title":"Enhanced Transformer Model for Data-to-Text Generation","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"enhancing-bert-for-lexical-normalization","title":"Enhancing BERT for Lexical Normalization","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"evaluating-bert-for-natural-language","title":"Evaluating BERT for natural language inference: A case study on the CommitmentBank","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"event-causality-recognition-exploiting","title":"Event Causality Recognition Exploiting Multiple Annotators' Judgments and Background Knowledge","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"extract-and-aggregate-a-novel-domain","title":"Extract and Aggregate: A Novel Domain-Independent Approach to Factual Data Verification","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"extractive-narrativeqa-with-heuristic-pre","title":"Extractive NarrativeQA with Heuristic Pre-Training","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/faspell-a-fast-adaptable-simple-powerful","slug":"faspell-a-fast-adaptable-simple-powerful","title":"FASPell: A Fast, Adaptable, Simple, Powerful Chinese Spell Checker Based On DAE-Decoder Paradigm","date":"2019-11-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"fine-grained-propaganda-detection-with-fine","title":"Fine-Grained Propaganda Detection with Fine-Tuned BERT","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"fine-tune-bert-with-sparse-self-attention","title":"Fine-tune BERT with Sparse Self-Attention Mechanism","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"from-monolingual-to-multilingual-faq","title":"From Monolingual to Multilingual FAQ Assistant using Multilingual Co-training","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"fully-unsupervised-crosslingual-semantic","title":"Fully Unsupervised Crosslingual Semantic Textual Similarity Metric Based on BERT for Identifying Parallel Data","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"gem-generative-enhanced-model-for-adversarial","title":"GEM: Generative Enhanced Model for adversarial attacks","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"generalizing-question-answering-system-with","title":"Generalizing Question Answering System with Pre-trained Language Model Fine-tuning","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/hit-scir-at-mrp-2019-a-unified-pipeline-for","slug":"hit-scir-at-mrp-2019-a-unified-pipeline-for","title":"HIT-SCIR at MRP 2019: A Unified Pipeline for Meaning Representation Parsing via Efficient Training and Effective Encoding","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"how-well-do-nli-models-capture-verb","title":"How well do NLI models capture verb veridicality?","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"idiap-nmt-system-for-wat-2019-multimodal","title":"Idiap NMT System for WAT 2019 Multimodal Translation Task","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"iit-kgp-at-coin-2019-using-pre-trained","title":"IIT-KGP at COIN 2019: Using pre-trained Language Models for modeling Machine Comprehension","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"improving-answer-selection-and-answer","title":"Improving Answer Selection and Answer Triggering using Hard Negatives","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"improving-generalization-of-transformer-for","title":"Improving Generalization of Transformer for Speech Recognition with Parallel Schedule Sampling and Relative Positional Embedding","date":"2019-11-01","arxiv_id":"1911.00203","n_code_links":0,"syntology":null},{"paper":null,"slug":"improving-natural-language-understanding-by","title":"Improving Natural Language Understanding by Reverse Mapping Bytepair Encoding","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"improving-pre-trained-multilingual-model-with","title":"Improving Pre-Trained Multilingual Model with Vocabulary Expansion","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"inspecting-unification-of-encoding-and","title":"Inspecting Unification of Encoding and Matching with Transformer: A Case Study of Machine Reading Comprehension","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"jbnu-at-mrp-2019-multi-level-biaffine","title":"JBNU at MRP 2019: Multi-level Biaffine Attention for Semantic Dependency Parsing","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"jeff-da-at-coin-shared-task","title":"Jeff Da at COIN - Shared Task: BIG MOOD: Relating Transformers to Explicit Commonsense Knowledge","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"justdeep-at-nlp4if-2019-task-1-propaganda","title":"JUSTDeep at NLP4IF 2019 Task 1: Propaganda Detection using Ensemble Deep Learning Models","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"lexicalat-lexical-based-adversarial","title":"LexicalAT: Lexical-Based Adversarial Reinforcement Training for Robust Sentiment Classification","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"long-warm-up-and-self-training-training","title":"Long Warm-up and Self-Training: Training Strategies of NICT-2 NMT System at WAT-2019","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"ltrc-mt-simple-textbackslash-effective-hindi","title":"LTRC-MT Simple \\& Effective Hindi-English Neural Machine Translation Systems at WAT 2019","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"mixed-multi-head-self-attention-for-neural","title":"Mixed Multi-Head Self-Attention for Neural Machine Translation","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"multi-view-domain-adapted-sentence-embeddings","title":"Multi-View Domain Adapted Sentence Embeddings for Low-Resource Unsupervised Duplicate Question Detection","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"multimodal-video-based-apparent-personality","title":"Multimodal Video-based Apparent Personality Recognition Using Long Short-Term Memory and Convolutional Neural Networks","date":"2019-11-01","arxiv_id":"1911.00381","n_code_links":0,"syntology":null},{"paper":null,"slug":"named-entity-recognition-is-there-a-glass-1","title":"Named Entity Recognition - Is There a Glass Ceiling?","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/natural-language-generation-for-effective","slug":"natural-language-generation-for-effective","title":"Natural Language Generation for Effective Knowledge Distillation","date":"2019-11-01","arxiv_id":null,"n_code_links":1,"syntology":null},{"paper":null,"slug":"no-youre-not-alone-a-better-way-to-find","title":"No, you're not alone: A better way to find people with similar experiences on Reddit","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"nsitnlp4if-2019-propaganda-detection-from","title":"NSIT@NLP4IF-2019: Propaganda Detection from News Articles using Transfer Learning","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"on-the-relation-between-position-information","title":"On the Relation between Position Information and Sentence Length in Neural Machine Translation","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"our-neural-machine-translation-systems-for","title":"Our Neural Machine Translation Systems for WAT 2019","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/pingan-smart-health-and-sjtu-at-coin-shared","slug":"pingan-smart-health-and-sjtu-at-coin-shared","title":"Pingan Smart Health and SJTU at COIN - Shared Task: utilizing Pre-trained Language Models and Common-sense Knowledge in Machine Reading Tasks","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"policy-preference-detection-in-parliamentary","title":"Policy Preference Detection in Parliamentary Debate Motions","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"pre-training-bert-on-domain-resources-for","title":"Pre-Training BERT on Domain Resources for Short Answer Grading","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"question-answering-using-hierarchical","title":"Question Answering Using Hierarchical Attention on Top of BERT Features","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"recurrent-positional-embedding-for-neural","title":"Recurrent Positional Embedding for Neural Machine Translation","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"recycling-a-pre-trained-bert-encoder-for","title":"Recycling a Pre-trained BERT Encoder for Neural Machine Translation","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"reevaluating-argument-component-extraction-in","title":"Reevaluating Argument Component Extraction in Low Resource Settings","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"relation-module-for-non-answerable","title":"Relation Module for Non-Answerable Predictions on Reading Comprehension","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"sarahs-participation-in-wat-2019","title":"Sarah's Participation in WAT 2019","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"selecting-planning-and-rewriting-a-modular","title":"Selecting, Planning, and Rewriting: A Modular Approach for Data-to-Document Generation and Translation","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"self-adaptive-scaling-for-learnable-residual","title":"Self-Adaptive Scaling for Learnable Residual Structure","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"sentence-level-propaganda-detection-in-news","title":"Sentence-Level Propaganda Detection in News Articles with Transfer Learning and BERT-BiLSTM-Capsule Model","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"suda-alibaba-at-mrp-2019-graph-based-models","title":"SUDA-Alibaba at MRP 2019: Graph-Based Models with BERT","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"sum-qe-a-bert-based-summary-quality","title":"SUM-QE: a BERT-based Summary Quality Estimation Model","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"supervised-neural-machine-translation-based","title":"Supervised neural machine translation based on data augmentation and improved training \\& inference process","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"systran-wat-2019-russian-japanese-news","title":"SYSTRAN @ WAT 2019: Russian-Japanese News Commentary task","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"systran-wngt-2019-dgt-task","title":"SYSTRAN @ WNGT 2019: DGT Task","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"team-domlin-exploiting-evidence-enhancement","title":"Team DOMLIN: Exploiting Evidence Enhancement for the FEVER Shared Task","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"the-concordia-nlg-surface-realizer-at-srst","title":"The Concordia NLG Surface Realizer at SRST 2019","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"transfer-learning-in-biomedical-named-entity","title":"Transfer Learning in Biomedical Named Entity Recognition: An Evaluation of BERT in the PharmaCoNER task","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"transformer-and-seq2seq-model-for-paraphrase","title":"Transformer and seq2seq model for Paraphrase Generation","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"transformer-based-model-for-single-documents","title":"Transformer-based Model for Single Documents Neural Summarization","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"transformer-dissection-an-unified-1","title":"Transformer Dissection: An Unified Understanding for Transformer's Attention via the Lens of Kernel","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"transforming-delete-retrieve-generate-1","title":"``Transforming'' Delete, Retrieve, Generate Approach for Controlled Text Style Transfer","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":"/paper/tupa-at-mrp-2019-a-multi-task-baseline-system","slug":"tupa-at-mrp-2019-a-multi-task-baseline-system","title":"TUPA at MRP 2019: A Multi-Task Baseline System","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"unsupervised-labeled-parsing-with-deep-inside","title":"Unsupervised Labeled Parsing with Deep Inside-Outside Recursive Autoencoders","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"what-does-this-word-mean-explaining","title":"What Does This Word Mean? Explaining Contextualized Embeddings with Natural Language Definition","date":"2019-11-01","arxiv_id":null,"n_code_links":0,"syntology":null},{"paper":null,"slug":"when-choosing-plausible-alternatives-clever-1","title":"When Choosing Plausible Alternatives, Clever Hans can be Clever","date":"2019-11-01","arxiv_id":"1911.00225","n_code_links":0,"syntology":null},{"paper":"/paper/attention-is-all-you-need-for-chinese-word","slug":"attention-is-all-you-need-for-chinese-word","title":"Attention Is All You Need for Chinese Word Segmentation","date":"2019-10-31","arxiv_id":"1910.14537","n_code_links":1,"syntology":null},{"paper":null,"slug":"dianet-bert-and-hierarchical-attention-multi","title":"DiaNet: BERT and Hierarchical Attention Multi-Task Learning of Fine-Grained Dialect","date":"2019-10-31","arxiv_id":"1910.14243","n_code_links":0,"syntology":null},{"paper":"/paper/do-multi-hop-readers-dream-of-reasoning","slug":"do-multi-hop-readers-dream-of-reasoning","title":"Do Multi-hop Readers Dream of Reasoning Chains?","date":"2019-10-31","arxiv_id":"1910.14520","n_code_links":1,"syntology":{"ran":9,"of":11,"n_ran_checked":6,"n_instrument":3,"unverified":2,"pointer_only":2,"phrase":"9 ran (of which 0 constructed an object rather than computing a result; 6 with no instrument failure: 2 honoured, 1 violated, 3 with no contract checked; 3 where Syntology's instrument failed) · 2 unverified","official":{"repos":["helloeve/bert-co-matching"],"state":"official (archive's flag): 9 ran","n_ran":9,"n_constructed":0,"n_ran_no_instrument_failure":6,"n_unverified":2,"ran_from_kinds":["official"]}}},{"paper":null,"slug":"document-level-neural-machine-translation-2","title":"Document-level Neural Machine Translation with Associated Memory Network","date":"2019-10-31","arxiv_id":"1910.14528","n_code_links":0,"syntology":null}],"record_sha256":"d74fb64c47d9f4fd4ace294d2c7f1e709c3e28346c0c200f4d38abfde765a4bb","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}