{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/language-modelling/papers/137","list_of":"/task/language-modelling","task":"Language Modelling","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":137,"pages_in_order":177,"rows_per_page":100,"rows":[13601,13700],"of":17610,"counts":{"archive_papers_tagged":17610,"with_a_code_link":7012,"where_syntology_ran_a_sample":2428,"not_listed_spam_title":0,"listed":17610,"listed_where_code_ran":2428,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":2027,"every_run_a_failure_of_syntologys_instrument":401,"listed_with_a_run_with_no_instrument_failure":2027,"listed_every_run_a_failure_of_syntologys_instrument":401,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/language-modelling","prev":"/task/language-modelling/papers/136","next":"/task/language-modelling/papers/138","papers":[{"url":null,"slug":"neural-language-models-are-not-born-equal-to","title":"Neural Language Models are not Born Equal to Fit Brain Data, but Training Helps","date":"2022-07-07","arxiv_id":"2207.03380","repositories_listed":0,"syntology":null},{"url":null,"slug":"aspect-based-sentiment-analysis-using-local","title":"Aspect-Based Sentiment Analysis using Local Context Focus Mechanism with DeBERTa","date":"2022-07-06","arxiv_id":"2207.02424","repositories_listed":0,"syntology":null},{"url":null,"slug":"text-enriched-sparse-hyperbolic-graph","title":"Text Enriched Sparse Hyperbolic Graph Convolutional Networks","date":"2022-07-06","arxiv_id":"2207.02368","repositories_listed":0,"syntology":null},{"url":null,"slug":"asr-generated-text-for-language-model-pre","title":"ASR-Generated Text for Language Model Pre-training Applied to Speech Tasks","date":"2022-07-05","arxiv_id":"2207.01893","repositories_listed":0,"syntology":null},{"url":null,"slug":"cross-lingual-qa-as-a-stepping-stone-for","title":"Cross-Lingual QA as a Stepping Stone for Monolingual Open QA in Icelandic","date":"2022-07-05","arxiv_id":"2207.01918","repositories_listed":0,"syntology":null},{"url":null,"slug":"mia-2022-shared-task-submission-leveraging","title":"MIA 2022 Shared Task Submission: Leveraging Entity Representations, Dense-Sparse Hybrids, and Fusion-in-Decoder for Cross-Lingual Question Answering","date":"2022-07-05","arxiv_id":"2207.01940","repositories_listed":0,"syntology":null},{"url":null,"slug":"bert-can-he-predict-contrastive-focus","title":"BERT, can HE predict contrastive focus? Predicting and controlling prominence in neural TTS using a language model","date":"2022-07-04","arxiv_id":"2207.01718","repositories_listed":0,"syntology":null},{"url":null,"slug":"frame-evaluating-simulatability-metrics-for","title":"FRAME: Evaluating Rationale-Label Consistency Metrics for Free-Text Rationales","date":"2022-07-02","arxiv_id":"2207.00779","repositories_listed":0,"syntology":null},{"url":null,"slug":"userlibri-a-dataset-for-asr-personalization","title":"UserLibri: A Dataset for ASR Personalization Using Only Text","date":"2022-07-02","arxiv_id":"2207.00706","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-dog-is-passing-over-the-jet-a-text","title":"A Dog Is Passing Over The Jet? A Text-Generation Dataset for Korean Commonsense Reasoning and Evaluation","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"a-self-supervised-joint-training-framework","title":"A Self-supervised Joint Training Framework for Document Reranking","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"an-annotated-dataset-and-automatic-approaches","title":"An Annotated Dataset and Automatic Approaches for Discourse Mode Identification in Low-resource Bengali Language","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"an-empirical-study-on-pseudo-log-likelihood","title":"An Empirical Study on Pseudo-log-likelihood Bias Measures for Masked Language Models Using Paraphrased Sentences","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"analog-testing-analytical-and-deductive-logic","title":"AnaLog: Testing Analytical and Deductive Logic Learnability in Language Models","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"attention-fusion-a-light-yet-efficient-late","title":"Attention Fusion: a light yet efficient late fusion mechanism for task adaptation in NLU","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":"/paper/beyond-characters-subword-level-morpheme","slug":"beyond-characters-subword-level-morpheme","title":"Beyond Characters: Subword-level Morpheme Segmentation","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"dangnt-sgu-at-semeval-2022-task-11-using-pre","title":"DANGNT-SGU at SemEval-2022 Task 11: Using Pre-trained Language Model for Complex Named Entity Recognition","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"data-augmentation-with-dual-training-for","title":"Data Augmentation with Dual Training for Offensive Span Detection","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"diversity-and-uncertainty-in-moderation-are-1","title":"”Diversity and Uncertainty in Moderation” are the Key to Data Selection for Multilingual Few-shot Transfer","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"dont-forget-about-pronouns-removing-gender-1","title":"Don’t Forget About Pronouns: Removing Gender Bias in Language Models Without Losing Factual Gender Information","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"empathetic-persuasion-reinforcing-empathy-and-1","title":"Empathetic Persuasion: Reinforcing Empathy and Persuasiveness in Dialogue Systems","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"exploring-the-effect-of-dialect-mismatched","title":"Exploring the Effect of Dialect Mismatched Language Models in Telugu Automatic Speech Recognition","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"gpt-2-based-human-in-the-loop-theatre-play","title":"GPT-2-based Human-in-the-loop Theatre Play Script Generation","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"huaams-at-semeval-2022-task-8-combining","title":"HuaAMS at SemEval-2022 Task 8: Combining Translation and Domain Pre-training for Cross-lingual News Article Similarity","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-classification-of-infrequent","title":"Improving Classification of Infrequent Cognitive Distortions: Domain-Specific Model vs. Data Augmentation","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-conversational-recommendation-3","title":"Improving Conversational Recommendation Systems’ Quality with Context-Aware Item Meta-Information","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"infrrd-ai-at-semeval-2022-task-11-a-system","title":"Infrrd.ai at SemEval-2022 Task 11: A system for named entity recognition using data augmentation, transformer-based sequence labeling model, and EnsembleCRF","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"intent-discovery-for-enterprise-virtual","title":"Intent Discovery for Enterprise Virtual Assistants: Applications of Utterance Embedding and Clustering to Intent Mining","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"jbnu-cclab-at-semeval-2022-task-7-deberta-for","title":"JBNU-CCLab at SemEval-2022 Task 7: DeBERTa for Identifying Plausible Clarifications in Instructional Texts","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"kroneckerbert-significant-compression-of-pre","title":"KroneckerBERT: Significant Compression of Pre-trained Language Models Through Kronecker Decomposition and Knowledge Distillation","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"l3i-at-semeval-2022-task-11-straightforward","title":"L3i at SemEval-2022 Task 11: Straightforward Additional Context for Multilingual Named Entity Recognition","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"language-model-augmented-monotonic-attention","title":"Language Model Augmented Monotonic Attention for Simultaneous Translation","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"mask-and-regenerate-a-classifier-based","title":"Mask and Regenerate: A Classifier-based Approach for Unpaired Sentiment Transformation of Reviews for Electronic Commerce Websites.","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"masking-morphosyntactic-categories-to","title":"Masking Morphosyntactic Categories to Evaluate Salience for Schizophrenia Diagnosis","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"minimally-supervised-relation-induction-from-1","title":"Minimally-Supervised Relation Induction from Pre-trained Language Model","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"mt-speech-at-semeval-2022-task-10","title":"MT-Speech at SemEval-2022 Task 10: Incorporating Data Augmentation and Auxiliary Task with Cross-Lingual Pretrained Language Model for Structured Sentiment Analysis","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"niksss-at-semeval-2022-task-6-are","title":"niksss at SemEval-2022 Task 6: Are Traditionally Pre-Trained Contextual Embeddings Enough for Detecting Intended Sarcasm ?","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"self-supervised-product-title-rewrite-for","title":"Self-supervised Product Title Rewrite for Product Listing Ads","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"spdb-innovation-lab-at-semeval-2022-task-10-a","title":"SPDB Innovation Lab at SemEval-2022 Task 10: A Novel End-to-End Structured Sentiment Analysis Model based on the ERNIE-M","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"swahbert-language-model-of-swahili","title":"SwahBERT: Language Model of Swahili","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"tug-cic-at-semeval-2021-task-6-two-stage-fine","title":"TUG-CIC at SemEval-2021 Task 6: Two-stage Fine-tuning for Intended Sarcasm Detection","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"uncertainty-and-inclusivity-in-gender-bias","title":"Uncertainty and Inclusivity in Gender Bias Annotation: An Annotation Taxonomy and Annotated Datasets of British English Text","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-paraphrasability-prediction-for","title":"Unsupervised Paraphrasability Prediction for Compound Nominalizations","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"zuo-zhuan-ancient-chinese-dataset-for-word","title":"Zuo Zhuan Ancient Chinese Dataset for Word Sense Disambiguation","date":"2022-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"diversity-and-uncertainty-in-moderation-are","title":"\"Diversity and Uncertainty in Moderation\" are the Key to Data Selection for Multilingual Few-shot Transfer","date":"2022-06-30","arxiv_id":"2206.15010","repositories_listed":0,"syntology":null},{"url":null,"slug":"escorpius-a-massive-spanish-crawling-corpus","title":"esCorpius: A Massive Spanish Crawling Corpus","date":"2022-06-30","arxiv_id":"2206.15147","repositories_listed":0,"syntology":null},{"url":null,"slug":"language-model-compression-with-weighted-low-1","title":"Language model compression with weighted low-rank factorization","date":"2022-06-30","arxiv_id":"2207.00112","repositories_listed":0,"syntology":null},{"url":null,"slug":"contextual-density-ratio-for-language-model","title":"Contextual Density Ratio for Language Model Biasing of Sequence to Sequence ASR Systems","date":"2022-06-29","arxiv_id":"2206.14623","repositories_listed":0,"syntology":null},{"url":null,"slug":"gpts-at-factify-2022-prompt-aided-fact","title":"GPTs at Factify 2022: Prompt Aided Fact-Verification","date":"2022-06-29","arxiv_id":"2206.14913","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-deliberation-by-text-only-and-semi","title":"Improving Deliberation by Text-Only and Semi-Supervised Training","date":"2022-06-29","arxiv_id":"2206.14716","repositories_listed":0,"syntology":null},{"url":null,"slug":"knowledge-distillation-of-transformer-based","title":"Knowledge Distillation of Transformer-based Language Models Revisited","date":"2022-06-29","arxiv_id":"2206.14366","repositories_listed":0,"syntology":null},{"url":null,"slug":"simple-and-effective-multi-sentence-tts-with","title":"Simple and Effective Multi-sentence TTS with Expressive and Coherent Prosody","date":"2022-06-29","arxiv_id":"2206.14643","repositories_listed":0,"syntology":null},{"url":null,"slug":"adaptive-multi-view-rule-discovery-for-weakly","title":"Adaptive Multi-view Rule Discovery for Weakly-Supervised Compatible Products Prediction","date":"2022-06-28","arxiv_id":"2206.13749","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-zero-shot-classification-approach-for-a","title":"A Zero-Shot Classification Approach for a Word-Guessing Challenge","date":"2022-06-27","arxiv_id":"2206.13099","repositories_listed":0,"syntology":null},{"url":null,"slug":"bi-vldoc-bidirectional-vision-language","title":"Bi-VLDoc: Bidirectional Vision-Language Modeling for Visually-Rich Document Understanding","date":"2022-06-27","arxiv_id":"2206.13155","repositories_listed":0,"syntology":null},{"url":null,"slug":"your-autoregressive-generative-model-can-be-1","title":"Your Autoregressive Generative Model Can be Better If You Treat It as an Energy-Based One","date":"2022-06-26","arxiv_id":"2206.12840","repositories_listed":0,"syntology":null},{"url":null,"slug":"construct-a-sentence-with-multiple-specified","title":"Construct a Sentence with Multiple Specified Words","date":"2022-06-25","arxiv_id":"2206.12565","repositories_listed":0,"syntology":null},{"url":null,"slug":"evaluating-generative-patent-language-models","title":"Evaluating Generative Patent Language Models","date":"2022-06-23","arxiv_id":"2206.14578","repositories_listed":0,"syntology":null},{"url":null,"slug":"dp-parse-finding-word-boundaries-from-raw","title":"DP-Parse: Finding Word Boundaries from Raw Speech with an Instance Lexicon","date":"2022-06-22","arxiv_id":"2206.11332","repositories_listed":0,"syntology":null},{"url":null,"slug":"efficient-and-effective-training-of-language","title":"Efficient and effective training of language and graph neural network models","date":"2022-06-22","arxiv_id":"2206.10781","repositories_listed":0,"syntology":null},{"url":null,"slug":"gaining-insights-on-u-s-senate-speeches-using","title":"Revisiting Group Differences in High-Dimensional Choices: Method and Application to Congressional Speech","date":"2022-06-22","arxiv_id":"2206.10877","repositories_listed":0,"syntology":null},{"url":null,"slug":"don-t-forget-about-pronouns-removing-gender","title":"Don't Forget About Pronouns: Removing Gender Bias in Language Models Without Losing Factual Gender Information","date":"2022-06-21","arxiv_id":"2206.10744","repositories_listed":0,"syntology":null},{"url":null,"slug":"general-framework-for-reversible-data-hiding-1","title":"General Framework for Reversible Data Hiding in Texts Based on Masked Language Modeling","date":"2022-06-21","arxiv_id":"2206.10112","repositories_listed":0,"syntology":null},{"url":null,"slug":"knowda-all-in-one-knowledge-mixture-model-for","title":"KnowDA: All-in-One Knowledge Mixture Model for Data Augmentation in Low-Resource NLP","date":"2022-06-21","arxiv_id":"2206.10265","repositories_listed":0,"syntology":null},{"url":null,"slug":"knowledge-graph-fusion-for-language-model","title":"Knowledge Graph Fusion for Language Model Fine-tuning","date":"2022-06-21","arxiv_id":"2206.14574","repositories_listed":0,"syntology":null},{"url":null,"slug":"taphsir-towards-anaphoric-ambiguity-detection","title":"TAPHSIR: Towards AnaPHoric Ambiguity Detection and ReSolution In Requirements","date":"2022-06-21","arxiv_id":"2206.10227","repositories_listed":0,"syntology":null},{"url":null,"slug":"using-cognitive-psychology-to-understand-gpt","title":"Using cognitive psychology to understand GPT-3","date":"2022-06-21","arxiv_id":"2206.14576","repositories_listed":0,"syntology":null},{"url":"/paper/0-1-deep-neural-networks-via-block-coordinate","slug":"0-1-deep-neural-networks-via-block-coordinate","title":"0/1 Deep Neural Networks via Block Coordinate Descent","date":"2022-06-19","arxiv_id":"2206.09379","repositories_listed":0,"syntology":null},{"url":null,"slug":"can-language-models-capture-graph-semantics","title":"Can Language Models Capture Graph Semantics? From Graphs to Language Model and Vice-Versa","date":"2022-06-18","arxiv_id":"2206.09259","repositories_listed":0,"syntology":null},{"url":null,"slug":"evolution-through-large-models","title":"Evolution through Large Models","date":"2022-06-17","arxiv_id":"2206.08896","repositories_listed":0,"syntology":null},{"url":null,"slug":"making-first-order-linear-logic-a-generating","title":"Making first order linear logic a generating grammar","date":"2022-06-17","arxiv_id":"2206.08955","repositories_listed":0,"syntology":null},{"url":null,"slug":"accelerating-inference-and-language-model","title":"Accelerating Inference and Language Model Fusion of Recurrent Neural Network Transducers via End-to-End 4-bit Quantization","date":"2022-06-16","arxiv_id":"2206.07882","repositories_listed":0,"syntology":null},{"url":null,"slug":"characteristics-of-harmful-text-towards","title":"Characteristics of Harmful Text: Towards Rigorous Benchmarking of Language Models","date":"2022-06-16","arxiv_id":"2206.08325","repositories_listed":0,"syntology":null},{"url":null,"slug":"deep-multi-task-models-for-misogyny","title":"Deep Multi-Task Models for Misogyny Identification and Categorization on Arabic Social Media","date":"2022-06-16","arxiv_id":"2206.08407","repositories_listed":0,"syntology":null},{"url":null,"slug":"goodbye-wavenet-a-language-model-for-raw","title":"A Language Model With Million Context Length For Raw Audio","date":"2022-06-16","arxiv_id":"2206.08297","repositories_listed":0,"syntology":null},{"url":null,"slug":"know-your-audience-specializing-grounded","title":"Know your audience: specializing grounded language models with listener subtraction","date":"2022-06-16","arxiv_id":"2206.08349","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-survey-neural-networks-for-amr-to-text","title":"A Survey : Neural Networks for AMR-to-Text","date":"2022-06-15","arxiv_id":"2206.07328","repositories_listed":0,"syntology":null},{"url":null,"slug":"emergent-abilities-of-large-language-models","title":"Emergent Abilities of Large Language Models","date":"2022-06-15","arxiv_id":"2206.07682","repositories_listed":0,"syntology":null},{"url":null,"slug":"residual-language-model-for-end-to-end-speech","title":"Residual Language Model for End-to-end Speech Recognition","date":"2022-06-15","arxiv_id":"2206.07430","repositories_listed":0,"syntology":null},{"url":null,"slug":"test-time-adaptation-for-visual-document","title":"Test-Time Adaptation for Visual Document Understanding","date":"2022-06-15","arxiv_id":"2206.07240","repositories_listed":0,"syntology":null},{"url":null,"slug":"fine-tuning-pre-trained-language-models-with","title":"Improving Pre-trained Language Model Fine-tuning with Noise Stability Regularization","date":"2022-06-12","arxiv_id":"2206.05658","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-dataset-and-benchmark-for-automatically","title":"From Human Days to Machine Seconds: Automatically Answering and Generating Machine Learning Final Exams","date":"2022-06-11","arxiv_id":"2206.05442","repositories_listed":0,"syntology":null},{"url":null,"slug":"measuring-the-carbon-intensity-of-ai-in-cloud","title":"Measuring the Carbon Intensity of AI in Cloud Instances","date":"2022-06-10","arxiv_id":"2206.05229","repositories_listed":0,"syntology":null},{"url":null,"slug":"sort-by-structure-language-model-ranking-as","title":"Sort by Structure: Language Model Ranking as Dependency Probing","date":"2022-06-10","arxiv_id":"2206.04935","repositories_listed":0,"syntology":null},{"url":null,"slug":"unsupervised-and-few-shot-parsing-from","title":"Unsupervised and Few-shot Parsing from Pretrained Language Models","date":"2022-06-10","arxiv_id":"2206.04980","repositories_listed":0,"syntology":null},{"url":null,"slug":"context-based-out-of-vocabulary-word-recovery","title":"Context-based out-of-vocabulary word recovery for ASR systems in Indian languages","date":"2022-06-09","arxiv_id":"2206.04305","repositories_listed":0,"syntology":null},{"url":null,"slug":"joint-encoder-decoder-self-supervised-pre","title":"Joint Encoder-Decoder Self-Supervised Pre-training for ASR","date":"2022-06-09","arxiv_id":"2206.04465","repositories_listed":0,"syntology":null},{"url":null,"slug":"few-shot-prompting-toward-controllable","title":"Learning to Generate Prompts for Dialogue Generation through Reinforcement Learning","date":"2022-06-08","arxiv_id":"2206.03931","repositories_listed":0,"syntology":null},{"url":null,"slug":"dynamar-dynamic-prompt-with-mask-token","title":"DynaMaR: Dynamic Prompt with Mask Token Representation","date":"2022-06-07","arxiv_id":"2206.02982","repositories_listed":0,"syntology":null},{"url":null,"slug":"id-agnostic-user-behavior-pre-training-for","title":"ID-Agnostic User Behavior Pre-training for Sequential Recommendation","date":"2022-06-06","arxiv_id":"2206.02323","repositories_listed":0,"syntology":null},{"url":"/paper/on-the-advance-of-making-language-models","slug":"on-the-advance-of-making-language-models","title":"Making Large Language Models Better Reasoners with Step-Aware Verifier","date":"2022-06-06","arxiv_id":"2206.02336","repositories_listed":0,"syntology":null},{"url":null,"slug":"sentiment-analysis-of-online-travel-reviews","title":"Sentiment Analysis of Online Travel Reviews Based on Capsule Network and Sentiment Lexicon","date":"2022-06-05","arxiv_id":"2206.02160","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-control-theoretic-framework-for-adaptive","title":"A Control Theoretic Framework for Adaptive Gradient Optimizers in Machine Learning","date":"2022-06-04","arxiv_id":"2206.02034","repositories_listed":0,"syntology":null},{"url":null,"slug":"automatic-generation-of-programming-exercises-1","title":"Automatic Generation of Programming Exercises and Code Explanations using Large Language Models","date":"2022-06-03","arxiv_id":"2206.11861","repositories_listed":0,"syntology":null},{"url":null,"slug":"visual-clues-bridging-vision-and-language","title":"Visual Clues: Bridging Vision and Language Foundations for Image Paragraph Captioning","date":"2022-06-03","arxiv_id":"2206.01843","repositories_listed":0,"syntology":null},{"url":null,"slug":"bayesformer-transformer-with-uncertainty","title":"BayesFormer: Transformer with Uncertainty Estimation","date":"2022-06-02","arxiv_id":"2206.00826","repositories_listed":0,"syntology":null},{"url":null,"slug":"code-generation-tools-almost-for-free-a-study","title":"Code Generation Tools (Almost) for Free? A Study of Few-Shot, Pre-Trained Language Models on Code","date":"2022-06-02","arxiv_id":"2206.01335","repositories_listed":0,"syntology":null},{"url":null,"slug":"vl-beit-generative-vision-language","title":"VL-BEiT: Generative Vision-Language Pretraining","date":"2022-06-02","arxiv_id":"2206.01127","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-language-modelling-approach-to-quality","title":"A Language Modelling Approach to Quality Assessment of OCR’ed Historical Text","date":"2022-06-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"automatic-speech-recognition-for-irish-the","title":"Automatic Speech Recognition for Irish: the ABAIR-ÉIST System","date":"2022-06-01","arxiv_id":null,"repositories_listed":0,"syntology":null}],"record_sha256":"a3011c8ad5e7bda77133a27465732e30f609aeb93c3291f90ac0e9c0e10b99f0","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}