{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/language-modeling/papers/101","list_of":"/task/language-modeling","task":"Language Modeling","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":101,"pages_in_order":142,"rows_per_page":100,"rows":[10001,10100],"of":14182,"counts":{"archive_papers_tagged":14182,"with_a_code_link":5620,"where_syntology_ran_a_sample":1894,"not_listed_spam_title":0,"listed":14182,"listed_where_code_ran":1894,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":1580,"every_run_a_failure_of_syntologys_instrument":314,"listed_with_a_run_with_no_instrument_failure":1580,"listed_every_run_a_failure_of_syntologys_instrument":314,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/language-modeling","prev":"/task/language-modeling/papers/100","next":"/task/language-modeling/papers/102","papers":[{"url":null,"slug":"a-systematic-study-of-performance-disparities","title":"A Systematic Study of Performance Disparities in Multilingual Task-Oriented Dialogue Systems","date":"2023-10-19","arxiv_id":"2310.12892","repositories_listed":0,"syntology":null},{"url":null,"slug":"an-exploration-of-in-context-learning-for","title":"Exploring In-Context Learning of Textless Speech Language Model for Speech Classification Tasks","date":"2023-10-19","arxiv_id":"2310.12477","repositories_listed":0,"syntology":null},{"url":null,"slug":"causal-structure-driven-augmentations-for","title":"Data Augmentations for Improved (Large) Language Model Generalization","date":"2023-10-19","arxiv_id":"2310.12803","repositories_listed":0,"syntology":null},{"url":null,"slug":"clair-evaluating-image-captions-with-large","title":"CLAIR: Evaluating Image Captions with Large Language Models","date":"2023-10-19","arxiv_id":"2310.12971","repositories_listed":0,"syntology":null},{"url":null,"slug":"efficient-long-range-transformers-you-need-to","title":"Efficient Long-Range Transformers: You Need to Attend More, but Not Necessarily at Every Layer","date":"2023-10-19","arxiv_id":"2310.12442","repositories_listed":0,"syntology":null},{"url":null,"slug":"is-chatgpt-a-financial-expert-evaluating","title":"Is ChatGPT a Financial Expert? Evaluating Language Models on Financial Natural Language Processing","date":"2023-10-19","arxiv_id":"2310.12664","repositories_listed":0,"syntology":null},{"url":null,"slug":"label-aware-automatic-verbalizer-for-few-shot","title":"Label-Aware Automatic Verbalizer for Few-Shot Text Classification","date":"2023-10-19","arxiv_id":"2310.12778","repositories_listed":0,"syntology":null},{"url":null,"slug":"laser-linear-compression-in-wireless","title":"LASER: Linear Compression in Wireless Distributed Optimization","date":"2023-10-19","arxiv_id":"2310.13033","repositories_listed":0,"syntology":null},{"url":null,"slug":"lost-in-translation-when-gpt-4v-ision-can-t","title":"Lost in Translation: When GPT-4V(ision) Can't See Eye to Eye with Text. A Vision-Language-Consistency Analysis of VLLMs and Beyond","date":"2023-10-19","arxiv_id":"2310.12520","repositories_listed":0,"syntology":null},{"url":null,"slug":"named-entity-recognition-for-monitoring-plant","title":"Named Entity Recognition for Monitoring Plant Health Threats in Tweets: a ChouBERT Approach","date":"2023-10-19","arxiv_id":"2310.12522","repositories_listed":0,"syntology":null},{"url":null,"slug":"document-level-language-models-for-machine","title":"Document-Level Language Models for Machine Translation","date":"2023-10-18","arxiv_id":"2310.12303","repositories_listed":0,"syntology":null},{"url":null,"slug":"pseudointelligence-a-unifying-framework-for","title":"Pseudointelligence: A Unifying Framework for Language Model Evaluation","date":"2023-10-18","arxiv_id":"2310.12135","repositories_listed":0,"syntology":null},{"url":null,"slug":"solving-the-multiplication-problem-of-a-large","title":"Solving the multiplication problem of a large language model system using a graph-based method","date":"2023-10-18","arxiv_id":"2310.13016","repositories_listed":0,"syntology":null},{"url":null,"slug":"chapgtp-illc-s-attempt-at-raising-a-babylm","title":"ChapGTP, ILLC's Attempt at Raising a BabyLM: Improving Data Efficiency by Automatic Task Formation","date":"2023-10-17","arxiv_id":"2310.11282","repositories_listed":0,"syntology":null},{"url":null,"slug":"correction-focused-language-model-training","title":"Correction Focused Language Model Training for Speech Recognition","date":"2023-10-17","arxiv_id":"2310.11003","repositories_listed":0,"syntology":null},{"url":"/paper/emulating-human-cognitive-processes-for","slug":"emulating-human-cognitive-processes-for","title":"Emulating Human Cognitive Processes for Expert-Level Medical Question-Answering with Large Language Models","date":"2023-10-17","arxiv_id":"2310.11266","repositories_listed":0,"syntology":null},{"url":null,"slug":"iterative-shallow-fusion-of-backward-language","title":"Iterative Shallow Fusion of Backward Language Model for End-to-End Speech Recognition","date":"2023-10-17","arxiv_id":"2310.11010","repositories_listed":0,"syntology":null},{"url":null,"slug":"large-language-model-prediction-capabilities","title":"Large Language Model Prediction Capabilities: Evidence from a Real-World Forecasting Tournament","date":"2023-10-17","arxiv_id":"2310.13014","repositories_listed":0,"syntology":null},{"url":null,"slug":"leveraging-large-language-model-for-automatic","title":"Leveraging Large Language Model for Automatic Evolving of Industrial Data-Centric R&D Cycle","date":"2023-10-17","arxiv_id":"2310.11249","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-stage-large-language-model-correction","title":"Multi-stage Large Language Model Correction for Speech Recognition","date":"2023-10-17","arxiv_id":"2310.11532","repositories_listed":0,"syntology":null},{"url":null,"slug":"revealing-the-unwritten-visual-investigation","title":"Revealing the Unwritten: Visual Investigation of Beam Search Trees to Address Language Model Prompting Challenges","date":"2023-10-17","arxiv_id":"2310.11252","repositories_listed":0,"syntology":null},{"url":null,"slug":"utilising-a-large-language-model-to-annotate","title":"Utilising a Large Language Model to Annotate Subject Metadata: A Case Study in an Australian National Research Data Catalogue","date":"2023-10-17","arxiv_id":"2310.11318","repositories_listed":0,"syntology":null},{"url":null,"slug":"bootstrap-your-own-skills-learning-to-solve","title":"Bootstrap Your Own Skills: Learning to Solve New Tasks with Large Language Model Guidance","date":"2023-10-16","arxiv_id":"2310.10021","repositories_listed":0,"syntology":null},{"url":null,"slug":"contextual-data-augmentation-for-task","title":"Contextual Data Augmentation for Task-Oriented Dialog Systems","date":"2023-10-16","arxiv_id":"2310.10380","repositories_listed":0,"syntology":null},{"url":null,"slug":"efficientocr-an-extensible-open-source","title":"EfficientOCR: An Extensible, Open-Source Package for Efficiently Digitizing World Knowledge","date":"2023-10-16","arxiv_id":"2310.10050","repositories_listed":0,"syntology":null},{"url":null,"slug":"forcegen-end-to-end-de-novo-protein","title":"ForceGen: End-to-end de novo protein generation based on nonlinear mechanical unfolding responses using a protein language diffusion model","date":"2023-10-16","arxiv_id":"2310.10605","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-large-language-model-fine-tuning","title":"Improving Large Language Model Fine-tuning for Solving Math Problems","date":"2023-10-16","arxiv_id":"2310.10047","repositories_listed":0,"syntology":null},{"url":null,"slug":"interactive-task-planning-with-language","title":"Interactive Task Planning with Language Models","date":"2023-10-16","arxiv_id":"2310.10645","repositories_listed":0,"syntology":null},{"url":null,"slug":"lobass-gauging-learnability-in-supervised","title":"DavIR: Data Selection via Implicit Reward for Large Language Models","date":"2023-10-16","arxiv_id":"2310.13008","repositories_listed":0,"syntology":null},{"url":null,"slug":"use-of-probabilistic-phrases-in-a","title":"Use of probabilistic phrases in a coordination game: human versus GPT-4","date":"2023-10-16","arxiv_id":"2310.10544","repositories_listed":0,"syntology":null},{"url":null,"slug":"aces-generating-diverse-programming-puzzles","title":"ACES: Generating Diverse Programming Puzzles with with Autotelic Generative Models","date":"2023-10-15","arxiv_id":"2310.10692","repositories_listed":0,"syntology":null},{"url":null,"slug":"beyond-segmentation-road-network-generation","title":"Beyond Segmentation: Road Network Generation with Multi-Modal LLMs","date":"2023-10-15","arxiv_id":"2310.09755","repositories_listed":0,"syntology":null},{"url":null,"slug":"empirical-study-of-pretrained-multilingual","title":"Empirical study of pretrained multilingual language models for zero-shot cross-lingual knowledge transfer in generation","date":"2023-10-15","arxiv_id":"2310.09917","repositories_listed":0,"syntology":null},{"url":null,"slug":"farzi-data-autoregressive-data-distillation","title":"Farzi Data: Autoregressive Data Distillation","date":"2023-10-15","arxiv_id":"2310.09983","repositories_listed":0,"syntology":null},{"url":null,"slug":"large-language-model-aware-in-context","title":"Large Language Model-Aware In-Context Learning for Code Generation","date":"2023-10-15","arxiv_id":"2310.09748","repositories_listed":0,"syntology":null},{"url":null,"slug":"large-vocabulary-spontaneous-speech","title":"Large Vocabulary Spontaneous Speech Recognition for Tigrigna","date":"2023-10-15","arxiv_id":"2402.04254","repositories_listed":0,"syntology":null},{"url":null,"slug":"reformulating-nlp-tasks-to-capture","title":"Reformulating NLP tasks to Capture Longitudinal Manifestation of Language Disorders in People with Dementia","date":"2023-10-15","arxiv_id":"2310.09897","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-study-of-the-impact-of-generative-ai-based","title":"A study of the impact of generative AI-based data augmentation on software metadata classification","date":"2023-10-14","arxiv_id":"2310.13714","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-binary-code-comment-quality","title":"Enhancing Binary Code Comment Quality Classification: Integrating Generative AI for Improved Accuracy","date":"2023-10-14","arxiv_id":"2310.11467","repositories_listed":0,"syntology":null},{"url":null,"slug":"legend-at-araieval-shared-task-persuasion","title":"Legend at ArAIEval Shared Task: Persuasion Technique Detection using a Language-Agnostic Text Representation Model","date":"2023-10-14","arxiv_id":"2310.09661","repositories_listed":0,"syntology":null},{"url":null,"slug":"software-metadata-classification-based-on","title":"Software Metadata Classification based on Generative Artificial Intelligence","date":"2023-10-14","arxiv_id":"2310.13006","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-case-based-persistent-memory-for-a-large","title":"A Case-Based Persistent Memory for a Large Language Model","date":"2023-10-13","arxiv_id":"2310.08842","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-ml-llm-pairing-for-better-code-comment","title":"A ML-LLM pairing for better code comment classification","date":"2023-10-13","arxiv_id":"2310.10275","repositories_listed":0,"syntology":null},{"url":null,"slug":"agentcf-collaborative-learning-with","title":"AgentCF: Collaborative Learning with Autonomous Language Agents for Recommender Systems","date":"2023-10-13","arxiv_id":"2310.09233","repositories_listed":0,"syntology":null},{"url":null,"slug":"clickprompt-ctr-models-are-strong-prompt","title":"ClickPrompt: CTR Models are Strong Prompt Generators for Adapting Language Models to CTR Prediction","date":"2023-10-13","arxiv_id":"2310.09234","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-bert-based-visual-question","title":"Enhancing BERT-Based Visual Question Answering through Keyword-Driven Sentence Selection","date":"2023-10-13","arxiv_id":"2310.09432","repositories_listed":0,"syntology":null},{"url":null,"slug":"incremental-object-detection-with-clip","title":"Incremental Object Detection with CLIP","date":"2023-10-13","arxiv_id":"2310.08815","repositories_listed":0,"syntology":null},{"url":null,"slug":"interactive-navigation-in-environments-with","title":"Interactive Navigation in Environments with Traversable Obstacles Using Large Language and Vision-Language Models","date":"2023-10-13","arxiv_id":"2310.08873","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-consensus-game-language-model-generation","title":"The Consensus Game: Language Model Generation via Equilibrium Search","date":"2023-10-13","arxiv_id":"2310.09139","repositories_listed":0,"syntology":null},{"url":null,"slug":"harnessing-large-language-models-empathetic","title":"Harnessing Large Language Models' Empathetic Response Generation Capabilities for Online Mental Health Counselling Support","date":"2023-10-12","arxiv_id":"2310.08017","repositories_listed":0,"syntology":null},{"url":null,"slug":"large-language-models-can-replicate-cross","title":"Large language models can replicate cross-cultural differences in personality","date":"2023-10-12","arxiv_id":"2310.10679","repositories_listed":0,"syntology":null},{"url":null,"slug":"multimodal-large-language-model-for-visual","title":"Multimodal Large Language Model for Visual Navigation","date":"2023-10-12","arxiv_id":"2310.08669","repositories_listed":0,"syntology":null},{"url":null,"slug":"toward-joint-language-modeling-for-speech","title":"Toward Joint Language Modeling for Speech Units and Text","date":"2023-10-12","arxiv_id":"2310.08715","repositories_listed":0,"syntology":null},{"url":null,"slug":"ziya-vl-bilingual-large-vision-language-model","title":"Ziya-Visual: Bilingual Large Vision-Language Model via Multi-Task Instruction Tuning","date":"2023-10-12","arxiv_id":"2310.08166","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-comparative-study-of-pre-trained-cnns-and","title":"A Comparative Study of Pre-trained CNNs and GRU-Based Attention for Image Caption Generation","date":"2023-10-11","arxiv_id":"2310.07252","repositories_listed":0,"syntology":null},{"url":null,"slug":"clausewitzgpt-framework-a-new-frontier-in","title":"ClausewitzGPT Framework: A New Frontier in Theoretical Large Language Model Enhanced Information Operations","date":"2023-10-11","arxiv_id":"2310.07099","repositories_listed":0,"syntology":null},{"url":null,"slug":"crosslingual-structural-priming-and-the-pre","title":"Crosslingual Structural Priming and the Pre-Training Dynamics of Bilingual Language Models","date":"2023-10-11","arxiv_id":"2310.07929","repositories_listed":0,"syntology":null},{"url":null,"slug":"fast-electra-for-efficient-pre-training","title":"Fast-ELECTRA for Efficient Pre-training","date":"2023-10-11","arxiv_id":"2310.07347","repositories_listed":0,"syntology":null},{"url":null,"slug":"langnav-language-as-a-perceptual","title":"LangNav: Language as a Perceptual Representation for Navigation","date":"2023-10-11","arxiv_id":"2310.07889","repositories_listed":0,"syntology":null},{"url":null,"slug":"matchat-a-large-language-model-and","title":"MatChat: A Large Language Model and Application Service Platform for Materials Science","date":"2023-10-11","arxiv_id":"2310.07197","repositories_listed":0,"syntology":null},{"url":null,"slug":"measuring-feature-sparsity-in-language-models","title":"Measuring Feature Sparsity in Language Models","date":"2023-10-11","arxiv_id":"2310.07837","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-multi-facet-paradigm-to-bridge-large","title":"Bridging Items and Language: A Transition Paradigm for Large Language Model-Based Recommendation","date":"2023-10-10","arxiv_id":"2310.06491","repositories_listed":0,"syntology":null},{"url":null,"slug":"acoustic-model-fusion-for-end-to-end-speech","title":"Acoustic Model Fusion for End-to-end Speech Recognition","date":"2023-10-10","arxiv_id":"2310.07062","repositories_listed":0,"syntology":null},{"url":null,"slug":"answer-candidate-type-selection-text-to-text","title":"Answer Candidate Type Selection: Text-to-Text Language Model for Closed Book Question Answering Meets Knowledge Graphs","date":"2023-10-10","arxiv_id":"2310.07008","repositories_listed":0,"syntology":null},{"url":null,"slug":"codefuse-13b-a-pretrained-multi-lingual-code","title":"CodeFuse-13B: A Pretrained Multi-lingual Code Large Language Model","date":"2023-10-10","arxiv_id":"2310.06266","repositories_listed":0,"syntology":null},{"url":null,"slug":"dobby-a-conversational-service-robot-driven","title":"Dobby: A Conversational Service Robot Driven by GPT-4","date":"2023-10-10","arxiv_id":"2310.06303","repositories_listed":0,"syntology":null},{"url":null,"slug":"generating-and-evaluating-tests-for-k-12","title":"Generating and Evaluating Tests for K-12 Students with Language Model Simulations: A Case Study on Sentence Reading Efficiency","date":"2023-10-10","arxiv_id":"2310.06837","repositories_listed":0,"syntology":null},{"url":null,"slug":"get-the-gist-using-large-language-models-for","title":"Get the gist? Using large language models for few-shot decontextualization","date":"2023-10-10","arxiv_id":"2310.06254","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-meta-learning-perspective-on-transformers","title":"A Meta-Learning Perspective on Transformers for Causal Language Modeling","date":"2023-10-09","arxiv_id":"2310.05884","repositories_listed":0,"syntology":null},{"url":null,"slug":"ccae-a-corpus-of-chinese-based-asian","title":"CCAE: A Corpus of Chinese-based Asian Englishes","date":"2023-10-09","arxiv_id":"2310.05381","repositories_listed":0,"syntology":null},{"url":null,"slug":"estimating-numbers-without-regression","title":"Estimating Numbers without Regression","date":"2023-10-09","arxiv_id":"2310.06204","repositories_listed":0,"syntology":null},{"url":null,"slug":"factual-and-personalized-recommendations","title":"Factual and Personalized Recommendations using Language Models and Reinforcement Learning","date":"2023-10-09","arxiv_id":"2310.06176","repositories_listed":0,"syntology":null},{"url":null,"slug":"guiding-language-model-reasoning-with","title":"Guiding Language Model Reasoning with Planning Tokens","date":"2023-10-09","arxiv_id":"2310.05707","repositories_listed":0,"syntology":null},{"url":null,"slug":"rethinking-memory-and-communication-cost-for","title":"Rethinking Memory and Communication Cost for Efficient Large Language Model Training","date":"2023-10-09","arxiv_id":"2310.06003","repositories_listed":0,"syntology":null},{"url":null,"slug":"scaling-studies-for-efficient-parameter","title":"Scaling Studies for Efficient Parameter Search and Parallelism for Large Language Model Pre-training","date":"2023-10-09","arxiv_id":"2310.05350","repositories_listed":0,"syntology":null},{"url":null,"slug":"terminology-aware-translation-with","title":"Terminology-Aware Translation with Constrained Decoding and Large Language Model Prompting","date":"2023-10-09","arxiv_id":"2310.05824","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-importance-of-prompt-tuning-for-automated","title":"The Importance of Prompt Tuning for Automated Neuron Explanations","date":"2023-10-09","arxiv_id":"2310.06200","repositories_listed":0,"syntology":null},{"url":null,"slug":"transformers-and-large-language-models-for","title":"Transformers and Large Language Models for Chemistry and Drug Discovery","date":"2023-10-09","arxiv_id":"2310.06083","repositories_listed":0,"syntology":null},{"url":null,"slug":"breaking-down-word-semantics-from-pre-trained","title":"Breaking Down Word Semantics from Pre-trained Language Models through Layer-wise Dimension Selection","date":"2023-10-08","arxiv_id":"2310.05115","repositories_listed":0,"syntology":null},{"url":null,"slug":"chatradio-valuer-a-chat-large-language-model","title":"ChatRadio-Valuer: A Chat Large Language Model for Generalizable Radiology Report Generation Based on Multi-institution and Multi-system Data","date":"2023-10-08","arxiv_id":"2310.05242","repositories_listed":0,"syntology":null},{"url":null,"slug":"generative-spoken-language-model-based-on","title":"Generative Spoken Language Model based on continuous word-sized audio tokens","date":"2023-10-08","arxiv_id":"2310.05224","repositories_listed":0,"syntology":null},{"url":null,"slug":"loose-lips-sink-ships-mitigating-length-bias","title":"Loose lips sink ships: Mitigating Length Bias in Reinforcement Learning from Human Feedback","date":"2023-10-08","arxiv_id":"2310.05199","repositories_listed":0,"syntology":null},{"url":null,"slug":"mindfuldiary-harnessing-large-language-model","title":"MindfulDiary: Harnessing Large Language Model to Support Psychiatric Patients' Journaling","date":"2023-10-08","arxiv_id":"2310.05231","repositories_listed":0,"syntology":null},{"url":null,"slug":"optimizing-large-language-models-to-expedite","title":"Optimizing Large Language Models to Expedite the Development of Smart Contracts","date":"2023-10-08","arxiv_id":"2310.05178","repositories_listed":0,"syntology":null},{"url":null,"slug":"synslator-an-interactive-machine-translation","title":"Synslator: An Interactive Machine Translation Tool with Online Learning","date":"2023-10-08","arxiv_id":"2310.05025","repositories_listed":0,"syntology":null},{"url":null,"slug":"iluvui-instruction-tuned-language-vision","title":"ILuvUI: Instruction-tuned LangUage-Vision modeling of UIs from Machine Conversations","date":"2023-10-07","arxiv_id":"2310.04869","repositories_listed":0,"syntology":null},{"url":null,"slug":"prompt-to-os-p2os-revolutionizing-operating","title":"Prompt-to-OS (P2OS): Revolutionizing Operating Systems and Human-Computer Interaction with Integrated AI Generative Models","date":"2023-10-07","arxiv_id":"2310.04875","repositories_listed":0,"syntology":null},{"url":null,"slug":"question-focused-summarization-by-decomposing","title":"Question-focused Summarization by Decomposing Articles into Facts and Opinions and Retrieving Entities","date":"2023-10-07","arxiv_id":"2310.04880","repositories_listed":0,"syntology":null},{"url":null,"slug":"tree-gpt-modular-large-language-model-expert","title":"Tree-GPT: Modular Large Language Model Expert System for Forest Remote Sensing Image Understanding and Interactive Analysis","date":"2023-10-07","arxiv_id":"2310.04698","repositories_listed":0,"syntology":null},{"url":null,"slug":"brainscuba-fine-grained-natural-language","title":"BrainSCUBA: Fine-Grained Natural Language Captions of Visual Cortex Selectivity","date":"2023-10-06","arxiv_id":"2310.04420","repositories_listed":0,"syntology":null},{"url":null,"slug":"from-task-structures-to-world-models-what-do","title":"From task structures to world models: What do LLMs know?","date":"2023-10-06","arxiv_id":"2310.04276","repositories_listed":0,"syntology":null},{"url":null,"slug":"functional-interpolation-for-relative","title":"Functional Interpolation for Relative Positions Improves Long Context Transformers","date":"2023-10-06","arxiv_id":"2310.04418","repositories_listed":0,"syntology":null},{"url":null,"slug":"quantized-transformer-language-model","title":"Quantized Transformer Language Model Implementations on Edge Devices","date":"2023-10-06","arxiv_id":"2310.03971","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-5-utr-language-model-for-decoding","title":"A 5' UTR Language Model for Decoding Untranslated Regions of mRNA and Function Predictions","date":"2023-10-05","arxiv_id":"2310.03281","repositories_listed":0,"syntology":null},{"url":null,"slug":"controllable-multi-document-summarization","title":"Controllable Multi-document Summarization: Coverage & Coherence Intuitive Policy with Large Language Model Based Rewards","date":"2023-10-05","arxiv_id":"2310.03473","repositories_listed":0,"syntology":null},{"url":null,"slug":"deep-representations-of-first-person-pronouns","title":"Deep Representations of First-person Pronouns for Prediction of Depression Symptom Severity","date":"2023-10-05","arxiv_id":"2310.03232","repositories_listed":0,"syntology":null},{"url":null,"slug":"llm-based-multi-document-summarization","title":"LLM Based Multi-Document Summarization Exploiting Main-Event Biased Monotone Submodular Content Extraction","date":"2023-10-05","arxiv_id":"2310.03414","repositories_listed":0,"syntology":null},{"url":null,"slug":"neural-language-model-pruning-for-automatic","title":"Neural Language Model Pruning for Automatic Speech Recognition","date":"2023-10-05","arxiv_id":"2310.03424","repositories_listed":0,"syntology":null},{"url":null,"slug":"from-words-to-watts-benchmarking-the-energy","title":"From Words to Watts: Benchmarking the Energy Costs of Large Language Model Inference","date":"2023-10-04","arxiv_id":"2310.03003","repositories_listed":0,"syntology":null},{"url":null,"slug":"heterogeneous-federated-learning-using","title":"Heterogeneous Federated Learning Using Knowledge Codistillation","date":"2023-10-04","arxiv_id":"2310.02549","repositories_listed":0,"syntology":null}],"record_sha256":"b6e47be3761b1ef7548e45e9a9e534f2c15751c017db8e890a3aa49630cde674","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}