{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/language-modeling/papers/91","list_of":"/task/language-modeling","task":"Language Modeling","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":91,"pages_in_order":142,"rows_per_page":100,"rows":[9001,9100],"of":14182,"counts":{"archive_papers_tagged":14182,"with_a_code_link":5620,"where_syntology_ran_a_sample":1894,"not_listed_spam_title":0,"listed":14182,"listed_where_code_ran":1894,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":1580,"every_run_a_failure_of_syntologys_instrument":314,"listed_with_a_run_with_no_instrument_failure":1580,"listed_every_run_a_failure_of_syntologys_instrument":314,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/language-modeling","prev":"/task/language-modeling/papers/90","next":"/task/language-modeling/papers/92","papers":[{"url":null,"slug":"leveraging-large-language-model-as-simulated","title":"Leveraging Large Language Model as Simulated Patients for Clinical Education","date":"2024-04-13","arxiv_id":"2404.13066","repositories_listed":0,"syntology":null},{"url":null,"slug":"on-speculative-decoding-for-multimodal-large","title":"On Speculative Decoding for Multimodal Large Language Models","date":"2024-04-13","arxiv_id":"2404.08856","repositories_listed":0,"syntology":null},{"url":null,"slug":"cuda-accelerated-soft-robot-neural-evolution","title":"CUDA-Accelerated Soft Robot Neural Evolution with Large Language Model Supervision","date":"2024-04-12","arxiv_id":"2405.00698","repositories_listed":0,"syntology":null},{"url":null,"slug":"emerging-property-of-masked-token-for","title":"Emerging Property of Masked Token for Effective Pre-training","date":"2024-04-12","arxiv_id":"2404.08330","repositories_listed":0,"syntology":null},{"url":null,"slug":"evaluating-the-quality-of-answers-in","title":"Measuring the Quality of Answers in Political Q&As with Large Language Models","date":"2024-04-12","arxiv_id":"2404.08816","repositories_listed":0,"syntology":null},{"url":null,"slug":"language-model-prompt-selection-via","title":"Language Model Prompt Selection via Simulation Optimization","date":"2024-04-12","arxiv_id":"2404.08164","repositories_listed":0,"syntology":null},{"url":null,"slug":"thematic-analysis-with-large-language-models","title":"Thematic Analysis with Large Language Models: does it work with languages other than English? A targeted test in Italian","date":"2024-04-12","arxiv_id":"2404.08488","repositories_listed":0,"syntology":null},{"url":null,"slug":"toward-a-theory-of-tokenization-in-llms","title":"Toward a Theory of Tokenization in LLMs","date":"2024-04-12","arxiv_id":"2404.08335","repositories_listed":0,"syntology":null},{"url":null,"slug":"training-a-vision-language-model-as","title":"Training a Vision Language Model as Smartphone Assistant","date":"2024-04-12","arxiv_id":"2404.08755","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-multi-expert-large-language-model","title":"A Multi-Expert Large Language Model Architecture for Verilog Code Generation","date":"2024-04-11","arxiv_id":"2404.08029","repositories_listed":0,"syntology":null},{"url":null,"slug":"auctions-with-llm-summaries","title":"Auctions with LLM Summaries","date":"2024-04-11","arxiv_id":"2404.08126","repositories_listed":0,"syntology":null},{"url":null,"slug":"audio-dialogues-dialogues-dataset-for-audio","title":"Audio Dialogues: Dialogues dataset for audio and music understanding","date":"2024-04-11","arxiv_id":"2404.07616","repositories_listed":0,"syntology":null},{"url":null,"slug":"data-driven-portfolio-management-for-motion","title":"Data-Driven Portfolio Management for Motion Pictures Industry: A New Data-Driven Optimization Methodology Using a Large Language Model as the Expert","date":"2024-04-11","arxiv_id":"2404.07434","repositories_listed":0,"syntology":null},{"url":null,"slug":"introducing-l2m3-a-multilingual-medical-large","title":"Introducing L2M3, A Multilingual Medical Large Language Model to Advance Health Equity in Low-Resource Regions","date":"2024-04-11","arxiv_id":"2404.08705","repositories_listed":0,"syntology":null},{"url":null,"slug":"on-unified-prompt-tuning-for-request-quality","title":"On Unified Prompt Tuning for Request Quality Assurance in Public Code Review","date":"2024-04-11","arxiv_id":"2404.07942","repositories_listed":0,"syntology":null},{"url":null,"slug":"researchagent-iterative-research-idea","title":"ResearchAgent: Iterative Research Idea Generation over Scientific Literature with Large Language Models","date":"2024-04-11","arxiv_id":"2404.07738","repositories_listed":0,"syntology":null},{"url":null,"slug":"risklabs-predicting-financial-risk-using","title":"RiskLabs: Predicting Financial Risk Using Large Language Model based on Multimodal and Multi-Sources Data","date":"2024-04-11","arxiv_id":"2404.07452","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-future-of-scientific-publishing-automated","title":"The Future of Scientific Publishing: Automated Article Generation","date":"2024-04-11","arxiv_id":"2404.17586","repositories_listed":0,"syntology":null},{"url":null,"slug":"why-do-small-language-models-underperform","title":"Why do small language models underperform? Studying Language Model Saturation via the Softmax Bottleneck","date":"2024-04-11","arxiv_id":"2404.07647","repositories_listed":0,"syntology":null},{"url":null,"slug":"accuracy-of-a-large-language-model-in","title":"Accuracy of a Large Language Model in Distinguishing Anti- And Pro-vaccination Messages on Social Media: The Case of Human Papillomavirus Vaccination","date":"2024-04-10","arxiv_id":"2404.06731","repositories_listed":0,"syntology":null},{"url":null,"slug":"frontier-ai-ethics-anticipating-and","title":"Frontier AI Ethics: Anticipating and Evaluating the Societal Impacts of Language Model Agents","date":"2024-04-10","arxiv_id":"2404.06750","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-language-model-reasoning-with-self","title":"Improving Language Model Reasoning with Self-motivated Learning","date":"2024-04-10","arxiv_id":"2404.07017","repositories_listed":0,"syntology":null},{"url":null,"slug":"medrg-medical-report-grounding-with-multi","title":"MedRG: Medical Report Grounding with Multi-modal Large Language Model","date":"2024-04-10","arxiv_id":"2404.06798","repositories_listed":0,"syntology":null},{"url":null,"slug":"toward-cross-layer-energy-optimizations-in","title":"Toward Cross-Layer Energy Optimizations in AI Systems","date":"2024-04-10","arxiv_id":"2404.06675","repositories_listed":0,"syntology":null},{"url":null,"slug":"agentscodriver-large-language-model-empowered","title":"AgentsCoDriver: Large Language Model Empowered Collaborative Driving with Lifelong Learning","date":"2024-04-09","arxiv_id":"2404.06345","repositories_listed":0,"syntology":null},{"url":null,"slug":"less-is-more-for-improving-automatic","title":"Less is More for Improving Automatic Evaluation of Factual Consistency","date":"2024-04-09","arxiv_id":"2404.06579","repositories_listed":0,"syntology":null},{"url":null,"slug":"prompt-driven-universal-model-for-view","title":"Prompt-driven Universal Model for View-Agnostic Echocardiography Analysis","date":"2024-04-09","arxiv_id":"2404.05916","repositories_listed":0,"syntology":null},{"url":null,"slug":"automating-research-synthesis-with-domain","title":"Automating Research Synthesis with Domain-Specific Large Language Model Fine-Tuning","date":"2024-04-08","arxiv_id":"2404.08680","repositories_listed":0,"syntology":null},{"url":null,"slug":"dlora-distributed-parameter-efficient-fine","title":"DLoRA: Distributed Parameter-Efficient Fine-Tuning Solution for Large Language Model","date":"2024-04-08","arxiv_id":"2404.05182","repositories_listed":0,"syntology":null},{"url":null,"slug":"llm-augmented-retrieval-enhancing-retrieval","title":"LLM-Augmented Retrieval: Enhancing Retrieval Models Through Language Models and Doc-Level Embedding","date":"2024-04-08","arxiv_id":"2404.05825","repositories_listed":0,"syntology":null},{"url":null,"slug":"ltner-large-language-model-tagging-for-named","title":"LTNER: Large Language Model Tagging for Named Entity Recognition with Contextualized Entity Marking","date":"2024-04-08","arxiv_id":"2404.05624","repositories_listed":0,"syntology":null},{"url":null,"slug":"opsd-an-offensive-persian-social-media","title":"OPSD: an Offensive Persian Social media Dataset and its baseline evaluations","date":"2024-04-08","arxiv_id":"2404.05540","repositories_listed":0,"syntology":null},{"url":null,"slug":"plug-and-play-with-prompts-a-prompt-tuning","title":"Plug and Play with Prompts: A Prompt Tuning Approach for Controlling Text Generation","date":"2024-04-08","arxiv_id":"2404.05143","repositories_listed":0,"syntology":null},{"url":null,"slug":"progressive-alignment-with-vlm-llm-feature-to","title":"Progressive Alignment with VLM-LLM Feature to Augment Defect Classification for the ASE Dataset","date":"2024-04-08","arxiv_id":"2404.05183","repositories_listed":0,"syntology":null},{"url":null,"slug":"synergy-of-large-language-model-and-model","title":"Synergy of Large Language Model and Model Driven Engineering for Automated Development of Centralized Vehicular Systems","date":"2024-04-08","arxiv_id":"2404.05508","repositories_listed":0,"syntology":null},{"url":null,"slug":"unbridled-icarus-a-survey-of-the-potential","title":"Unbridled Icarus: A Survey of the Potential Perils of Image Inputs in Multimodal Large Language Model Security","date":"2024-04-08","arxiv_id":"2404.05264","repositories_listed":0,"syntology":null},{"url":null,"slug":"genearl-a-training-free-generative-framework","title":"GenEARL: A Training-Free Generative Framework for Multimodal Event Argument Role Labeling","date":"2024-04-07","arxiv_id":"2404.04763","repositories_listed":0,"syntology":null},{"url":null,"slug":"hidden-you-malicious-goal-into-benigh","title":"Hidden You Malicious Goal Into Benign Narratives: Jailbreak Large Language Models through Logic Chain Injection","date":"2024-04-07","arxiv_id":"2404.04849","repositories_listed":0,"syntology":null},{"url":null,"slug":"how-bad-is-training-on-synthetic-data-a","title":"How Bad is Training on Synthetic Data? A Statistical Analysis of Language Model Collapse","date":"2024-04-07","arxiv_id":"2404.05090","repositories_listed":0,"syntology":null},{"url":null,"slug":"lucky-52-how-many-languages-are-needed-to","title":"How Many Languages Make Good Multilingual Instruction Tuning? A Case Study on BLOOM","date":"2024-04-07","arxiv_id":"2404.04850","repositories_listed":0,"syntology":null},{"url":null,"slug":"multilingual-large-language-model-a-survey-of","title":"Multilingual Large Language Model: A Survey of Resources, Taxonomy and Frontiers","date":"2024-04-07","arxiv_id":"2404.04925","repositories_listed":0,"syntology":null},{"url":null,"slug":"silversight-a-multi-task-chinese-financial","title":"SilverSight: A Multi-Task Chinese Financial Large Language Model Based on Adaptive Semantic Space Learning","date":"2024-04-07","arxiv_id":"2404.04949","repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-understanding-the-influence-of-reward","title":"Towards Understanding the Influence of Reward Margin on Preference Model Performance","date":"2024-04-07","arxiv_id":"2404.04932","repositories_listed":0,"syntology":null},{"url":null,"slug":"x-vars-introducing-explainability-in-football","title":"X-VARS: Introducing Explainability in Football Refereeing with Multi-Modal Large Language Model","date":"2024-04-07","arxiv_id":"2404.06332","repositories_listed":0,"syntology":null},{"url":null,"slug":"your-finetuned-large-language-model-is","title":"Your Finetuned Large Language Model is Already a Powerful Out-of-distribution Detector","date":"2024-04-07","arxiv_id":"2404.08679","repositories_listed":0,"syntology":null},{"url":null,"slug":"binary-classifier-optimization-for-large","title":"Binary Classifier Optimization for Large Language Model Alignment","date":"2024-04-06","arxiv_id":"2404.04656","repositories_listed":0,"syntology":null},{"url":null,"slug":"large-language-model-llm-ai-text-generation","title":"Large Language Model (LLM) AI text generation detection based on transformer deep learning algorithm","date":"2024-04-06","arxiv_id":"2405.06652","repositories_listed":0,"syntology":null},{"url":null,"slug":"what-happens-when-small-is-made-smaller","title":"What Happens When Small Is Made Smaller? Exploring the Impact of Compression on Small Data Pretrained Language Models","date":"2024-04-06","arxiv_id":"2404.04759","repositories_listed":0,"syntology":null},{"url":null,"slug":"chinese-tiny-llm-pretraining-a-chinese","title":"Chinese Tiny LLM: Pretraining a Chinese-Centric Large Language Model","date":"2024-04-05","arxiv_id":"2404.04167","repositories_listed":0,"syntology":null},{"url":null,"slug":"data-augmentation-with-in-context-learning","title":"Data Augmentation with In-Context Learning and Comparative Evaluation in Math Word Problem Solving","date":"2024-04-05","arxiv_id":"2404.03938","repositories_listed":0,"syntology":null},{"url":null,"slug":"implicit-bias-of-adamw-ell-infty-norm","title":"Implicit Bias of AdamW: $\\ell_\\infty$ Norm Constrained Optimization","date":"2024-04-05","arxiv_id":"2404.04454","repositories_listed":0,"syntology":null},{"url":null,"slug":"player2vec-a-language-modeling-approach-to","title":"player2vec: A Language Modeling Approach to Understand Player Behavior in Games","date":"2024-04-05","arxiv_id":"2404.04234","repositories_listed":0,"syntology":null},{"url":null,"slug":"can-small-language-models-help-large-language","title":"Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought","date":"2024-04-04","arxiv_id":"2404.03414","repositories_listed":0,"syntology":null},{"url":null,"slug":"ow-viscap-open-world-video-instance","title":"OW-VISCapTor: Abstractors for Open-World Video Instance Segmentation and Captioning","date":"2024-04-04","arxiv_id":"2404.03657","repositories_listed":0,"syntology":null},{"url":null,"slug":"rall-e-robust-codec-language-modeling-with","title":"RALL-E: Robust Codec Language Modeling with Chain-of-Thought Prompting for Text-to-Speech Synthesis","date":"2024-04-04","arxiv_id":"2404.03204","repositories_listed":0,"syntology":null},{"url":null,"slug":"semgrasp-semantic-grasp-generation-via","title":"SemGrasp: Semantic Grasp Generation via Language Aligned Discretization","date":"2024-04-04","arxiv_id":"2404.03590","repositories_listed":0,"syntology":null},{"url":null,"slug":"standardizing-knowledge-engineering-practices","title":"Standardizing Knowledge Engineering Practices with a Reference Architecture","date":"2024-04-04","arxiv_id":"2404.03624","repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-pareto-optimal-throughput-in-small","title":"Towards Pareto Optimal Throughput in Small Language Model Serving","date":"2024-04-04","arxiv_id":"2404.03353","repositories_listed":0,"syntology":null},{"url":null,"slug":"calibrating-the-confidence-of-large-language","title":"Calibrating the Confidence of Large Language Models by Eliciting Fidelity","date":"2024-04-03","arxiv_id":"2404.02655","repositories_listed":0,"syntology":null},{"url":null,"slug":"clam-tts-improving-neural-codec-language","title":"CLaM-TTS: Improving Neural Codec Language Model for Zero-Shot Text-to-Speech","date":"2024-04-03","arxiv_id":"2404.02781","repositories_listed":0,"syntology":null},{"url":null,"slug":"construction-of-functional-materials","title":"Construction and Application of Materials Knowledge Graph in Multidisciplinary Materials Science via Large Language Model","date":"2024-04-03","arxiv_id":"2404.03080","repositories_listed":0,"syntology":null},{"url":null,"slug":"cross-architecture-transfer-learning-for","title":"Cross-Architecture Transfer Learning for Linear-Cost Inference Transformers","date":"2024-04-03","arxiv_id":"2404.02684","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-human-computer-interaction-in-chest","title":"Enhancing Human-Computer Interaction in Chest X-ray Analysis using Vision and Language Model with Eye Gaze Patterns","date":"2024-04-03","arxiv_id":"2404.02370","repositories_listed":0,"syntology":null},{"url":null,"slug":"from-narratives-to-numbers-valid-inference","title":"From Narratives to Numbers: Valid Inference Using Language Model Predictions from Verbal Autopsy Narratives","date":"2024-04-03","arxiv_id":"2404.02438","repositories_listed":0,"syntology":null},{"url":null,"slug":"i-design-personalized-llm-interior-designer","title":"I-Design: Personalized LLM Interior Designer","date":"2024-04-03","arxiv_id":"2404.02838","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-topic-relevance-model-by-mix","title":"Improving Topic Relevance Model by Mix-structured Summarization and LLM-based Data Augmentation","date":"2024-04-03","arxiv_id":"2404.02616","repositories_listed":0,"syntology":null},{"url":null,"slug":"mai-ho-omauna-i-ka-ai-language-models-improve","title":"Mai Ho'omāuna i ka 'Ai: Language Models Improve Automatic Speech Recognition in Hawaiian","date":"2024-04-03","arxiv_id":"2404.03073","repositories_listed":0,"syntology":null},{"url":null,"slug":"phonologybench-evaluating-phonological-skills","title":"PhonologyBench: Evaluating Phonological Skills of Large Language Models","date":"2024-04-03","arxiv_id":"2404.02456","repositories_listed":0,"syntology":null},{"url":null,"slug":"retrieving-examples-from-memory-for-retrieval","title":"Retrieving Examples from Memory for Retrieval Augmented Neural Machine Translation: A Systematic Comparison","date":"2024-04-03","arxiv_id":"2404.02835","repositories_listed":0,"syntology":null},{"url":null,"slug":"testing-the-effect-of-code-documentation-on","title":"Testing the Effect of Code Documentation on Large Language Model Code Understanding","date":"2024-04-03","arxiv_id":"2404.03114","repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-large-language-model-driven-reference","title":"Towards Large Language Model driven Reference-less Translation Evaluation for English and Indian Languages","date":"2024-04-03","arxiv_id":"2404.02512","repositories_listed":0,"syntology":null},{"url":null,"slug":"vocabulary-attack-to-hijack-large-language","title":"Vocabulary Attack to Hijack Large Language Model Applications","date":"2024-04-03","arxiv_id":"2404.02637","repositories_listed":0,"syntology":null},{"url":null,"slug":"asymptotics-of-language-model-alignment","title":"Asymptotics of Language Model Alignment","date":"2024-04-02","arxiv_id":"2404.01730","repositories_listed":0,"syntology":null},{"url":null,"slug":"automated-user-story-generation-with-test","title":"Automated User Story Generation with Test Case Specification Using Large Language Model","date":"2024-04-02","arxiv_id":"2404.01558","repositories_listed":0,"syntology":null},{"url":null,"slug":"constrained-robotic-navigation-on-preferred","title":"Constrained Robotic Navigation on Preferred Terrains Using LLMs and Speech Instruction: Exploiting the Power of Adverbs","date":"2024-04-02","arxiv_id":"2404.02294","repositories_listed":0,"syntology":null},{"url":null,"slug":"effective-internal-language-model-training","title":"Effective internal language model training and fusion for factorized transducer model","date":"2024-04-02","arxiv_id":"2404.01716","repositories_listed":0,"syntology":null},{"url":null,"slug":"indoculture-exploring-geographically","title":"IndoCulture: Exploring Geographically-Influenced Cultural Commonsense Reasoning Across Eleven Indonesian Provinces","date":"2024-04-02","arxiv_id":"2404.01854","repositories_listed":0,"syntology":null},{"url":null,"slug":"mchartqa-a-universal-benchmark-for-multimodal","title":"mChartQA: A universal benchmark for multimodal Chart Question Answer based on Vision-Language Alignment and Reasoning","date":"2024-04-02","arxiv_id":"2404.01548","repositories_listed":0,"syntology":null},{"url":null,"slug":"octopus-on-device-language-model-for-function","title":"Octopus: On-device language model for function calling of software APIs","date":"2024-04-02","arxiv_id":"2404.01549","repositories_listed":0,"syntology":null},{"url":null,"slug":"octopus-v2-on-device-language-model-for-super","title":"Octopus v2: On-device language model for super agent","date":"2024-04-02","arxiv_id":"2404.01744","repositories_listed":0,"syntology":null},{"url":null,"slug":"topic-based-watermarks-for-llm-generated-text","title":"Topic-Based Watermarks for Large Language Models","date":"2024-04-02","arxiv_id":"2404.02138","repositories_listed":0,"syntology":null},{"url":null,"slug":"aispace-at-semeval-2024-task-8-a-class","title":"AISPACE at SemEval-2024 task 8: A Class-balanced Soft-voting System for Detecting Multi-generator Machine-generated Text","date":"2024-04-01","arxiv_id":"2404.00950","repositories_listed":0,"syntology":null},{"url":null,"slug":"effectively-prompting-small-sized-language","title":"Effectively Prompting Small-sized Language Models for Cross-lingual Tasks via Winning Tickets","date":"2024-04-01","arxiv_id":"2404.01242","repositories_listed":0,"syntology":null},{"url":null,"slug":"green-ai-exploring-carbon-footprints","title":"Green AI: Exploring Carbon Footprints, Mitigation Strategies, and Trade Offs in Large Language Model Training","date":"2024-04-01","arxiv_id":"2404.01157","repositories_listed":0,"syntology":null},{"url":null,"slug":"syncmask-synchronized-attentional-masking-for","title":"SyncMask: Synchronized Attentional Masking for Fashion-centric Vision-Language Pretraining","date":"2024-04-01","arxiv_id":"2404.01156","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-fine-line-navigating-large-language-model","title":"The Fine Line: Navigating Large Language Model Pretraining with Down-streaming Capability Analysis","date":"2024-04-01","arxiv_id":"2404.01204","repositories_listed":0,"syntology":null},{"url":null,"slug":"twin-gpt-digital-twins-for-clinical-trials","title":"TWIN-GPT: Digital Twins for Clinical Trials via Large Language Model","date":"2024-04-01","arxiv_id":"2404.01273","repositories_listed":0,"syntology":null},{"url":"/paper/llms-are-good-action-recognizers","slug":"llms-are-good-action-recognizers","title":"LLMs are Good Action Recognizers","date":"2024-03-31","arxiv_id":"2404.00532","repositories_listed":0,"syntology":null},{"url":null,"slug":"training-free-semantic-segmentation-via-llm","title":"Training-Free Semantic Segmentation via LLM-Supervision","date":"2024-03-31","arxiv_id":"2404.00701","repositories_listed":0,"syntology":null},{"url":null,"slug":"controllable-and-diverse-data-augmentation","title":"Controllable and Diverse Data Augmentation with Large Language Model for Low-Resource Open-Domain Dialogue Generation","date":"2024-03-30","arxiv_id":"2404.00361","repositories_listed":0,"syntology":null},{"url":null,"slug":"numerologic-number-encoding-for-enhanced-llms","title":"NumeroLogic: Number Encoding for Enhanced LLMs' Numerical Reasoning","date":"2024-03-30","arxiv_id":"2404.00459","repositories_listed":0,"syntology":null},{"url":null,"slug":"survey-on-large-language-model-enhanced","title":"Survey on Large Language Model-Enhanced Reinforcement Learning: Concept, Taxonomy, and Methods","date":"2024-03-30","arxiv_id":"2404.00282","repositories_listed":0,"syntology":null},{"url":null,"slug":"zero-shot-safety-prediction-for-autonomous","title":"Zero-shot Safety Prediction for Autonomous Robots with Foundation World Models","date":"2024-03-30","arxiv_id":"2404.00462","repositories_listed":0,"syntology":null},{"url":null,"slug":"fsmr-a-feature-swapping-multi-modal-reasoning","title":"FSMR: A Feature Swapping Multi-modal Reasoning Approach with Joint Textual and Visual Clues","date":"2024-03-29","arxiv_id":"2403.20026","repositories_listed":0,"syntology":null},{"url":null,"slug":"gpta-generative-prompt-tuning-assistant-for","title":"GPTA: Generative Prompt Tuning Assistant for Synergistic Downstream Neural Network Enhancement with LLMs","date":"2024-03-29","arxiv_id":"2404.00189","repositories_listed":0,"syntology":null},{"url":null,"slug":"large-language-model-based-situational","title":"Large Language Model based Situational Dialogues for Second Language Learning","date":"2024-03-29","arxiv_id":"2403.20005","repositories_listed":0,"syntology":null},{"url":null,"slug":"purple-making-a-large-language-model-a-better","title":"PURPLE: Making a Large Language Model a Better SQL Writer","date":"2024-03-29","arxiv_id":"2403.20014","repositories_listed":0,"syntology":null},{"url":null,"slug":"realm-reference-resolution-as-language","title":"ReALM: Reference Resolution As Language Modeling","date":"2024-03-29","arxiv_id":"2403.20329","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-future-of-combating-rumors-retrieval","title":"The Future of Combating Rumors? Retrieval, Discrimination, and Generation","date":"2024-03-29","arxiv_id":"2403.20204","repositories_listed":0,"syntology":null},{"url":null,"slug":"using-llms-to-model-the-beliefs-and","title":"Using LLMs to Model the Beliefs and Preferences of Targeted Populations","date":"2024-03-29","arxiv_id":"2403.20252","repositories_listed":0,"syntology":null}],"record_sha256":"3f5ef7ff18e3972dd4cd85de80f46fff54990e326e1964c753324b25bb2b7f9f","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}