{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/language-modeling/papers/84","list_of":"/task/language-modeling","task":"Language Modeling","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":84,"pages_in_order":142,"rows_per_page":100,"rows":[8301,8400],"of":14182,"counts":{"archive_papers_tagged":14182,"with_a_code_link":5620,"where_syntology_ran_a_sample":1894,"not_listed_spam_title":0,"listed":14182,"listed_where_code_ran":1894,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":1580,"every_run_a_failure_of_syntologys_instrument":314,"listed_with_a_run_with_no_instrument_failure":1580,"listed_every_run_a_failure_of_syntologys_instrument":314,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/language-modeling","prev":"/task/language-modeling/papers/83","next":"/task/language-modeling/papers/85","papers":[{"url":null,"slug":"j-chat-japanese-large-scale-spoken-dialogue","title":"J-CHAT: Japanese Large-scale Spoken Dialogue Corpus for Spoken Dialogue Language Modeling","date":"2024-07-22","arxiv_id":"2407.15828","repositories_listed":0,"syntology":null},{"url":null,"slug":"llmexplainer-large-language-model-based","title":"LLMExplainer: Large Language Model based Bayesian Inference for Graph Explanation Generation","date":"2024-07-22","arxiv_id":"2407.15351","repositories_listed":0,"syntology":null},{"url":null,"slug":"pre-training-and-prompting-for-few-shot-node","title":"Pre-Training and Prompting for Few-Shot Node Classification on Text-Attributed Graphs","date":"2024-07-22","arxiv_id":"2407.15431","repositories_listed":0,"syntology":null},{"url":null,"slug":"sam2clip2sam-vision-language-model-for","title":"SAM2CLIP2SAM: Vision Language Model for Segmentation of 3D CT Scans for Covid-19 Detection","date":"2024-07-22","arxiv_id":"2407.15728","repositories_listed":0,"syntology":null},{"url":null,"slug":"socialquotes-learning-contextual-roles-of","title":"SocialQuotes: Learning Contextual Roles of Social Media Quotes on the Web","date":"2024-07-22","arxiv_id":"2407.16007","repositories_listed":0,"syntology":null},{"url":null,"slug":"text-to-battery-recipe-a-language-modeling","title":"Text-to-Battery Recipe: A language modeling-based protocol for automatic battery recipe extraction and retrieval","date":"2024-07-22","arxiv_id":"2407.15459","repositories_listed":0,"syntology":null},{"url":null,"slug":"evidence-based-temporal-fact-verification","title":"Evidence-Based Temporal Fact Verification","date":"2024-07-21","arxiv_id":"2407.15291","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-to-compile-programs-to-neural","title":"Learning to Compile Programs to Neural Networks","date":"2024-07-21","arxiv_id":"2407.15078","repositories_listed":0,"syntology":null},{"url":null,"slug":"relational-database-augmented-large-language","title":"Relational Database Augmented Large Language Model","date":"2024-07-21","arxiv_id":"2407.15071","repositories_listed":0,"syntology":null},{"url":null,"slug":"can-vlms-be-used-on-videos-for-action","title":"Can VLMs be used on videos for action recognition? LLMs are Visual Reasoning Coordinators","date":"2024-07-20","arxiv_id":"2407.14834","repositories_listed":0,"syntology":null},{"url":null,"slug":"falcon2-11b-technical-report","title":"Falcon2-11B Technical Report","date":"2024-07-20","arxiv_id":"2407.14885","repositories_listed":0,"syntology":null},{"url":null,"slug":"seal-advancing-speech-language-models-to-be","title":"Seal: Advancing Speech Language Models to be Few-Shot Learners","date":"2024-07-20","arxiv_id":"2407.14875","repositories_listed":0,"syntology":null},{"url":null,"slug":"contrastive-learning-with-counterfactual","title":"Contrastive Learning with Counterfactual Explanations for Radiology Report Generation","date":"2024-07-19","arxiv_id":"2407.14474","repositories_listed":0,"syntology":null},{"url":null,"slug":"cve-llm-automatic-vulnerability-evaluation-in","title":"CVE-LLM : Automatic vulnerability evaluation in medical device industry using large language models","date":"2024-07-19","arxiv_id":"2407.14640","repositories_listed":0,"syntology":null},{"url":null,"slug":"evlm-an-efficient-vision-language-model-for","title":"EVLM: An Efficient Vision-Language Model for Visual Understanding","date":"2024-07-19","arxiv_id":"2407.14177","repositories_listed":0,"syntology":null},{"url":null,"slug":"generative-language-model-for-catalyst","title":"Generative Language Model for Catalyst Discovery","date":"2024-07-19","arxiv_id":"2407.14040","repositories_listed":0,"syntology":null},{"url":null,"slug":"lamagic-language-model-based-topology","title":"LaMAGIC: Language-Model-based Topology Generation for Analog Integrated Circuits","date":"2024-07-19","arxiv_id":"2407.18269","repositories_listed":0,"syntology":null},{"url":null,"slug":"lapis-language-model-augmented-police","title":"LAPIS: Language Model-Augmented Police Investigation System","date":"2024-07-19","arxiv_id":"2407.20248","repositories_listed":0,"syntology":null},{"url":null,"slug":"large-language-model-enabled-semantic","title":"Large Language Model Enabled Semantic Communication Systems","date":"2024-07-19","arxiv_id":"2407.14112","repositories_listed":0,"syntology":null},{"url":null,"slug":"performance-modeling-and-workload-analysis-of","title":"Performance Modeling and Workload Analysis of Distributed Large Language Model Training and Inference","date":"2024-07-19","arxiv_id":"2407.14645","repositories_listed":0,"syntology":null},{"url":null,"slug":"2408-00004","title":"Handling Numeric Expressions in Automatic Speech Recognition","date":"2024-07-18","arxiv_id":"2408.00004","repositories_listed":0,"syntology":null},{"url":null,"slug":"affordance-perception-by-a-knowledge-guided","title":"Affordance Perception by a Knowledge-Guided Vision-Language Model with Efficient Error Correction","date":"2024-07-18","arxiv_id":"2407.13368","repositories_listed":0,"syntology":null},{"url":null,"slug":"attention-overflow-language-model-input-blur","title":"Attention Overflow: Language Model Input Blur during Long-Context Missing Items Recommendation","date":"2024-07-18","arxiv_id":"2407.13481","repositories_listed":0,"syntology":null},{"url":null,"slug":"combining-constraint-programming-reasoning","title":"Combining Constraint Programming Reasoning with Large Language Model Predictions","date":"2024-07-18","arxiv_id":"2407.13490","repositories_listed":0,"syntology":null},{"url":null,"slug":"correcting-the-mythos-of-kl-regularization","title":"Correcting the Mythos of KL-Regularization: Direct Alignment without Overoptimization via Chi-Squared Preference Optimization","date":"2024-07-18","arxiv_id":"2407.13399","repositories_listed":0,"syntology":null},{"url":null,"slug":"fantastic-sequences-and-where-to-find-them","title":"FANTAstic SEquences and Where to Find Them: Faithful and Efficient API Call Generation through State-tracked Constrained Decoding and Reranking","date":"2024-07-18","arxiv_id":"2407.13945","repositories_listed":0,"syntology":null},{"url":"/paper/fulg-150b-romanian-corpus-for-language-model","slug":"fulg-150b-romanian-corpus-for-language-model","title":"FuLG: 150B Romanian Corpus for Language Model Pretraining","date":"2024-07-18","arxiv_id":"2407.13657","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-visual-grounding-from-generative","title":"Learning Visual Grounding from Generative Vision and Language Model","date":"2024-07-18","arxiv_id":"2407.14563","repositories_listed":0,"syntology":null},{"url":null,"slug":"phi-3-safety-post-training-aligning-language","title":"Phi-3 Safety Post-Training: Aligning Language Models with a \"Break-Fix\" Cycle","date":"2024-07-18","arxiv_id":"2407.13833","repositories_listed":0,"syntology":null},{"url":null,"slug":"research-on-tibetan-tourism-viewpoints","title":"Research on Tibetan Tourism Viewpoints information generation system based on LLM","date":"2024-07-18","arxiv_id":"2407.13561","repositories_listed":0,"syntology":null},{"url":null,"slug":"segpoint-segment-any-point-cloud-via-large","title":"SegPoint: Segment Any Point Cloud via Large Language Model","date":"2024-07-18","arxiv_id":"2407.13761","repositories_listed":0,"syntology":null},{"url":null,"slug":"spontaneous-style-text-to-speech-synthesis","title":"Spontaneous Style Text-to-Speech Synthesis with Controllable Spontaneous Behaviors Based on Language Models","date":"2024-07-18","arxiv_id":"2407.13509","repositories_listed":0,"syntology":null},{"url":null,"slug":"transformer-based-single-cell-language-model","title":"Transformer-based Single-Cell Language Model: A Survey","date":"2024-07-18","arxiv_id":"2407.13205","repositories_listed":0,"syntology":null},{"url":null,"slug":"trialenroll-predicting-clinical-trial","title":"TrialEnroll: Predicting Clinical Trial Enrollment Success with Deep & Cross Network and Large Language Models","date":"2024-07-18","arxiv_id":"2407.13115","repositories_listed":0,"syntology":null},{"url":null,"slug":"llm-inference-serving-survey-of-recent","title":"LLM Inference Serving: Survey of Recent Advances and Opportunities","date":"2024-07-17","arxiv_id":"2407.12391","repositories_listed":0,"syntology":null},{"url":null,"slug":"pretraining-data-and-tokenizer-for-indic-llm","title":"Krutrim LLM: A Novel Tokenization Strategy for Multilingual Indic Languages with Petabyte-Scale Data Processing","date":"2024-07-17","arxiv_id":"2407.12481","repositories_listed":0,"syntology":null},{"url":null,"slug":"r-x-retrieval-and-execution-from-everyday","title":"R+X: Retrieval and Execution from Everyday Human Videos","date":"2024-07-17","arxiv_id":"2407.12957","repositories_listed":0,"syntology":null},{"url":null,"slug":"retrieval-enhanced-machine-learning-synthesis","title":"Retrieval-Enhanced Machine Learning: Synthesis and Opportunities","date":"2024-07-17","arxiv_id":"2407.12982","repositories_listed":0,"syntology":null},{"url":null,"slug":"visiontrap-vision-augmented-trajectory","title":"VisionTrap: Vision-Augmented Trajectory Prediction Guided by Textual Descriptions","date":"2024-07-17","arxiv_id":"2407.12345","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-language-modeling-approach-to-diacritic","title":"A Language Modeling Approach to Diacritic-Free Hebrew TTS","date":"2024-07-16","arxiv_id":"2407.12206","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-pilot-study-of-gslm-based-simulation-of","title":"A Pilot Study of GSLM-based Simulation of Foreign Accentuation Only Using Native Speech Corpora","date":"2024-07-16","arxiv_id":"2407.11370","repositories_listed":0,"syntology":null},{"url":null,"slug":"badrobot-jailbreaking-llm-based-embodied-ai","title":"BadRobot: Jailbreaking Embodied LLMs in the Physical World","date":"2024-07-16","arxiv_id":"2407.20242","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-foundations-of-tokenization-statistical","title":"The Foundations of Tokenization: Statistical and Computational Concerns","date":"2024-07-16","arxiv_id":"2407.11606","repositories_listed":0,"syntology":null},{"url":null,"slug":"biasscanner-automatic-detection-and","title":"BiasScanner: Automatic Detection and Classification of News Bias to Strengthen Democracy","date":"2024-07-15","arxiv_id":"2407.10829","repositories_listed":0,"syntology":null},{"url":null,"slug":"building-intelligence-identification-system","title":"Building Intelligence Identification System via Large Language Model Watermarking: A Survey and Beyond","date":"2024-07-15","arxiv_id":"2407.11100","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-medication-recommendation-with-llm","title":"Enhancing Medication Recommendation with LLM Text Representation","date":"2024-07-15","arxiv_id":"2407.10453","repositories_listed":0,"syntology":null},{"url":null,"slug":"fine-tuning-and-prompt-optimization-two-great","title":"Fine-Tuning and Prompt Optimization: Two Great Steps that Work Better Together","date":"2024-07-15","arxiv_id":"2407.10930","repositories_listed":0,"syntology":null},{"url":null,"slug":"grapheval-a-knowledge-graph-based-llm","title":"GraphEval: A Knowledge-Graph Based LLM Hallucination Evaluation Framework","date":"2024-07-15","arxiv_id":"2407.10793","repositories_listed":0,"syntology":null},{"url":null,"slug":"large-language-model-based-fmri-encoding-of","title":"Large Language Model-based FMRI Encoding of Language Functions for Subjects with Neurocognitive Disorder","date":"2024-07-15","arxiv_id":"2407.10376","repositories_listed":0,"syntology":null},{"url":null,"slug":"mmm-multilingual-mutual-reinforcement-effect","title":"MMM: Multilingual Mutual Reinforcement Effect Mix Datasets & Test with Open-domain Information Extraction Large Language Models","date":"2024-07-15","arxiv_id":"2407.10953","repositories_listed":0,"syntology":null},{"url":null,"slug":"key-point-driven-mathematical-reasoning","title":"Key-Point-Driven Mathematical Reasoning Distillation of Large Language Model","date":"2024-07-14","arxiv_id":"2407.10167","repositories_listed":0,"syntology":null},{"url":null,"slug":"lean-star-learning-to-interleave-thinking-and","title":"Lean-STaR: Learning to Interleave Thinking and Proving","date":"2024-07-14","arxiv_id":"2407.10040","repositories_listed":0,"syntology":null},{"url":"/paper/leanquant-accurate-large-language-model","slug":"leanquant-accurate-large-language-model","title":"LeanQuant: Accurate Large Language Model Quantization with Loss-Error-Aware Grid","date":"2024-07-14","arxiv_id":"2407.10032","repositories_listed":0,"syntology":{"n":7,"n_ran":3,"n_constructed":0,"n_ran_checked":1,"n_instrument":2,"n_unverified":4,"n_honours":0,"n_violates":0,"n_no_contract":1,"n_pointer_only":7,"phrase":"3 ran (of which 0 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 2 where Syntology's instrument failed) · 4 unverified","sample_list":"/paper/leanquant-accurate-large-language-model#ran","syntology_url":"https://syntology.ai/paper/2407.10032","mcp":{"get_harvested_code_for_paper":{"arxiv_id":"2407.10032"}},"official":null}},{"url":null,"slug":"multi-granularity-semantic-revision-for-large","title":"Multi-Granularity Semantic Revision for Large Language Model Distillation","date":"2024-07-14","arxiv_id":"2407.10068","repositories_listed":0,"syntology":null},{"url":null,"slug":"semantic-understanding-and-data-imputation","title":"Data Imputation using Large Language Model to Accelerate Recommendation System","date":"2024-07-14","arxiv_id":"2407.10078","repositories_listed":0,"syntology":null},{"url":null,"slug":"bilingual-adaptation-of-monolingual","title":"Bilingual Adaptation of Monolingual Foundation Models","date":"2024-07-13","arxiv_id":"2407.12869","repositories_listed":0,"syntology":null},{"url":null,"slug":"explanation-is-all-you-need-in-distillation","title":"Explanation is All You Need in Distillation: Mitigating Bias and Shortcut Learning","date":"2024-07-13","arxiv_id":"2407.09788","repositories_listed":0,"syntology":null},{"url":null,"slug":"iccv23-visual-dialog-emotion-explanation","title":"ICCV23 Visual-Dialog Emotion Explanation Challenge: SEU_309 Team Technical Report","date":"2024-07-13","arxiv_id":"2407.09760","repositories_listed":0,"syntology":null},{"url":null,"slug":"pfps-prompt-guided-flexible-pathological","title":"PFPs: Prompt-guided Flexible Pathological Segmentation for Diverse Potential Outcomes Using Large Vision and Language Models","date":"2024-07-13","arxiv_id":"2407.09979","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-neural-matrix-decomposition-recommender","title":"A Neural Matrix Decomposition Recommender System Model based on the Multimodal Large Language Model","date":"2024-07-12","arxiv_id":"2407.08942","repositories_listed":0,"syntology":null},{"url":null,"slug":"ai-powered-immersive-assistance-for","title":"AI-Powered Immersive Assistance for Interactive Task Execution in Industrial Environments","date":"2024-07-12","arxiv_id":"2407.09147","repositories_listed":0,"syntology":null},{"url":null,"slug":"bridging-dictionary-ai-generated-dictionary","title":"Bridging Dictionary: AI-Generated Dictionary of Partisan Language Use","date":"2024-07-12","arxiv_id":"2407.09661","repositories_listed":0,"syntology":null},{"url":null,"slug":"does-incomplete-syntax-influence-korean","title":"Does Incomplete Syntax Influence Korean Language Model? Focusing on Word Order and Case Markers","date":"2024-07-12","arxiv_id":"2407.09184","repositories_listed":0,"syntology":null},{"url":null,"slug":"domain-hierarchy-adaptation-via-chain-of","title":"Domain-Hierarchy Adaptation via Chain of Iterative Reasoning for Few-shot Hierarchical Text Classification","date":"2024-07-12","arxiv_id":"2407.08959","repositories_listed":0,"syntology":null},{"url":null,"slug":"gpc-generative-and-general-pathology-image","title":"GPC: Generative and General Pathology Image Classifier","date":"2024-07-12","arxiv_id":"2407.09035","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-sociolinguistic-foundations-of-language","title":"The Sociolinguistic Foundations of Language Modeling","date":"2024-07-12","arxiv_id":"2407.09241","repositories_listed":0,"syntology":null},{"url":null,"slug":"automata-based-constraints-for-language-model","title":"Automata-based constraints for language model decoding","date":"2024-07-11","arxiv_id":"2407.08103","repositories_listed":0,"syntology":null},{"url":null,"slug":"autoregressive-speech-synthesis-without","title":"Autoregressive Speech Synthesis without Vector Quantization","date":"2024-07-11","arxiv_id":"2407.08551","repositories_listed":0,"syntology":null},{"url":null,"slug":"continually-learn-to-map-visual-concepts-to","title":"Continually Learn to Map Visual Concepts to Large Language Models in Resource-constrained Environments","date":"2024-07-11","arxiv_id":"2407.08279","repositories_listed":0,"syntology":null},{"url":null,"slug":"evaluating-nuanced-bias-in-large-language","title":"Evaluating Nuanced Bias in Large Language Model Free Response Answers","date":"2024-07-11","arxiv_id":"2407.08842","repositories_listed":0,"syntology":null},{"url":null,"slug":"fault-diagnosis-in-power-grids-with-large","title":"Fault Diagnosis in Power Grids with Large Language Model","date":"2024-07-11","arxiv_id":"2407.08836","repositories_listed":0,"syntology":null},{"url":null,"slug":"genet-a-multimodal-llm-based-co-pilot-for","title":"GeNet: A Multimodal LLM-Based Co-Pilot for Network Topology and Configuration","date":"2024-07-11","arxiv_id":"2407.08249","repositories_listed":0,"syntology":null},{"url":null,"slug":"rule-based-neural-and-llm-back-translation","title":"Rule-Based, Neural and LLM Back-Translation: Comparative Insights from a Variant of Ladin","date":"2024-07-11","arxiv_id":"2407.08819","repositories_listed":0,"syntology":null},{"url":null,"slug":"turn-level-empathy-prediction-using","title":"Turn-Level Empathy Prediction Using Psychological Indicators","date":"2024-07-11","arxiv_id":"2407.08607","repositories_listed":0,"syntology":null},{"url":null,"slug":"unveiling-disparities-in-maternity-care-a","title":"Unveiling Disparities in Maternity Care: A Topic Modelling Approach to Analysing Maternity Incident Investigation Reports","date":"2024-07-11","arxiv_id":"2407.08328","repositories_listed":0,"syntology":null},{"url":null,"slug":"deconstructing-what-makes-a-good-optimizer","title":"Deconstructing What Makes a Good Optimizer for Language Models","date":"2024-07-10","arxiv_id":"2407.07972","repositories_listed":0,"syntology":null},{"url":null,"slug":"evaluating-voice-command-pipelines-for-drone","title":"Evaluating Voice Command Pipelines for Drone Control: From STT and LLM to Direct Classification and Siamese Networks","date":"2024-07-10","arxiv_id":"2407.08658","repositories_listed":0,"syntology":null},{"url":null,"slug":"hilight-technical-report-on-the-motern-ai","title":"HiLight: Technical Report on the Motern AI Video Language Model","date":"2024-07-10","arxiv_id":"2407.07325","repositories_listed":0,"syntology":null},{"url":null,"slug":"knowledge-overshadowing-causes-amalgamated","title":"Knowledge Overshadowing Causes Amalgamated Hallucination in Large Language Models","date":"2024-07-10","arxiv_id":"2407.08039","repositories_listed":0,"syntology":null},{"url":null,"slug":"large-language-model-augmented-auto","title":"Large Language Model-Augmented Auto-Delineation of Treatment Target Volume in Radiation Therapy","date":"2024-07-10","arxiv_id":"2407.07296","repositories_listed":0,"syntology":null},{"url":null,"slug":"lokilm-technical-report","title":"LokiLM: Technical Report","date":"2024-07-10","arxiv_id":"2407.07370","repositories_listed":0,"syntology":null},{"url":null,"slug":"malicious-path-manipulations-via-exploitation","title":"Malicious Path Manipulations via Exploitation of Representation Vulnerabilities of Vision-Language Navigation Systems","date":"2024-07-10","arxiv_id":"2407.07392","repositories_listed":0,"syntology":null},{"url":null,"slug":"mixsumm-topic-based-data-augmentation-using","title":"A Guide To Effectively Leveraging LLMs for Low-Resource Text Summarization: Data Augmentation and Semi-supervised Approaches","date":"2024-07-10","arxiv_id":"2407.07341","repositories_listed":0,"syntology":null},{"url":null,"slug":"token-mol-1-0-tokenized-drug-design-with","title":"Token-Mol 1.0: Tokenized drug design with large language model","date":"2024-07-10","arxiv_id":"2407.07930","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-simple-architecture-for-enterprise-large","title":"A Simple Architecture for Enterprise Large Language Model Applications based on Role based security and Clearance Levels using Retrieval-Augmented Generation or Mixture of Experts","date":"2024-07-09","arxiv_id":"2407.06718","repositories_listed":0,"syntology":null},{"url":null,"slug":"autotask-task-aware-multi-faceted-single","title":"AutoTask: Task Aware Multi-Faceted Single Model for Multi-Task Ads Relevance","date":"2024-07-09","arxiv_id":"2407.06549","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-low-resource-nmt-with-a","title":"Enhancing Low-Resource NMT with a Multilingual Encoder and Knowledge Distillation: A Case Study","date":"2024-07-09","arxiv_id":"2407.06538","repositories_listed":0,"syntology":null},{"url":null,"slug":"lets-c-leveraging-language-embedding-for-time","title":"LETS-C: Leveraging Text Embedding for Time Series Classification","date":"2024-07-09","arxiv_id":"2407.06533","repositories_listed":0,"syntology":null},{"url":null,"slug":"pseudo-perplexity-in-one-fell-swoop-for","title":"Pseudo-perplexity in One Fell Swoop for Protein Fitness Estimation","date":"2024-07-09","arxiv_id":"2407.07265","repositories_listed":0,"syntology":null},{"url":null,"slug":"softdedup-an-efficient-data-reweighting","title":"SoftDedup: an Efficient Data Reweighting Method for Speeding Up Language Model Pre-training","date":"2024-07-09","arxiv_id":"2407.06654","repositories_listed":0,"syntology":null},{"url":null,"slug":"using-pretrained-large-language-model-with","title":"Using Pretrained Large Language Model with Prompt Engineering to Answer Biomedical Questions","date":"2024-07-09","arxiv_id":"2407.06779","repositories_listed":0,"syntology":null},{"url":null,"slug":"artificial-intuition-efficient-classification","title":"Artificial Intuition: Efficient Classification of Scientific Abstracts","date":"2024-07-08","arxiv_id":"2407.06093","repositories_listed":0,"syntology":null},{"url":null,"slug":"b-mojo-hybrid-state-space-realizations-of","title":"B'MOJO: Hybrid State Space Realizations of Foundation Models with Eidetic and Fading Memory","date":"2024-07-08","arxiv_id":"2407.06324","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-language-model-rationality-with-bi","title":"Enhancing Language Model Rationality with Bi-Directional Deliberation Reasoning","date":"2024-07-08","arxiv_id":"2407.06112","repositories_listed":0,"syntology":null},{"url":null,"slug":"genartist-multimodal-llm-as-an-agent-for","title":"GenArtist: Multimodal LLM as an Agent for Unified Image Generation and Editing","date":"2024-07-08","arxiv_id":"2407.05600","repositories_listed":0,"syntology":null},{"url":null,"slug":"genfollower-enhancing-car-following","title":"GenFollower: Enhancing Car-Following Prediction with Large Language Models","date":"2024-07-08","arxiv_id":"2407.05611","repositories_listed":0,"syntology":null},{"url":null,"slug":"igea-a-decoder-only-language-model-for","title":"Igea: a Decoder-Only Language Model for Biomedical Text Generation in Italian","date":"2024-07-08","arxiv_id":"2407.06011","repositories_listed":0,"syntology":null},{"url":null,"slug":"large-language-models-for-judicial-entity","title":"Large Language Models for Judicial Entity Extraction: A Comparative Study","date":"2024-07-08","arxiv_id":"2407.05786","repositories_listed":0,"syntology":null},{"url":null,"slug":"mathrm-e-2-cfd-towards-effective-and","title":"$\\mathrm{E^{2}CFD}$: Towards Effective and Efficient Cost Function Design for Safe Reinforcement Learning via Large Language Model","date":"2024-07-08","arxiv_id":"2407.05580","repositories_listed":0,"syntology":null},{"url":"/paper/on-speeding-up-language-model-evaluation","slug":"on-speeding-up-language-model-evaluation","title":"On Speeding Up Language Model Evaluation","date":"2024-07-08","arxiv_id":"2407.06172","repositories_listed":0,"syntology":{"n":2,"n_ran":2,"n_constructed":1,"n_ran_checked":1,"n_instrument":1,"n_unverified":0,"n_honours":0,"n_violates":0,"n_no_contract":1,"n_pointer_only":0,"phrase":"2 ran (of which 1 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 1 where Syntology's instrument failed) · 0 unverified","sample_list":"/paper/on-speeding-up-language-model-evaluation#ran","syntology_url":"https://syntology.ai/paper/2407.06172","mcp":{"get_harvested_code_for_paper":{"arxiv_id":"2407.06172"}},"official":null}}],"record_sha256":"3a1a0a987b58c78308aeea4cc1193843eb33b82dfccf22771d1775b0c8a43440","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}