{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/language-modeling/papers/98","list_of":"/task/language-modeling","task":"Language Modeling","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":98,"pages_in_order":142,"rows_per_page":100,"rows":[9701,9800],"of":14182,"counts":{"archive_papers_tagged":14182,"with_a_code_link":5620,"where_syntology_ran_a_sample":1894,"not_listed_spam_title":0,"listed":14182,"listed_where_code_ran":1894,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":1580,"every_run_a_failure_of_syntologys_instrument":314,"listed_with_a_run_with_no_instrument_failure":1580,"listed_every_run_a_failure_of_syntologys_instrument":314,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/language-modeling","prev":"/task/language-modeling/papers/97","next":"/task/language-modeling/papers/99","papers":[{"url":null,"slug":"challenges-with-unsupervised-llm-knowledge","title":"Challenges with unsupervised LLM knowledge discovery","date":"2023-12-15","arxiv_id":"2312.10029","repositories_listed":0,"syntology":null},{"url":null,"slug":"instructpipe-building-visual-programming","title":"InstructPipe: Generating Visual Blocks Pipelines with Human Instructions and LLMs","date":"2023-12-15","arxiv_id":"2312.09672","repositories_listed":0,"syntology":null},{"url":null,"slug":"leveraging-language-id-to-calculate","title":"Leveraging Language ID to Calculate Intermediate CTC Loss for Enhanced Code-Switching Speech Recognition","date":"2023-12-15","arxiv_id":"2312.09583","repositories_listed":0,"syntology":null},{"url":"/paper/rest-meets-react-self-improvement-for-multi","slug":"rest-meets-react-self-improvement-for-multi","title":"ReST meets ReAct: Self-Improvement for Multi-Step Reasoning LLM Agent","date":"2023-12-15","arxiv_id":"2312.10003","repositories_listed":0,"syntology":null},{"url":null,"slug":"student-as-an-inherent-denoiser-of-noisy","title":"Student as an Inherent Denoiser of Noisy Teacher","date":"2023-12-15","arxiv_id":"2312.10185","repositories_listed":0,"syntology":null},{"url":null,"slug":"language-modeling-on-a-spinnaker-2","title":"Language Modeling on a SpiNNaker 2 Neuromorphic Chip","date":"2023-12-14","arxiv_id":"2312.09084","repositories_listed":0,"syntology":null},{"url":null,"slug":"lift-unsupervised-reinforcement-learning-with","title":"LiFT: Unsupervised Reinforcement Learning with Foundation Models as Teachers","date":"2023-12-14","arxiv_id":"2312.08958","repositories_listed":0,"syntology":null},{"url":null,"slug":"pixel-aligned-language-models","title":"Pixel Aligned Language Models","date":"2023-12-14","arxiv_id":"2312.09237","repositories_listed":0,"syntology":null},{"url":null,"slug":"assessing-gpt4-v-on-structured-reasoning","title":"Assessing GPT4-V on Structured Reasoning Tasks","date":"2023-12-13","arxiv_id":"2312.11524","repositories_listed":0,"syntology":null},{"url":null,"slug":"contractive-error-feedback-for-gradient-1","title":"Contractive error feedback for gradient compression","date":"2023-12-13","arxiv_id":"2312.08538","repositories_listed":0,"syntology":null},{"url":null,"slug":"fine-grained-image-text-alignment-in-medical","title":"Fine-Grained Image-Text Alignment in Medical Imaging Enables Explainable Cyclic Image-Report Generation","date":"2023-12-13","arxiv_id":"2312.08078","repositories_listed":0,"syntology":null},{"url":null,"slug":"helping-language-models-learn-more-multi","title":"Helping Language Models Learn More: Multi-dimensional Task Prompt for Few-shot Tuning","date":"2023-12-13","arxiv_id":"2312.08027","repositories_listed":0,"syntology":null},{"url":null,"slug":"large-language-model-enhanced-multi-agent","title":"Large Language Model Enhanced Multi-Agent Systems for 6G Communications","date":"2023-12-13","arxiv_id":"2312.07850","repositories_listed":0,"syntology":null},{"url":null,"slug":"ld-sdm-language-driven-hierarchical-species","title":"LD-SDM: Language-Driven Hierarchical Species Distribution Modeling","date":"2023-12-13","arxiv_id":"2312.08334","repositories_listed":0,"syntology":null},{"url":null,"slug":"synocene-beyond-the-anthropocene-de","title":"Synocene, Beyond the Anthropocene: De-Anthropocentralising Human-Nature-AI Interaction","date":"2023-12-13","arxiv_id":"2312.11525","repositories_listed":0,"syntology":null},{"url":null,"slug":"astrocyte-enabled-advancements-in-spiking","title":"Astrocyte-Enabled Advancements in Spiking Neural Networks for Large Language Modeling","date":"2023-12-12","arxiv_id":"2312.07625","repositories_listed":0,"syntology":null},{"url":null,"slug":"classifying-complex-documents-comparing","title":"Classifying complex documents: comparing bespoke solutions to large language models","date":"2023-12-12","arxiv_id":"2312.07182","repositories_listed":0,"syntology":null},{"url":null,"slug":"complexitynet-increasing-llm-inference","title":"ComplexityNet: Increasing LLM Inference Efficiency by Learning Task Complexity","date":"2023-12-12","arxiv_id":"2312.11511","repositories_listed":0,"syntology":null},{"url":"/paper/llm-in-a-flash-efficient-large-language-model","slug":"llm-in-a-flash-efficient-large-language-model","title":"LLM in a flash: Efficient Large Language Model Inference with Limited Memory","date":"2023-12-12","arxiv_id":"2312.11514","repositories_listed":0,"syntology":null},{"url":null,"slug":"remote-sensing-vision-language-foundation","title":"Remote Sensing Vision-Language Foundation Models without Annotations via Ground Remote Alignment","date":"2023-12-12","arxiv_id":"2312.06960","repositories_listed":0,"syntology":null},{"url":null,"slug":"scca-shifted-cross-chunk-attention-for-long","title":"SCCA: Shifted Cross Chunk Attention for long contextual semantic expansion","date":"2023-12-12","arxiv_id":"2312.07305","repositories_listed":0,"syntology":null},{"url":null,"slug":"sm70-a-large-language-model-for-medical","title":"SM70: A Large Language Model for Medical Devices","date":"2023-12-12","arxiv_id":"2312.06974","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-gua-speech-system-description-for-cnvsrc","title":"The GUA-Speech System Description for CNVSRC Challenge 2023","date":"2023-12-12","arxiv_id":"2312.07254","repositories_listed":0,"syntology":null},{"url":null,"slug":"translating-natural-language-queries-to-sql","title":"Translating Natural Language Queries to SQL Using the T5 Model","date":"2023-12-12","arxiv_id":"2312.12414","repositories_listed":0,"syntology":null},{"url":null,"slug":"variety-and-quality-over-quantity-towards","title":"Rethinking the Instruction Quality: LIFT is What You Need","date":"2023-12-12","arxiv_id":"2312.11508","repositories_listed":0,"syntology":null},{"url":null,"slug":"vision-language-assisted-attribute-learning","title":"Vision-language Assisted Attribute Learning","date":"2023-12-12","arxiv_id":"2312.07009","repositories_listed":0,"syntology":null},{"url":null,"slug":"audio-visual-llm-for-video-understanding","title":"Audio-Visual LLM for Video Understanding","date":"2023-12-11","arxiv_id":"2312.06720","repositories_listed":0,"syntology":null},{"url":null,"slug":"decoupling-sql-query-hardness-parsing-for","title":"Decoupling SQL Query Hardness Parsing for Text-to-SQL","date":"2023-12-11","arxiv_id":"2312.06172","repositories_listed":0,"syntology":null},{"url":null,"slug":"metal-metamorphic-testing-framework-for","title":"METAL: Metamorphic Testing Framework for Analyzing Large-Language Model Qualities","date":"2023-12-11","arxiv_id":"2312.06056","repositories_listed":0,"syntology":null},{"url":null,"slug":"order-matters-in-the-presence-of-dataset-1","title":"Order Matters in the Presence of Dataset Imbalance for Multilingual Learning","date":"2023-12-11","arxiv_id":"2312.06134","repositories_listed":0,"syntology":null},{"url":null,"slug":"where-exactly-does-contextualization-in-a-plm","title":"Where exactly does contextualization in a PLM happen?","date":"2023-12-11","arxiv_id":"2312.06514","repositories_listed":0,"syntology":null},{"url":null,"slug":"leveraging-generative-language-models-for","title":"Leveraging Generative Language Models for Weakly Supervised Sentence Component Analysis in Video-Language Joint Learning","date":"2023-12-10","arxiv_id":"2312.06699","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-review-of-hybrid-and-ensemble-in-deep","title":"A Review of Hybrid and Ensemble in Deep Learning for Natural Language Processing","date":"2023-12-09","arxiv_id":"2312.05589","repositories_listed":0,"syntology":null},{"url":null,"slug":"domain-adaptation-of-a-state-of-the-art-text","title":"Domain Adaptation of a State of the Art Text-to-SQL Model: Lessons Learned and Challenges Found","date":"2023-12-09","arxiv_id":"2312.05448","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-medical-specialty-assignment-to","title":"Enhancing Medical Specialty Assignment to Patients using NLP Techniques","date":"2023-12-09","arxiv_id":"2312.05585","repositories_listed":0,"syntology":null},{"url":null,"slug":"leveraging-reinforcement-learning-and-large","title":"PerfRL: A Small Language Model Framework for Efficient Code Optimization","date":"2023-12-09","arxiv_id":"2312.05657","repositories_listed":0,"syntology":null},{"url":null,"slug":"stateful-large-language-model-serving-with","title":"Stateful Large Language Model Serving with Pensieve","date":"2023-12-09","arxiv_id":"2312.05516","repositories_listed":0,"syntology":null},{"url":null,"slug":"tcnca-temporal-convolution-network-with","title":"TCNCA: Temporal Convolution Network with Chunked Attention for Scalable Sequence Processing","date":"2023-12-09","arxiv_id":"2312.05605","repositories_listed":0,"syntology":null},{"url":null,"slug":"teamwork-dimensions-classification-using-bert","title":"Teamwork Dimensions Classification Using BERT","date":"2023-12-09","arxiv_id":"2312.05483","repositories_listed":0,"syntology":null},{"url":null,"slug":"illicit-darkweb-classification-via-natural","title":"Illicit Darkweb Classification via Natural-language Processing: Classifying Illicit Content of Webpages based on Textual Information","date":"2023-12-08","arxiv_id":"2312.04944","repositories_listed":0,"syntology":null},{"url":null,"slug":"neuron-patching-neuron-level-model-editing-on","title":"Neuron Patching: Semantic-based Neuron-level Language Model Repair for Code Generation","date":"2023-12-08","arxiv_id":"2312.05356","repositories_listed":0,"syntology":null},{"url":null,"slug":"ophtha-llama2-a-large-language-model-for","title":"Ophtha-LLaMA2: A Large Language Model for Ophthalmology","date":"2023-12-08","arxiv_id":"2312.04906","repositories_listed":0,"syntology":null},{"url":null,"slug":"retrieval-based-video-language-model-for","title":"Retrieval-based Video Language Model for Efficient Long Video Question Answering","date":"2023-12-08","arxiv_id":"2312.04931","repositories_listed":0,"syntology":null},{"url":null,"slug":"user-aware-prefix-tuning-is-a-good-learner","title":"User-Aware Prefix-Tuning is a Good Learner for Personalized Image Captioning","date":"2023-12-08","arxiv_id":"2312.04793","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-block-metropolis-hastings-sampler-for","title":"A Block Metropolis-Hastings Sampler for Controllable Energy-based Text Generation","date":"2023-12-07","arxiv_id":"2312.04510","repositories_listed":0,"syntology":null},{"url":null,"slug":"comparing-large-language-model-ai-and-human","title":"Comparing Large Language Model AI and Human-Generated Coaching Messages for Behavioral Weight Loss","date":"2023-12-07","arxiv_id":"2312.04059","repositories_listed":0,"syntology":null},{"url":null,"slug":"convrt-consistent-video-restoration-through","title":"ConVRT: Consistent Video Restoration Through Turbulence with Test-time Optimization of Neural Video Representations","date":"2023-12-07","arxiv_id":"2312.04679","repositories_listed":0,"syntology":null},{"url":null,"slug":"efficient-large-language-models-fine-tuning","title":"Efficient End-to-end Language Model Fine-tuning on Graphs","date":"2023-12-07","arxiv_id":"2312.04737","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-medical-task-performance-in-gpt-4v","title":"Enhancing Medical Task Performance in GPT-4V: A Comprehensive Study on Prompt Engineering Strategies","date":"2023-12-07","arxiv_id":"2312.04344","repositories_listed":0,"syntology":null},{"url":null,"slug":"purple-llama-cyberseceval-a-secure-coding","title":"Purple Llama CyberSecEval: A Secure Coding Benchmark for Language Models","date":"2023-12-07","arxiv_id":"2312.04724","repositories_listed":0,"syntology":null},{"url":null,"slug":"using-a-large-language-model-to-generate-a","title":"Using a Large Language Model to generate a Design Structure Matrix","date":"2023-12-07","arxiv_id":"2312.04134","repositories_listed":0,"syntology":null},{"url":null,"slug":"an-integration-of-pre-trained-speech-and","title":"Integrating Pre-Trained Speech and Language Models for End-to-End Speech Recognition","date":"2023-12-06","arxiv_id":"2312.03668","repositories_listed":0,"syntology":null},{"url":null,"slug":"corporate-bankruptcy-prediction-with-domain","title":"Corporate Bankruptcy Prediction with Domain-Adapted BERT","date":"2023-12-06","arxiv_id":"2312.03194","repositories_listed":0,"syntology":null},{"url":null,"slug":"evaluating-and-mitigating-discrimination-in","title":"Evaluating and Mitigating Discrimination in Language Model Decisions","date":"2023-12-06","arxiv_id":"2312.03689","repositories_listed":0,"syntology":null},{"url":null,"slug":"fomo-rewards-can-we-cast-foundation-models-as","title":"FoMo Rewards: Can we cast foundation models as reward functions?","date":"2023-12-06","arxiv_id":"2312.03881","repositories_listed":0,"syntology":null},{"url":null,"slug":"run-lora-run-faster-and-lighter-lora","title":"Run LoRA Run: Faster and Lighter LoRA Implementations","date":"2023-12-06","arxiv_id":"2312.03415","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-hardware-evaluation-framework-for-large","title":"A Hardware Evaluation Framework for Large Language Model Inference","date":"2023-12-05","arxiv_id":"2312.03134","repositories_listed":0,"syntology":null},{"url":null,"slug":"etc-temporal-boundary-expand-then-clarify-for","title":"EtC: Temporal Boundary Expand then Clarify for Weakly Supervised Video Grounding with Multimodal Large Language Model","date":"2023-12-05","arxiv_id":"2312.02483","repositories_listed":0,"syntology":null},{"url":null,"slug":"generating-fine-grained-human-motions-using","title":"FG-MDM: Towards Zero-Shot Human Motion Generation via ChatGPT-Refined Descriptions","date":"2023-12-05","arxiv_id":"2312.02772","repositories_listed":0,"syntology":null},{"url":null,"slug":"gpt-vs-human-for-scientific-reviews-a-dual","title":"GPT vs Human for Scientific Reviews: A Dual Source Review on Applications of ChatGPT in Science","date":"2023-12-05","arxiv_id":"2312.03769","repositories_listed":0,"syntology":null},{"url":null,"slug":"protein-language-model-powered-3d-ligand","title":"Protein Language Model-Powered 3D Ligand Binding Site Prediction from Protein Sequence","date":"2023-12-05","arxiv_id":"2312.03016","repositories_listed":0,"syntology":null},{"url":null,"slug":"scaling-laws-for-adversarial-attacks-on","title":"Scaling Laws for Adversarial Attacks on Language Model Activations","date":"2023-12-05","arxiv_id":"2312.02780","repositories_listed":0,"syntology":null},{"url":"/paper/visual-program-distillation-distilling-tools","slug":"visual-program-distillation-distilling-tools","title":"Visual Program Distillation: Distilling Tools and Programmatic Reasoning into Vision-Language Models","date":"2023-12-05","arxiv_id":"2312.03052","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-survey-on-large-language-model-llm-security","title":"A Survey on Large Language Model (LLM) Security and Privacy: The Good, the Bad, and the Ugly","date":"2023-12-04","arxiv_id":"2312.02003","repositories_listed":0,"syntology":null},{"url":null,"slug":"clamp-contrastive-language-model-prompt","title":"CLAMP: Contrastive LAnguage Model Prompt-tuning","date":"2023-12-04","arxiv_id":"2312.01629","repositories_listed":0,"syntology":null},{"url":null,"slug":"expand-bert-representation-with-visual","title":"Expand BERT Representation with Visual Information via Grounded Language Learning with Multimodal Partial Alignment","date":"2023-12-04","arxiv_id":"2312.01592","repositories_listed":0,"syntology":null},{"url":null,"slug":"jellyfish-a-large-language-model-for-data","title":"Jellyfish: A Large Language Model for Data Preprocessing","date":"2023-12-04","arxiv_id":"2312.01678","repositories_listed":0,"syntology":null},{"url":null,"slug":"measuring-distributional-shifts-in-text-the","title":"Measuring Distributional Shifts in Text: The Advantage of Language Model-Based Embeddings","date":"2023-12-04","arxiv_id":"2312.02337","repositories_listed":0,"syntology":null},{"url":null,"slug":"medxchat-bridging-cxr-modalities-with-a","title":"MedXChat: A Unified Multimodal Large Language Model Framework towards CXRs Understanding and Generation","date":"2023-12-04","arxiv_id":"2312.02233","repositories_listed":0,"syntology":null},{"url":null,"slug":"rinas-training-with-dataset-shuffling-can-be","title":"RINAS: Training with Dataset Shuffling Can Be General and Fast","date":"2023-12-04","arxiv_id":"2312.02368","repositories_listed":0,"syntology":null},{"url":null,"slug":"semantics-aware-motion-retargeting-with","title":"Semantics-aware Motion Retargeting with Vision-Language Models","date":"2023-12-04","arxiv_id":"2312.01964","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-contemporary-art-of-image-search","title":"The Contemporary Art of Image Search: Iterative User Intent Expansion via Vision-Language Model","date":"2023-12-04","arxiv_id":"2312.01656","repositories_listed":0,"syntology":null},{"url":null,"slug":"tppoet-transformer-based-persian-poem","title":"TPPoet: Transformer-Based Persian Poem Generation using Minimal Data and Advanced Decoding Techniques","date":"2023-12-04","arxiv_id":"2312.02125","repositories_listed":0,"syntology":null},{"url":null,"slug":"unleashing-the-potential-of-large-language","title":"Unleashing the Potential of Large Language Model: Zero-shot VQA for Flood Disaster Scenario","date":"2023-12-04","arxiv_id":"2312.01882","repositories_listed":0,"syntology":null},{"url":null,"slug":"vaquita-enhancing-alignment-in-llm-assisted","title":"VaQuitA: Enhancing Alignment in LLM-Assisted Video Understanding","date":"2023-12-04","arxiv_id":"2312.02310","repositories_listed":0,"syntology":null},{"url":null,"slug":"symnoise-advancing-language-model-fine-tuning","title":"SymNoise: Advancing Language Model Fine-tuning with Symmetric Noise","date":"2023-12-03","arxiv_id":"2312.01523","repositories_listed":0,"syntology":null},{"url":null,"slug":"advanced-language-model-driven-verilog","title":"Advanced Large Language Model (LLM)-Driven Verilog Development: Enhancing Power, Performance, and Area Optimization in Code Synthesis","date":"2023-12-02","arxiv_id":"2312.01022","repositories_listed":0,"syntology":null},{"url":null,"slug":"self-generated-wargame-ai-double-layer-agent","title":"Self Generated Wargame AI: Double Layer Agent Task Planning Based on Large Language Model","date":"2023-12-02","arxiv_id":"2312.01090","repositories_listed":0,"syntology":null},{"url":null,"slug":"analyzing-the-influence-of-fake-news-in-the","title":"Analyzing the Impact of Fake News on the Anticipated Outcome of the 2024 Election Ahead of Time","date":"2023-12-01","arxiv_id":"2312.03750","repositories_listed":0,"syntology":null},{"url":null,"slug":"beyond-chatbots-explorellm-for-structured","title":"Beyond ChatBots: ExploreLLM for Structured Thoughts and Personalized Model Responses","date":"2023-12-01","arxiv_id":"2312.00763","repositories_listed":0,"syntology":null},{"url":null,"slug":"deciphering-digital-detectives-understanding","title":"Deciphering Digital Detectives: Understanding LLM Behaviors and Capabilities in Multi-Agent Mystery Games","date":"2023-12-01","arxiv_id":"2312.00746","repositories_listed":0,"syntology":null},{"url":null,"slug":"hashmarks-privacy-preserving-benchmarks-for","title":"Hashmarks: Privacy-Preserving Benchmarks for High-Stakes AI Evaluation","date":"2023-12-01","arxiv_id":"2312.00645","repositories_listed":0,"syntology":null},{"url":null,"slug":"hyperparameter-optimization-for-large","title":"Hyperparameter Optimization for Large Language Model Instruction-Tuning","date":"2023-12-01","arxiv_id":"2312.00949","repositories_listed":0,"syntology":null},{"url":null,"slug":"lightclip-learning-multi-level-interaction","title":"LightCLIP: Learning Multi-Level Interaction for Lightweight Vision-Language Models","date":"2023-12-01","arxiv_id":"2312.00674","repositories_listed":0,"syntology":null},{"url":null,"slug":"lingualinked-a-distributed-large-language","title":"LinguaLinked: A Distributed Large Language Model Inference System for Mobile Devices","date":"2023-12-01","arxiv_id":"2312.00388","repositories_listed":0,"syntology":null},{"url":null,"slug":"mitigating-over-smoothing-in-transformers-via-1","title":"Mitigating Over-smoothing in Transformers via Regularized Nonlocal Functionals","date":"2023-12-01","arxiv_id":"2312.00751","repositories_listed":0,"syntology":null},{"url":"/paper/zero-shot-video-question-answering-with","slug":"zero-shot-video-question-answering-with","title":"Zero-Shot Video Question Answering with Procedural Programs","date":"2023-12-01","arxiv_id":"2312.00937","repositories_listed":0,"syntology":null},{"url":null,"slug":"codi-2-in-context-interleaved-and-interactive","title":"CoDi-2: In-Context, Interleaved, and Interactive Any-to-Any Generation","date":"2023-11-30","arxiv_id":"2311.18775","repositories_listed":0,"syntology":null},{"url":null,"slug":"detailed-human-centric-text-description","title":"Detailed Human-Centric Text Description-Driven Large Scene Synthesis","date":"2023-11-30","arxiv_id":"2311.18654","repositories_listed":0,"syntology":null},{"url":null,"slug":"evaluating-large-language-model-creativity","title":"Evaluating Large Language Model Creativity from a Literary Perspective","date":"2023-11-30","arxiv_id":"2312.03746","repositories_listed":0,"syntology":null},{"url":null,"slug":"aviationgpt-a-large-language-model-for-the","title":"AviationGPT: A Large Language Model for the Aviation Domain","date":"2023-11-29","arxiv_id":"2311.17686","repositories_listed":0,"syntology":null},{"url":null,"slug":"elo-uncovered-robustness-and-best-practices","title":"Elo Uncovered: Robustness and Best Practices in Language Model Evaluation","date":"2023-11-29","arxiv_id":"2311.17295","repositories_listed":0,"syntology":null},{"url":null,"slug":"end-to-end-joint-rich-and-normalized-asr-with","title":"End-to-end Joint Punctuated and Normalized ASR with a Limited Amount of Punctuated Training Data","date":"2023-11-29","arxiv_id":"2311.17741","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-answer-selection-in-community","title":"Enhancing Answer Selection in Community Question Answering with Pre-trained and Large Language Models","date":"2023-11-29","arxiv_id":"2311.17502","repositories_listed":0,"syntology":null},{"url":null,"slug":"evaluating-vlms-for-score-based-multi-probe","title":"Leveraging VLM-Based Pipelines to Annotate 3D Objects","date":"2023-11-29","arxiv_id":"2311.17851","repositories_listed":0,"syntology":null},{"url":null,"slug":"how-to-build-an-ai-tutor-that-can-adapt-to","title":"How to Build an AI Tutor That Can Adapt to Any Course Using Knowledge Graph-Enhanced Retrieval-Augmented Generation (KG-RAG)","date":"2023-11-29","arxiv_id":"2311.17696","repositories_listed":0,"syntology":null},{"url":null,"slug":"informal-safety-guarantees-for-simulated","title":"Informal Safety Guarantees for Simulated Optimizers Through Extrapolation from Partial Simulations","date":"2023-11-29","arxiv_id":"2401.16426","repositories_listed":0,"syntology":null},{"url":null,"slug":"language-models-a-guide-for-the-perplexed","title":"Language Models: A Guide for the Perplexed","date":"2023-11-29","arxiv_id":"2311.17301","repositories_listed":0,"syntology":null},{"url":null,"slug":"leap-llm-generation-of-egocentric-action","title":"LEAP: LLM-Generation of Egocentric Action Programs","date":"2023-11-29","arxiv_id":"2312.00055","repositories_listed":0,"syntology":null},{"url":null,"slug":"llm-state-expandable-state-representation-for","title":"LLM-State: Open World State Representation for Long-horizon Task Planning with Large Language Model","date":"2023-11-29","arxiv_id":"2311.17406","repositories_listed":0,"syntology":null}],"record_sha256":"b32ce951b6fabd1b1869d61665e0beaba4791de85ef3d7a6fbe99e98d3b0b05a","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}