{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/memorization/papers/7","list_of":"/task/memorization","task":"Memorization","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":7,"pages_in_order":11,"rows_per_page":100,"rows":[601,700],"of":1088,"counts":{"archive_papers_tagged":1088,"with_a_code_link":438,"where_syntology_ran_a_sample":177,"not_listed_spam_title":0,"listed":1088,"listed_where_code_ran":177,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":148,"every_run_a_failure_of_syntologys_instrument":29,"listed_with_a_run_with_no_instrument_failure":148,"listed_every_run_a_failure_of_syntologys_instrument":29,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/memorization","prev":"/task/memorization/papers/6","next":"/task/memorization/papers/8","papers":[{"url":null,"slug":"a-geometric-framework-for-understanding","title":"A Geometric Framework for Understanding Memorization in Generative Models","date":"2024-10-31","arxiv_id":"2411.00113","repositories_listed":0,"syntology":null},{"url":null,"slug":"dynamic-uncertainty-ranking-enhancing-in","title":"Dynamic Uncertainty Ranking: Enhancing In-Context Learning for Long-Tail Knowledge in LLMs","date":"2024-10-31","arxiv_id":"2410.23605","repositories_listed":0,"syntology":null},{"url":null,"slug":"on-memorization-of-large-language-models-in","title":"On Memorization of Large Language Models in Logical Reasoning","date":"2024-10-30","arxiv_id":"2410.23123","repositories_listed":0,"syntology":null},{"url":null,"slug":"provably-optimal-memory-capacity-for-modern","title":"Provably Optimal Memory Capacity for Modern Hopfield Models: Transformer-Compatible Dense Associative Memories as Spherical Codes","date":"2024-10-30","arxiv_id":"2410.23126","repositories_listed":0,"syntology":null},{"url":null,"slug":"exploring-local-memorization-in-diffusion","title":"Exploring Local Memorization in Diffusion Models via Bright Ending Attention","date":"2024-10-29","arxiv_id":"2410.21665","repositories_listed":0,"syntology":null},{"url":null,"slug":"investigating-memorization-in-video-diffusion","title":"Investigating Memorization in Video Diffusion Models","date":"2024-10-29","arxiv_id":"2410.21669","repositories_listed":0,"syntology":null},{"url":null,"slug":"historical-test-time-prompt-tuning-for-vision","title":"Historical Test-time Prompt Tuning for Vision Foundation Models","date":"2024-10-27","arxiv_id":"2410.20346","repositories_listed":0,"syntology":null},{"url":null,"slug":"measuring-memorization-through-probabilistic","title":"Measuring memorization through probabilistic discoverable extraction","date":"2024-10-25","arxiv_id":"2410.19482","repositories_listed":0,"syntology":null},{"url":null,"slug":"mixture-of-parrots-experts-improve","title":"Mixture of Parrots: Experts improve memorization more than reasoning","date":"2024-10-24","arxiv_id":"2410.19034","repositories_listed":0,"syntology":null},{"url":null,"slug":"dual-model-defense-safeguarding-diffusion","title":"Dual-Model Defense: Safeguarding Diffusion Models from Membership Inference Attacks through Disjoint Data Splitting","date":"2024-10-22","arxiv_id":"2410.16657","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-simple-model-of-inference-scaling-laws","title":"A Simple Model of Inference Scaling Laws","date":"2024-10-21","arxiv_id":"2410.16377","repositories_listed":0,"syntology":null},{"url":null,"slug":"reasoning-memorization-and-fine-tuning","title":"Reasoning, Memorization, and Fine-Tuning Language Models for Non-Cooperative Games","date":"2024-10-18","arxiv_id":"2410.14890","repositories_listed":0,"syntology":null},{"url":null,"slug":"self-comparison-for-dataset-level-membership","title":"Self-Comparison for Dataset-Level Membership Inference in Large (Vision-)Language Models","date":"2024-10-16","arxiv_id":"2410.13088","repositories_listed":0,"syntology":null},{"url":null,"slug":"patch-based-diffusion-models-beat-whole-image","title":"Patch-Based Diffusion Models Beat Whole-Image Models for Mismatched Distribution Inverse Problems","date":"2024-10-15","arxiv_id":"2410.11730","repositories_listed":0,"syntology":null},{"url":null,"slug":"wilt-a-multi-turn-memorization-robust","title":"WILT: A Multi-Turn, Memorization-Robust Inductive Logic Benchmark for LLMs","date":"2024-10-14","arxiv_id":"2410.10998","repositories_listed":0,"syntology":null},{"url":null,"slug":"losing-dimensions-geometric-memorization-in","title":"Losing dimensions: Geometric memorization in generative diffusion","date":"2024-10-11","arxiv_id":"2410.08727","repositories_listed":0,"syntology":null},{"url":null,"slug":"emergent-properties-with-repeated-examples","title":"Emergent properties with repeated examples","date":"2024-10-09","arxiv_id":"2410.07041","repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-a-theoretical-understanding-of-2","title":"Extracting Training Data from Unconditional Diffusion Models","date":"2024-10-03","arxiv_id":"2410.02467","repositories_listed":0,"syntology":null},{"url":null,"slug":"undesirable-memorization-in-large-language","title":"Undesirable Memorization in Large Language Models: A Survey","date":"2024-10-03","arxiv_id":"2410.02650","repositories_listed":0,"syntology":null},{"url":null,"slug":"mitigating-backdoor-threats-to-large-language","title":"Mitigating Backdoor Threats to Large Language Models: Advancement and Challenges","date":"2024-09-30","arxiv_id":"2409.19993","repositories_listed":0,"syntology":null},{"url":null,"slug":"localizing-memorization-in-ssl-vision","title":"Localizing Memorization in SSL Vision Encoders","date":"2024-09-27","arxiv_id":"2409.19069","repositories_listed":0,"syntology":null},{"url":null,"slug":"optimal-memorization-capacity-of-transformers","title":"Optimal Memorization Capacity of Transformers","date":"2024-09-26","arxiv_id":"2409.17677","repositories_listed":0,"syntology":null},{"url":null,"slug":"pdfed-privacy-preserving-and-decentralized","title":"PDFed: Privacy-Preserving and Decentralized Asynchronous Federated Learning for Diffusion Models","date":"2024-09-26","arxiv_id":"2409.18245","repositories_listed":0,"syntology":null},{"url":null,"slug":"ssp-racl-classification-of-noisy-fundus","title":"SSP-RACL: Classification of Noisy Fundus Images with Self-Supervised Pretraining and Robust Adaptive Credal Loss","date":"2024-09-25","arxiv_id":"2409.18147","repositories_listed":0,"syntology":null},{"url":null,"slug":"training-data-attribution-was-your-model","title":"Training Data Attribution: Was Your Model Secretly Trained On Data Created By Mine?","date":"2024-09-24","arxiv_id":"2409.15781","repositories_listed":0,"syntology":null},{"url":null,"slug":"2409-14200","title":"Data-centric NLP Backdoor Defense from the Lens of Memorization","date":"2024-09-21","arxiv_id":"2409.14200","repositories_listed":0,"syntology":null},{"url":null,"slug":"training-large-asr-encoders-with-differential","title":"Training Large ASR Encoders with Differential Privacy","date":"2024-09-21","arxiv_id":"2409.13953","repositories_listed":0,"syntology":null},{"url":null,"slug":"unlocking-memorization-in-large-language","title":"Unlocking Memorization in Large Language Models with Dynamic Soft Prompting","date":"2024-09-20","arxiv_id":"2409.13853","repositories_listed":0,"syntology":null},{"url":null,"slug":"promise-and-peril-of-collaborative-code","title":"Promise and Peril of Collaborative Code Generation Models: Balancing Effectiveness and Memorization","date":"2024-09-18","arxiv_id":"2409.12020","repositories_listed":0,"syntology":null},{"url":null,"slug":"implicit-reasoning-in-deep-time-series","title":"Implicit Reasoning in Deep Time Series Forecasting","date":"2024-09-17","arxiv_id":"2409.10840","repositories_listed":0,"syntology":null},{"url":null,"slug":"online-learning-via-memory-retrieval","title":"Online Learning via Memory: Retrieval-Augmented Detector Adaptation","date":"2024-09-16","arxiv_id":"2409.10716","repositories_listed":0,"syntology":null},{"url":null,"slug":"nevlp-noise-robust-framework-for-efficient","title":"NEVLP: Noise-Robust Framework for Efficient Vision-Language Pre-training","date":"2024-09-15","arxiv_id":"2409.09582","repositories_listed":0,"syntology":null},{"url":null,"slug":"revisiting-physical-world-adversarial-attack","title":"Revisiting Physical-World Adversarial Attack on Traffic Sign Recognition: A Commercial Systems Perspective","date":"2024-09-15","arxiv_id":"2409.09860","repositories_listed":0,"syntology":null},{"url":null,"slug":"2409-13745","title":"Context-Aware Membership Inference Attacks against Pre-trained Large Language Models","date":"2024-09-11","arxiv_id":"2409.13745","repositories_listed":0,"syntology":null},{"url":null,"slug":"applied-federated-model-personalisation-in","title":"Applied Federated Model Personalisation in the Industrial Domain: A Comparative Study","date":"2024-09-10","arxiv_id":"2409.06904","repositories_listed":0,"syntology":null},{"url":null,"slug":"catch-me-if-you-can-detecting-unauthorized","title":"Anonymity Unveiled: A Practical Framework for Auditing Data Use in Deep Learning Models","date":"2024-09-10","arxiv_id":"2409.06280","repositories_listed":0,"syntology":null},{"url":null,"slug":"deep-neural-networks-multi-classification-and","title":"Constructive Universal Approximation and Finite Sample Memorization by Narrow Deep ReLU Networks","date":"2024-09-10","arxiv_id":"2409.06555","repositories_listed":0,"syntology":null},{"url":null,"slug":"customizing-large-language-model-generation","title":"Customizing Large Language Model Generation Style using Parameter-Efficient Finetuning","date":"2024-09-06","arxiv_id":"2409.04574","repositories_listed":0,"syntology":null},{"url":null,"slug":"generalization-vs-memorization-in-the","title":"Generalization vs. Memorization in the Presence of Statistical Biases in Transformers","date":"2024-09-06","arxiv_id":"2409.04654","repositories_listed":0,"syntology":null},{"url":null,"slug":"edcssm-edge-detection-with-convolutional","title":"EDCSSM: Edge Detection with Convolutional State Space Model","date":"2024-09-03","arxiv_id":"2409.01609","repositories_listed":0,"syntology":null},{"url":null,"slug":"avoiding-generative-model-writer-s-block-with","title":"Avoiding Generative Model Writer's Block With Embedding Nudging","date":"2024-08-28","arxiv_id":"2408.15450","repositories_listed":0,"syntology":null},{"url":null,"slug":"memorization-in-in-context-learning","title":"Memorization in In-Context Learning","date":"2024-08-21","arxiv_id":"2408.11546","repositories_listed":0,"syntology":null},{"url":null,"slug":"altbi-constructing-improved-outlier-detection","title":"ALTBI: Constructing Improved Outlier Detection Models via Optimization of Inlier-Memorization Effect","date":"2024-08-19","arxiv_id":"2408.09791","repositories_listed":0,"syntology":null},{"url":null,"slug":"maple-enhancing-review-generation-with-multi","title":"MAPLE: Enhancing Review Generation with Multi-Aspect Prompt LEarning in Explainable Recommendation","date":"2024-08-19","arxiv_id":"2408.09865","repositories_listed":0,"syntology":null},{"url":null,"slug":"information-theoretic-progress-measures","title":"Information-Theoretic Progress Measures reveal Grokking is an Emergent Phase Transition","date":"2024-08-16","arxiv_id":"2408.08944","repositories_listed":0,"syntology":null},{"url":null,"slug":"realtime-generation-of-streamliners-with","title":"Generating Streamlining Constraints with Large Language Models","date":"2024-08-16","arxiv_id":"2408.10268","repositories_listed":0,"syntology":null},{"url":null,"slug":"understanding-the-local-geometry-of","title":"Understanding the Local Geometry of Generative Model Manifolds","date":"2024-08-15","arxiv_id":"2408.08307","repositories_listed":0,"syntology":null},{"url":null,"slug":"get-confused-cautiously-textual-sequence","title":"Get Confused Cautiously: Textual Sequence Memorization Erasure with Selective Entropy Maximization","date":"2024-08-09","arxiv_id":"2408.04983","repositories_listed":0,"syntology":null},{"url":null,"slug":"maxmind-a-memory-loop-network-to-enhance","title":"MaxMind: A Memory Loop Network to Enhance Software Productivity based on Large Language Models","date":"2024-08-07","arxiv_id":"2408.03841","repositories_listed":0,"syntology":null},{"url":null,"slug":"2408-02983","title":"Diffusion Model Meets Non-Exemplar Class-Incremental Learning and Beyond","date":"2024-08-06","arxiv_id":"2408.02983","repositories_listed":0,"syntology":null},{"url":null,"slug":"human-foraging-strategies-flexibly-adapt-to","title":"Human foraging strategies flexibly adapt to resource distribution and time constraints","date":"2024-08-02","arxiv_id":"2408.01350","repositories_listed":0,"syntology":null},{"url":null,"slug":"2408-00359","title":"Memorization Capacity for Additive Fine-Tuning with Small ReLU Networks","date":"2024-08-01","arxiv_id":"2408.00359","repositories_listed":0,"syntology":null},{"url":null,"slug":"2407-21248","title":"Adaptive Pre-training Data Detection for Large Language Models via Surprising Tokens","date":"2024-07-30","arxiv_id":"2407.21248","repositories_listed":0,"syntology":null},{"url":null,"slug":"embedding-space-selection-for-detecting","title":"Embedding Space Selection for Detecting Memorization and Fingerprinting in Generative Models","date":"2024-07-30","arxiv_id":"2407.21159","repositories_listed":0,"syntology":null},{"url":null,"slug":"llms-understanding-of-natural-language","title":"LLMs' Understanding of Natural Language Revealed","date":"2024-07-29","arxiv_id":"2407.19630","repositories_listed":0,"syntology":null},{"url":null,"slug":"strong-copyright-protection-for-language","title":"Strong Copyright Protection for Language Models via Adaptive Model Fusion","date":"2024-07-29","arxiv_id":"2407.20105","repositories_listed":0,"syntology":null},{"url":null,"slug":"graph-memory-learning-imitating-lifelong","title":"Graph Memory Learning: Imitating Lifelong Remembering and Forgetting of Brain Networks","date":"2024-07-27","arxiv_id":"2407.19183","repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-clean-label-backdoor-attacks-in-the","title":"Towards Clean-Label Backdoor Attacks in the Physical World","date":"2024-07-27","arxiv_id":"2407.19203","repositories_listed":0,"syntology":null},{"url":null,"slug":"empirical-capacity-model-for-self-attention","title":"Empirical Capacity Model for Self-Attention Neural Networks","date":"2024-07-22","arxiv_id":"2407.15425","repositories_listed":0,"syntology":null},{"url":null,"slug":"knowledge-mechanisms-in-large-language-models","title":"Knowledge Mechanisms in Large Language Models: A Survey and Perspective","date":"2024-07-22","arxiv_id":"2407.15017","repositories_listed":0,"syntology":null},{"url":"/paper/generalization-v-s-memorization-tracing","slug":"generalization-v-s-memorization-tracing","title":"Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data","date":"2024-07-20","arxiv_id":"2407.14985","repositories_listed":0,"syntology":{"n":15,"n_ran":11,"n_constructed":0,"n_ran_checked":11,"n_instrument":0,"n_unverified":4,"n_honours":1,"n_violates":0,"n_no_contract":10,"n_pointer_only":0,"phrase":"11 ran (of which 0 constructed an object rather than computing a result; 11 with no instrument failure: 1 honoured, 0 violated, 10 with no contract checked; 0 where Syntology's instrument failed) · 4 unverified","sample_list":"/paper/generalization-v-s-memorization-tracing#ran","syntology_url":"https://syntology.ai/paper/2407.14985","mcp":{"get_harvested_code_for_paper":{"arxiv_id":"2407.14985"}},"official":null}},{"url":null,"slug":"2408-01431","title":"Building an Ethical and Trustworthy Biomedical AI Ecosystem for the Translational and Clinical Integration of Foundational Models","date":"2024-07-18","arxiv_id":"2408.01431","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-camouflaged-object-detection-from","title":"Learning Camouflaged Object Detection from Noisy Pseudo Label","date":"2024-07-18","arxiv_id":"2407.13157","repositories_listed":0,"syntology":null},{"url":null,"slug":"training-foundation-models-as-data","title":"Training Foundation Models as Data Compression: On Information, Model Weights and Copyright Law","date":"2024-07-18","arxiv_id":"2407.13493","repositories_listed":0,"syntology":null},{"url":null,"slug":"unveiling-structural-memorization-structural","title":"Unveiling Structural Memorization: Structural Membership Inference Attack for Text-to-Image Diffusion Models","date":"2024-07-18","arxiv_id":"2407.13252","repositories_listed":0,"syntology":null},{"url":null,"slug":"bootstrapped-pre-training-with-dynamic","title":"Bootstrapped Pre-training with Dynamic Identifier Prediction for Generative Retrieval","date":"2024-07-16","arxiv_id":"2407.11504","repositories_listed":0,"syntology":null},{"url":null,"slug":"mix-cpt-a-domain-adaptation-framework-via","title":"Mix-CPT: A Domain Adaptation Framework via Decoupling Knowledge Learning and Format Alignment","date":"2024-07-15","arxiv_id":"2407.10804","repositories_listed":0,"syntology":null},{"url":null,"slug":"extracting-training-data-from-document-based","title":"Extracting Training Data from Document-Based VQA Models","date":"2024-07-11","arxiv_id":"2407.08707","repositories_listed":0,"syntology":null},{"url":null,"slug":"pii-compass-guiding-llm-training-data","title":"PII-Compass: Guiding LLM training data extraction prompts towards the target PII via grounding","date":"2024-07-03","arxiv_id":"2407.02943","repositories_listed":0,"syntology":null},{"url":null,"slug":"unseentimeqa-time-sensitive-question","title":"UnSeenTimeQA: Time-Sensitive Question-Answering Beyond LLMs' Memorization","date":"2024-07-03","arxiv_id":"2407.03525","repositories_listed":0,"syntology":null},{"url":null,"slug":"detection-and-measurement-of-syntactic","title":"Detection and Measurement of Syntactic Templates in Generated Text","date":"2024-06-28","arxiv_id":"2407.00211","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-data-privacy-in-large-language","title":"Enhancing Data Privacy in Large Language Models through Private Association Editing","date":"2024-06-26","arxiv_id":"2406.18221","repositories_listed":0,"syntology":null},{"url":null,"slug":"generative-artificial-intelligence-in-2","title":"Generative artificial intelligence in ophthalmology: multimodal retinal images for the diagnosis of Alzheimer's disease with convolutional neural networks","date":"2024-06-26","arxiv_id":"2406.18247","repositories_listed":0,"syntology":null},{"url":null,"slug":"modeling-a-novel-dataset-for-testing","title":"modeLing: A Novel Dataset for Testing Linguistic Reasoning in Language Models","date":"2024-06-24","arxiv_id":"2406.17038","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-with-noisy-ground-truth-from-2d","title":"Learning with Noisy Ground Truth: From 2D Classification to 3D Reconstruction","date":"2024-06-23","arxiv_id":"2406.15982","repositories_listed":0,"syntology":null},{"url":null,"slug":"scaling-laws-for-fact-memorization-of-large","title":"Scaling Laws for Fact Memorization of Large Language Models","date":"2024-06-22","arxiv_id":"2406.15720","repositories_listed":0,"syntology":null},{"url":null,"slug":"mind-the-privacy-unit-user-level-differential","title":"Mind the Privacy Unit! User-Level Differential Privacy for Language Model Fine-Tuning","date":"2024-06-20","arxiv_id":"2406.14322","repositories_listed":0,"syntology":null},{"url":null,"slug":"protecting-privacy-through-approximating","title":"Protecting Privacy Through Approximating Optimal Parameters for Sequence Unlearning in Language Models","date":"2024-06-20","arxiv_id":"2406.14091","repositories_listed":0,"syntology":null},{"url":null,"slug":"uncovering-latent-memories-assessing-data","title":"Uncovering Latent Memories: Assessing Data Leakage and Memorization Patterns in Frontier AI Models","date":"2024-06-20","arxiv_id":"2406.14549","repositories_listed":0,"syntology":null},{"url":null,"slug":"extracting-training-data-from-unconditional","title":"Extracting Training Data from Unconditional Diffusion Models","date":"2024-06-18","arxiv_id":"2406.12752","repositories_listed":0,"syntology":null},{"url":null,"slug":"measuring-memorization-in-rlhf-for-code","title":"Measuring memorization in RLHF for code completion","date":"2024-06-17","arxiv_id":"2406.11715","repositories_listed":0,"syntology":null},{"url":null,"slug":"exposing-the-achilles-heel-evaluating-llms","title":"Exposing the Achilles' Heel: Evaluating LLMs Ability to Handle Mistakes in Mathematical Reasoning","date":"2024-06-16","arxiv_id":"2406.10834","repositories_listed":0,"syntology":null},{"url":null,"slug":"bridging-the-gap-in-drug-safety-data-analysis","title":"Automating Pharmacovigilance Evidence Generation: Using Large Language Models to Produce Context-Aware SQL","date":"2024-06-15","arxiv_id":"2406.10690","repositories_listed":0,"syntology":null},{"url":null,"slug":"between-randomness-and-arbitrariness-some","title":"Between Randomness and Arbitrariness: Some Lessons for Reliable Machine Learning at Scale","date":"2024-06-13","arxiv_id":"2406.09548","repositories_listed":0,"syntology":null},{"url":null,"slug":"diffusion-soup-model-merging-for-text-to","title":"Diffusion Soup: Model Merging for Text-to-Image Diffusion Models","date":"2024-06-12","arxiv_id":"2406.08431","repositories_listed":0,"syntology":null},{"url":null,"slug":"exploring-fact-memorization-and-style","title":"Exploring Fact Memorization and Style Imitation in LLMs Using QLoRA: An Experimental Study and Quality Assessment Methods","date":"2024-06-12","arxiv_id":"2406.08582","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-llms-for-recommendation-with-out-of","title":"Improving LLMs for Recommendation with Out-Of-Vocabulary Tokens","date":"2024-06-12","arxiv_id":"2406.08477","repositories_listed":0,"syntology":null},{"url":null,"slug":"large-language-models-memorize-sensor","title":"Large Language Models Memorize Sensor Datasets! Implications on Human Activity Recognition Research","date":"2024-06-09","arxiv_id":"2406.05900","repositories_listed":0,"syntology":null},{"url":null,"slug":"memorization-in-deep-learning-a-survey","title":"Memorization in deep learning: A survey","date":"2024-06-06","arxiv_id":"2406.03880","repositories_listed":0,"syntology":null},{"url":null,"slug":"what-should-embeddings-embed-autoregressive","title":"What Should Embeddings Embed? Autoregressive Models Represent Latent Generating Distributions","date":"2024-06-06","arxiv_id":"2406.03707","repositories_listed":0,"syntology":null},{"url":null,"slug":"efficiently-train-asr-models-that-memorize","title":"Efficiently Train ASR Models that Memorize Less and Perform Better with Per-core Clipping","date":"2024-06-04","arxiv_id":"2406.02004","repositories_listed":0,"syntology":null},{"url":null,"slug":"differentially-private-fine-tuning-of","title":"Differentially Private Fine-Tuning of Diffusion Models","date":"2024-06-03","arxiv_id":"2406.01355","repositories_listed":0,"syntology":null},{"url":null,"slug":"memorized-images-in-diffusion-models-share-a","title":"Memorized Images in Diffusion Models share a Subspace that can be Located and Deleted","date":"2024-06-01","arxiv_id":"2406.18566","repositories_listed":0,"syntology":null},{"url":null,"slug":"breaking-indistinguishability-with-transfer","title":"A Machine Learning-Based Framework for Assessing Cryptographic Indistinguishability of Lightweight Block Ciphers","date":"2024-05-30","arxiv_id":"2405.19683","repositories_listed":0,"syntology":null},{"url":null,"slug":"how-does-perfect-fitting-affect","title":"How Do the Architecture and Optimizer Affect Representation Learning? On the Training Dynamics of Representations in Deep Neural Networks","date":"2024-05-27","arxiv_id":"2405.17377","repositories_listed":0,"syntology":null},{"url":"/paper/unsupervised-meta-learning-via-in-context","slug":"unsupervised-meta-learning-via-in-context","title":"Unsupervised Meta-Learning via In-Context Learning","date":"2024-05-25","arxiv_id":"2405.16124","repositories_listed":0,"syntology":{"n":1,"n_ran":1,"n_constructed":0,"n_ran_checked":1,"n_instrument":0,"n_unverified":0,"n_honours":0,"n_violates":0,"n_no_contract":1,"n_pointer_only":1,"phrase":"1 ran (of which 0 constructed an object rather than computing a result; 1 with no instrument failure: 0 honoured, 0 violated, 1 with no contract checked; 0 where Syntology's instrument failed) · 0 unverified","sample_list":"/paper/unsupervised-meta-learning-via-in-context#ran","syntology_url":"https://syntology.ai/paper/2405.16124","mcp":{"get_harvested_code_for_paper":{"arxiv_id":"2405.16124"}},"official":null}},{"url":null,"slug":"bounds-for-the-smallest-eigenvalue-of-the-ntk","title":"Bounds for the smallest eigenvalue of the NTK for arbitrary spherical data of arbitrary dimension","date":"2024-05-23","arxiv_id":"2405.14630","repositories_listed":0,"syntology":null},{"url":null,"slug":"extracting-essential-and-disentangled","title":"FINED: Feed Instance-Wise Information Need with Essential and Disentangled Parametric Knowledge from the Past","date":"2024-05-20","arxiv_id":"2406.00012","repositories_listed":0,"syntology":null},{"url":null,"slug":"quantifying-in-context-reasoning-effects-and","title":"Quantifying In-Context Reasoning Effects and Memorization Effects in LLMs","date":"2024-05-20","arxiv_id":"2405.11880","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-multi-perspective-analysis-of-memorization","title":"A Multi-Perspective Analysis of Memorization in Large Language Models","date":"2024-05-19","arxiv_id":"2405.11577","repositories_listed":0,"syntology":null}],"record_sha256":"b5203ee6f9c4c81a450d665aacd4946ced48fc038aaff05a2ef44c6b42cbedaf","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}