{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/memorization/papers/11","list_of":"/task/memorization","task":"Memorization","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":11,"pages_in_order":11,"rows_per_page":100,"rows":[1001,1088],"of":1088,"counts":{"archive_papers_tagged":1088,"with_a_code_link":438,"where_syntology_ran_a_sample":177,"not_listed_spam_title":0,"listed":1088,"listed_where_code_ran":177,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":148,"every_run_a_failure_of_syntologys_instrument":29,"listed_with_a_run_with_no_instrument_failure":148,"listed_every_run_a_failure_of_syntologys_instrument":29,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/memorization","prev":"/task/memorization/papers/10","next":null,"papers":[{"url":null,"slug":"the-labeling-distribution-matrix-ldm-a-tool","title":"The Labeling Distribution Matrix (LDM): A Tool for Estimating Machine Learning Algorithm Capacity","date":"2019-12-23","arxiv_id":"1912.10597","repositories_listed":0,"syntology":null},{"url":null,"slug":"neural-networks-learning-and-memorization","title":"Neural Networks Learning and Memorization with (almost) no Over-Parameterization","date":"2019-11-22","arxiv_id":"1911.09873","repositories_listed":0,"syntology":null},{"url":null,"slug":"neural-network-memorization-dissection","title":"Neural Network Memorization Dissection","date":"2019-11-21","arxiv_id":"1911.09537","repositories_listed":0,"syntology":null},{"url":null,"slug":"on-the-unintended-social-bias-of-training","title":"On the Unintended Social Bias of Training Language Generation Models with Data from Local Media","date":"2019-11-01","arxiv_id":"1911.00461","repositories_listed":0,"syntology":null},{"url":null,"slug":"robust-training-with-ensemble-consensus","title":"Robust Training with Ensemble Consensus","date":"2019-10-22","arxiv_id":"1910.09792","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-simple-approach-to-the-noisy-label-problem","title":"A Simple Approach to the Noisy Label Problem Through the Gambler's Loss","date":"2019-09-25","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"assessing-generalization-in-td-methods-for","title":"Assessing Generalization in TD methods for Deep Reinforcement Learning","date":"2019-09-25","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"autoencoder-based-initialization-for","title":"Autoencoder-based Initialization for Recurrent Neural Networks with a Linear Memory","date":"2019-09-25","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"on-the-unintended-social-bias-of-training-1","title":"On the Unintended Social Bias of Training Language Generation Models with News Articles","date":"2019-09-25","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"overparameterized-neural-networks-can-1","title":"Overparameterized Neural Networks Can Implement Associative Memory","date":"2019-09-25","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"the-sooner-the-better-investigating-structure","title":"The Sooner The Better: Investigating Structure of Early Winning Lottery Tickets","date":"2019-09-25","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"fault-diagnosing-slam-for-varying-scale","title":"Fault-Diagnosing SLAM for Varying Scale Change Detection","date":"2019-09-16","arxiv_id":"1909.09592","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-sparsity-in-reservoir-computing","title":"Learning sparsity in reservoir computing through a novel bio-inspired algorithm","date":"2019-07-19","arxiv_id":"1907.08600","repositories_listed":0,"syntology":null},{"url":null,"slug":"circuit-based-intrinsic-methods-to-detect","title":"Circuit-Based Intrinsic Methods to Detect Overfitting","date":"2019-07-03","arxiv_id":"1907.01991","repositories_listed":0,"syntology":null},{"url":null,"slug":"stolen-memories-leveraging-model-memorization","title":"Stolen Memories: Leveraging Model Memorization for Calibrated White-Box Membership Inference","date":"2019-06-27","arxiv_id":"1906.11798","repositories_listed":0,"syntology":null},{"url":null,"slug":"on-the-role-of-geometry-in-geo-localization","title":"On the Role of Geometry in Geo-Localization","date":"2019-06-26","arxiv_id":"1906.10855","repositories_listed":0,"syntology":null},{"url":null,"slug":"decoupling-gating-from-linearity-1","title":"Decoupling Gating from Linearity","date":"2019-06-12","arxiv_id":"1906.05032","repositories_listed":0,"syntology":null},{"url":null,"slug":"does-learning-require-memorization-a-short","title":"Does Learning Require Memorization? A Short Tale about a Long Tail","date":"2019-06-12","arxiv_id":"1906.05271","repositories_listed":0,"syntology":null},{"url":null,"slug":"190604809","title":"Suppressing Model Overfitting for Image Super-Resolution Networks","date":"2019-06-11","arxiv_id":"1906.04809","repositories_listed":0,"syntology":null},{"url":"/paper/stable-rank-normalization-for-improved","slug":"stable-rank-normalization-for-improved","title":"Stable Rank Normalization for Improved Generalization in Neural Networks and GANs","date":"2019-06-11","arxiv_id":"1906.04659","repositories_listed":0,"syntology":null},{"url":null,"slug":"190600904","title":"Deep ReLU Networks Have Surprisingly Few Activation Patterns","date":"2019-06-03","arxiv_id":"1906.00904","repositories_listed":0,"syntology":null},{"url":null,"slug":"better-generalization-with-on-the-fly-dataset","title":"Better Generalization with On-the-fly Dataset Denoising","date":"2019-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"downsampling-leads-to-image-memorization-in","title":"Downsampling leads to Image Memorization in Convolutional Autoencoders","date":"2019-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"investigating-cnns-learning-representation","title":"Investigating CNNs' Learning Representation under label noise","date":"2019-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"long-term-vehicle-localization-by-recursive","title":"Long-Term Vehicle Localization by Recursive Knowledge Distillation","date":"2019-04-07","arxiv_id":"1904.03551","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-information-complexity-of-learning-tasks","title":"The Information Complexity of Learning Tasks, their Structure and their Distance","date":"2019-04-05","arxiv_id":"1904.03292","repositories_listed":0,"syntology":null},{"url":null,"slug":"understanding-feature-selection-and-feature","title":"Understanding Feature Selection and Feature Memorization in Recurrent Neural Networks","date":"2019-03-03","arxiv_id":"1903.00906","repositories_listed":0,"syntology":null},{"url":null,"slug":"identity-crisis-memorization-and","title":"Identity Crisis: Memorization and Generalization under Extreme Overparameterization","date":"2019-02-13","arxiv_id":"1902.04698","repositories_listed":0,"syntology":null},{"url":null,"slug":"do-we-train-on-test-data-purging-cifar-of","title":"Do We Train on Test Data? Purging CIFAR of Near-Duplicates","date":"2019-02-01","arxiv_id":"1902.00423","repositories_listed":0,"syntology":null},{"url":null,"slug":"revisiting-sample-selection-approach-to","title":"Revisiting Sample Selection Approach to Positive-Unlabeled Learning: Turning Unlabeled Data into Positive rather than Negative","date":"2019-01-29","arxiv_id":"1901.10155","repositories_listed":0,"syntology":null},{"url":null,"slug":"state-regularized-recurrent-neural-networks","title":"State-Regularized Recurrent Neural Networks","date":"2019-01-25","arxiv_id":"1901.08817","repositories_listed":0,"syntology":null},{"url":"/paper/videomem-constructing-analyzing-predicting","slug":"videomem-constructing-analyzing-predicting","title":"VideoMem: Constructing, Analyzing, Predicting Short-term and Long-term Video Memorability","date":"2018-12-05","arxiv_id":"1812.01973","repositories_listed":0,"syntology":null},{"url":null,"slug":"limited-gradient-descent-learning-with-noisy","title":"Limited Gradient Descent: Learning With Noisy Labels","date":"2018-11-20","arxiv_id":"1811.08117","repositories_listed":0,"syntology":null},{"url":null,"slug":"leveraging-random-label-memorization-for","title":"Leveraging Random Label Memorization for Unsupervised Pre-Training","date":"2018-11-05","arxiv_id":"1811.01640","repositories_listed":0,"syntology":null},{"url":null,"slug":"finite-sample-expressive-power-of-small-width","title":"Small ReLU networks are powerful memorizers: a tight analysis of memorization capacity","date":"2018-10-17","arxiv_id":"1810.07770","repositories_listed":0,"syntology":null},{"url":null,"slug":"are-you-sure-youwant-to-do-that","title":"Are You Sure YouWant To Do That? Classification with Interpretable Queries","date":"2018-10-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"memorization-in-overparameterized","title":"Memorization in Overparameterized Autoencoders","date":"2018-10-16","arxiv_id":"1810.10333","repositories_listed":0,"syntology":null},{"url":null,"slug":"detecting-memorization-in-relu-networks","title":"Detecting Memorization in ReLU Networks","date":"2018-10-08","arxiv_id":"1810.03372","repositories_listed":0,"syntology":null},{"url":null,"slug":"wide-and-deep-learning-for-peer-to-peer","title":"Wide and Deep Learning for Peer-to-Peer Lending","date":"2018-10-05","arxiv_id":"1810.03466","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-practical-approach-to-sizing-neural","title":"A Practical Approach to Sizing Neural Networks","date":"2018-10-04","arxiv_id":"1810.02328","repositories_listed":0,"syntology":null},{"url":null,"slug":"pumpout-a-meta-approach-for-robustly-training","title":"Pumpout: A Meta Approach for Robustly Training Deep Neural Networks with Noisy Labels","date":"2018-09-27","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"state-regularized-recurrent-networks","title":"State-Regularized Recurrent Networks","date":"2018-09-27","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"deja-vu-an-empirical-evaluation-of-the","title":"Déjà Vu: an empirical evaluation of the memorization properties of ConvNets","date":"2018-09-17","arxiv_id":"1809.06396","repositories_listed":0,"syntology":null},{"url":"/paper/closed-book-training-to-improve-summarization","slug":"closed-book-training-to-improve-summarization","title":"Closed-Book Training to Improve Summarization Encoder Memory","date":"2018-09-12","arxiv_id":"1809.04585","repositories_listed":0,"syntology":null},{"url":null,"slug":"are-you-sure-you-want-to-do-that","title":"Are You Sure You Want To Do That? Classification with Verification","date":"2018-09-07","arxiv_id":"1809.02652","repositories_listed":0,"syntology":null},{"url":"/paper/videomatch-matching-based-video-object","slug":"videomatch-matching-based-video-object","title":"VideoMatch: Matching based Video Object Segmentation","date":"2018-09-04","arxiv_id":"1809.01123","repositories_listed":0,"syntology":null},{"url":null,"slug":"airline-passenger-name-record-generation","title":"Airline Passenger Name Record Generation using Generative Adversarial Networks","date":"2018-07-17","arxiv_id":"1807.06657","repositories_listed":0,"syntology":null},{"url":null,"slug":"mediaeval-2018-predicting-media-memorability","title":"MediaEval 2018: Predicting Media Memorability Task","date":"2018-07-03","arxiv_id":"1807.01052","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-spline-theory-of-deep-learning","title":"A Spline Theory of Deep Learning","date":"2018-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-and-memorization","title":"Learning and Memorization","date":"2018-07-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"olive-oil-is-made-of-olives-baby-oil-is-made-1","title":"Olive Oil is Made \\textitof Olives, Baby Oil is Made \\textitfor Babies: Interpreting Noun Compounds Using Paraphrases in a Neural Model","date":"2018-06-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"lstms-exploit-linguistic-attributes-of-data","title":"LSTMs Exploit Linguistic Attributes of Data","date":"2018-05-29","arxiv_id":"1805.11653","repositories_listed":0,"syntology":null},{"url":null,"slug":"approximating-real-time-recurrent-learning","title":"Approximating Real-Time Recurrent Learning with Random Kronecker Factors","date":"2018-05-28","arxiv_id":"1805.10842","repositories_listed":0,"syntology":null},{"url":null,"slug":"refining-source-representations-with-relation-1","title":"Refining Source Representations with Relation Networks for Neural Machine Translation","date":"2018-05-25","arxiv_id":"1805.11154","repositories_listed":0,"syntology":null},{"url":null,"slug":"dnn-or-k-nn-that-is-the-generalize-vs","title":"DNN or k-NN: That is the Generalize vs. Memorize Question","date":"2018-05-17","arxiv_id":"1805.06822","repositories_listed":0,"syntology":null},{"url":null,"slug":"mad-max-affine-spline-insights-into-deep","title":"Mad Max: Affine Spline Insights into Deep Learning","date":"2018-05-17","arxiv_id":"1805.06576","repositories_listed":0,"syntology":null},{"url":null,"slug":"memgen-memory-is-all-you-need","title":"MemGEN: Memory is All You Need","date":"2018-03-29","arxiv_id":"1803.11203","repositories_listed":0,"syntology":null},{"url":"/paper/fast-parametric-learning-with-activation","slug":"fast-parametric-learning-with-activation","title":"Fast Parametric Learning with Activation Memorization","date":"2018-03-27","arxiv_id":"1803.10049","repositories_listed":0,"syntology":null},{"url":null,"slug":"algebraic-machine-learning","title":"Algebraic Machine Learning","date":"2018-03-14","arxiv_id":"1803.05252","repositories_listed":0,"syntology":null},{"url":null,"slug":"detecting-learning-vs-memorization-in-deep","title":"Detecting Learning vs Memorization in Deep Neural Networks using Shared Structure Validation Sets","date":"2018-02-21","arxiv_id":"1802.07714","repositories_listed":0,"syntology":null},{"url":null,"slug":"same-different-problems-strain-convolutional","title":"Same-different problems strain convolutional neural networks","date":"2018-02-09","arxiv_id":"1802.03390","repositories_listed":0,"syntology":null},{"url":null,"slug":"structured-memory-based-deep-model-to-detect","title":"Structured Memory based Deep Model to Detect as well as Characterize Novel Inputs","date":"2018-01-30","arxiv_id":"1801.09859","repositories_listed":0,"syntology":null},{"url":null,"slug":"empirical-explorations-in-training-networks","title":"Empirical Explorations in Training Networks with Discrete Activations","date":"2018-01-16","arxiv_id":"1801.05156","repositories_listed":0,"syntology":null},{"url":null,"slug":"not-so-clevr-visual-relations-strain","title":"Not-So-CLEVR: Visual Relations Strain Feedforward Neural Networks","date":"2018-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"optimizing-human-learning","title":"Optimizing Human Learning","date":"2017-12-05","arxiv_id":"1712.01856","repositories_listed":0,"syntology":null},{"url":null,"slug":"nonlinear-random-matrix-theory-for-deep","title":"Nonlinear random matrix theory for deep learning","date":"2017-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"markov-chain-hebbian-learning-algorithm-with","title":"Markov chain Hebbian learning algorithm with ternary synaptic units","date":"2017-11-23","arxiv_id":"1711.08679","repositories_listed":0,"syntology":null},{"url":null,"slug":"three-factors-influencing-minima-in-sgd","title":"Three Factors Influencing Minima in SGD","date":"2017-11-13","arxiv_id":"1711.04623","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-to-update-auto-associative-memory-in","title":"Learning to update Auto-associative Memory in Recurrent Neural Networks for Improving Sequence Memorization","date":"2017-09-19","arxiv_id":"1709.06493","repositories_listed":0,"syntology":null},{"url":null,"slug":"zero-shot-learning-to-manage-a-large-number","title":"Zero-Shot Learning to Manage a Large Number of Place-Specific Compressive Change Classifiers","date":"2017-09-15","arxiv_id":"1709.05397","repositories_listed":0,"syntology":null},{"url":null,"slug":"geometry-of-neural-network-loss-surfaces-via","title":"Geometry of Neural Network Loss Surfaces via Random Matrix Theory","date":"2017-08-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"most-ligand-based-classification-benchmarks","title":"Most Ligand-Based Classification Benchmarks Reward Memorization Rather than Generalization","date":"2017-06-20","arxiv_id":"1706.06619","repositories_listed":0,"syntology":null},{"url":null,"slug":"latent-geometry-and-memorization-in","title":"Latent Geometry and Memorization in Generative Models","date":"2017-05-25","arxiv_id":"1705.09303","repositories_listed":0,"syntology":null},{"url":null,"slug":"learn-memorize-recall-reduce-a-robotic-cloud","title":"Learn-Memorize-Recall-Reduce A Robotic Cloud Computing Paradigm","date":"2017-04-16","arxiv_id":"1704.04712","repositories_listed":0,"syntology":null},{"url":null,"slug":"soft-label-memorization-generalization-for","title":"Soft Label Memorization-Generalization for Natural Language Inference","date":"2017-02-27","arxiv_id":"1702.08563","repositories_listed":0,"syntology":null},{"url":null,"slug":"3d-human-pose-estimation-2d-pose-estimation","title":"3D Human Pose Estimation = 2D Pose Estimation + Matching","date":"2016-12-20","arxiv_id":"1612.06524","repositories_listed":0,"syntology":null},{"url":null,"slug":"stable-memory-allocation-in-the-hippocampus","title":"Stable Memory Allocation in the Hippocampus: Fundamental Limits and Neural Realization","date":"2016-12-14","arxiv_id":"1612.04659","repositories_listed":0,"syntology":null},{"url":null,"slug":"parameter-compression-of-recurrent-neural","title":"Parameter Compression of Recurrent Neural Networks and Degradation of Short-term Memory","date":"2016-12-02","arxiv_id":"1612.00891","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-word-alignment-for-low-resource","title":"Improving word alignment for low resource languages using English monolingual SRL","date":"2016-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"prototypical-recurrent-unit","title":"Prototypical Recurrent Unit","date":"2016-11-20","arxiv_id":"1611.06530","repositories_listed":0,"syntology":null},{"url":null,"slug":"nn-grams-unifying-neural-network-and-n-gram","title":"NN-grams: Unifying neural network and n-gram language models for Speech Recognition","date":"2016-06-23","arxiv_id":"1606.07470","repositories_listed":0,"syntology":null},{"url":null,"slug":"blink-rate-variability-during-resting-and","title":"Blink Rate Variability during resting and reading sessions","date":"2016-04-13","arxiv_id":"1605.02037","repositories_listed":0,"syntology":null},{"url":null,"slug":"semantic-object-parsing-with-local-global","title":"Semantic Object Parsing with Local-Global Long Short-Term Memory","date":"2015-11-14","arxiv_id":"1511.04510","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-deep-neural-network-policies-with","title":"Learning Deep Neural Network Policies with Continuous Memory States","date":"2015-07-05","arxiv_id":"1507.01273","repositories_listed":0,"syntology":null},{"url":null,"slug":"variance-reduced-stochastic-gradient-descent-1","title":"Variance Reduced Stochastic Gradient Descent with Neighbors","date":"2015-06-11","arxiv_id":"1506.03662","repositories_listed":0,"syntology":null},{"url":null,"slug":"recurrent-neural-networks-with-external","title":"Recurrent Neural Networks with External Memory for Language Understanding","date":"2015-05-31","arxiv_id":"1506.00195","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-comparative-study-of-reservoir-computing","title":"A Comparative Study of Reservoir Computing for Temporal Signal Processing","date":"2014-01-10","arxiv_id":"1401.2224","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-generalization-and-functional","title":"Learning, Generalization, and Functional Entropy in Random Automata Networks","date":"2013-06-25","arxiv_id":"1306.6041","repositories_listed":0,"syntology":null}],"record_sha256":"f2672fc42cf84e385c79ab9f4b86afae041493295dde4f92ad2f345afc4a9d80","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}