Browse State-of-the-Art › Model Compression › Papers, page 13
Model Compression
Papers archive 2025-07-28
archive papers tagged: 1,356 · with a code link: 440 · where Syntology ran a sample: 119 (97 with a run with no instrument failure, 22 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (119 of 1,356 tagged: 97 with a run with no instrument failure, 22 where every run was a failure of Syntology's instrument)
Page 13 of 14: papers 1,201 to 1,300 of 1,356, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Explaining Sequence-Level Knowledge Distillation as Data-Augmentation for Neural Machine Translation6 Dec 2019 0 repositories listed
-
Deep Model Compression Via Two-Stage Deep Reinforcement Learning4 Dec 2019 0 repositories listed
-
The Knowledge Within: Methods for Data-Free Model Compression3 Dec 2019 0 repositories listed
-
Pruning at a Glance: Global Neural Pruning for Model Compression30 Nov 2019 0 repositories listed
-
Communication-Efficient Distributed Online Learning with Kernels28 Nov 2019 0 repositories listed
-
Data-Driven Compression of Convolutional Neural Networks28 Nov 2019 0 repositories listed
-
Structured Multi-Hashing for Model Compression25 Nov 2019 0 repositories listed
-
A SOT-MRAM-based Processing-In-Memory Engine for Highly Compressed DNN Implementation24 Nov 2019 0 repositories listed
-
Graph Pruning for Model Compression22 Nov 2019 0 repositories listed
-
DARB: A Density-Aware Regular-Block Pruning for Deep Neural Networks19 Nov 2019 0 repositories listed
-
Distributed Low Precision Training Without Mixed Precision18 Nov 2019 0 repositories listed
-
ASCAI: Adaptive Sampling for acquiring Compact AI15 Nov 2019 0 repositories listed
-
SubCharacter Chinese-English Neural Machine Translation with Wubi encoding7 Nov 2019 0 repositories listed
-
Localization-aware Channel Pruning for Object Detection6 Nov 2019 0 repositories listed
-
Locality-Sensitive Hashing for f-Divergences: Mutual Information Loss and Beyond28 Oct 2019 0 repositories listed
-
Cross-Channel Intragroup Sparsity Neural Network26 Oct 2019 0 repositories listed
-
LPRNet: Lightweight Deep Network by Low-rank Pointwise Residual Convolution25 Oct 2019 0 repositories listed
-
Model Compression with Two-stage Multi-teacher Knowledge Distillation for Web Question Answering System18 Oct 2019 0 repositories listed
-
Structured Pruning of a BERT-based Question Answering Model14 Oct 2019 0 repositories listed
-
Differentiable Sparsification for Deep Neural Networks8 Oct 2019 0 repositories listed
-
REQ-YOLO: A Resource-Aware, Efficient Quantization Framework for Object Detection on FPGAs29 Sep 2019 0 repositories listed
-
Robust Membership Encoding: Inference Attacks and Copyright Protection for Deep Learning27 Sep 2019 0 repositories listed
-
Atomic Compression Networks25 Sep 2019 0 repositories listed
-
Balancing Specialization, Generalization, and Compression for Detection and Tracking25 Sep 2019 0 repositories listed
-
Decoupling Weight Regularization from Batch Size for Model Compression25 Sep 2019 0 repositories listed
-
Extremely Small BERT Models from Mixed-Vocabulary Training25 Sep 2019 0 repositories listed
-
GQ-Net: Training Quantization-Friendly Deep Networks25 Sep 2019 0 repositories listed
-
Network Pruning for Low-Rank Binary Index25 Sep 2019 0 repositories listed
-
Differentiable Mask for Pruning Convolutional and Recurrent Networks10 Sep 2019 0 repositories listed
-
PCONV: The Missing but Desirable Sparsity in DNN Weight Pruning for Real-time Execution on Mobile Devices6 Sep 2019 0 repositories listed
-
On the Effectiveness of Low-Rank Matrix Factorization for LSTM Model Compression27 Aug 2019 0 repositories listed
-
Tiny but Accurate: A Pruned, Quantized and Optimized Memristor Crossbar Framework for Ultra Efficient DNN Implementation27 Aug 2019 0 repositories listed
-
MobiSR: Efficient On-Device Super-Resolution through Heterogeneous Mobile Processors21 Aug 2019 0 repositories listed
-
Tuning Algorithms and Generators for Efficient Edge Inference31 Jul 2019 0 repositories listed
-
Memory- and Communication-Aware Model Compression for Distributed Deep Learning Inference on IoT26 Jul 2019 0 repositories listed
-
Neural Epitome Search for Architecture-Agnostic Network Compression12 Jul 2019 0 repositories listed
-
Data-Independent Neural Pruning via Coresets9 Jul 2019 0 repositories listed
-
ShrinkML: End-to-End ASR Model Compression Using Reinforcement Learning8 Jul 2019 0 repositories listed
-
AutoCompress: An Automatic DNN Structured Pruning Framework for Ultra-High Compression Rates6 Jul 2019 0 repositories listed
-
Non-Structured DNN Weight Pruning -- Is It Beneficial in Any Platform?3 Jul 2019 0 repositories listed
-
Weight Normalization based Quantization for Deep Neural Network Compression1 Jul 2019 0 repositories listed
-
Joint Regularization on Activations and Weights for Efficient Neural Network Pruning19 Jun 2019 0 repositories listed
-
Scalable Model Compression by Entropy Penalized Reparameterization15 Jun 2019 0 repositories listed
-
Membership Privacy for Machine Learning Models Through Knowledge Transfer15 Jun 2019 0 repositories listed
-
Does Learning Require Memorization? A Short Tale about a Long Tail12 Jun 2019 0 repositories listed
-
Network Implosion: Effective Model Compression for ResNets via Static Layer Pruning and Retraining10 Jun 2019 0 repositories listed
-
Deep Face Recognition Model Compression via Knowledge Transfer and Distillation3 Jun 2019 0 repositories listed
-
Cross Domain Model Compression by Structurally Weight Sharing1 Jun 2019 0 repositories listed
-
Multi-Precision Quantized Neural Networks via Encoding Decomposition of -1 and +131 May 2019 0 repositories listed
-
HadaNets: Flexible Quantization Strategies for Neural Networks26 May 2019 0 repositories listed
-
Learning Low-Rank Approximation for CNNs24 May 2019 0 repositories listed
-
Structured Compression by Weight Encryption for Unstructured Pruning and Quantization24 May 2019 0 repositories listed
-
DARC: Differentiable ARchitecture Compression20 May 2019 0 repositories listed
-
Dream Distillation: A Data-Independent Model Compression Framework17 May 2019 0 repositories listed
-
Network Pruning for Low-Rank Binary Indexing14 May 2019 0 repositories listed
-
2-bit Model Compression of Deep Convolutional Neural Network on ASIC Engine for Image Retrieval8 May 2019 0 repositories listed
-
Creating Lightweight Object Detectors with Model Compression for Deployment on Edge Devices6 May 2019 0 repositories listed
-
26ms Inference Time for ResNet-50: Towards Real-Time Execution of all DNNs on Smartphone2 May 2019 0 repositories listed
-
Toward Extremely Low Bit and Lossless Accuracy in DNNs with Progressive ADMM2 May 2019 0 repositories listed
-
Double Viterbi: Weight Encoding for High Compression Ratio and Fast On-Chip Reconstruction for Deep Neural Network1 May 2019 0 repositories listed
-
Integral Pruning on Activations and Weights for Efficient Neural Networks1 May 2019 0 repositories listed
-
Model Compression with Generative Adversarial Networks1 May 2019 0 repositories listed
-
N-Ary Quantization for CNN Model Compression and Inference Acceleration1 May 2019 0 repositories listed
-
Selective Convolutional Units: Improving CNNs via Channel Selectivity1 May 2019 0 repositories listed
-
Conditional Teacher-Student Learning28 Apr 2019 0 repositories listed
-
Survey of Dropout Methods for Deep Neural Networks25 Apr 2019 0 repositories listed
-
Model Compression with Multi-Task Knowledge Distillation for Web-scale Question Answering System21 Apr 2019 0 repositories listed
-
Compression and Localization in Reinforcement Learning for ATARI Games20 Apr 2019 0 repositories listed
-
16 Apr 2019 0 repositories listed
-
3DQ: Compact Quantized Neural Networks for Volumetric Whole Brain Segmentation5 Apr 2019 0 repositories listed
-
Real time backbone for semantic segmentation16 Mar 2019 0 repositories listed
-
Recurrent Convolution for Compact and Cost-Adjustable Neural Networks: An Empirical Study26 Feb 2019 0 repositories listed
-
Efficient Memory Management for GPU-based Deep Learning Systems19 Feb 2019 0 repositories listed
-
Architecture Compression8 Feb 2019 0 repositories listed
-
MICIK: MIning Cross-Layer Inherent Similarity Knowledge for Deep Model Compression3 Feb 2019 0 repositories listed
-
Intrinsically Sparse Long Short-Term Memory Networks26 Jan 2019 0 repositories listed
-
Exploring the 3D architectures of deep material network in data-driven multiscale mechanics2 Jan 2019 0 repositories listed
-
Natively Interpretable Machine Learning and Artificial Intelligence: Preliminary Results and Future Directions2 Jan 2019 0 repositories listed
-
A Low Effort Approach to Structured CNN Design Using PCA15 Dec 2018 0 repositories listed
-
Stochastic Model Pruning via Weight Dropping Away and Back5 Dec 2018 0 repositories listed
-
Leveraging Filter Correlations for Deep Model Compression26 Nov 2018 0 repositories listed
-
A Survey of Mobile Computing for the Visually Impaired25 Nov 2018 0 repositories listed
-
Joint Neural Architecture Search and Quantization23 Nov 2018 0 repositories listed
-
Graph-Adaptive Pruning for Efficient Inference of Convolutional Neural Networks21 Nov 2018 0 repositories listed
-
Stability Based Filter Pruning for Accelerating Deep CNNs20 Nov 2018 0 repositories listed
-
Three Dimensional Convolutional Neural Network Pruning with Regularization-Based Method19 Nov 2018 0 repositories listed
-
Private Model Compression via Knowledge Distillation13 Nov 2018 0 repositories listed
-
Sequence-Level Knowledge Distillation for Model Compression of Attention-based Sequence-to-Sequence Speech Recognition12 Nov 2018 0 repositories listed
-
FLOPs as a Direct Optimization Objective for Learning Sparse Neural Networks7 Nov 2018 0 repositories listed
-
A Unified Framework of DNN Weight Pruning and Weight Clustering/Quantization Using ADMM5 Nov 2018 0 repositories listed
-
DeepTwist: Learning Model Compression via Occasional Weight Distortion30 Oct 2018 0 repositories listed
-
Distilling with Performance Enhanced Students24 Oct 2018 0 repositories listed
-
To Compress, or Not to Compress: Characterizing Deep Learning Model Compression for Embedded Inference21 Oct 2018 0 repositories listed
-
Block-wise Intermediate Representation Training for Model Compression20 Oct 2018 0 repositories listed
-
Compression of Deep Neural Networks by combining pruning and low rank decomposition20 Oct 2018 0 repositories listed
-
Pruning at a Glance: A Structured Class-Blind Pruning Technique for Model Compression20 Oct 2018 0 repositories listed
-
Recurrent Convolutions: A Model Compression Point of View20 Oct 2018 0 repositories listed
-
Progressive Weight Pruning of Deep Neural Networks using ADMM17 Oct 2018 0 repositories listed
-
Rate Distortion For Model Compression: From Theory To Practice9 Oct 2018 0 repositories listed
-
Efficient Computation of Quantized Neural Networks by {−1, +1} Encoding Decomposition8 Oct 2018 0 repositories listed