Browse State-of-the-Art › Model Compression › Papers, page 12
Model Compression
Papers archive 2025-07-28
archive papers tagged: 1,356 · with a code link: 440 · where Syntology ran a sample: 119 (97 with a run with no instrument failure, 22 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (119 of 1,356 tagged: 97 with a run with no instrument failure, 22 where every run was a failure of Syntology's instrument)
Page 12 of 14: papers 1,101 to 1,200 of 1,356, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
29 Nov 2020 0 repositories listed
-
Auto Graph Encoder-Decoder for Neural Network Pruning25 Nov 2020 0 repositories listed
-
Bringing AI To Edge: From Deep Learning's Perspective25 Nov 2020 0 repositories listed
-
MixMix: All You Need for Data-Free Compression Are Feature and Data Mixing19 Nov 2020 0 repositories listed
-
Automated Model Compression by Jointly Applied Pruning and Quantization12 Nov 2020 0 repositories listed
-
Neural Network Compression Via Sparse Optimization10 Nov 2020 0 repositories listed
-
Effective Model Compression via Stage-wise Pruning10 Nov 2020 0 repositories listed
-
Know What You Don't Need: Single-Shot Meta-Pruning for Attention Heads7 Nov 2020 0 repositories listed
-
Exploring the Boundaries of Low-Resource BERT Distillation1 Nov 2020 0 repositories listed
-
Watermarking Graph Neural Networks by Random Graphs1 Nov 2020 0 repositories listed
-
Activation Map Adaptation for Effective Knowledge Distillation26 Oct 2020 0 repositories listed
-
MARS: Multi-macro Architecture SRAM CIM-Based Accelerator with Co-designed Compressed Neural Networks24 Oct 2020 0 repositories listed
-
AutoBSS: An Efficient Algorithm for Block Stacking Style Search20 Oct 2020 0 repositories listed
-
Knowledge Distillation in Wide Neural Networks: Risk Bound, Data Efficiency and Imperfect Teacher20 Oct 2020 0 repositories listed
-
Noisy Neural Network Compression for Analog Storage Devices19 Oct 2020 0 repositories listed
-
Closed-Loop Neural Interfaces with Embedded Machine Learning15 Oct 2020 0 repositories listed
-
Weight Squeezing: Reparameterization for Knowledge Transfer and Model Compression14 Oct 2020 0 repositories listed
-
A Model Compression Method with Matrix Product Operators for Speech Enhancement10 Oct 2020 0 repositories listed
-
Compressing Deep Convolutional Neural Networks by Stacking Low-dimensional Binary Convolution Filters6 Oct 2020 0 repositories listed
-
GECKO: Reconciling Privacy, Accuracy and Efficiency in Embedded Deep Learning2 Oct 2020 0 repositories listed
-
Pea-KD: Parameter-efficient and Accurate Knowledge Distillation on BERT30 Sep 2020 0 repositories listed
-
Pea-KD: Parameter-efficient and accurate Knowledge Distillation28 Sep 2020 0 repositories listed
-
Conditional Automated Channel Pruning for Deep Neural Networks21 Sep 2020 0 repositories listed
-
MSP: An FPGA-Specific Mixed-Scheme, Multi-Precision Deep Neural Network Quantization Framework16 Sep 2020 0 repositories listed
-
A Progressive Sub-Network Searching Framework for Dynamic Inference11 Sep 2020 0 repositories listed
-
A Partial Regularization Method for Network Compression3 Sep 2020 0 repositories listed
-
Layer-specific Optimization for Mixed Data Flow with Mixed Precision in FPGA Design for CNN-based Object Detectors3 Sep 2020 0 repositories listed
-
Against Membership Inference Attack: Pruning is All You Need28 Aug 2020 0 repositories listed
-
One Weight Bitwidth to Rule Them All22 Aug 2020 0 repositories listed
-
Data-Independent Structured Pruning of Neural Networks via Coresets19 Aug 2020 0 repositories listed
-
Cascaded channel pruning using hierarchical self-distillation16 Aug 2020 0 repositories listed
-
Towards Modality Transferable Visual Information Representation with Optimal Model Compression13 Aug 2020 0 repositories listed
-
Adaptive Learning of Tensor Network Structures12 Aug 2020 0 repositories listed
-
Iterative Compression of End-to-End ASR Model using AutoML6 Aug 2020 0 repositories listed
-
Structured Convolutions for Efficient Neural Network Design6 Aug 2020 0 repositories listed
-
TutorNet: Towards Flexible Knowledge Distillation for End-to-End Speech Recognition3 Aug 2020 0 repositories listed
-
Differentiable Feature Aggregation Search for Knowledge Distillation2 Aug 2020 0 repositories listed
-
Compressing Deep Neural Networks via Layer Fusion29 Jul 2020 0 repositories listed
-
ALF: Autoencoder-based Low-rank Filter-sharing for Efficient Convolutional Neural Networks27 Jul 2020 0 repositories listed
-
RT3D: Achieving Real-Time Execution of 3D Convolutional Neural Networks on Mobile Devices20 Jul 2020 0 repositories listed
-
FTRANS: Energy-Efficient Acceleration of Transformers using FPGA16 Jul 2020 0 repositories listed
-
Representation Transfer by Optimal Transport13 Jul 2020 0 repositories listed
-
Learning to Prune Deep Neural Networks via Reinforcement Learning9 Jul 2020 0 repositories listed
-
Soft Labeling Affects Out-of-Distribution Detection of Deep Neural Networks7 Jul 2020 0 repositories listed
-
Knowledge Distillation Beyond Model Compression3 Jul 2020 0 repositories listed
-
Channel Compression: Rethinking Information Redundancy among Channels in CNN Architecture2 Jul 2020 0 repositories listed
-
Exploring the Limits of Simple Learners in Knowledge Distillation for Document Classification with DocBERT1 Jul 2020 0 repositories listed
-
Go Wide, Then Narrow: Efficient Training of Deep Thin Networks1 Jul 2020 0 repositories listed
-
On the Demystification of Knowledge Distillation: A Residual Network Perspective30 Jun 2020 0 repositories listed
-
PFGDF: Pruning Filter via Gaussian Distribution Feature for Deep Neural Networks Acceleration23 Jun 2020 0 repositories listed
-
Additive Tree-Structured Covariance Function for Conditional Parameter Spaces in Bayesian Optimization21 Jun 2020 0 repositories listed
-
ResOT: Resource-Efficient Oblique Trees for Neural Signal Classification14 Jun 2020 0 repositories listed
-
Dynamic Model Pruning with Feedback12 Jun 2020 0 repositories listed
-
An Embedded Deep Learning Object Detection Model For Traffic In Asian Countries9 Jun 2020 0 repositories listed
-
Knowledge Distillation: A Survey9 Jun 2020 0 repositories listed
-
AdaDeep: A Usage-Driven, Automated Deep Model Compression Framework for Enabling Ubiquitous Intelligent Mobiles8 Jun 2020 0 repositories listed
-
EDCompress: Energy-Aware Model Compression for Dataflows8 Jun 2020 0 repositories listed
-
An Overview of Neural Network Compression5 Jun 2020 0 repositories listed
-
Discrete Model Compression With Resource Constraint for Deep Neural Networks1 Jun 2020 0 repositories listed
-
Multi-Dimensional Pruning: A Unified Framework for Model Compression1 Jun 2020 0 repositories listed
-
Weight Squeezing: Reparameterization for Compression and Fast Inference30 May 2020 0 repositories listed
-
Exploiting Non-Linear Redundancy for Neural Model Compression28 May 2020 0 repositories listed
-
Compressing Recurrent Neural Networks Using Hierarchical Tucker Tensor Decomposition9 May 2020 0 repositories listed
-
Pruning Algorithms to Accelerate Convolutional Neural Networks for Edge Applications: A Survey8 May 2020 0 repositories listed
-
SmartExchange: Trading Higher-cost Memory Storage/Access for Lower-cost Computation7 May 2020 0 repositories listed
-
Distilling Spikes: Knowledge Distillation in Spiking Neural Networks1 May 2020 0 repositories listed
-
Streamlining Tensor and Network Pruning in PyTorch28 Apr 2020 0 repositories listed
-
Robust testing of low-dimensional functions24 Apr 2020 0 repositories listed
-
PERMDNN: Efficient Compressed DNN Architecture with Permuted Diagonal Matrices23 Apr 2020 0 repositories listed
-
Lottery Hypothesis based Unsupervised Pre-training for Model Compression in Federated Learning21 Apr 2020 0 repositories listed
-
Extending DeepSDF for automatic 3D shape retrieval and similarity transform estimation20 Apr 2020 0 repositories listed
-
GeneCAI: Genetic Evolution for Acquiring Compact AI8 Apr 2020 0 repositories listed
-
LadaBERT: Lightweight Adaptation of BERT through Hybrid Model Compression8 Apr 2020 0 repositories listed
-
Introducing Pose Consistency and Warp-Alignment for Self-Supervised 6D Object Pose Estimation in Color Images27 Mar 2020 0 repositories listed
-
A Survey on Contextual Embeddings16 Mar 2020 0 repositories listed
-
A Privacy-Preserving-Oriented DNN Pruning and Mobile Acceleration Framework13 Mar 2020 0 repositories listed
-
Learning by Sampling and Compressing: Efficient Graph Representation Learning with Extremely Limited Annotations13 Mar 2020 0 repositories listed
-
Knowledge distillation via adaptive instance normalization9 Mar 2020 0 repositories listed
-
Pacemaker: Intermediate Teacher Knowledge Distillation For On-The-Fly Convolutional Neural Network9 Mar 2020 0 repositories listed
-
5 Mar 2020 0 repositories listed
-
An Efficient Method of Training Small Models for Regression Problems with Knowledge Distillation28 Feb 2020 0 repositories listed
-
Compressing Large-Scale Transformer-Based Models: A Case Study on BERT27 Feb 2020 0 repositories listed
-
Residual Knowledge Distillation21 Feb 2020 0 repositories listed
-
Balancing Cost and Benefit with Tied-Multi Transformers20 Feb 2020 0 repositories listed
-
Performance Aware Convolutional Neural Network Channel Pruning for Embedded GPUs20 Feb 2020 0 repositories listed
-
PCNN: Pattern-based Fine-Grained Regular Pruning towards Optimizing CNN Accelerators11 Feb 2020 0 repositories listed
-
Understanding and Improving Knowledge Distillation10 Feb 2020 0 repositories listed
-
Lightweight Convolutional Representations for On-Device Natural Language Processing4 Feb 2020 0 repositories listed
-
Search for Better Students to Learn Distilled Knowledge30 Jan 2020 0 repositories listed
-
MT-BioNER: Multi-task Learning for Biomedical Named Entity Recognition using Deep Bidirectional Transformers24 Jan 2020 0 repositories listed
-
Small, Accurate, and Fast Vehicle Re-ID on the Edge: the SAFR Approach24 Jan 2020 0 repositories listed
-
SS-Auto: A Single-Shot, Automatic Structured Weight Pruning Framework of DNNs with Ultra-High Efficiency23 Jan 2020 0 repositories listed
-
A "Network Pruning Network" Approach to Deep Model Compression15 Jan 2020 0 repositories listed
-
Differentiable Architecture Compression1 Jan 2020 0 repositories listed
-
FedBoost: A Communication-Efficient Algorithm for Federated Learning1 Jan 2020 0 repositories listed
-
PatDNN: Achieving Real-Time DNN Execution on Mobile Devices with Pattern-based Weight Pruning1 Jan 2020 0 repositories listed
-
DeGAN : Data-Enriching GAN for Retrieving Representative Samples from a Trained Classifier27 Dec 2019 0 repositories listed
-
Domain Adaptation Regularization for Spectral Pruning26 Dec 2019 0 repositories listed
-
Towards Building a Real Time Mobile Device Bird Counting System Through Synthetic Data Training and Model Compression15 Dec 2019 0 repositories listed
-
An Improving Framework of regularization for Network Compression11 Dec 2019 0 repositories listed