Browse State-of-the-Art › Model Compression › Papers, page 7
Model Compression
Papers archive 2025-07-28
archive papers tagged: 1,356 · with a code link: 440 · where Syntology ran a sample: 119 (97 with a run with no instrument failure, 22 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (119 of 1,356 tagged: 97 with a run with no instrument failure, 22 where every run was a failure of Syntology's instrument)
Page 7 of 14: papers 601 to 700 of 1,356, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
NVRC: Neural Video Representation Compression11 Sep 2024 0 repositories listed
-
Ultron: Enabling Temporal Geometry Compression of 3D Mesh Sequences using Temporal Correspondence and Mesh Deformation8 Sep 2024 0 repositories listed
-
LoCa: Logit Calibration for Knowledge Distillation7 Sep 2024 0 repositories listed
-
Efficient Point Cloud Classification via Offline Distillation Framework and Negative-Weight Self-Distillation Technique3 Sep 2024 0 repositories listed
-
Foundations of Large Language Model Compression -- Part 1: Weight Quantization3 Sep 2024 0 repositories listed
-
Edge AI: Evaluation of Model Compression Techniques for Convolutional Neural Networks2 Sep 2024 0 repositories listed
-
Convolutional Neural Network Compression Based on Low-Rank Decomposition29 Aug 2024 0 repositories listed
-
Variational autoencoder-based neural network model compression25 Aug 2024 0 repositories listed
-
MPruner: Optimizing Neural Network Size with CKA-Based Mutual Information Pruning24 Aug 2024 0 repositories listed
-
A Survey on Drowsiness Detection -- Modern Applications and Methods23 Aug 2024 0 repositories listed
-
A Web-Based Solution for Federated Learning with LLM-Based Automation23 Aug 2024 0 repositories listed
-
Fine-Tuning and Deploying Large Language Models Over Edges: Issues and Approaches20 Aug 2024 0 repositories listed
-
NeR-VCP: A Video Content Protection Method Based on Implicit Neural Representation20 Aug 2024 0 repositories listed
-
MoDeGPT: Modular Decomposition for Large Language Model Compression19 Aug 2024 0 repositories listed
-
RepControlNet: ControlNet Reparameterization17 Aug 2024 0 repositories listed
-
An Effective Information Theoretic Framework for Channel Pruning14 Aug 2024 0 repositories listed
-
Infra-YOLO: Efficient Neural Network Structure with Model Compression for Real-Time Infrared Small Object Detection14 Aug 2024 0 repositories listed
-
AdapMTL: Adaptive Pruning Framework for Multitask Learning Model7 Aug 2024 0 repositories listed
-
Compress and Compare: Interactively Evaluating Efficiency and Behavior Across ML Model Compression Experiments6 Aug 2024 0 repositories listed
-
DopQ-ViT: Towards Distribution-Friendly and Outlier-Aware Post-Training Quantization for Vision Transformers6 Aug 2024 0 repositories listed
-
Tensor Train Low-rank Approximation (TT-LoRA): Democratizing AI with Accelerated LLMs2 Aug 2024 0 repositories listed
-
Artificial Neural Networks for Photonic Applications: From Algorithms to Implementation2 Aug 2024 0 repositories listed
-
An Efficient Real-Time Object Detection Framework on Resource-Constricted Hardware Devices via Software and Hardware Co-design2 Aug 2024 0 repositories listed
-
NeuSemSlice: Towards Effective DNN Model Maintenance via Neuron-level Semantic Slicing26 Jul 2024 0 repositories listed
-
Comprehensive Study on Performance Evaluation and Optimization of Model Compression: Bridging Traditional Deep Learning and Large Language Models22 Jul 2024 0 repositories listed
-
LORTSAR: Low-Rank Transformer for Skeleton-based Action Recognition19 Jul 2024 0 repositories listed
-
Compressed models are NOT miniature versions of large models18 Jul 2024 0 repositories listed
-
Mamba-PTQ: Outlier Channels in Recurrent Large Language Models17 Jul 2024 0 repositories listed
-
Inference Optimization of Foundation Models on AI Accelerators12 Jul 2024 0 repositories listed
-
Explicit-NeRF-QA: A Quality Assessment Database for Explicit NeRF Model Compression11 Jul 2024 0 repositories listed
-
Quantizing YOLOv7: A Comprehensive Study6 Jul 2024 0 repositories listed
-
AMD: Automatic Multi-step Distillation of Large-scale Vision Models5 Jul 2024 0 repositories listed
-
The Impact of Quantization and Pruning on Deep Reinforcement Learning Models5 Jul 2024 0 repositories listed
-
Efficient DNN-Powered Software with Fair Sparse Models3 Jul 2024 0 repositories listed
-
MLKD-BERT: Multi-level Knowledge Distillation for Pre-trained Language Models3 Jul 2024 0 repositories listed
-
FoldGPT: Simple and Effective Large Language Model Compression Scheme1 Jul 2024 0 repositories listed
-
MCNC: Manifold Constrained Network Compression27 Jun 2024 0 repositories listed
-
Exploring compressibility of transformer based text-to-music (TTM) models24 Jun 2024 0 repositories listed
-
Speeding Up Image Classifiers with Little Companions24 Jun 2024 0 repositories listed
-
Failure-Resilient Distributed Inference with Model Compression over Heterogeneous Edge Devices20 Jun 2024 0 repositories listed
-
SDQ: Sparse Decomposed Quantization for LLM Inference19 Jun 2024 0 repositories listed
-
Finding Task-specific Subnetworks in Multi-task Spoken Language Understanding Model18 Jun 2024 0 repositories listed
-
An Empirical Investigation of Matrix Factorization Methods for Pre-trained Transformers17 Jun 2024 0 repositories listed
-
Compress then Serve: Serving Thousands of LoRA Adapters with Little Overhead17 Jun 2024 0 repositories listed
-
Model Adaptation for Time Constrained Embodied Control17 Jun 2024 0 repositories listed
-
Knowledge Distillation in Federated Learning: a Survey on Long Lasting Challenges and New Solutions16 Jun 2024 0 repositories listed
-
Implicit Neural Representation for Videos Based on Residual Connection15 Jun 2024 0 repositories listed
-
EncCluster: Scalable Functional Encryption in Federated Learning through Weight Clustering and Probabilistic Filters13 Jun 2024 0 repositories listed
-
PC-LoRA: Low-Rank Adaptation for Progressive Model Compression with Knowledge Distillation13 Jun 2024 0 repositories listed
-
DistilDoc: Knowledge Distillation for Visually-Rich Document Applications12 Jun 2024 0 repositories listed
-
MobileAIBench: Benchmarking LLMs and LMMs for On-Device Use Cases12 Jun 2024 0 repositories listed
-
On the social bias of speech self-supervised models7 Jun 2024 0 repositories listed
-
Reweighted Solutions for Weighted Low Rank Approximation4 Jun 2024 0 repositories listed
-
Towards Efficient Deep Spiking Neural Networks Construction with Spiking Activity based Pruning3 Jun 2024 0 repositories listed
-
Effective Interplay between Sparsity and Quantization: From Theory to Practice31 May 2024 0 repositories listed
-
LCQ: Low-Rank Codebook based Quantization for Large Language Models31 May 2024 0 repositories listed
-
Dual sparse training framework: inducing activation map sparsity via Transformed ℓ1 regularization30 May 2024 0 repositories listed
-
Efficient Model Compression for Hierarchical Federated Learning27 May 2024 0 repositories listed
-
ExtremeMETA: High-speed Lightweight Image Segmentation Model by Remodeling Multi-channel Metamaterial Imagers27 May 2024 0 repositories listed
-
NV-Embed: Improved Techniques for Training LLMs as Generalist Embedding Models27 May 2024 0 repositories listed
-
Efficiency optimization of large-scale language models based on deep learning in natural language processing tasks20 May 2024 0 repositories listed
-
TinyM²Net-V3: Memory-Aware Compressed Multimodal Deep Neural Networks for Sustainable Edge Deployment20 May 2024 0 repositories listed
-
Densely Distilling Cumulative Knowledge for Continual Learning16 May 2024 0 repositories listed
-
AdaKD: Dynamic Knowledge Distillation of ASR models using Adaptive Loss Weighting11 May 2024 0 repositories listed
-
Characterizing the Accuracy -- Efficiency Trade-off of Low-rank Decomposition in Language Models10 May 2024 0 repositories listed
-
From Algorithm to Hardware: A Survey on Efficient and Safe Deployment of Deep Neural Networks9 May 2024 0 repositories listed
-
NurtureNet: A Multi-task Video-based Approach for Newborn Anthropometry9 May 2024 0 repositories listed
-
Light Field Compression Based on Implicit Neural Representation7 May 2024 0 repositories listed
-
Communication-Efficient Federated Learning with Adaptive Compression under Dynamic Bandwidth6 May 2024 0 repositories listed
-
Dependency-Aware Semi-Structured Sparsity of GLU Variants in Large Language Models3 May 2024 0 repositories listed
-
FedGreen: Carbon-aware Federated Learning with Model Size Adaptation23 Apr 2024 0 repositories listed
-
Rapid Deployment of DNNs for Edge Computing via Structured Pruning at Initialization22 Apr 2024 0 repositories listed
-
Understanding the Performance Horizon of the Latest ML Workloads with NonGEMM Workloads17 Apr 2024 0 repositories listed
-
Comprehensive Survey of Model Compression and Speed up for Vision Transformers16 Apr 2024 0 repositories listed
-
Structured Model Pruning for Efficient Inference in Computational Pathology12 Apr 2024 0 repositories listed
-
Bayesian Federated Model Compression for Communication and Computation Efficiency11 Apr 2024 0 repositories listed
-
Simplifying Two-Stage Detectors for On-Device Inference in Remote Sensing11 Apr 2024 0 repositories listed
-
Automated Inference of Graph Transformation Rules3 Apr 2024 0 repositories listed
-
Improve Knowledge Distillation via Label Revision and Data Selection3 Apr 2024 0 repositories listed
-
Knowledge Distillation with Multi-granularity Mixture of Priors for Image Super-Resolution3 Apr 2024 0 repositories listed
-
On Linearizing Structured Data in Encoder-Decoder Language Models: Insights from Text-to-SQL3 Apr 2024 0 repositories listed
-
Enhancing Inference Efficiency of Large Language Models: Investigating Optimization Strategies and Architectural Innovations2 Apr 2024 0 repositories listed
-
Instance-Aware Group Quantization for Vision Transformers1 Apr 2024 0 repositories listed
-
Dense Vision Transformer Compression with Few Samples27 Mar 2024 0 repositories listed
-
Order of Compression: A Systematic and Optimal Sequence to Combinationally Compress CNN26 Mar 2024 0 repositories listed
-
Magic for the Age of Quantized DNNs22 Mar 2024 0 repositories listed
-
Advancing IIoT with Over-the-Air Federated Learning: The Role of Iterative Magnitude Pruning21 Mar 2024 0 repositories listed
-
DiPaCo: Distributed Path Composition15 Mar 2024 0 repositories listed
-
BRIEDGE: EEG-Adaptive Edge AI for Multi-Brain to Multi-Robot Interaction14 Mar 2024 0 repositories listed
-
Maxwell's Demon at Work: Efficient Pruning by Leveraging Saturation of Neurons12 Mar 2024 0 repositories listed
-
Enhanced Sparsification via Stimulative Training11 Mar 2024 0 repositories listed
-
Optimal Policy Sparsification and Low Rank Decomposition for Deep Reinforcement Learning10 Mar 2024 0 repositories listed
-
Towards efficient deep autoencoders for multivariate time series anomaly detection4 Mar 2024 0 repositories listed
-
Model Compression Method for S4 with Diagonal State Space Layers using Balanced Truncation25 Feb 2024 0 repositories listed
-
FinGPT-HPC: Efficient Pretraining and Finetuning Large Language Models for Financial Applications with High-Performance Computing21 Feb 2024 0 repositories listed
-
From Cloud to Edge: Rethinking Generative AI for Low-Resource Design Challenges20 Feb 2024 0 repositories listed
-
Towards a tailored mixed-precision sub-8-bit quantization scheme for Gated Recurrent Units using Genetic Algorithms19 Feb 2024 0 repositories listed
-
Extraction of nonlinearity in neural networks with Koopman operator18 Feb 2024 0 repositories listed
-
Model Compression and Efficient Inference for Large Language Models: A Survey15 Feb 2024 0 repositories listed
-
Bayesian Deep Learning Via Expectation Maximization and Turbo Deep Approximate Message Passing12 Feb 2024 0 repositories listed