Browse State-of-the-Art › Quantization › Papers, page 31
Quantization
Papers archive 2025-07-28
archive papers tagged: 4,925 · with a code link: 1,596 · where Syntology ran a sample: 515 (452 with a run with no instrument failure, 63 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (515 of 4,925 tagged: 452 with a run with no instrument failure, 63 where every run was a failure of Syntology's instrument)
Page 31 of 50: papers 3,001 to 3,100 of 4,925, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Augmenting Hessians with Inter-Layer Dependencies for Mixed-Precision Post-Training Quantization8 Jun 2023 0 repositories listed
-
Iterative Signal Processing for Integrated Sensing and Communication Systems8 Jun 2023 0 repositories listed
-
Sensitivity-Aware Finetuning for Accuracy Recovery on Deep Learning Hardware5 Jun 2023 0 repositories listed
-
Modular Transformers: Compressing Transformers into Modularized Layers for Flexible Efficient Inference4 Jun 2023 0 repositories listed
-
Temporal Dynamic Quantization for Diffusion Models4 Jun 2023 0 repositories listed
-
Dynamic quantized consensus under DoS attacks: Towards a tight zooming-out factor1 Jun 2023 0 repositories listed
-
FlexRound: Learnable Rounding based on Element-wise Division for Post-Training Quantization1 Jun 2023 0 repositories listed
-
On the Effectiveness of Hybrid Mutual Information Estimation1 Jun 2023 0 repositories listed
-
Quantization-Aware and Tensor-Compressed Training of Transformers for Natural Language Understanding1 Jun 2023 0 repositories listed
-
Towards Learning Discrete Representations via Self-Supervision for Wearables-Based Human Activity Recognition1 Jun 2023 0 repositories listed
-
Asymptotic Performance Analysis of Large-Scale Active IRS-Aided Wireless Network31 May 2023 0 repositories listed
-
Implementation of a framework for deploying AI inference engines in FPGAs30 May 2023 0 repositories listed
-
Intriguing Properties of Quantization at Scale30 May 2023 0 repositories listed
-
Low Precision Quantization-aware Training in Spiking Neural Networks with Differentiable Quantization Function30 May 2023 0 repositories listed
-
PreQuant: A Task-agnostic Quantization Approach for Pre-trained Language Models30 May 2023 0 repositories listed
-
Stochastic Gradient Langevin Dynamics Based on Quantization with Increasing Resolution30 May 2023 0 repositories listed
-
BRICS: Bi-level feature Representation of Image CollectionS29 May 2023 0 repositories listed
-
DeCoR: Defy Knowledge Forgetting by Predicting Earlier Audio Codes29 May 2023 0 repositories listed
-
Global-QSGD: Practical Floatless Quantization for Distributed Learning with Theoretical Guarantees29 May 2023 0 repositories listed
-
Reducing Communication for Split Learning by Randomized Top-k Sparsification29 May 2023 0 repositories listed
-
Reversible Quantization Index Modulation for Static Deep Neural Network Watermarking29 May 2023 0 repositories listed
-
SlimFit: Memory-Efficient Fine-Tuning of Transformer-based Models Using Training Dynamics29 May 2023 0 repositories listed
-
Efficient Storage of Fine-Tuned Models via Low-Rank Approximation of Weight Residuals28 May 2023 0 repositories listed
-
Examining the Role and Limits of Batchnorm Optimization to Mitigate Diverse Hardware-noise in In-memory Computing28 May 2023 0 repositories listed
-
2-bit Conformer quantization for automatic speech recognition26 May 2023 0 repositories listed
-
BinaryViT: Towards Efficient and Accurate Binary Vision Transformers24 May 2023 0 repositories listed
-
Just CHOP: Embarrassingly Simple LLM Compression24 May 2023 0 repositories listed
-
RAND: Robustness Aware Norm Decay For Quantized Seq2seq Models24 May 2023 0 repositories listed
-
Adversarial Defenses via Vector Quantization23 May 2023 0 repositories listed
-
Combining Multi-Objective Bayesian Optimization with Reinforcement Learning for TinyML23 May 2023 0 repositories listed
-
Downlink Clustering-Based Scheduling of IRS-Assisted Communications With Reconfiguration Constraints23 May 2023 0 repositories listed
-
Memory-Efficient Fine-Tuning of Compressed Large Language Models via sub-4-bit Integer Quantization23 May 2023 0 repositories listed
-
Differential Privacy with Random Projections and Sign Random Projections22 May 2023 0 repositories listed
-
Digital-SC: Digital Semantic Communication with Adaptive Network Split and Learned Non-Linear Quantization22 May 2023 0 repositories listed
-
Revisiting Data Augmentation in Model Compression: An Empirical and Comprehensive Study22 May 2023 0 repositories listed
-
TinyissimoYOLO: A Quantized, Low-Memory Footprint, TinyML Object Detection Network for Low Power Microcontrollers22 May 2023 0 repositories listed
-
TSPTQ-ViT: Two-scaled post-training quantization for vision transformer22 May 2023 0 repositories listed
-
Atomic Anatomy of Low-Inertia Power Systems21 May 2023 0 repositories listed
-
Bi-ViT: Pushing the Limit of Vision Transformer Quantization21 May 2023 0 repositories listed
-
FAQ: Mitigating the Impact of Faults in the Weight Memory of DNN Accelerators through Fault-Aware Quantization21 May 2023 0 repositories listed
-
Integer or Floating Point? New Outlooks for Low-Bit Quantization on Large Language Models21 May 2023 0 repositories listed
-
ReTAG: Reasoning Aware Table to Analytic Text Generation19 May 2023 0 repositories listed
-
Two-Bit RIS-Aided Communications at 3.5GHz: Some Insights from the Measurement Results Under Multiple Practical Scenes19 May 2023 0 repositories listed
-
Boost Vision Transformer with GPU-Friendly Sparsity and Quantization18 May 2023 0 repositories listed
-
Q-SHED: Distributed Optimization at the Edge via Hessian Eigenvectors Quantization18 May 2023 0 repositories listed
-
DQ-Whisper: Joint Distillation and Quantization for Efficient Multilingual Speech Recognition18 May 2023 0 repositories listed
-
Compress, Then Prompt: Improving Accuracy-Efficiency Trade-off of LLM Inference with Transferable Prompt17 May 2023 0 repositories listed
-
Component Training of Turbo Autoencoders16 May 2023 0 repositories listed
-
Designing Discontinuities15 May 2023 0 repositories listed
-
Fast Inference of Tree Ensembles on ARM Devices15 May 2023 0 repositories listed
-
Straightening Out the Straight-Through Estimator: Overcoming Optimization Challenges in Vector Quantized Networks15 May 2023 0 repositories listed
-
Task-Oriented Communication Design at Scale15 May 2023 0 repositories listed
-
Analyzing Compression Techniques for Computer Vision14 May 2023 0 repositories listed
-
Federated TD Learning over Finite-Rate Erasure Channels: Linear Speedup under Markovian Sampling14 May 2023 0 repositories listed
-
Accelerator-Aware Training for Transducer-Based Speech Recognition12 May 2023 0 repositories listed
-
Patch-wise Mixed-Precision Quantization of Vision Transformer11 May 2023 0 repositories listed
-
Speaker Diaphragm Excursion Prediction: deep attention and online adaptation11 May 2023 0 repositories listed
-
Mobile Image Restoration via Prior Quantization10 May 2023 0 repositories listed
-
Multiscale Augmented Normalizing Flows for Image Compression9 May 2023 0 repositories listed
-
CrAFT: Compression-Aware Fine-Tuning for Efficient Visual Task Adaptation8 May 2023 0 repositories listed
-
Structural and Statistical Texture Knowledge Distillation for Semantic Segmentation6 May 2023 0 repositories listed
-
Emulation Learning for Neuromimetic Systems4 May 2023 0 repositories listed
-
Vertical Federated Learning over Cloud-RAN: Convergence Analysis and System Optimization4 May 2023 0 repositories listed
-
Hybrid model for Single-Stage Multi-Person Pose Estimation2 May 2023 0 repositories listed
-
ICQ: A Quantization Scheme for Best-Arm Identification Over Bit-Constrained Channels30 Apr 2023 0 repositories listed
-
Guaranteed Quantization Error Computation for Neural Network Model Compression26 Apr 2023 0 repositories listed
-
Killing Two Birds with One Stone: Quantization Achieves Privacy in Distributed Learning26 Apr 2023 0 repositories listed
-
Membrane Potential Distribution Adjustment and Parametric Surrogate Gradient in Spiking Neural Networks26 Apr 2023 0 repositories listed
-
Improving Robustness Against Adversarial Attacks with Deeply Quantized Neural Networks25 Apr 2023 0 repositories listed
-
Speed Is All You Need: On-Device Acceleration of Large Diffusion Models via GPU-Aware Optimizations21 Apr 2023 0 repositories listed
-
Transformer-based models and hardware acceleration analysis in autonomous driving: A survey21 Apr 2023 0 repositories listed
-
Improving Post-Training Quantization on Object Detection with Task Loss-Guided Lp Metric19 Apr 2023 0 repositories listed
-
DeepGEMM: Accelerated Ultra Low-Precision Inference on CPU Architectures using Lookup Tables18 Apr 2023 0 repositories listed
-
ATHEENA: A Toolflow for Hardware Early-Exit Network Automation17 Apr 2023 0 repositories listed
-
Soft Label Coding for End-to-end Sound Source Localization With Ad-hoc Microphone Arrays15 Apr 2023 0 repositories listed
-
Convergence rate of Tsallis entropic regularized optimal transport13 Apr 2023 0 repositories listed
-
D-SVM over Networked Systems with Non-Ideal Linking Conditions13 Apr 2023 0 repositories listed
-
End-to-end codesign of Hessian-aware quantized neural networks for FPGAs and ASICs13 Apr 2023 0 repositories listed
-
Unsupervised Multi-Criteria Adversarial Detection in Deep Image Retrieval9 Apr 2023 0 repositories listed
-
Benchmarking the Robustness of Quantized Models8 Apr 2023 0 repositories listed
-
AutoQNN: An End-to-End Framework for Automatically Quantizing Neural Networks7 Apr 2023 0 repositories listed
-
FedDiSC: A Computation-efficient Federated Learning Framework for Power Systems Disturbance and Cyber Attack Discrimination7 Apr 2023 0 repositories listed
-
Blockwise Compression of Transformer-based Models without Retraining4 Apr 2023 0 repositories listed
-
A Unified Compression Framework for Efficient Speech-Driven Talking-Face Generation2 Apr 2023 0 repositories listed
-
Distributed Optimization for Quadratic Cost Functions over Large-Scale Networks with Quantized Communication and Finite-Time Convergence2 Apr 2023 0 repositories listed
-
FP8 versus INT8 for efficient deep learning inference31 Mar 2023 0 repositories listed
-
A Joint Model and Data Driven Method for Distributed Estimation30 Mar 2023 0 repositories listed
-
oBERTa: Improving Sparse Transfer Learning via improved initialization, distillation, and pruning regimes30 Mar 2023 0 repositories listed
-
Low-Dose CT Image Reconstruction using Vector Quantized Convolutional Autoencoder with Perceptual Loss28 Mar 2023 0 repositories listed
-
Tetra-AML: Automatic Machine Learning via Tensor Networks28 Mar 2023 0 repositories listed
-
Binarizing Sparse Convolutional Networks for Efficient Point Cloud Analysis27 Mar 2023 0 repositories listed
-
An Evaluation of Memory Optimization Methods for Training Neural Networks26 Mar 2023 0 repositories listed
-
LVQAC: Lattice Vector Quantization Coupled with Spatially Adaptive Companding for Efficient Learned Image Compression25 Mar 2023 0 repositories listed
-
Towards Accurate Post-Training Quantization for Vision Transformer25 Mar 2023 0 repositories listed
-
Benchmarking the Reliability of Post-training Quantization: a Particular Focus on Worst-case Performance23 Mar 2023 0 repositories listed
-
Scaled Quantization for the Vision Transformer23 Mar 2023 0 repositories listed
-
Low Rank Optimization for Efficient Deep Learning: Making A Balance between Compact Architecture and Fast Training22 Mar 2023 0 repositories listed
-
Fighting over-fitting with quantization for learning deep neural networks on noisy labels21 Mar 2023 0 repositories listed
-
Quantized Zero Dynamics Attacks against Sampled-data Control Systems21 Mar 2023 0 repositories listed
-
14 Mar 2023 0 repositories listed