Browse State-of-the-Art › Quantization › Papers, page 21
Quantization
Papers archive 2025-07-28
archive papers tagged: 4,925 · with a code link: 1,596 · where Syntology ran a sample: 515 (452 with a run with no instrument failure, 63 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (515 of 4,925 tagged: 452 with a run with no instrument failure, 63 where every run was a failure of Syntology's instrument)
Page 21 of 50: papers 2,001 to 2,100 of 4,925, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Dataset Distillation as Pushforward Optimal Quantization13 Jan 2025 0 repositories listed
-
FlexQuant: Elastic Quantization Framework for Locally Hosted LLM on Edge Devices13 Jan 2025 0 repositories listed
-
Koopman Meets Limited Bandwidth: Effect of Quantization on Data-Driven Linear Prediction and Control of Nonlinear Systems13 Jan 2025 0 repositories listed
-
QuantuneV2: Compiler-Based Local Metric-Driven Mixed Precision Quantization for Practical Embedded AI Applications13 Jan 2025 0 repositories listed
-
ZOQO: Zero-Order Quantized Optimization12 Jan 2025 0 repositories listed
-
Mix-QViT: Mixed-Precision Vision Transformer Quantization Driven by Layer Importance and Quantization Sensitivity10 Jan 2025 0 repositories listed
-
Precoding Design for Limited-Feedback MISO Systems via Character-Polynomial Codes10 Jan 2025 0 repositories listed
-
JAQ: Joint Efficient Architecture Design and Low-Bit Quantization with Hardware-Software Co-Exploration9 Jan 2025 0 repositories listed
-
Knowledge Transfer in Model-Based Reinforcement Learning Agents for Efficient Multi-Task Learning9 Jan 2025 0 repositories listed
-
Histogram-Equalized Quantization for logic-gated Residual Neural Networks8 Jan 2025 0 repositories listed
-
UPAQ: A Framework for Real-Time and Energy-Efficient 3D Object Detection in Autonomous Vehicles8 Jan 2025 0 repositories listed
-
Effective and Efficient Mixed Precision Quantization of Speech Foundation Models7 Jan 2025 0 repositories listed
-
A Novel Structure-Agnostic Multi-Objective Approach for Weight-Sharing Compression in Deep Neural Networks6 Jan 2025 0 repositories listed
-
Quantization Meets Reasoning: Exploring LLM Low-Bit Quantization Degradation for Mathematical Reasoning6 Jan 2025 0 repositories listed
-
Scaling Laws for Floating Point Quantization Training5 Jan 2025 0 repositories listed
-
TAPAS: Thermal- and Power-Aware Scheduling for LLM Inference in Cloud Platforms5 Jan 2025 0 repositories listed
-
Optimizing Small Language Models for In-Vehicle Function-Calling4 Jan 2025 0 repositories listed
-
Compressed Domain Prior-Guided Video Super-Resolution for Cloud Gaming Content3 Jan 2025 0 repositories listed
-
Millimeter-Wave Energy-Efficient Hybrid Beamforming Architecture and Algorithm3 Jan 2025 0 repositories listed
-
Exploiting Latent Properties to Optimize Neural Codecs2 Jan 2025 0 repositories listed
-
Modulo Sampling: Performance Guarantees in The Presence of Quantization2 Jan 2025 0 repositories listed
-
TabTreeFormer: Tabular Data Generation Using Hybrid Tree-Transformer2 Jan 2025 0 repositories listed
-
CacheQuant: Comprehensively Accelerated Diffusion Models1 Jan 2025 0 repositories listed
-
DynScene: Scalable Generation of Dynamic Robotic Manipulation Scenes for Embodied AI1 Jan 2025 0 repositories listed
-
Efficient Decoupled Feature 3D Gaussian Splatting via Hierarchical Compression1 Jan 2025 0 repositories listed
-
Enhancing Diversity for Data-free Quantization1 Jan 2025 0 repositories listed
-
Frequency-Biased Synergistic Design for Image Compression and Compensation1 Jan 2025 0 repositories listed
-
Multirate Neural Image Compression with Adaptive Lattice Vector Quantization1 Jan 2025 0 repositories listed
-
PillarHist: A Quantization-aware Pillar Feature Encoder based on Height-aware Histogram1 Jan 2025 0 repositories listed
-
Pioneering 4-Bit FP Quantization for Diffusion Models: Mixup-Sign Quantization and Timestep-Aware Fine-Tuning1 Jan 2025 0 repositories listed
-
Rethinking Diffusion for Text-Driven Human Motion Generation: Redundant Representations, Evaluation, and Masked Autoregression1 Jan 2025 0 repositories listed
-
Secret Lies in Color: Enhancing AI-Generated Images Detection with Color Distribution Analysis1 Jan 2025 0 repositories listed
-
Self-Supervised Learning for Color Spike Camera Reconstruction1 Jan 2025 0 repositories listed
-
STEPS: Sequential Probability Tensor Estimation for Text-to-Image Hard Prompt Search1 Jan 2025 0 repositories listed
-
Intuitive Analysis of the Quantization-based Optimization: From Stochastic and Quantum Mechanical Perspective31 Dec 2024 0 repositories listed
-
Accelerating Energy-Efficient Federated Learning in Cell-Free Networks with Adaptive Quantization30 Dec 2024 0 repositories listed
-
DoTA: Weight-Decomposed Tensor Adaptation for Large Language Models30 Dec 2024 0 repositories listed
-
Improving Acoustic Scene Classification in Low-Resource Conditions30 Dec 2024 0 repositories listed
-
PQD: Post-training Quantization for Efficient Diffusion Models30 Dec 2024 0 repositories listed
-
IMSSA: Deploying modern state-space models on memristive in-memory compute hardware28 Dec 2024 0 repositories listed
-
Pushing the Envelope of Low-Bit LLM via Dynamic Error Compensation28 Dec 2024 0 repositories listed
-
Data-Free Group-Wise Fully Quantized Winograd Convolution via Learnable Scales27 Dec 2024 0 repositories listed
-
Causal Speech Enhancement with Predicting Semantics based on Quantized Self-supervised Learning Features26 Dec 2024 0 repositories listed
-
Semantic Residual for Multimodal Unified Discrete Representation26 Dec 2024 0 repositories listed
-
Recommending Pre-Trained Models for IoT Devices25 Dec 2024 0 repositories listed
-
Resource-Efficient Transformer Architecture: Optimizing Memory and Execution Time for Real-Time Applications25 Dec 2024 0 repositories listed
-
1.58-bit FLUX24 Dec 2024 0 repositories listed
-
Achieving Robustness in Blind Modulo Analog-to-Digital Conversion24 Dec 2024 0 repositories listed
-
LSAQ: Layer-Specific Adaptive Quantization for Large Language Model Deployment24 Dec 2024 0 repositories listed
-
Unified Stochastic Framework for Neural Network Quantization and Pruning24 Dec 2024 0 repositories listed
-
GQSA: Group Quantization and Sparsity for Accelerating Large Language Model Inference23 Dec 2024 0 repositories listed
-
Adaptive Dataset Quantization22 Dec 2024 0 repositories listed
-
Semantics Prompting Data-Free Quantization for Low-Bit Vision Transformers21 Dec 2024 0 repositories listed
-
TCAQ-DM: Timestep-Channel Adaptive Quantization for Diffusion Models21 Dec 2024 0 repositories listed
-
Improving Quantization-aware Training of Low-Precision Network via Block Replacement on Full-Precision Counterpart20 Dec 2024 0 repositories listed
-
MixLLM: LLM Quantization with Global Mixed-precision between Output-features and Highly-efficient System Design19 Dec 2024 0 repositories listed
-
Progressive Fine-to-Coarse Reconstruction for Accurate Low-Bit Post-Training Quantization in Vision Transformers19 Dec 2024 0 repositories listed
-
Qua²SeDiMo: Quantifiable Quantization Sensitivity of Diffusion Models19 Dec 2024 0 repositories listed
-
On the Compression of Language Models for Code: An Empirical Study on CodeBERT18 Dec 2024 0 repositories listed
-
Self-control: A Better Conditional Mechanism for Masked Autoregressive Model18 Dec 2024 0 repositories listed
-
More Tokens, Lower Precision: Towards the Optimal Token-Precision Trade-off in KV Cache Compression17 Dec 2024 0 repositories listed
-
Apollo-Forecast: Overcoming Aliasing and Inference Speed Challenges in Language Models for Time Series Forecasting16 Dec 2024 0 repositories listed
-
CSR:Achieving 1 Bit Key-Value Cache via Sparse Representation16 Dec 2024 0 repositories listed
-
FinLoRA: Finetuning Quantized Financial Large Language Models Using Low-Rank Adaptation16 Dec 2024 0 repositories listed
-
QPruner: Probabilistic Decision Quantization for Structured Pruning in Large Language Models16 Dec 2024 0 repositories listed
-
Quantifying Climate Change Impacts on Renewable Energy Generation: A Super-Resolution Recurrent Diffusion Model16 Dec 2024 0 repositories listed
-
VRVVC: Variable-Rate NeRF-Based Volumetric Video Compression16 Dec 2024 0 repositories listed
-
Nanoscaling Floating-Point (NxFP): NanoMantissa, Adaptive Microexponents, and Code Recycling for Direct-Cast Compression of Large Language Models15 Dec 2024 0 repositories listed
-
ProFe: Communication-Efficient Decentralized Federated Learning via Distillation and Prototypes15 Dec 2024 0 repositories listed
-
TrimLLM: Progressive Layer Dropping for Domain-Specific LLMs15 Dec 2024 0 repositories listed
-
Adaptive Quantization Resolution and Power Control for Federated Learning over Cell-free Networks14 Dec 2024 0 repositories listed
-
Enhancing Off-Grid One-Bit DOA Estimation with Learning-Based Sparse Bayesian Approach for Non-Uniform Sparse Array14 Dec 2024 0 repositories listed
-
Memory-Efficient 4-bit Preconditioned Stochastic Optimization14 Dec 2024 0 repositories listed
-
Progressive Compression with Universally Quantized Diffusion Models14 Dec 2024 0 repositories listed
-
Efficient Generative Modeling with Residual Vector Quantization-Based Tokens13 Dec 2024 0 repositories listed
-
MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization13 Dec 2024 0 repositories listed
-
Panacea: Novel DNN Accelerator using Accuracy-Preserving Asymmetric Quantization and Energy-Saving Bit-Slice Sparsity13 Dec 2024 0 repositories listed
-
TTAQ: Towards Stable Post-training Quantization in Continuous Domain Adaptation13 Dec 2024 0 repositories listed
-
VQTalker: Towards Multilingual Talking Avatars through Facial Motion Tokenization13 Dec 2024 0 repositories listed
-
CRVQ: Channel-relaxed Vector Quantization for Extreme Compression of LLMs12 Dec 2024 0 repositories listed
-
DQA: An Efficient Method for Deep Quantization of Deep Neural Network Activations12 Dec 2024 0 repositories listed
-
On Round-Off Errors and Gaussian Blur in Superresolution and in Image Registration12 Dec 2024 0 repositories listed
-
Optimising TinyML with Quantization and Distillation of Transformer and Mamba Models for Indoor Localisation on Edge Devices12 Dec 2024 0 repositories listed
-
Breaking the Bias: Recalibrating the Attention of Industrial Anomaly Detection11 Dec 2024 0 repositories listed
-
TurboAttention: Efficient Attention Approximation For High Throughputs LLMs11 Dec 2024 0 repositories listed
-
Machine learning-driven conservative-to-primitive conversion in hybrid piecewise polytropic and tabulated equations of state10 Dec 2024 0 repositories listed
-
Low-Rank Correction for Quantized LLMs10 Dec 2024 0 repositories listed
-
Post-Training Non-Uniform Quantization for Convolutional Neural Networks10 Dec 2024 0 repositories listed
-
QuantFormer: Learning to Quantize for Neural Activity Forecasting in Mouse Visual Cortex10 Dec 2024 0 repositories listed
-
Compression for Better: A General and Stable Lossless Compression Framework9 Dec 2024 0 repositories listed
-
Efficiency Meets Fidelity: A Novel Quantization Framework for Stable Diffusion9 Dec 2024 0 repositories listed
-
Federated Split Learning with Model Pruning and Gradient Quantization in Wireless Networks9 Dec 2024 0 repositories listed
-
FP=xINT:A Low-Bit Series Expansion Algorithm for Post-Training Quantization9 Dec 2024 0 repositories listed
-
Fuzzy Norm-Explicit Product Quantization for Recommender Systems8 Dec 2024 0 repositories listed
-
SizeGS: Size-aware Compression of 3D Gaussians with Hierarchical Mixed Precision Quantization8 Dec 2024 0 repositories listed
-
Taming Sensitive Weights : Noise Perturbation Fine-tuning for Robust LLM Quantization8 Dec 2024 0 repositories listed
-
Vision Transformer-based Semantic Communications With Importance-Aware Quantization8 Dec 2024 0 repositories listed
-
Efficient Distributed Training through Gradient Compression with Sparsification and Quantization Techniques7 Dec 2024 0 repositories listed
-
Error Feedback Approach for Quantization Noise Reduction of Distributed Graph Filters7 Dec 2024 0 repositories listed
-
GAQAT: gradient-adaptive quantization-aware training for domain generalization7 Dec 2024 0 repositories listed