{"url":"/task/quantization","name":"Quantization","slug":"quantization","description_markdown":"**Quantization** is a promising technique to reduce the computation cost of neural network training, which can replace high-cost floating-point numbers (e.g., float32) with low-cost fixed-point numbers (e.g., int8/int16).\r\n\r\n\r\n<span class=\"description-source\">Source: [Adaptive Precision Training: Quantify Back Propagation in Neural Networks with Fixed-point Numbers ](https://arxiv.org/abs/1911.00361)</span>","categories":[{"name":"Computer Vision","url":"/area/computer-vision"},{"name":"Methodology","url":"/area/methodology"}],"source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","slug_source":"archive_url"},"counts":{"papers_tagged":4925,"papers_with_code":1596,"benchmarks":10,"benchmark_tables_in_archive":10,"benchmark_tables_shown":10,"benchmark_tables_withheld_as_spam":0,"benchmark_definition":"a leaderboard table with at least one row; benchmark_tables_shown also counts the zero-row tables; benchmark_tables_in_archive adds the tables withheld as spam","datasets":18,"subtasks":2,"parent_tasks":0},"benchmarks":[{"leaderboard":"/sota/quantization-on-imagenet","slug":"quantization-on-imagenet","dataset":"ImageNet","dataset_url":"/dataset/imagenet","rows_in_archive":27,"metrics":["Top-1 Accuracy (%)","Weight bits","Activation bits"],"first_row_in_archive_order":{"model":"FQ-ViT (ViT-L)","paper_title":"FQ-ViT: Post-Training Quantization for Fully Quantized Vision Transformer","paper_url":"/paper/fq-vit-fully-quantized-vision-transformer","paper_date":"2021-11-27","arxiv_id":"2111.13824","code_links":[{"title":"megvii-research/FQ-ViT","url":"https://github.com/megvii-research/FQ-ViT"}],"syntology":{"n":3,"n_ran":3,"n_unverified":0,"n_pointer_only":1}}},{"leaderboard":"/sota/quantization-on-cifar-10","slug":"quantization-on-cifar-10","dataset":"CIFAR-10","dataset_url":"/dataset/cifar-10","rows_in_archive":2,"metrics":["MAP"],"first_row_in_archive_order":{"model":"3DCNN_VIVA_3","paper_title":"Compressing 3DCNNs Based on Tensor Train Decomposition","paper_url":"/paper/lossless-compression-for-3dcnns-based-on","paper_date":"2019-12-08","arxiv_id":"1912.03647","code_links":[],"syntology":null}},{"leaderboard":"/sota/quantization-on-agedb-30","slug":"quantization-on-agedb-30","dataset":"AgeDB-30","dataset_url":null,"rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":null,"paper_title":"QuantFace: Towards Lightweight Face Recognition by Synthetic Data Low-bit Quantization","paper_url":"/paper/quantface-towards-lightweight-face","paper_date":"2022-06-21","arxiv_id":"2206.10526","code_links":[{"title":"fdbtrs/QuantFace","url":"https://github.com/fdbtrs/QuantFace"}],"syntology":null}},{"leaderboard":"/sota/quantization-on-cfp-fp","slug":"quantization-on-cfp-fp","dataset":"CFP-FP","dataset_url":null,"rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":null,"paper_title":"QuantFace: Towards Lightweight Face Recognition by Synthetic Data Low-bit Quantization","paper_url":"/paper/quantface-towards-lightweight-face","paper_date":"2022-06-21","arxiv_id":"2206.10526","code_links":[{"title":"fdbtrs/QuantFace","url":"https://github.com/fdbtrs/QuantFace"}],"syntology":null}},{"leaderboard":"/sota/quantization-on-coco","slug":"quantization-on-coco","dataset":"COCO (Common Objects in Context)","dataset_url":"/dataset/coco","rows_in_archive":1,"metrics":["MAP"],"first_row_in_archive_order":{"model":"SSD ResNet50 V1 FPN 640x640","paper_title":"HPTQ: Hardware-Friendly Post Training Quantization","paper_url":"/paper/hptq-hardware-friendly-post-training","paper_date":"2021-09-19","arxiv_id":"2109.09113","code_links":[{"title":"sony/model_optimization","url":"https://github.com/sony/model_optimization"}],"syntology":null}},{"leaderboard":"/sota/quantization-on-ijb-b","slug":"quantization-on-ijb-b","dataset":"IJB-B","dataset_url":"/dataset/ijb-b","rows_in_archive":1,"metrics":["TAR @ FAR=1e-4"],"first_row_in_archive_order":{"model":null,"paper_title":"QuantFace: Towards Lightweight Face Recognition by Synthetic Data Low-bit Quantization","paper_url":"/paper/quantface-towards-lightweight-face","paper_date":"2022-06-21","arxiv_id":"2206.10526","code_links":[{"title":"fdbtrs/QuantFace","url":"https://github.com/fdbtrs/QuantFace"}],"syntology":null}},{"leaderboard":"/sota/quantization-on-ijb-c","slug":"quantization-on-ijb-c","dataset":"IJB-C","dataset_url":"/dataset/ijb-c","rows_in_archive":1,"metrics":["TAR @ FAR=1e-4"],"first_row_in_archive_order":{"model":null,"paper_title":"QuantFace: Towards Lightweight Face Recognition by Synthetic Data Low-bit Quantization","paper_url":"/paper/quantface-towards-lightweight-face","paper_date":"2022-06-21","arxiv_id":"2206.10526","code_links":[{"title":"fdbtrs/QuantFace","url":"https://github.com/fdbtrs/QuantFace"}],"syntology":null}},{"leaderboard":"/sota/quantization-on-knowledge-based","slug":"quantization-on-knowledge-based","dataset":"Knowledge-based:","dataset_url":"/dataset/word-sense-disambiguation-a-unified","rows_in_archive":1,"metrics":["All"],"first_row_in_archive_order":{"model":"3DCNN_VIVA_5","paper_title":"Compressing 3DCNNs Based on Tensor Train Decomposition","paper_url":"/paper/lossless-compression-for-3dcnns-based-on","paper_date":"2019-12-08","arxiv_id":"1912.03647","code_links":[],"syntology":null}},{"leaderboard":"/sota/quantization-on-lfw","slug":"quantization-on-lfw","dataset":"LFW","dataset_url":"/dataset/lfw","rows_in_archive":1,"metrics":["Accuracy"],"first_row_in_archive_order":{"model":null,"paper_title":"QuantFace: Towards Lightweight Face Recognition by Synthetic Data Low-bit Quantization","paper_url":"/paper/quantface-towards-lightweight-face","paper_date":"2022-06-21","arxiv_id":"2206.10526","code_links":[{"title":"fdbtrs/QuantFace","url":"https://github.com/fdbtrs/QuantFace"}],"syntology":null}},{"leaderboard":"/sota/quantization-on-wiki-40b","slug":"quantization-on-wiki-40b","dataset":"Wiki-40B","dataset_url":"/dataset/wiki-40b","rows_in_archive":1,"metrics":["Perplexity"],"first_row_in_archive_order":{"model":"OutEffHop-Bert_base","paper_title":"Outlier-Efficient Hopfield Layers for Large Transformer-Based Models","paper_url":"/paper/outlier-efficient-hopfield-layers-for-large","paper_date":"2024-04-04","arxiv_id":"2404.03828","code_links":[{"title":"magics-lab/outeffhop","url":"https://github.com/magics-lab/outeffhop"}],"syntology":{"n":13,"n_ran":10,"n_unverified":3,"n_pointer_only":0}}}],"datasets":[{"url":"/dataset/cifar-10","name":"CIFAR-10","full_name":"CIFAR-10","num_papers_in_archive":16145},{"url":"/dataset/imagenet","name":"ImageNet","full_name":"","num_papers_in_archive":15430},{"url":"/dataset/coco","name":"COCO (Common Objects in Context)","full_name":"Common Objects in Context","num_papers_in_archive":11922},{"url":"/dataset/lfw","name":"LFW","full_name":"Labeled Faces in the Wild","num_papers_in_archive":820},{"url":"/dataset/reddit","name":"Reddit","full_name":"","num_papers_in_archive":699},{"url":"/dataset/ijb-c","name":"IJB-C","full_name":"IARPA Janus Benchmark-C","num_papers_in_archive":246},{"url":"/dataset/ijb-b","name":"IJB-B","full_name":"IARPA Janus Benchmark-B","num_papers_in_archive":163},{"url":"/dataset/word-sense-disambiguation-a-unified","name":"Word Sense Disambiguation: a Unified Evaluation Framework and Empirical Comparison","full_name":"","num_papers_in_archive":109},{"url":"/dataset/tiny-images","name":"Tiny Images","full_name":"","num_papers_in_archive":103},{"url":"/dataset/visual-wake-words","name":"Visual Wake Words","full_name":"","num_papers_in_archive":40},{"url":"/dataset/wiki-40b","name":"Wiki-40B","full_name":"","num_papers_in_archive":30},{"url":"/dataset/reddit-12k","name":"REDDIT-12K","full_name":"","num_papers_in_archive":24},{"url":"/dataset/groove-midi-dataset","name":"Groove","full_name":"Groove MIDI Dataset","num_papers_in_archive":16},{"url":"/dataset/kannada-mnist","name":"Kannada-MNIST","full_name":"","num_papers_in_archive":7},{"url":"/dataset/twitter100k","name":"Twitter100k","full_name":"","num_papers_in_archive":5},{"url":"/dataset/bach-doodle","name":"Bach Doodle","full_name":"Bach Doodle","num_papers_in_archive":4},{"url":"/dataset/cal10k","name":"CAL10K","full_name":"Computer Audition Lab 10000","num_papers_in_archive":1},{"url":"/dataset/fas100k","name":"FAS100K","full_name":null,"num_papers_in_archive":1}],"subtasks":[{"url":"/task/data-free-quantization","name":"Data Free Quantization"},{"url":"/task/unet-quantization","name":"UNET Quantization"}],"parent_tasks":[],"papers":{"order":"repositories listed in the archive (desc), then date (desc); the archive holds no stars","population":"papers tagged with this task that list at least one repository in the archive","shown":30,"of":1596,"tagged_in_all":4925,"items":[{"url":"/paper/fasttextzip-compressing-text-classification","title":"FastText.zip: Compressing text classification models","date":"2016-12-12","arxiv_id":"1612.03651","repositories_listed":44,"syntology":{"n":18,"n_ran":3,"n_unverified":15,"n_pointer_only":12}},{"url":"/paper/wav2vec-2-0-a-framework-for-self-supervised","title":"wav2vec 2.0: A Framework for Self-Supervised Learning of Speech Representations","date":"2020-06-20","arxiv_id":"2006.11477","repositories_listed":25,"syntology":{"n":9,"n_ran":2,"n_unverified":7,"n_pointer_only":2}},{"url":"/paper/quantization-and-training-of-neural-networks","title":"Quantization and Training of Neural Networks for Efficient Integer-Arithmetic-Only Inference","date":"2017-12-15","arxiv_id":"1712.05877","repositories_listed":21,"syntology":{"n":7,"n_ran":7,"n_unverified":0,"n_pointer_only":4}},{"url":"/paper/qlora-efficient-finetuning-of-quantized-llms","title":"QLoRA: Efficient Finetuning of Quantized LLMs","date":"2023-05-23","arxiv_id":"2305.14314","repositories_listed":20,"syntology":{"n":26,"n_ran":17,"n_unverified":9,"n_pointer_only":17}},{"url":"/paper/gptq-accurate-post-training-quantization-for","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","date":"2022-10-31","arxiv_id":"2210.17323","repositories_listed":17,"syntology":{"n":15,"n_ran":5,"n_unverified":10,"n_pointer_only":1}},{"url":"/paper/deep-compression-compressing-deep-neural","title":"Deep Compression: Compressing Deep Neural Networks with Pruning, Trained Quantization and Huffman Coding","date":"2015-10-01","arxiv_id":"1510.00149","repositories_listed":15,"syntology":{"n":4,"n_ran":2,"n_unverified":2,"n_pointer_only":1}},{"url":"/paper/billion-scale-similarity-search-with-gpus","title":"Billion-scale similarity search with GPUs","date":"2017-02-28","arxiv_id":"1702.08734","repositories_listed":14,"syntology":{"n":35,"n_ran":8,"n_unverified":27,"n_pointer_only":27}},{"url":"/paper/dorefa-net-training-low-bitwidth","title":"DoReFa-Net: Training Low Bitwidth Convolutional Neural Networks with Low Bitwidth Gradients","date":"2016-06-20","arxiv_id":"1606.06160","repositories_listed":13,"syntology":{"n":13,"n_ran":1,"n_unverified":12,"n_pointer_only":1}},{"url":"/paper/awq-activation-aware-weight-quantization-for","title":"AWQ: Activation-aware Weight Quantization for LLM Compression and Acceleration","date":"2023-06-01","arxiv_id":"2306.00978","repositories_listed":12,"syntology":{"n":18,"n_ran":12,"n_unverified":6,"n_pointer_only":2}},{"url":"/paper/haq-hardware-aware-automated-quantization","title":"HAQ: Hardware-Aware Automated Quantization with Mixed Precision","date":"2018-11-21","arxiv_id":"1811.08886","repositories_listed":11,"syntology":null},{"url":"/paper/polysemous-codes","title":"Polysemous codes","date":"2016-09-07","arxiv_id":"1609.01882","repositories_listed":11,"syntology":{"n":2,"n_ran":1,"n_unverified":1,"n_pointer_only":0}},{"url":"/paper/glm-130b-an-open-bilingual-pre-trained-model","title":"GLM-130B: An Open Bilingual Pre-trained Model","date":"2022-10-05","arxiv_id":"2210.02414","repositories_listed":9,"syntology":{"n":21,"n_ran":5,"n_unverified":16,"n_pointer_only":0}},{"url":"/paper/learned-step-size-quantization","title":"Learned Step Size Quantization","date":"2019-02-21","arxiv_id":"1902.08153","repositories_listed":9,"syntology":{"n":23,"n_ran":7,"n_unverified":16,"n_pointer_only":6}},{"url":"/paper/unsupervised-cross-lingual-representation-3","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","date":"2020-06-24","arxiv_id":"2006.13979","repositories_listed":8,"syntology":{"n":6,"n_ran":0,"n_unverified":6,"n_pointer_only":0}},{"url":"/paper/link-and-code-fast-indexing-with-graphs-and","title":"Link and code: Fast indexing with graphs and compact regression codes","date":"2018-04-26","arxiv_id":"1804.09996","repositories_listed":8,"syntology":null},{"url":"/paper/yolov6-a-single-stage-object-detection","title":"YOLOv6: A Single-Stage Object Detection Framework for Industrial Applications","date":"2022-09-07","arxiv_id":"2209.02976","repositories_listed":7,"syntology":{"n":2,"n_ran":2,"n_unverified":0,"n_pointer_only":2}},{"url":"/paper/i-bert-integer-only-bert-quantization","title":"I-BERT: Integer-only BERT Quantization","date":"2021-01-05","arxiv_id":"2101.01321","repositories_listed":7,"syntology":null},{"url":"/paper/automatic-perturbation-analysis-on-general","title":"Automatic Perturbation Analysis for Scalable Certified Robustness and Beyond","date":"2020-02-28","arxiv_id":"2002.12920","repositories_listed":7,"syntology":{"n":18,"n_ran":5,"n_unverified":13,"n_pointer_only":0}},{"url":"/paper/improvements-to-target-based-3d-lidar-to","title":"Improvements to Target-Based 3D LiDAR to Camera Calibration","date":"2019-10-07","arxiv_id":"1910.03126","repositories_listed":7,"syntology":null},{"url":"/paper/qwen2-technical-report","title":"Qwen2 Technical Report","date":"2024-07-15","arxiv_id":"2407.10671","repositories_listed":6,"syntology":null},{"url":"/paper/chronos-learning-the-language-of-time-series","title":"Chronos: Learning the Language of Time Series","date":"2024-03-12","arxiv_id":"2403.07815","repositories_listed":6,"syntology":{"n":28,"n_ran":13,"n_unverified":15,"n_pointer_only":0}},{"url":"/paper/qvrf-a-quantization-error-aware-variable-rate","title":"QVRF: A Quantization-error-aware Variable Rate Framework for Learned Image Compression","date":"2023-03-10","arxiv_id":"2303.05744","repositories_listed":6,"syntology":null},{"url":"/paper/massive-language-models-can-be-accurately","title":"SparseGPT: Massive Language Models Can Be Accurately Pruned in One-Shot","date":"2023-01-02","arxiv_id":"2301.00774","repositories_listed":6,"syntology":{"n":12,"n_ran":2,"n_unverified":10,"n_pointer_only":9}},{"url":"/paper/speecht5-unified-modal-encoder-decoder-pre","title":"SpeechT5: Unified-Modal Encoder-Decoder Pre-Training for Spoken Language Processing","date":"2021-10-14","arxiv_id":"2110.07205","repositories_listed":6,"syntology":{"n":3,"n_ran":2,"n_unverified":1,"n_pointer_only":3}},{"url":"/paper/jointly-optimizing-query-encoder-and-product","title":"Jointly Optimizing Query Encoder and Product Quantization to Improve Retrieval Performance","date":"2021-08-02","arxiv_id":"2108.00644","repositories_listed":6,"syntology":null},{"url":"/paper/pareto-optimal-quantized-resnet-is-mostly-4","title":"Pareto-Optimal Quantized ResNet Is Mostly 4-bit","date":"2021-05-07","arxiv_id":"2105.03536","repositories_listed":6,"syntology":null},{"url":"/paper/single-path-one-shot-neural-architecture","title":"Single Path One-Shot Neural Architecture Search with Uniform Sampling","date":"2019-03-31","arxiv_id":"1904.00420","repositories_listed":6,"syntology":{"n":7,"n_ran":1,"n_unverified":6,"n_pointer_only":1}},{"url":"/paper/trained-ternary-quantization","title":"Trained Ternary Quantization","date":"2016-12-04","arxiv_id":"1612.01064","repositories_listed":6,"syntology":{"n":7,"n_ran":5,"n_unverified":2,"n_pointer_only":3}},{"url":"/paper/smoothquant-accurate-and-efficient-post","title":"SmoothQuant: Accurate and Efficient Post-Training Quantization for Large Language Models","date":"2022-11-18","arxiv_id":"2211.10438","repositories_listed":5,"syntology":{"n":5,"n_ran":0,"n_unverified":5,"n_pointer_only":0}},{"url":"/paper/ternarybert-distillation-aware-ultra-low-bit","title":"TernaryBERT: Distillation-aware Ultra-low Bit BERT","date":"2020-09-27","arxiv_id":"2009.12812","repositories_listed":5,"syntology":null}],"syntology_records":21,"syntology_note":"a paper without a record is not a recorded non-run: it may lack an arXiv id or simply be absent from the graph layer"},"description_links":{"kept":0,"unwrapped_to_text":0,"bare_urls_linked":0,"relative_images_dropped":0,"rule":"internal links are kept only when the target slug exists in the catalog"},"syntology":{"read_at":"2026-09-24T18:15:14+00:00","claim":"Per-sample execution status on synthesized fixtures ('ran N of M samples'); not a correctness claim and not a ranking signal.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"}},"not_shown":{"libraries":"the archive has no per-task library table","trend_sparklines":"the Trend column of the benchmarks table was a rendered image; it is not in the archive","social_and_latest_sorts":"stars and social signals are not in the archive"}}