{"about":{"site":"https://codewithpapers.app","non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page"},"url":"/code/get-ptb","entry":"get_ptb","source":"Syntology graph, per-sample; not an archive number","read_at":"2026-09-24T18:15:14+00:00","claim":"Names are grouped by exact entry-name string. Same-named routines are NOT asserted to be equivalent; 'ran' means executed on a synthesized fixture, not correctness. n_samples_ran = sum of by_status over every status except 'unverified' (ran_draft_wrong and ran_fixture are failures of Syntology's instrument, not of the code); n_papers_ran = papers with at least one such sample.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"},"n_papers":43,"n_papers_ran":3,"units":"n_samples, n_samples_ran, n_samples_fingerprinted and by_status count distinct code bodies (code_sha256); n_places and n_places_pointer_only count places, one per (paper, code body) pair, which is also the unit of the samples list","n_samples":26,"n_samples_ran":3,"n_samples_fingerprinted":0,"n_places":43,"n_places_pointer_only":14,"by_status":{"ran_honours":0,"ran_violates":0,"ran_draft_wrong":0,"ran_fixture":0,"ran":3,"unverified":23},"syntology":{"atlas_url":null,"mcp":null,"mcp_per_sample":{"tool":"get_code","arguments_in":"samples[].mcp_get_code"},"developers":"https://syntology.ai/developers"},"samples":[{"arxiv_id":"2606.00494","paper":"/paper/arxiv-2606-00494","title":"ProjQ: Project-and-Quantize for Adapter-Aware LLM Compression","date":null,"month_inferred_from_arxiv_id":"2026-06","title_source":"syntology","repo":"yy9301/ProjQ","path":"datautils.py","file_url":"https://github.com/yy9301/ProjQ/blob/HEAD/datautils.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"d313d28375a69ab9","mcp_get_code":{"code_sha256":"d313d28375a69ab9"}},{"arxiv_id":"2601.06787","paper":"/paper/arxiv-2601-06787","title":"Garbage Attention in Large Language Models: <BOS> Sink Heads and Sink-aware Pruning","date":null,"month_inferred_from_arxiv_id":"2026-01","title_source":"syntology","repo":"CASIA-LMC-Lab/FLAP","path":"lib/prune.py","file_url":"https://github.com/CASIA-LMC-Lab/FLAP/blob/HEAD/lib/prune.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"1d035152616b1d19","mcp_get_code":{"code_sha256":"1d035152616b1d19"}},{"arxiv_id":"2510.03267","paper":"/paper/arxiv-2510-03267","title":"PT$^2$-LLM: Post-Training Ternarization for Large Language Models","date":null,"month_inferred_from_arxiv_id":"2025-10","title_source":"syntology","repo":"XIANGLONGYAN/PT2-LLM","path":"pt2_llm/data.py","file_url":"https://github.com/XIANGLONGYAN/PT2-LLM/blob/HEAD/pt2_llm/data.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"1b0736b420b42de6","mcp_get_code":{"code_sha256":"1b0736b420b42de6"}},{"arxiv_id":"2506.09351","paper":null,"title":"arXiv:2506.09351","date":null,"month_inferred_from_arxiv_id":"2025-06","title_source":null,"repo":"yuchenblah/DIVE","path":"lib/evaldata.py","file_url":"https://github.com/yuchenblah/DIVE/blob/HEAD/lib/evaldata.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"6086a5ef9f4b6277","mcp_get_code":{"code_sha256":"6086a5ef9f4b6277"}},{"arxiv_id":"2506.03781","paper":null,"title":"arXiv:2506.03781","date":null,"month_inferred_from_arxiv_id":"2025-06","title_source":null,"repo":"OpenGVLab/OmniQuant","path":"datautils.py","file_url":"https://github.com/OpenGVLab/OmniQuant/blob/HEAD/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"bd4f416e271c2fb5","mcp_get_code":{"code_sha256":"bd4f416e271c2fb5"}},{"arxiv_id":"2505.23807","paper":"/paper/dlp-dynamic-layerwise-pruning-in-large","title":"DLP: Dynamic Layerwise Pruning in Large Language Models","date":"2025-05-27","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"ironartisan/dlp","path":"lib/prune.py","file_url":"https://github.com/ironartisan/dlp/blob/HEAD/lib/prune.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"6286af97d1bc3835","mcp_get_code":{"code_sha256":"6286af97d1bc3835"}},{"arxiv_id":"2505.02214","paper":"/paper/an-empirical-study-of-qwen3-quantization","title":"An Empirical Study of Qwen3 Quantization","date":"2025-05-04","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"efficient-ml/qwen3-quantization","path":"BiLLM/datautils.py","file_url":"https://github.com/efficient-ml/qwen3-quantization/blob/HEAD/BiLLM/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"a7cbf4fc49c71e03","mcp_get_code":{"code_sha256":"a7cbf4fc49c71e03"}},{"arxiv_id":"2411.17525","paper":"/paper/pushing-the-limits-of-large-language-model","title":"Pushing the Limits of Large Language Model Quantization via the Linearity Theorem","date":"2024-11-26","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"goodevening13/aquakv","path":"aquakv/datautils.py","file_url":"https://github.com/goodevening13/aquakv/blob/HEAD/aquakv/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"330e351424a2b37b","mcp_get_code":{"code_sha256":"330e351424a2b37b"}},{"arxiv_id":"2410.06270","paper":"/paper/mc-moe-mixture-compressor-for-mixture-of","title":"MC-MoE: Mixture Compressor for Mixture-of-Experts LLMs Gains More","date":"2024-10-08","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Aaronhuang-778/MC-MoE","path":"datautils.py","file_url":"https://github.com/Aaronhuang-778/MC-MoE/blob/HEAD/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"a7cbf4fc49c71e03","mcp_get_code":{"code_sha256":"a7cbf4fc49c71e03"}},{"arxiv_id":"2409.18850","paper":"/paper/two-sparse-matrices-are-better-than-one","title":"Two Sparse Matrices are Better than One: Sparsifying Neural Networks with Double Sparse Factorization","date":"2024-09-27","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"usamec/double_sparse","path":"datautils.py","file_url":"https://github.com/usamec/double_sparse/blob/HEAD/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"a7cbf4fc49c71e03","mcp_get_code":{"code_sha256":"a7cbf4fc49c71e03"}},{"arxiv_id":"2407.10032","paper":"/paper/leanquant-accurate-large-language-model","title":"LeanQuant: Accurate Large Language Model Quantization with Loss-Error-Aware Grid","date":"2024-07-14","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"LeanModels/LeanQuant","path":"datautils.py","file_url":"https://github.com/LeanModels/LeanQuant/blob/HEAD/datautils.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"f810b1ddd55b5375","mcp_get_code":{"code_sha256":"f810b1ddd55b5375"}},{"arxiv_id":"2407.06483","paper":"/paper/composable-interventions-for-language-models","title":"Composable Interventions for Language Models","date":"2024-07-09","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"hartvigsen-group/composable-interventions","path":"sparsellm/lib/datautils.py","file_url":"https://github.com/hartvigsen-group/composable-interventions/blob/HEAD/sparsellm/lib/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3a6ac4325dad94a4","mcp_get_code":{"code_sha256":"3a6ac4325dad94a4"}},{"arxiv_id":"2406.15524","paper":"/paper/rethinking-pruning-large-language-models","title":"Rethinking Pruning Large Language Models: Benefits and Pitfalls of Reconstruction Error Minimization","date":"2024-06-21","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"log-postech/rethinking-llm-pruning","path":"lib/data.py","file_url":"https://github.com/log-postech/rethinking-llm-pruning/blob/HEAD/lib/data.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3b99c66b488c6dc0","mcp_get_code":{"code_sha256":"3b99c66b488c6dc0"}},{"arxiv_id":"2406.12928","paper":"/paper/evaluating-the-generalization-ability-of-1","title":"Evaluating the Generalization Ability of Quantized LLMs: Benchmark, Analysis, and Toolbox","date":"2024-06-15","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"tsingmaoai/mi-optimize","path":"mi_optimize/datasets/data_loader.py","file_url":"https://github.com/tsingmaoai/mi-optimize/blob/HEAD/mi_optimize/datasets/data_loader.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NOASSERTION","inline_ok":false,"code_sha256_prefix":"f6e95ffd6622a1b4","mcp_get_code":{"code_sha256":"f6e95ffd6622a1b4"}},{"arxiv_id":"2406.05981","paper":"/paper/shiftaddllm-accelerating-pretrained-llms-via","title":"ShiftAddLLM: Accelerating Pretrained LLMs via Post-Training Multiplication-Less Reparameterization","date":"2024-06-10","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"gatech-eic/shiftaddllm","path":"datautils.py","file_url":"https://github.com/gatech-eic/shiftaddllm/blob/HEAD/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"7f7c3deb52669856","mcp_get_code":{"code_sha256":"7f7c3deb52669856"}},{"arxiv_id":"2406.01721","paper":"/paper/rotation-and-permutation-for-advanced-outlier","title":"DuQuant: Distributing Outliers via Dual Transformation Makes Stronger Quantized LLMs","date":"2024-06-03","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Hsu1023/DuQuant","path":"datautils.py","file_url":"https://github.com/Hsu1023/DuQuant/blob/HEAD/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"bd4f416e271c2fb5","mcp_get_code":{"code_sha256":"bd4f416e271c2fb5"}},{"arxiv_id":"2406.00800","paper":"/paper/magr-weight-magnitude-reduction-for-enhancing","title":"MagR: Weight Magnitude Reduction for Enhancing Post-Training Quantization","date":"2024-06-02","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"AozhongZhang/MagR","path":"datautils.py","file_url":"https://github.com/AozhongZhang/MagR/blob/HEAD/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"3a6ac4325dad94a4","mcp_get_code":{"code_sha256":"3a6ac4325dad94a4"}},{"arxiv_id":"2405.15756","paper":"/paper/sparse-expansion-and-neuronal-disentanglement","title":"Sparse Expansion and Neuronal Disentanglement","date":"2024-05-24","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"shavit-lab/sparse-expansion","path":"utils/datautils.py","file_url":"https://github.com/shavit-lab/sparse-expansion/blob/HEAD/utils/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"a7cbf4fc49c71e03","mcp_get_code":{"code_sha256":"a7cbf4fc49c71e03"}},{"arxiv_id":"2405.14917","paper":"/paper/slim-llm-salience-driven-mixed-precision","title":"SliM-LLM: Salience-Driven Mixed-Precision Quantization for Large Language Models","date":"2024-05-23","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Aaronhuang-778/SliM-LLM","path":"slim-llm-plus/datautils.py","file_url":"https://github.com/Aaronhuang-778/SliM-LLM/blob/HEAD/slim-llm-plus/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"bd4f416e271c2fb5","mcp_get_code":{"code_sha256":"bd4f416e271c2fb5"}},{"arxiv_id":"2404.14047","paper":"/paper/how-good-are-low-bit-quantized-llama3-models","title":"An empirical study of LLaMA3 quantization: from LLMs to MLLMs","date":"2024-04-22","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"macaronlin/llama3-quantization","path":"datautils.py","file_url":"https://github.com/macaronlin/llama3-quantization/blob/HEAD/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"bd4f416e271c2fb5","mcp_get_code":{"code_sha256":"bd4f416e271c2fb5"}},{"arxiv_id":"2403.12544","paper":"/paper/affinequant-affine-transformation","title":"AffineQuant: Affine Transformation Quantization for Large Language Models","date":"2024-03-19","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"bytedance/affinequant","path":"datautils.py","file_url":"https://github.com/bytedance/affinequant/blob/HEAD/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"bd4f416e271c2fb5","mcp_get_code":{"code_sha256":"bd4f416e271c2fb5"}},{"arxiv_id":"2403.06082","paper":"/paper/framequant-flexible-low-bit-quantization-for","title":"FrameQuant: Flexible Low-Bit Quantization for Transformers","date":"2024-03-10","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"vsingh-group/framequant","path":"datautils.py","file_url":"https://github.com/vsingh-group/framequant/blob/HEAD/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3265f727a396f15d","mcp_get_code":{"code_sha256":"3265f727a396f15d"}},{"arxiv_id":"2402.17946","paper":"/paper/gradient-free-adaptive-global-pruning-for-pre","title":"SparseLLM: Towards Global Pruning for Pre-trained Language Models","date":"2024-02-28","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"BaiTheBest/SparseLLM","path":"datautils.py","file_url":"https://github.com/BaiTheBest/SparseLLM/blob/HEAD/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"a7cbf4fc49c71e03","mcp_get_code":{"code_sha256":"a7cbf4fc49c71e03"}},{"arxiv_id":"2402.16880","paper":"/paper/besa-pruning-large-language-models-with","title":"BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation","date":"2024-02-18","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"linkanonymous/besa","path":"utils/data.py","file_url":"https://github.com/linkanonymous/besa/blob/HEAD/utils/data.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3c22f52a4d22d5d2","mcp_get_code":{"code_sha256":"3c22f52a4d22d5d2"}},{"arxiv_id":"2402.11295","paper":"/paper/onebit-towards-extremely-low-bit-large","title":"OneBit: Towards Extremely Low-bit Large Language Models","date":"2024-02-17","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"xuyuzhuang11/OneBit","path":"evaluation/lm_eval/datautils.py","file_url":"https://github.com/xuyuzhuang11/OneBit/blob/HEAD/evaluation/lm_eval/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"90dfde049522b716","mcp_get_code":{"code_sha256":"90dfde049522b716"}},{"arxiv_id":"2402.09773","paper":"/paper/nuteprune-efficient-progressive-pruning-with","title":"NutePrune: Efficient Progressive Pruning with Numerous Teachers for Large Language Models","date":"2024-02-15","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"lucius-lsr/nuteprune","path":"eval_ppl.py","file_url":"https://github.com/lucius-lsr/nuteprune/blob/HEAD/eval_ppl.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"6ada2617ee1d6042","mcp_get_code":{"code_sha256":"6ada2617ee1d6042"}},{"arxiv_id":"2402.04291","paper":"/paper/billm-pushing-the-limit-of-post-training","title":"BiLLM: Pushing the Limit of Post-Training Quantization for LLMs","date":"2024-02-06","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"aaronhuang-778/billm","path":"datautils.py","file_url":"https://github.com/aaronhuang-778/billm/blob/HEAD/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"a7cbf4fc49c71e03","mcp_get_code":{"code_sha256":"a7cbf4fc49c71e03"}},{"arxiv_id":"2312.11983","paper":"/paper/fluctuation-based-adaptive-structured-pruning","title":"Fluctuation-based Adaptive Structured Pruning for Large Language Models","date":"2023-12-19","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"casia-iva-lab/flap","path":"lib/data.py","file_url":"https://github.com/casia-iva-lab/flap/blob/HEAD/lib/data.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"1d035152616b1d19","mcp_get_code":{"code_sha256":"1d035152616b1d19"}},{"arxiv_id":"2310.19102","paper":"/paper/atom-low-bit-quantization-for-efficient-and","title":"Atom: Low-bit Quantization for Efficient and Accurate LLM Serving","date":"2023-10-29","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"efeslab/atom","path":"model/datautils.py","file_url":"https://github.com/efeslab/atom/blob/HEAD/model/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"d71aa8d60119d553","mcp_get_code":{"code_sha256":"d71aa8d60119d553"}},{"arxiv_id":"2310.09499","paper":"/paper/one-shot-sensitivity-aware-mixed-sparsity","title":"One-Shot Sensitivity-Aware Mixed Sparsity Pruning for Large Language Models","date":"2023-10-14","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"talkking/MixGPT","path":"datautils.py","file_url":"https://github.com/talkking/MixGPT/blob/HEAD/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"7d205a0e647139ae","mcp_get_code":{"code_sha256":"7d205a0e647139ae"}},{"arxiv_id":"2310.09259","paper":"/paper/towards-end-to-end-4-bit-inference-on","title":"QUIK: Towards End-to-End 4-Bit Inference on Generative Large Language Models","date":"2023-10-13","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"ist-daslab/quik","path":"experiments/datautils.py","file_url":"https://github.com/ist-daslab/quik/blob/HEAD/experiments/datautils.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"614c29352fee019e","mcp_get_code":{"code_sha256":"614c29352fee019e"}},{"arxiv_id":"2310.08915","paper":"/paper/dynamic-sparse-no-training-training-free-fine","title":"Dynamic Sparse No Training: Training-Free Fine-tuning for Sparse LLMs","date":"2023-10-13","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"zyxxmu/dsnot","path":"lib/prune.py","file_url":"https://github.com/zyxxmu/dsnot/blob/HEAD/lib/prune.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3b99c66b488c6dc0","mcp_get_code":{"code_sha256":"3b99c66b488c6dc0"}},{"arxiv_id":"2310.08041","paper":"/paper/qllm-accurate-and-efficient-low-bitwidth","title":"QLLM: Accurate and Efficient Low-Bitwidth Quantization for Large Language Models","date":"2023-10-12","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"modeltc/qllm","path":"datautils.py","file_url":"https://github.com/modeltc/qllm/blob/HEAD/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"1b68bae7cd1dd862","mcp_get_code":{"code_sha256":"1b68bae7cd1dd862"}},{"arxiv_id":"2310.00034","paper":"/paper/pb-llm-partially-binarized-large-language","title":"PB-LLM: Partially Binarized Large Language Models","date":"2023-09-29","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"hahnyuan/binaryllm","path":"gptq_pb/datautils.py","file_url":"https://github.com/hahnyuan/binaryllm/blob/HEAD/gptq_pb/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"a7cbf4fc49c71e03","mcp_get_code":{"code_sha256":"a7cbf4fc49c71e03"}},{"arxiv_id":"2308.13137","paper":"/paper/omniquant-omnidirectionally-calibrated","title":"OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models","date":"2023-08-25","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"opengvlab/omniquant","path":"datautils.py","file_url":"https://github.com/opengvlab/omniquant/blob/HEAD/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"bd4f416e271c2fb5","mcp_get_code":{"code_sha256":"bd4f416e271c2fb5"}},{"arxiv_id":"2307.15290","paper":"/paper/chathome-development-and-evaluation-of-a","title":"ChatHome: Development and Evaluation of a Domain-Specific Language Model for Home Renovation","date":"2023-07-28","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"lianjiatech/belle","path":"models/gptq/datautils.py","file_url":"https://github.com/lianjiatech/belle/blob/HEAD/models/gptq/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"c1c9acf2a2b2ad95","mcp_get_code":{"code_sha256":"c1c9acf2a2b2ad95"}},{"arxiv_id":"2307.09288","paper":"/paper/llama-2-open-foundation-and-fine-tuned-chat","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","date":"2023-07-18","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"squeezeailab/squeezellm","path":"squeezellm/datautils.py","file_url":"https://github.com/squeezeailab/squeezellm/blob/HEAD/squeezellm/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"b1e98f962f5ae82d","mcp_get_code":{"code_sha256":"b1e98f962f5ae82d"}},{"arxiv_id":"2304.01089","paper":"/paper/rptq-reorder-based-post-training-quantization","title":"RPTQ: Reorder-based Post-training Quantization for Large Language Models","date":"2023-04-03","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"hahnyuan/rptq4llm","path":"datautils.py","file_url":"https://github.com/hahnyuan/rptq4llm/blob/HEAD/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"53cc9d33d473dc6b","mcp_get_code":{"code_sha256":"53cc9d33d473dc6b"}},{"arxiv_id":"openreview_Im05D8gFFn","paper":null,"title":"arXiv:openreview_Im05D8gFFn","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"mazumder-lab/RobOP","path":"RobOP-ALPS/datautils.py","file_url":"https://github.com/mazumder-lab/RobOP/blob/HEAD/RobOP-ALPS/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"ecf5f166de1b29da","mcp_get_code":{"code_sha256":"ecf5f166de1b29da"}},{"arxiv_id":"aaai_28960","paper":null,"title":"arXiv:aaai_28960","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"CASIA-IVA-Lab/FLAP","path":"lib/data.py","file_url":"https://github.com/CASIA-IVA-Lab/FLAP/blob/HEAD/lib/data.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"1d035152616b1d19","mcp_get_code":{"code_sha256":"1d035152616b1d19"}},{"arxiv_id":"2025.naacl-long.237","paper":null,"title":"arXiv:2025.naacl-long.237","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"nbasyl/LLM-FP4","path":"datautils.py","file_url":"https://github.com/nbasyl/LLM-FP4/blob/HEAD/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"a7a0ae47fad93751","mcp_get_code":{"code_sha256":"a7a0ae47fad93751"}},{"arxiv_id":"2025.findings-emnlp.1054","paper":null,"title":"arXiv:2025.findings-emnlp.1054","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"IST-DASLab/sparsegpt","path":"datautils.py","file_url":"https://github.com/IST-DASLab/sparsegpt/blob/HEAD/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"a7cbf4fc49c71e03","mcp_get_code":{"code_sha256":"a7cbf4fc49c71e03"}},{"arxiv_id":"2024.findings-naacl.145","paper":null,"title":"arXiv:2024.findings-naacl.145","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"LianjiaTech/BELLE","path":"models/gptq/datautils.py","file_url":"https://github.com/LianjiaTech/BELLE/blob/HEAD/models/gptq/datautils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"c1c9acf2a2b2ad95","mcp_get_code":{"code_sha256":"c1c9acf2a2b2ad95"}}]}