{"about":{"site":"https://codewithpapers.app","non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page"},"url":"/code/get-config-class-from-processor-class","entry":"get_config_class_from_processor_class","source":"Syntology graph, per-sample; not an archive number","read_at":"2026-09-24T18:15:14+00:00","claim":"Names are grouped by exact entry-name string. Same-named routines are NOT asserted to be equivalent; 'ran' means executed on a synthesized fixture, not correctness. n_samples_ran = sum of by_status over every status except 'unverified' (ran_draft_wrong and ran_fixture are failures of Syntology's instrument, not of the code); n_papers_ran = papers with at least one such sample.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"},"n_papers":29,"n_papers_ran":0,"units":"n_samples, n_samples_ran, n_samples_fingerprinted and by_status count distinct code bodies (code_sha256); n_places and n_places_pointer_only count places, one per (paper, code body) pair, which is also the unit of the samples list","n_samples":2,"n_samples_ran":0,"n_samples_fingerprinted":0,"n_places":29,"n_places_pointer_only":16,"by_status":{"ran_honours":0,"ran_violates":0,"ran_draft_wrong":0,"ran_fixture":0,"ran":0,"unverified":2},"syntology":{"atlas_url":null,"mcp":null,"mcp_per_sample":{"tool":"get_code","arguments_in":"samples[].mcp_get_code"},"developers":"https://syntology.ai/developers"},"samples":[{"arxiv_id":"2603.16206","paper":"/paper/arxiv-2603-16206","title":"Offline Exploration-Aware Fine-Tuning for Long-Chain Mathematical Reasoning","date":null,"month_inferred_from_arxiv_id":"2026-03","title_source":"syntology","repo":"takagi97/OXA-Fine-tuning","path":"2-fine-tuning/transformers-4.51.0/utils/create_dummy_models.py","file_url":"https://github.com/takagi97/OXA-Fine-tuning/blob/HEAD/2-fine-tuning/transformers-4.51.0/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2510.24061","paper":"/paper/arxiv-2510-24061","title":"FALQON: Accelerating LoRA Fine-tuning with Low-Bit Floating-Point Arithmetic","date":null,"month_inferred_from_arxiv_id":"2025-10","title_source":"syntology","repo":"iamkanghyunchoi/falqon","path":"transformers/utils/create_dummy_models.py","file_url":"https://github.com/iamkanghyunchoi/falqon/blob/HEAD/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2506.17218","paper":"/paper/machine-mental-imagery-empower-multimodal","title":"Machine Mental Imagery: Empower Multimodal Reasoning with Latent Visual Tokens","date":"2025-06-20","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"umass-embodied-agi/mirage","path":"transformers/utils/create_dummy_models.py","file_url":"https://github.com/umass-embodied-agi/mirage/blob/HEAD/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2506.13752","paper":"/paper/steering-llm-thinking-with-budget-guidance","title":"Steering LLM Thinking with Budget Guidance","date":"2025-06-16","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"umass-embodied-agi/budgetguidance","path":"3rdparty/transformers/utils/create_dummy_models.py","file_url":"https://github.com/umass-embodied-agi/budgetguidance/blob/HEAD/3rdparty/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2504.03933","paper":"/paper/language-models-are-implicitly-continuous","title":"Language Models Are Implicitly Continuous","date":"2025-04-04","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"samuelemarro/continuous-llm-experiments","path":"utils/create_dummy_models.py","file_url":"https://github.com/samuelemarro/continuous-llm-experiments/blob/HEAD/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":false,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2502.04667","paper":"/paper/unveiling-the-mechanisms-of-explicit-cot","title":"Unveiling the Mechanisms of Explicit CoT Training: How CoT Enhances Reasoning Generalization","date":"2025-02-07","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"chen123ctrls/t-cotmechanism","path":"ControlledExperiments/transformers/utils/create_dummy_models.py","file_url":"https://github.com/chen123ctrls/t-cotmechanism/blob/HEAD/ControlledExperiments/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2411.10606","paper":"/paper/amoeballm-constructing-any-shape-large","title":"AmoebaLLM: Constructing Any-Shape Large Language Models for Efficient and Instant Deployment","date":"2024-11-15","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"GATECH-EIC/AmoebaLLM","path":"transformers/utils/create_dummy_models.py","file_url":"https://github.com/GATECH-EIC/AmoebaLLM/blob/HEAD/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2411.09688","paper":"/paper/squeezed-attention-accelerating-long-context","title":"Squeezed Attention: Accelerating Long Context Length LLM Inference","date":"2024-11-14","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"SqueezeAILab/SqueezedAttention","path":"transformers/utils/create_dummy_models.py","file_url":"https://github.com/SqueezeAILab/SqueezedAttention/blob/HEAD/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2411.04358","paper":"/paper/robust-and-efficient-fine-tuning-of-llms-with","title":"Robust and Efficient Fine-tuning of LLMs with Bayesian Reparameterization of Low-Rank Adaptation","date":"2024-11-07","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"lcs2-iiitd/monteclora","path":"transformers/utils/create_dummy_models.py","file_url":"https://github.com/lcs2-iiitd/monteclora/blob/HEAD/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2411.02433","paper":"/paper/sled-self-logits-evolution-decoding-for","title":"SLED: Self Logits Evolution Decoding for Improving Factuality in Large Language Models","date":"2024-11-01","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"JayZhang42/SLED","path":"transformers/utils/create_dummy_models.py","file_url":"https://github.com/JayZhang42/SLED/blob/HEAD/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2410.19123","paper":"/paper/read-me-refactorizing-llms-as-router","title":"Read-ME: Refactorizing LLMs as Router-Decoupled Mixture of Experts with System Co-Design","date":"2024-10-24","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"VITA-Group/READ-ME","path":"utils/create_dummy_models.py","file_url":"https://github.com/VITA-Group/READ-ME/blob/HEAD/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2410.12178","paper":"/paper/model-balancing-helps-low-data-training-and","title":"Model Balancing Helps Low-data Training and Fine-tuning","date":"2024-10-16","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"zihanghliu/modelbalancing","path":"transformers/utils/create_dummy_models.py","file_url":"https://github.com/zihanghliu/modelbalancing/blob/HEAD/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2408.03617","paper":"/paper/is-child-directed-speech-effective-training","title":"Is Child-Directed Speech Effective Training Data for Language Models?","date":"2024-08-07","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"styfeng/TinyDialogues","path":"transformers/utils/create_dummy_models.py","file_url":"https://github.com/styfeng/TinyDialogues/blob/HEAD/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2407.07071","paper":"/paper/lookback-lens-detecting-and-mitigating","title":"Lookback Lens: Detecting and Mitigating Contextual Hallucinations in Large Language Models Using Only Attention Maps","date":"2024-07-09","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"voidism/lookback-lens","path":"transformers-4.32.0/utils/create_dummy_models.py","file_url":"https://github.com/voidism/lookback-lens/blob/HEAD/transformers-4.32.0/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2406.05427","paper":"/paper/decision-mamba-a-multi-grained-state-space","title":"Decision Mamba: A Multi-Grained State Space Model with Self-Evolution Regularization for Offline RL","date":"2024-06-08","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"aopolin-lv/DecisionMamba","path":"transformers/utils/create_dummy_models.py","file_url":"https://github.com/aopolin-lv/DecisionMamba/blob/HEAD/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2405.11613","paper":"/paper/decoding-by-contrasting-knowledge-enhancing","title":"Decoding by Contrasting Knowledge: Enhancing LLMs' Confidence on Edited Facts","date":"2024-05-19","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"byronbbl/deck","path":"transformers-4.28.1/utils/create_dummy_models.py","file_url":"https://github.com/byronbbl/deck/blob/HEAD/transformers-4.28.1/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2404.16367","paper":"/paper/learning-syntax-without-planting-trees","title":"Learning Syntax Without Planting Trees: Understanding When and Why Transformers Generalize Hierarchically","date":"2024-04-25","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"kabirahuja2431/transformers-hg","path":"transformers/utils/create_dummy_models.py","file_url":"https://github.com/kabirahuja2431/transformers-hg/blob/HEAD/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2402.18223","paper":"/paper/improving-open-ended-text-generation-via","title":"Improving Open-Ended Text Generation via Adaptive Decoding","date":"2024-02-28","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"zwhong714/adaptive_decoding","path":"transformers-main/utils/create_dummy_models.py","file_url":"https://github.com/zwhong714/adaptive_decoding/blob/HEAD/transformers-main/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2402.17812","paper":"/paper/dropbp-accelerating-fine-tuning-of-large","title":"DropBP: Accelerating Fine-Tuning of Large Language Models by Dropping Backward Propagation","date":"2024-02-27","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"woosunghyeon/dropbp","path":"huggingface/transformers_dropbp/utils/create_dummy_models.py","file_url":"https://github.com/woosunghyeon/dropbp/blob/HEAD/huggingface/transformers_dropbp/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2402.11295","paper":"/paper/onebit-towards-extremely-low-bit-large","title":"OneBit: Towards Extremely Low-bit Large Language Models","date":"2024-02-17","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"xuyuzhuang11/OneBit","path":"transformers/utils/create_dummy_models.py","file_url":"https://github.com/xuyuzhuang11/OneBit/blob/HEAD/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2401.08350","paper":"/paper/salute-the-classic-revisiting-challenges-of","title":"Salute the Classic: Revisiting Challenges of Machine Translation in the Age of Large Language Models","date":"2024-01-16","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"pangjh3/llm4mt","path":"transformers/utils/create_dummy_models.py","file_url":"https://github.com/pangjh3/llm4mt/blob/HEAD/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2401.05930","paper":"/paper/sh2-self-highlighted-hesitation-helps-you","title":"SH2: Self-Highlighted Hesitation Helps You Decode More Truthfully","date":"2024-01-11","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"0-kaikai-0/sh2","path":"transformers/utils/create_dummy_models.py","file_url":"https://github.com/0-kaikai-0/sh2/blob/HEAD/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2312.15710","paper":"/paper/alleviating-hallucinations-of-large-language","title":"Alleviating Hallucinations of Large Language Models through Induced Hallucinations","date":"2023-12-25","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"hillzhang1999/icd","path":"transformers/utils/create_dummy_models.py","file_url":"https://github.com/hillzhang1999/icd/blob/HEAD/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2311.07468","paper":"/paper/are-we-falling-in-a-middle-intelligence-trap","title":"An Analysis and Mitigation of the Reversal Curse","date":"2023-11-13","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"trestad/mitigating-reversal-curse","path":"transformers/utils/create_dummy_models.py","file_url":"https://github.com/trestad/mitigating-reversal-curse/blob/HEAD/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2308.12219","paper":"/paper/diffusion-language-models-can-perform-many","title":"Diffusion Language Models Can Perform Many Tasks with Scaling and Instruction-Finetuning","date":"2023-08-23","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"yegcjs/diffusionllm","path":"transformers/utils/create_dummy_models.py","file_url":"https://github.com/yegcjs/diffusionllm/blob/HEAD/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2305.10614","paper":"/paper/token-wise-decomposition-of-autoregressive","title":"Token-wise Decomposition of Autoregressive Language Model Hidden States for Analyzing Model Predictions","date":"2023-05-17","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"byungdoh/llm_decomposition","path":"huggingface/utils/create_dummy_models.py","file_url":"https://github.com/byungdoh/llm_decomposition/blob/HEAD/huggingface/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"8291db316b0e343a","mcp_get_code":{"code_sha256":"8291db316b0e343a"}},{"arxiv_id":"2007.07779","paper":"/paper/adapterhub-a-framework-for-adapting","title":"AdapterHub: A Framework for Adapting Transformers","date":"2020-07-15","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"mklimasz/language-arithmetic","path":"utils/create_dummy_models.py","file_url":"https://github.com/mklimasz/language-arithmetic/blob/HEAD/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":false,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2024.findings-naacl.117","paper":null,"title":"arXiv:2024.findings-naacl.117","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"qqplot/dcpmi","path":"transformers/utils/create_dummy_models.py","file_url":"https://github.com/qqplot/dcpmi/blob/HEAD/transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}},{"arxiv_id":"2024.findings-acl.699","paper":null,"title":"arXiv:2024.findings-acl.699","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"CPJKU/ScaLearn","path":"adapter-transformers/utils/create_dummy_models.py","file_url":"https://github.com/CPJKU/ScaLearn/blob/HEAD/adapter-transformers/utils/create_dummy_models.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"3d999b95009c7537","mcp_get_code":{"code_sha256":"3d999b95009c7537"}}]}