{"about":{"site":"https://codewithpapers.app","non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page"},"url":"/code/load-tf-weights-in-bert","entry":"load_tf_weights_in_bert","source":"Syntology graph, per-sample; not an archive number","read_at":"2026-09-24T18:15:14+00:00","claim":"Names are grouped by exact entry-name string. Same-named routines are NOT asserted to be equivalent; 'ran' means executed on a synthesized fixture, not correctness. n_samples_ran = sum of by_status over every status except 'unverified' (ran_draft_wrong and ran_fixture are failures of Syntology's instrument, not of the code); n_papers_ran = papers with at least one such sample.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"},"n_papers":135,"n_papers_ran":19,"units":"n_samples, n_samples_ran, n_samples_fingerprinted and by_status count distinct code bodies (code_sha256); n_places and n_places_pointer_only count places, one per (paper, code body) pair, which is also the unit of the samples list","n_samples":27,"n_samples_ran":1,"n_samples_fingerprinted":0,"n_places":142,"n_places_pointer_only":42,"by_status":{"ran_honours":0,"ran_violates":0,"ran_draft_wrong":1,"ran_fixture":0,"ran":0,"unverified":26},"syntology":{"atlas_url":null,"mcp":null,"mcp_per_sample":{"tool":"get_code","arguments_in":"samples[].mcp_get_code"},"developers":"https://syntology.ai/developers"},"samples":[{"arxiv_id":"2604.27550","paper":"/paper/arxiv-2604-27550","title":"APPSI-139: A Parallel Corpus of English Application Privacy Policy Summarization and Interpretation","date":null,"month_inferred_from_arxiv_id":"2026-04","title_source":"syntology","repo":"EnlightenedAI/APPSI-139","path":"Infer/pytorch_pretrained/modeling.py","file_url":"https://github.com/EnlightenedAI/APPSI-139/blob/HEAD/Infer/pytorch_pretrained/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"b1a7180868dd8d6a","mcp_get_code":{"code_sha256":"b1a7180868dd8d6a"}},{"arxiv_id":"2506.05890","paper":"/paper/unleashing-the-potential-of-consistency-1","title":"Unleashing the Potential of Consistency Learning for Detecting and Grounding Multi-Modal Media Manipulation","date":"2025-06-06","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"liyih/CSCL","path":"code/MultiModal-DeepFake-main/models/METER/bert_model.py","file_url":"https://github.com/liyih/CSCL/blob/HEAD/code/MultiModal-DeepFake-main/models/METER/bert_model.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"efbb0f3903b5f779","mcp_get_code":{"code_sha256":"efbb0f3903b5f779"}},{"arxiv_id":"2411.11919","paper":"/paper/vl-uncertainty-detecting-hallucination-in","title":"VL-Uncertainty: Detecting Hallucination in Large Vision-Language Model via Uncertainty Estimation","date":"2024-11-18","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"JT-Sun/Filtering-WoRA","path":"models/bert.py","file_url":"https://github.com/JT-Sun/Filtering-WoRA/blob/HEAD/models/bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2411.02669","paper":"/paper/semantic-aligned-adversarial-evolution","title":"Semantic-Aligned Adversarial Evolution Triangle for High-Transferability Vision-Language Attack","date":"2024-11-04","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"jiaxiaojunqaq/sa-aet","path":"models/xbert.py","file_url":"https://github.com/jiaxiaojunqaq/sa-aet/blob/HEAD/models/xbert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2410.03531","paper":"/paper/mare-multi-aspect-rationale-extractor-on","title":"MARE: Multi-Aspect Rationale Extractor on Unsupervised Rationale Extraction","date":"2024-10-04","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"CSU-NLP-Group/MARE","path":"src/module/modeling_mare.py","file_url":"https://github.com/CSU-NLP-Group/MARE/blob/HEAD/src/module/modeling_mare.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"efbb0f3903b5f779","mcp_get_code":{"code_sha256":"efbb0f3903b5f779"}},{"arxiv_id":"2409.19961","paper":"/paper/multimodal-llm-enhanced-cross-lingual-cross","title":"Multimodal LLM Enhanced Cross-lingual Cross-modal Retrieval","date":"2024-09-30","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"lijiabei-7/leccr","path":"LECCR/models/xbert.py","file_url":"https://github.com/lijiabei-7/leccr/blob/HEAD/LECCR/models/xbert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2409.01193","paper":"/paper/clibe-detecting-dynamic-backdoors-in","title":"CLIBE: Detecting Dynamic Backdoors in Transformer-based NLP Models","date":"2024-09-02","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"raytsang123/clibe","path":"discriminative_backdoors/detection/modeling_bert.py","file_url":"https://github.com/raytsang123/clibe/blob/HEAD/discriminative_backdoors/detection/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"efbb0f3903b5f779","mcp_get_code":{"code_sha256":"efbb0f3903b5f779"}},{"arxiv_id":"2406.18847","paper":"/paper/learning-retrieval-augmentation-for","title":"Learning Retrieval Augmentation for Personalized Dialogue Generation","date":"2024-06-27","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"hqsiswiliam/lapdog","path":"src/modeling_bert.py","file_url":"https://github.com/hqsiswiliam/lapdog/blob/HEAD/src/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"d009b630f4496e64","mcp_get_code":{"code_sha256":"d009b630f4496e64"}},{"arxiv_id":"2406.05491","paper":"/paper/one-perturbation-is-enough-on-generating","title":"One Perturbation is Enough: On Generating Universal Adversarial Perturbations against Vision-Language Pre-training Models","date":"2024-06-08","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"ffhibnese/cpgc_vlp_universal_attacks","path":"models/xbert.py","file_url":"https://github.com/ffhibnese/cpgc_vlp_universal_attacks/blob/HEAD/models/xbert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2404.19563","paper":"/paper/repeval-effective-text-evaluation-with-llm","title":"RepEval: Effective Text Evaluation with LLM Representation","date":"2024-04-30","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"shikib/usr","path":"transformers/modeling_bert.py","file_url":"https://github.com/shikib/usr/blob/HEAD/transformers/modeling_bert.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"2404.13039","paper":"/paper/lapa-latent-prompt-assist-model-for-medical","title":"LaPA: Latent Prompt Assist Model For Medical Visual Question Answering","date":"2024-04-19","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"garygutc/lapa_model","path":"m3ae/modules/language_encoders/bert_model.py","file_url":"https://github.com/garygutc/lapa_model/blob/HEAD/m3ae/modules/language_encoders/bert_model.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"efbb0f3903b5f779","mcp_get_code":{"code_sha256":"efbb0f3903b5f779"}},{"arxiv_id":"2403.06208","paper":"/paper/personalized-lora-for-human-centered-text","title":"Personalized LoRA for Human-Centered Text Understanding","date":"2024-03-10","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"yoyo-yun/plora","path":"models/baselines/MA_BERT.py","file_url":"https://github.com/yoyo-yun/plora/blob/HEAD/models/baselines/MA_BERT.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2403.03942","paper":"/paper/the-heuristic-core-understanding-subnetwork","title":"The Heuristic Core: Understanding Subnetwork Generalization in Pretrained Language Models","date":"2024-03-06","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"princeton-nlp/heuristic-core","path":"src/pruning/modeling_pert.py","file_url":"https://github.com/princeton-nlp/heuristic-core/blob/HEAD/src/pruning/modeling_pert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"75c010fd45104632","mcp_get_code":{"code_sha256":"75c010fd45104632"}},{"arxiv_id":"2402.01729","paper":"/paper/contextualization-distillation-from-large","title":"Contextualization Distillation from Large Language Model for Knowledge Graph Completion","date":"2024-01-28","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"David-Li0406/Contextulization-Distillation","path":"kg-bert/model_distillation.py","file_url":"https://github.com/David-Li0406/Contextulization-Distillation/blob/HEAD/kg-bert/model_distillation.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"b1a7180868dd8d6a","mcp_get_code":{"code_sha256":"b1a7180868dd8d6a"}},{"arxiv_id":"2401.00793","paper":"/paper/secformer-towards-fast-and-accurate-privacy","title":"SecFormer: Fast and Accurate Privacy-Preserving Inference for Transformer Models via SMPC","date":"2024-01-01","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"jinglong696/secformer","path":"performance/knowledge_distill/transformer/modeling.py","file_url":"https://github.com/jinglong696/secformer/blob/HEAD/performance/knowledge_distill/transformer/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"0453ed29d1aecc4c","mcp_get_code":{"code_sha256":"0453ed29d1aecc4c"}},{"arxiv_id":"2312.12470","paper":"/paper/rotated-multi-scale-interaction-network-for","title":"Rotated Multi-Scale Interaction Network for Referring Remote Sensing Image Segmentation","date":"2023-12-19","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"lsan2401/rmsin","path":"bert/modeling_bert.py","file_url":"https://github.com/lsan2401/rmsin/blob/HEAD/bert/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"fb9398de2966d6de","mcp_get_code":{"code_sha256":"fb9398de2966d6de"}},{"arxiv_id":"2312.12198","paper":"/paper/mask-grounding-for-referring-image","title":"Mask Grounding for Referring Image Segmentation","date":"2023-12-19","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"yxchng/mask-grounding","path":"bert/modeling_bert.py","file_url":"https://github.com/yxchng/mask-grounding/blob/HEAD/bert/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"AGPL-3.0","inline_ok":false,"code_sha256_prefix":"fb9398de2966d6de","mcp_get_code":{"code_sha256":"fb9398de2966d6de"}},{"arxiv_id":"2312.02249","paper":"/paper/recursive-visual-programming","title":"Recursive Visual Programming","date":"2023-12-04","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"para-lost/rvp","path":"base_models/tcl/tcl_xbert.py","file_url":"https://github.com/para-lost/rvp/blob/HEAD/base_models/tcl/tcl_xbert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2311.12570","paper":"/paper/bend-benchmarking-dna-language-models-on","title":"BEND: Benchmarking DNA Language Models on biologically meaningful tasks","date":"2023-11-21","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"frederikkemarin/BEND","path":"bend/models/gena_lm.py","file_url":"https://github.com/frederikkemarin/BEND/blob/HEAD/bend/models/gena_lm.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"BSD-3-Clause","inline_ok":true,"code_sha256_prefix":"4db905959447729d","mcp_get_code":{"code_sha256":"4db905959447729d"}},{"arxiv_id":"2310.16579","paper":"/paper/wsdms-debunk-fake-news-via-weakly-supervised","title":"WSDMS: Debunk Fake News via Weakly Supervised Detection of Misinforming Sentences with Contextualized Social Wisdom","date":"2023-10-25","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"HKBUNLP/WSDMS-EMNLP2023","path":"bert_model.py","file_url":"https://github.com/HKBUNLP/WSDMS-EMNLP2023/blob/HEAD/bert_model.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"baa5766f4566aafc","mcp_get_code":{"code_sha256":"baa5766f4566aafc"}},{"arxiv_id":"2310.14577","paper":"/paper/decrisismb-debiased-semi-supervised-learning","title":"DeCrisisMB: Debiased Semi-Supervised Learning for Crisis Tweet Classification via Memory Bank","date":"2023-10-23","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"HenryPengZou/DeCrisisMB","path":"models/Bert4Mixup.py","file_url":"https://github.com/HenryPengZou/DeCrisisMB/blob/HEAD/models/Bert4Mixup.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"d009b630f4496e64","mcp_get_code":{"code_sha256":"d009b630f4496e64"}},{"arxiv_id":"2309.14763","paper":"/paper/conpet-continual-parameter-efficient-tuning","title":"ConPET: Continual Parameter-Efficient Tuning for Large Language Models","date":"2023-09-26","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"raincleared-song/conpet","path":"models/bert_lora.py","file_url":"https://github.com/raincleared-song/conpet/blob/HEAD/models/bert_lora.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"cd99ddf3ebf977c5","mcp_get_code":{"code_sha256":"cd99ddf3ebf977c5"}},{"arxiv_id":"2309.14203","paper":"/paper/detecting-and-grounding-multi-modal-media-1","title":"Detecting and Grounding Multi-Modal Media Manipulation and Beyond","date":"2023-09-25","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"rshaojimmy/multimodal-deepfake","path":"models/xbert.py","file_url":"https://github.com/rshaojimmy/multimodal-deepfake/blob/HEAD/models/xbert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2309.01017","paper":"/paper/contrastive-grouping-with-transformer-for-1","title":"Contrastive Grouping with Transformer for Referring Image Segmentation","date":"2023-09-02","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"toneyaya/cgformer","path":"bert/modeling_bert.py","file_url":"https://github.com/toneyaya/cgformer/blob/HEAD/bert/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"fb9398de2966d6de","mcp_get_code":{"code_sha256":"fb9398de2966d6de"}},{"arxiv_id":"2308.13853","paper":"/paper/beyond-one-to-one-rethinking-the-referring","title":"Beyond One-to-One: Rethinking the Referring Image Segmentation","date":"2023-08-26","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"toggle1995/RIS-DMMI","path":"bert/modeling_bert.py","file_url":"https://github.com/toggle1995/RIS-DMMI/blob/HEAD/bert/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"fb9398de2966d6de","mcp_get_code":{"code_sha256":"fb9398de2966d6de"}},{"arxiv_id":"2308.10873","paper":"/paper/spikingbert-distilling-bert-to-train-spiking","title":"SpikingBERT: Distilling BERT to Train Spiking Language Models Using Implicit Differentiation","date":"2023-08-21","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"neurocomplab-psu/spikingbert","path":"transformer/modeling.py","file_url":"https://github.com/neurocomplab-psu/spikingbert/blob/HEAD/transformer/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"0453ed29d1aecc4c","mcp_get_code":{"code_sha256":"0453ed29d1aecc4c"}},{"arxiv_id":"2308.07922","paper":"/paper/raven-in-context-learning-with-retrieval","title":"RAVEN: In-Context Learning with Retrieval-Augmented Encoder-Decoder Language Models","date":"2023-08-15","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"jeffhj/raven","path":"src/modeling_bert.py","file_url":"https://github.com/jeffhj/raven/blob/HEAD/src/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"d009b630f4496e64","mcp_get_code":{"code_sha256":"d009b630f4496e64"}},{"arxiv_id":"2308.07146","paper":"/paper/ctp-towards-vision-language-continual","title":"CTP: Towards Vision-Language Continual Pretraining via Compatible Momentum Contrast and Topology Preservation","date":"2023-08-14","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"kevinlight831/ctp","path":"models/xbert.py","file_url":"https://github.com/kevinlight831/ctp/blob/HEAD/models/xbert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"e4471ca16a2e77e8","mcp_get_code":{"code_sha256":"e4471ca16a2e77e8"}},{"arxiv_id":"2307.14061","paper":"/paper/set-level-guidance-attack-boosting","title":"Set-level Guidance Attack: Boosting Adversarial Transferability of Vision-Language Pre-training Models","date":"2023-07-26","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Zoky-2020/Set-level_Guidance_Attack","path":"models/xbert.py","file_url":"https://github.com/Zoky-2020/Set-level_Guidance_Attack/blob/HEAD/models/xbert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2307.11984","paper":"/paper/learning-vision-and-language-navigation-from","title":"Learning Vision-and-Language Navigation from YouTube Videos","date":"2023-07-22","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"jeremylinky/youtube-vln","path":"vilbert/vilbert.py","file_url":"https://github.com/jeremylinky/youtube-vln/blob/HEAD/vilbert/vilbert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"baa5766f4566aafc","mcp_get_code":{"code_sha256":"baa5766f4566aafc"}},{"arxiv_id":"2306.04362","paper":"/paper/youku-mplug-a-10-million-large-scale-chinese","title":"Youku-mPLUG: A 10 Million Large-scale Chinese Video-Language Dataset for Pre-training and Benchmarks","date":"2023-06-07","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"x-plug/youku-mplug","path":"models/modeling_mplug.py","file_url":"https://github.com/x-plug/youku-mplug/blob/HEAD/models/modeling_mplug.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2306.02898","paper":"/paper/towards-unified-text-based-person-retrieval-a","title":"Towards Unified Text-based Person Retrieval: A Large-scale Multi-Attribute and Language Search Benchmark","date":"2023-06-05","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Shuyu-XJTU/APTM","path":"models/bert.py","file_url":"https://github.com/Shuyu-XJTU/APTM/blob/HEAD/models/bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2305.14766","paper":"/paper/beamsearchqa-large-language-models-are-strong","title":"Allies: Prompting Large Language Model with Beam Search","date":"2023-05-24","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"microsoft/simxns","path":"ALLIES/modeling_bert.py","file_url":"https://github.com/microsoft/simxns/blob/HEAD/ALLIES/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d009b630f4496e64","mcp_get_code":{"code_sha256":"d009b630f4496e64"}},{"arxiv_id":"2305.14007","paper":"/paper/when-does-aggregating-multiple-skills-with","title":"When Does Aggregating Multiple Skills with Multi-Task Learning Work? A Case Study in Financial NLP","date":"2023-05-23","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"EdisonNi-hku/MTL4Finance","path":"code/models/modeling_task_embeddings.py","file_url":"https://github.com/EdisonNi-hku/MTL4Finance/blob/HEAD/code/models/modeling_task_embeddings.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"2305.13653","paper":"/paper/rasa-relation-and-sensitivity-aware","title":"RaSa: Relation and Sensitivity Aware Representation Learning for Text-based Person Search","date":"2023-05-23","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Flame-Chasers/RaSa","path":"models/xbert.py","file_url":"https://github.com/Flame-Chasers/RaSa/blob/HEAD/models/xbert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2305.06152","paper":"/paper/structure-clip-enhance-multi-modal-language","title":"Structure-CLIP: Towards Scene Graph Knowledge to Enhance Multi-modal Structured Representations","date":"2023-05-06","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"zjukg/DUET","path":"model/swin_modeling_bert.py","file_url":"https://github.com/zjukg/DUET/blob/HEAD/model/swin_modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"4db905959447729d","mcp_get_code":{"code_sha256":"4db905959447729d"}},{"arxiv_id":"2305.00593","paper":"/paper/reliable-gradient-free-and-likelihood-free","title":"Reliable Gradient-free and Likelihood-free Prompt Tuning","date":"2023-04-30","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"maohaos2/SBI_LLM","path":"models/modeling_bert.py","file_url":"https://github.com/maohaos2/SBI_LLM/blob/HEAD/models/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2303.04995","paper":"/paper/text-visual-prompting-for-efficient-2d","title":"Text-Visual Prompting for Efficient 2D Temporal Video Grounding","date":"2023-03-09","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"intel/TVP","path":"src/modeling/transformers.py","file_url":"https://github.com/intel/TVP/blob/HEAD/src/modeling/transformers.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"0766f48ad6e01b56","mcp_get_code":{"code_sha256":"0766f48ad6e01b56"}},{"arxiv_id":"2302.07387","paper":"/paper/polyformer-referring-image-segmentation-as","title":"PolyFormer: Referring Image Segmentation as Sequential Polygon Generation","date":"2023-02-14","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"amazon-science/polygon-transformer","path":"bert/modeling_bert.py","file_url":"https://github.com/amazon-science/polygon-transformer/blob/HEAD/bert/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":false,"code_sha256_prefix":"fb9398de2966d6de","mcp_get_code":{"code_sha256":"fb9398de2966d6de"}},{"arxiv_id":"2302.00402","paper":"/paper/mplug-2-a-modularized-multi-modal-foundation","title":"mPLUG-2: A Modularized Multi-modal Foundation Model Across Text, Image and Video","date":"2023-02-01","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"X-PLUG/mPLUG-2","path":"models/modeling_mplug2.py","file_url":"https://github.com/X-PLUG/mPLUG-2/blob/HEAD/models/modeling_mplug2.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2212.03506","paper":"/paper/wider-closer-mixture-of-short-channel","title":"WIDER & CLOSER: Mixture of Short-channel Distillers for Zero-shot Cross-lingual Named Entity Recognition","date":"2022-12-07","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"mckysse/msd","path":"transformers/modeling_bert.py","file_url":"https://github.com/mckysse/msd/blob/HEAD/transformers/modeling_bert.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"2211.15029","paper":"/paper/diffusionbert-improving-generative-masked","title":"DiffusionBERT: Improving Generative Masked Language Models with Diffusion Models","date":"2022-11-28","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"hzfinfdu/diffusion-bert","path":"models/modeling_bert.py","file_url":"https://github.com/hzfinfdu/diffusion-bert/blob/HEAD/models/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"d009b630f4496e64","mcp_get_code":{"code_sha256":"d009b630f4496e64"}},{"arxiv_id":"2211.13594","paper":"/paper/self-supervised-vision-language-pretraining","title":"Self-supervised vision-language pretraining for Medical visual question answering","date":"2022-11-24","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"pengfeiliheu/m2i2","path":"models/xbert.py","file_url":"https://github.com/pengfeiliheu/m2i2/blob/HEAD/models/xbert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2210.10678","paper":"/paper/towards-realistic-low-resource-relation","title":"Towards Realistic Low-resource Relation Extraction: A Benchmark with Empirical Baseline Study","date":"2022-10-19","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"zjunlp/KnowPrompt","path":"models/bert/modeling_bert.py","file_url":"https://github.com/zjunlp/KnowPrompt/blob/HEAD/models/bert/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"efbb0f3903b5f779","mcp_get_code":{"code_sha256":"efbb0f3903b5f779"}},{"arxiv_id":"2210.10246","paper":"/paper/tempo-accelerating-transformer-based-model","title":"Tempo: Accelerating Transformer-Based Model Training through Memory Footprint Reduction","date":"2022-10-19","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"uoft-ecosystem/tempo","path":"NVIDIA_DeepLearningExample_BERT/modeling_tempo.py","file_url":"https://github.com/uoft-ecosystem/tempo/blob/HEAD/NVIDIA_DeepLearningExample_BERT/modeling_tempo.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"b3aa7f0f06a96951","mcp_get_code":{"code_sha256":"b3aa7f0f06a96951"}},{"arxiv_id":"2210.07795","paper":"/paper/efficientvlm-fast-and-accurate-vision","title":"EfficientVLM: Fast and Accurate Vision-Language Models via Knowledge Distillation and Modal-adaptive Pruning","date":"2022-10-14","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"swaggy-tn/efficientvlm","path":"efficient_models/eff_bert.py","file_url":"https://github.com/swaggy-tn/efficientvlm/blob/HEAD/efficient_models/eff_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"BSD-3-Clause","inline_ok":false,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2210.05211","paper":"/paper/a-win-win-deal-towards-sparse-and-robust-pre","title":"A Win-win Deal: Towards Sparse and Robust Pre-trained Language Models","date":"2022-10-11","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"llyx97/sparse-and-robust-PLM","path":"hg_transformers/modeling_bert.py","file_url":"https://github.com/llyx97/sparse-and-robust-PLM/blob/HEAD/hg_transformers/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"0766f48ad6e01b56","mcp_get_code":{"code_sha256":"0766f48ad6e01b56"}},{"arxiv_id":"2209.14279","paper":"/paper/causal-proxy-models-for-concept-based-model","title":"Causal Proxy Models for Concept-Based Model Explanations","date":"2022-09-28","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"frankaging/causal-proxy-model","path":"models/modelings_bert.py","file_url":"https://github.com/frankaging/causal-proxy-model/blob/HEAD/models/modelings_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d009b630f4496e64","mcp_get_code":{"code_sha256":"d009b630f4496e64"}},{"arxiv_id":"2208.05647","paper":"/paper/ppmn-pixel-phrase-matching-network-for-one","title":"PPMN: Pixel-Phrase Matching Network for One-Stage Panoptic Narrative Grounding","date":"2022-08-11","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"dzh19990407/ppmn","path":"models/modeling.py","file_url":"https://github.com/dzh19990407/ppmn/blob/HEAD/models/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"7099305544368003","mcp_get_code":{"code_sha256":"7099305544368003"}},{"arxiv_id":"2207.05333","paper":"/paper/idea-increasing-text-diversity-via-online","title":"IDEA: Increasing Text Diversity via Online Multi-Label Recognition for Vision-Language Pre-training","date":"2022-07-12","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"xinyu1205/idea-pytorch","path":"models/xbert.py","file_url":"https://github.com/xinyu1205/idea-pytorch/blob/HEAD/models/xbert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2206.07699","paper":"/paper/prefix-language-models-are-unified-modal","title":"Write and Paint: Generative Vision-Language Models are Unified Modal Learners","date":"2022-06-15","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"shizhediao/davinci","path":"models/bert.py","file_url":"https://github.com/shizhediao/davinci/blob/HEAD/models/bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"BSD-3-Clause","inline_ok":false,"code_sha256_prefix":"4db905959447729d","mcp_get_code":{"code_sha256":"4db905959447729d"}},{"arxiv_id":"2205.11169","paper":"/paper/pevl-position-enhanced-pre-training-and","title":"PEVL: Position-enhanced Pre-training and Prompt Tuning for Vision-language Models","date":"2022-05-23","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"thunlp/PEVL","path":"models/xbert.py","file_url":"https://github.com/thunlp/PEVL/blob/HEAD/models/xbert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2204.10298","paper":"/paper/diffcse-difference-based-contrastive-learning","title":"DiffCSE: Difference-based Contrastive Learning for Sentence Embeddings","date":"2022-04-21","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"voidism/diffcse","path":"modeling_bert.py","file_url":"https://github.com/voidism/diffcse/blob/HEAD/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2203.11591","paper":"/paper/hop-history-and-order-aware-pre-training-for","title":"HOP: History-and-Order Aware Pre-training for Vision-and-Language Navigation","date":"2022-03-22","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"yanyuanqiao/hop-vln","path":"tasks/pretrain/vilmodel.py","file_url":"https://github.com/yanyuanqiao/hop-vln/blob/HEAD/tasks/pretrain/vilmodel.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"2203.11431","paper":"/paper/task-guided-disentangled-tuning-for","title":"Task-guided Disentangled Tuning for Pretrained Language Models","date":"2022-03-22","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"lemon0830/TDT","path":"TDT/transformers/modeling_bert.py","file_url":"https://github.com/lemon0830/TDT/blob/HEAD/TDT/transformers/modeling_bert.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"2203.01670","paper":"/paper/a-simple-hash-based-early-exiting-approach-1","title":"A Simple Hash-Based Early Exiting Approach For Language Understanding and Generation","date":"2022-03-03","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"txsun1997/hashee","path":"difficulty/modeling_bert.py","file_url":"https://github.com/txsun1997/hashee/blob/HEAD/difficulty/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2201.11732","paper":"/paper/iglue-a-benchmark-for-transfer-learning","title":"IGLUE: A Benchmark for Transfer Learning across Modalities, Tasks, and Languages","date":"2022-01-27","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"e-bug/volta","path":"volta/encoders.py","file_url":"https://github.com/e-bug/volta/blob/HEAD/volta/encoders.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"baa5766f4566aafc","mcp_get_code":{"code_sha256":"baa5766f4566aafc"}},{"arxiv_id":"2201.06885","paper":"/paper/mining-fine-grained-semantics-via-graph","title":"Evidence-aware Fake News Detection with Graph Neural Networks","date":"2022-01-18","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"CRIPAC-DIG/GET","path":"pytorch_transformers/modeling_bert.py","file_url":"https://github.com/CRIPAC-DIG/GET/blob/HEAD/pytorch_transformers/modeling_bert.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"2112.02505","paper":"/paper/causal-distillation-for-language-models","title":"Causal Distillation for Language Models","date":"2021-12-05","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"frankaging/Causal-Distill","path":"distillation/models/modeling_bert.py","file_url":"https://github.com/frankaging/Causal-Distill/blob/HEAD/distillation/models/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"4db905959447729d","mcp_get_code":{"code_sha256":"4db905959447729d"}},{"arxiv_id":"2111.09452","paper":"/paper/towards-open-vocabulary-object-detection","title":"Open Vocabulary Object Detection with Pseudo Bounding-Box Labels","date":"2021-11-18","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"salesforce/pb-ovd","path":"ALBEF/models/xbert.py","file_url":"https://github.com/salesforce/pb-ovd/blob/HEAD/ALBEF/models/xbert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"BSD-3-Clause","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2110.07592","paper":"/paper/speech-toxicity-analysis-a-new-spoken","title":"DeToxy: A Large-Scale Multimodal Dataset for Toxicity Classification in Spoken Utterances","date":"2021-10-14","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"sreyan88/toxicity-detection-in-spoken-utterances","path":"e2e/mmi_module_only_audio.py","file_url":"https://github.com/sreyan88/toxicity-detection-in-spoken-utterances/blob/HEAD/e2e/mmi_module_only_audio.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"b1a7180868dd8d6a","mcp_get_code":{"code_sha256":"b1a7180868dd8d6a"}},{"arxiv_id":"2110.06446","paper":"/paper/improving-graph-based-sentence-ordering-with","title":"Improving Graph-based Sentence Ordering with Iteratively Predicted Pairwise Orderings","date":"2021-10-13","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"DeepLearnXMU/IRSEG","path":"IRSEKG+bert+FHdecoder/model/modeling_bert.py","file_url":"https://github.com/DeepLearnXMU/IRSEG/blob/HEAD/IRSEKG%2Bbert%2BFHdecoder/model/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"fb9398de2966d6de","mcp_get_code":{"code_sha256":"fb9398de2966d6de"}},{"arxiv_id":"2110.02526","paper":"/paper/coarse-to-fine-reasoning-for-visual-question","title":"Coarse-to-Fine Reasoning for Visual Question Answering","date":"2021-10-06","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"aioz-ai/crf_vqa","path":"lxrt/modeling.py","file_url":"https://github.com/aioz-ai/crf_vqa/blob/HEAD/lxrt/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"7099305544368003","mcp_get_code":{"code_sha256":"7099305544368003"}},{"arxiv_id":"2110.15064","paper":"/paper/towards-fine-grained-reasoning-for-fake-news","title":"Towards Fine-Grained Reasoning for Fake News Detection","date":"2021-09-13","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Ahren09/FinerFact","path":"kgat/bert_model.py","file_url":"https://github.com/Ahren09/FinerFact/blob/HEAD/kgat/bert_model.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"baa5766f4566aafc","mcp_get_code":{"code_sha256":"baa5766f4566aafc"}},{"arxiv_id":"2109.15107","paper":"/paper/crossaug-a-contrastive-data-augmentation","title":"CrossAug: A Contrastive Data Augmentation Method for Debiasing Fact Verification Models","date":"2021-09-30","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"minwhoo/crossaug","path":"modeling_bert.py","file_url":"https://github.com/minwhoo/crossaug/blob/HEAD/modeling_bert.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"2109.08828","paper":"/paper/perspective-taking-and-pragmatics-for","title":"Perspective-taking and Pragmatics for Generating Empathetic Responses Focused on Emotion Causes","date":"2021-09-18","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"skywalker023/focused-empathy","path":"from_epitome/modeling_bert.py","file_url":"https://github.com/skywalker023/focused-empathy/blob/HEAD/from_epitome/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"0766f48ad6e01b56","mcp_get_code":{"code_sha256":"0766f48ad6e01b56"}},{"arxiv_id":"2108.09105","paper":"/paper/airbert-in-domain-pretraining-for-vision-and","title":"Airbert: In-domain Pretraining for Vision-and-Language Navigation","date":"2021-08-20","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"airbert-vln/airbert","path":"vilbert/vilbert.py","file_url":"https://github.com/airbert-vln/airbert/blob/HEAD/vilbert/vilbert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"baa5766f4566aafc","mcp_get_code":{"code_sha256":"baa5766f4566aafc"}},{"arxiv_id":"2107.14596","paper":"/paper/multi-stage-pre-training-over-simplified","title":"Multi-stage Pre-training over Simplified Multimodal Pre-training Models","date":"2021-07-22","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"lttsmn/LXMERT-S","path":"Desktop/LXMERT_S/src/lxrt/modeling.py","file_url":"https://github.com/lttsmn/LXMERT-S/blob/HEAD/Desktop/LXMERT_S/src/lxrt/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"fc89e34806bd2562","mcp_get_code":{"code_sha256":"fc89e34806bd2562"}},{"arxiv_id":"2106.08087","paper":"/paper/cblue-a-chinese-biomedical-language","title":"CBLUE: A Chinese Biomedical Language Understanding Evaluation Benchmark","date":"2021-06-15","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"cbluebenchmark/cblue","path":"cblue/models/zen/modeling.py","file_url":"https://github.com/cbluebenchmark/cblue/blob/HEAD/cblue/models/zen/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"b1a7180868dd8d6a","mcp_get_code":{"code_sha256":"b1a7180868dd8d6a"}},{"arxiv_id":"2105.12002","paper":"/paper/super-tickets-in-pre-trained-language-models","title":"Super Tickets in Pre-Trained Language Models: From Model Compression to Improving Generalization","date":"2021-05-25","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"cliang1453/super-structured-lottery-tickets","path":"module/modeling_bert.py","file_url":"https://github.com/cliang1453/super-structured-lottery-tickets/blob/HEAD/module/modeling_bert.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"MIT","inline_ok":false,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"2105.03761","paper":"/paper/e-vil-a-dataset-and-benchmark-for-natural","title":"e-ViL: A Dataset and Benchmark for Natural Language Explanations in Vision-Language Tasks","date":"2021-05-08","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"maximek3/e-ViL","path":"src/modeling.py","file_url":"https://github.com/maximek3/e-ViL/blob/HEAD/src/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"f4e7ffb01089db78","mcp_get_code":{"code_sha256":"f4e7ffb01089db78"}},{"arxiv_id":"2104.09791","paper":"/paper/b-prop-bootstrapped-pre-training-with","title":"B-PROP: Bootstrapped Pre-training with Representative Words Prediction for Ad-hoc Retrieval","date":"2021-04-20","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Albert-Ma/PROP","path":"pytorch_pretrain_bert/modeling.py","file_url":"https://github.com/Albert-Ma/PROP/blob/HEAD/pytorch_pretrain_bert/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"b1a7180868dd8d6a","mcp_get_code":{"code_sha256":"b1a7180868dd8d6a"}},{"arxiv_id":"2104.08247","paper":"/paper/what-to-pre-train-on-efficient-intermediate","title":"What to Pre-Train on? Efficient Intermediate Task Selection","date":"2021-04-16","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"adapter-hub/efficient-task-transfer","path":"task_selection/modeling/modeling_bert.py","file_url":"https://github.com/adapter-hub/efficient-task-transfer/blob/HEAD/task_selection/modeling/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2104.06599","paper":"/paper/learning-how-to-ask-querying-lms-with","title":"Learning How to Ask: Querying LMs with Mixtures of Soft Prompts","date":"2021-04-14","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"hiaoxui/soft-prompts","path":"soft_prompts/lm/modeling_bert.py","file_url":"https://github.com/hiaoxui/soft-prompts/blob/HEAD/soft_prompts/lm/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2012.15701","paper":"/paper/binarybert-pushing-the-limit-of-bert","title":"BinaryBERT: Pushing the Limit of BERT Quantization","date":"2020-12-31","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":null,"path":"","file_url":null,"status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":null,"inline_ok":false,"code_sha256_prefix":"0453ed29d1aecc4c","mcp_get_code":{"code_sha256":"0453ed29d1aecc4c"}},{"arxiv_id":"2012.07463","paper":"/paper/parameter-efficient-transfer-learning-with-1","title":"Parameter-Efficient Transfer Learning with Diff Pruning","date":"2020-12-14","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":null,"path":"","file_url":null,"status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":null,"inline_ok":false,"code_sha256_prefix":"0766f48ad6e01b56","mcp_get_code":{"code_sha256":"0766f48ad6e01b56"}},{"arxiv_id":"2011.01513","paper":"/paper/charbert-character-aware-pre-trained-language","title":"CharBERT: Character-aware Pre-trained Language Model","date":"2020-11-03","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"wtma/CharBERT","path":"modeling/modeling_bert.py","file_url":"https://github.com/wtma/CharBERT/blob/HEAD/modeling/modeling_bert.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"2010.11731","paper":"/paper/improving-bert-performance-for-aspect-based","title":"Improving BERT Performance for Aspect-Based Sentiment Analysis","date":"2020-10-22","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"IMPLabUniPr/BERT-for-ABSA","path":"src/modeling.py","file_url":"https://github.com/IMPLabUniPr/BERT-for-ABSA/blob/HEAD/src/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"b1a7180868dd8d6a","mcp_get_code":{"code_sha256":"b1a7180868dd8d6a"}},{"arxiv_id":"2010.10392","paper":"/paper/characterbert-reconciling-elmo-and-bert-for","title":"CharacterBERT: Reconciling ELMo and BERT for Word-Level Open-Vocabulary Representations From Characters","date":"2020-10-20","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"IMPLabUniPr/UniParma-at-semeval-2021-task-5","path":"transformers/modeling_bert.py","file_url":"https://github.com/IMPLabUniPr/UniParma-at-semeval-2021-task-5/blob/HEAD/transformers/modeling_bert.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"2010.06138","paper":"/paper/incorporating-bert-into-parallel-sequence","title":"Incorporating BERT into Parallel Sequence Decoding with Adapters","date":"2020-10-13","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"lemmonation/abnet","path":"bert/modeling.py","file_url":"https://github.com/lemmonation/abnet/blob/HEAD/bert/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"b1a7180868dd8d6a","mcp_get_code":{"code_sha256":"b1a7180868dd8d6a"}},{"arxiv_id":"2010.05607","paper":"/paper/the-elephant-in-the-interpretability-room-why","title":"The elephant in the interpretability room: Why use attention as explanation when we have saliency methods?","date":"2020-10-12","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"jessevig/bertviz","path":"bertviz/transformers_neuron_view/modeling_bert.py","file_url":"https://github.com/jessevig/bertviz/blob/HEAD/bertviz/transformers_neuron_view/modeling_bert.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"2007.12223","paper":"/paper/the-lottery-ticket-hypothesis-for-pre-trained","title":"The Lottery Ticket Hypothesis for Pre-trained BERT Networks","date":"2020-07-23","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"TAMU-VITA/BERT-Tickets","path":"transformers-master/src/transformers/modeling_bert.py","file_url":"https://github.com/TAMU-VITA/BERT-Tickets/blob/HEAD/transformers-master/src/transformers/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"0766f48ad6e01b56","mcp_get_code":{"code_sha256":"0766f48ad6e01b56"}},{"arxiv_id":"2006.04884","paper":"/paper/on-the-stability-of-fine-tuning-bert","title":"On the Stability of Fine-tuning BERT: Misconceptions, Explanations, and Strong Baselines","date":"2020-06-08","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"uds-lsv/bert-stable-fine-tuning","path":"src/transformers/modeling_bert.py","file_url":"https://github.com/uds-lsv/bert-stable-fine-tuning/blob/HEAD/src/transformers/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"0766f48ad6e01b56","mcp_get_code":{"code_sha256":"0766f48ad6e01b56"}},{"arxiv_id":"2005.02439","paper":"/paper/contextualizing-hate-speech-classifiers-with","title":"Contextualizing Hate Speech Classifiers with Post-hoc Explanation","date":"2020-05-05","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"owaisCS/TestHateSpeech","path":"bert/modeling.py","file_url":"https://github.com/owaisCS/TestHateSpeech/blob/HEAD/bert/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"b1a7180868dd8d6a","mcp_get_code":{"code_sha256":"b1a7180868dd8d6a"}},{"arxiv_id":"2005.00770","paper":"/paper/exploring-and-predicting-transferability","title":"Exploring and Predicting Transferability across NLP Tasks","date":"2020-05-02","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"tuvuumass/task-transferability","path":"transformers/modeling_task_embeddings.py","file_url":"https://github.com/tuvuumass/task-transferability/blob/HEAD/transformers/modeling_task_embeddings.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"2005.00558","paper":"/paper/pointer-constrained-text-generation-via","title":"POINTER: Constrained Progressive Text Generation via Insertion-based Generative Pre-training","date":"2020-05-01","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"dreasysnail/POINTER","path":"pytorch_transformers/modeling_bert.py","file_url":"https://github.com/dreasysnail/POINTER/blob/HEAD/pytorch_transformers/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"03a94dbb436249a3","mcp_get_code":{"code_sha256":"03a94dbb436249a3"}},{"arxiv_id":"2004.07453","paper":"/paper/the-right-tool-for-the-job-matching-model-and","title":"The Right Tool for the Job: Matching Model and Instance Complexities","date":"2020-04-16","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"allenai/sledgehammer","path":"allennlp_overrides/pytorch_pretrained_bert/modeling.py","file_url":"https://github.com/allenai/sledgehammer/blob/HEAD/allennlp_overrides/pytorch_pretrained_bert/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"b1a7180868dd8d6a","mcp_get_code":{"code_sha256":"b1a7180868dd8d6a"}},{"arxiv_id":"2004.05707","paper":"/paper/vgcn-bert-augmenting-bert-with-graph","title":"VGCN-BERT: Augmenting BERT with Graph Embedding for Text Classification","date":"2020-04-12","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Louis-udm/VGCN-BERT","path":"old_version/pytorch_pretrained_bert/modeling.py","file_url":"https://github.com/Louis-udm/VGCN-BERT/blob/HEAD/old_version/pytorch_pretrained_bert/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"460517934d4f107f","mcp_get_code":{"code_sha256":"460517934d4f107f"}},{"arxiv_id":"2004.04037","paper":"/paper/dynabert-dynamic-bert-with-adaptive-width-and","title":"DynaBERT: Dynamic BERT with Adaptive Width and Depth","date":"2020-04-08","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"huawei-noah/pretrained-language-model","path":"DynaBERT/transformers/modeling_bert.py","file_url":"https://github.com/huawei-noah/pretrained-language-model/blob/HEAD/DynaBERT/transformers/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"58ca2fa000be80dc","mcp_get_code":{"code_sha256":"58ca2fa000be80dc"}},{"arxiv_id":"2004.03829","paper":"/paper/exploring-versatile-generative-language-model","title":"Exploring Versatile Generative Language Model Via Parameter-Efficient Transfer Learning","date":"2020-04-08","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"zlinao/VGLM","path":"pytorch_transformers/modeling_bert.py","file_url":"https://github.com/zlinao/VGLM/blob/HEAD/pytorch_transformers/modeling_bert.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"2002.10345","paper":"/paper/improving-bert-fine-tuning-via-self-ensemble","title":"Improving BERT Fine-Tuning via Self-Ensemble and Self-Distillation","date":"2020-02-24","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":null,"path":"","file_url":null,"status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":null,"inline_ok":false,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"2002.01808","paper":"/paper/k-adapter-infusing-knowledge-into-pre-trained","title":"K-Adapter: Infusing Knowledge into Pre-Trained Models with Adapters","date":"2020-02-05","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"microsoft/K-Adapter","path":"pytorch_transformers/modeling_bert.py","file_url":"https://github.com/microsoft/K-Adapter/blob/HEAD/pytorch_transformers/modeling_bert.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"1912.02379","paper":"/paper/large-scale-pretraining-for-visual-dialog-a","title":"Large-scale Pretraining for Visual Dialog: A Simple State-of-the-Art Baseline","date":"2019-12-05","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"vmurahari3/visdial-bert","path":"models/vilbert_dialog.py","file_url":"https://github.com/vmurahari3/visdial-bert/blob/HEAD/models/vilbert_dialog.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"BSD-3-Clause","inline_ok":true,"code_sha256_prefix":"baa5766f4566aafc","mcp_get_code":{"code_sha256":"baa5766f4566aafc"}},{"arxiv_id":"1912.02315","paper":"/paper/12-in-1-multi-task-vision-and-language","title":"12-in-1: Multi-Task Vision and Language Representation Learning","date":"2019-12-05","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"facebookresearch/vilbert-multi-task","path":"vilbert/vilbert.py","file_url":"https://github.com/facebookresearch/vilbert-multi-task/blob/HEAD/vilbert/vilbert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":false,"code_sha256_prefix":"baa5766f4566aafc","mcp_get_code":{"code_sha256":"baa5766f4566aafc"}},{"arxiv_id":"1911.03631","paper":"/paper/hierarchical-graph-network-for-multi-hop","title":"Hierarchical Graph Network for Multi-hop Question Answering","date":"2019-11-09","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"yuwfan/HGN","path":"transformers/modeling_bert.py","file_url":"https://github.com/yuwfan/HGN/blob/HEAD/transformers/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":false,"code_sha256_prefix":"ca4a7d28d683cd33","mcp_get_code":{"code_sha256":"ca4a7d28d683cd33"}},{"arxiv_id":"1911.03584","paper":"/paper/on-the-relationship-between-self-attention-1","title":"On the Relationship between Self-Attention and Convolutional Layers","date":"2019-11-08","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"epfml/attention-cnn","path":"models/bert.py","file_url":"https://github.com/epfml/attention-cnn/blob/HEAD/models/bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"b1a7180868dd8d6a","mcp_get_code":{"code_sha256":"b1a7180868dd8d6a"}},{"arxiv_id":"1911.00720","paper":"/paper/zen-pre-training-chinese-text-encoder","title":"ZEN: Pre-training Chinese Text Encoder Enhanced by N-gram Representations","date":"2019-11-02","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"SVAIGBA/TwASP","path":"pytorch_pretrained_bert/modeling.py","file_url":"https://github.com/SVAIGBA/TwASP/blob/HEAD/pytorch_pretrained_bert/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"b1a7180868dd8d6a","mcp_get_code":{"code_sha256":"b1a7180868dd8d6a"}},{"arxiv_id":"1910.09796","paper":"/paper/kernel-graph-attention-network-for-fact","title":"Fine-grained Fact Verification with Kernel Graph Attention Network","date":"2019-10-22","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":null,"path":"","file_url":null,"status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":null,"inline_ok":false,"code_sha256_prefix":"baa5766f4566aafc","mcp_get_code":{"code_sha256":"baa5766f4566aafc"}},{"arxiv_id":"1909.11942","paper":"/paper/albert-a-lite-bert-for-self-supervised","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations","date":"2019-09-26","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Soikonomou/bert_new","path":"src/model/BERT/modeling_bert.py","file_url":"https://github.com/Soikonomou/bert_new/blob/HEAD/src/model/BERT/modeling_bert.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"1909.11942","paper":"/paper/albert-a-lite-bert-for-self-supervised","title":"ALBERT: A Lite BERT for Self-supervised Learning of Language Representations","date":"2019-09-26","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Soikonomou/albert_final","path":"src/model/ALBERT/modeling_bert.py","file_url":"https://github.com/Soikonomou/albert_final/blob/HEAD/src/model/ALBERT/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"ca4a7d28d683cd33","mcp_get_code":{"code_sha256":"ca4a7d28d683cd33"}},{"arxiv_id":"1909.05311","paper":"/paper/graph-based-reasoning-over-heterogeneous","title":"Graph-Based Reasoning over Heterogeneous External Knowledge for Commonsense Question Answering","date":"2019-09-09","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"DecstionBack/AAAI_2020_CommonsenseQA","path":"pytorch_transformers/modeling_bert.py","file_url":"https://github.com/DecstionBack/AAAI_2020_CommonsenseQA/blob/HEAD/pytorch_transformers/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"03a94dbb436249a3","mcp_get_code":{"code_sha256":"03a94dbb436249a3"}},{"arxiv_id":"1909.02209","paper":"/paper/semantics-aware-bert-for-language","title":"Semantics-aware BERT for Language Understanding","date":"2019-09-05","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"cooelf/SemBERT","path":"pytorch_pretrained_bert/modeling.py","file_url":"https://github.com/cooelf/SemBERT/blob/HEAD/pytorch_pretrained_bert/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"baa5766f4566aafc","mcp_get_code":{"code_sha256":"baa5766f4566aafc"}},{"arxiv_id":"1909.00252","paper":"/paper/humor-detection-a-transformer-gets-the-last","title":"Humor Detection: A Transformer Gets the Last Laugh","date":"2019-08-31","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"orionw/RedditHumorDetection","path":"pytorch_pretrained_bert/modeling.py","file_url":"https://github.com/orionw/RedditHumorDetection/blob/HEAD/pytorch_pretrained_bert/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"baa5766f4566aafc","mcp_get_code":{"code_sha256":"baa5766f4566aafc"}},{"arxiv_id":"1908.09355","paper":"/paper/patient-knowledge-distillation-for-bert-model","title":"Patient Knowledge Distillation for BERT Model Compression","date":"2019-08-25","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Daniel-H-99/Patient-Knowledge-Distillation","path":"BERT/pytorch_pretrained_bert/modeling.py","file_url":"https://github.com/Daniel-H-99/Patient-Knowledge-Distillation/blob/HEAD/BERT/pytorch_pretrained_bert/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":false,"code_sha256_prefix":"b1a7180868dd8d6a","mcp_get_code":{"code_sha256":"b1a7180868dd8d6a"}},{"arxiv_id":"1908.07490","paper":"/paper/lxmert-learning-cross-modality-encoder","title":"LXMERT: Learning Cross-Modality Encoder Representations from Transformers","date":"2019-08-20","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"ghazaleh-mahmoodi/lxmert_compression","path":"lxmert/src/lxrt/modeling.py","file_url":"https://github.com/ghazaleh-mahmoodi/lxmert_compression/blob/HEAD/lxmert/src/lxrt/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"7099305544368003","mcp_get_code":{"code_sha256":"7099305544368003"}},{"arxiv_id":"1908.02265","paper":"/paper/vilbert-pretraining-task-agnostic","title":"ViLBERT: Pretraining Task-Agnostic Visiolinguistic Representations for Vision-and-Language Tasks","date":"2019-08-06","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":null,"path":"","file_url":null,"status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":null,"inline_ok":false,"code_sha256_prefix":"baa5766f4566aafc","mcp_get_code":{"code_sha256":"baa5766f4566aafc"}},{"arxiv_id":"1906.08237","paper":"/paper/xlnet-generalized-autoregressive-pretraining","title":"XLNet: Generalized Autoregressive Pretraining for Language Understanding","date":"2019-06-19","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"samwisegamjeee/pytorch-transformers","path":"pytorch_transformers/modeling_bert.py","file_url":"https://github.com/samwisegamjeee/pytorch-transformers/blob/HEAD/pytorch_transformers/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"03a94dbb436249a3","mcp_get_code":{"code_sha256":"03a94dbb436249a3"}},{"arxiv_id":"1906.01698","paper":"/paper/open-sesame-getting-inside-berts-linguistic","title":"Open Sesame: Getting Inside BERT's Linguistic Knowledge","date":"2019-06-04","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"yongjie-lin/bert-opensesame","path":"bertviz/bertviz/pytorch_pretrained_bert/modeling.py","file_url":"https://github.com/yongjie-lin/bert-opensesame/blob/HEAD/bertviz/bertviz/pytorch_pretrained_bert/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"baa5766f4566aafc","mcp_get_code":{"code_sha256":"baa5766f4566aafc"}},{"arxiv_id":"1905.12794","paper":"/paper/the-fashion-iq-dataset-retrieving-images-by","title":"Fashion IQ: A New Dataset Towards Retrieving Images by Natural Language Feedback","date":"2019-05-30","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"hssip/fashionsap","path":"models/xbert.py","file_url":"https://github.com/hssip/fashionsap/blob/HEAD/models/xbert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"BSD-3-Clause","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"1902.01069","paper":"/paper/a-comprehensive-exploration-on-wikisql-with","title":"A Comprehensive Exploration on WikiSQL with Table-Aware Word Contextualization","date":"2019-02-04","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"tanmay1618/text_to_sql_bert","path":"modeling_bert.py","file_url":"https://github.com/tanmay1618/text_to_sql_bert/blob/HEAD/modeling_bert.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"1810.04805","paper":"/paper/bert-pre-training-of-deep-bidirectional","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","date":"2018-10-11","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"lonePatient/Bert-Multi-Label-Text-Classification","path":"pybert/model/albert/modeling_bert.py","file_url":"https://github.com/lonePatient/Bert-Multi-Label-Text-Classification/blob/HEAD/pybert/model/albert/modeling_bert.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"1810.04805","paper":"/paper/bert-pre-training-of-deep-bidirectional","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","date":"2018-10-11","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":null,"path":"","file_url":null,"status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":null,"inline_ok":false,"code_sha256_prefix":"b1a7180868dd8d6a","mcp_get_code":{"code_sha256":"b1a7180868dd8d6a"}},{"arxiv_id":"1810.04805","paper":"/paper/bert-pre-training-of-deep-bidirectional","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","date":"2018-10-11","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":null,"path":"","file_url":null,"status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":null,"inline_ok":false,"code_sha256_prefix":"0453ed29d1aecc4c","mcp_get_code":{"code_sha256":"0453ed29d1aecc4c"}},{"arxiv_id":"1810.04805","paper":"/paper/bert-pre-training-of-deep-bidirectional","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","date":"2018-10-11","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Impavidity/relogic","path":"relogic/logickit/inference/modeling.py","file_url":"https://github.com/Impavidity/relogic/blob/HEAD/relogic/logickit/inference/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"5a70204480cee7ee","mcp_get_code":{"code_sha256":"5a70204480cee7ee"}},{"arxiv_id":"1810.04805","paper":"/paper/bert-pre-training-of-deep-bidirectional","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","date":"2018-10-11","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"charles9n/bert-sklearn","path":"bert_sklearn/model/pytorch_pretrained/modeling.py","file_url":"https://github.com/charles9n/bert-sklearn/blob/HEAD/bert_sklearn/model/pytorch_pretrained/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"4b95ca6b1e45f55d","mcp_get_code":{"code_sha256":"4b95ca6b1e45f55d"}},{"arxiv_id":"aaai_5722","paper":null,"title":"arXiv:aaai_5722","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"microsoft/Distilled-Sentence-Embedding","path":"pytorch_pretrained_bert/modeling.py","file_url":"https://github.com/microsoft/Distilled-Sentence-Embedding/blob/HEAD/pytorch_pretrained_bert/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"b1a7180868dd8d6a","mcp_get_code":{"code_sha256":"b1a7180868dd8d6a"}},{"arxiv_id":"aaai_33874","paper":null,"title":"arXiv:aaai_33874","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"txsun1997/Black-Box-Tuning","path":"models/deep_modeling_bert.py","file_url":"https://github.com/txsun1997/Black-Box-Tuning/blob/HEAD/models/deep_modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"aaai_33874","paper":null,"title":"arXiv:aaai_33874","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"txsun1997/Black-Box-Tuning","path":"models/deep_modeling_cpt_utils.py","file_url":"https://github.com/txsun1997/Black-Box-Tuning/blob/HEAD/models/deep_modeling_cpt_utils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"efbb0f3903b5f779","mcp_get_code":{"code_sha256":"efbb0f3903b5f779"}},{"arxiv_id":"aaai_32468","paper":null,"title":"arXiv:aaai_32468","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"airsplay/LXMERT","path":"src/lxrt/modeling.py","file_url":"https://github.com/airsplay/LXMERT/blob/HEAD/src/lxrt/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"7099305544368003","mcp_get_code":{"code_sha256":"7099305544368003"}},{"arxiv_id":"aaai_27969","paper":null,"title":"arXiv:aaai_27969","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"TianyuGoGO/XPNG","path":"models/modeling.py","file_url":"https://github.com/TianyuGoGO/XPNG/blob/HEAD/models/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"7099305544368003","mcp_get_code":{"code_sha256":"7099305544368003"}},{"arxiv_id":"Yang_Beyond_Walking_A_Large-Scale_Image-Text_Benchmark_for_Text-based_Person_Anomaly_ICCV_2025_paper","paper":null,"title":"arXiv:Yang_Beyond_Walking_A_Large-Scale_Image-Text_Benchmark_for_Text-based_Person_Anomaly_ICCV_2025_paper","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"Shuyu-XJTU/CMP","path":"models/bert.py","file_url":"https://github.com/Shuyu-XJTU/CMP/blob/HEAD/models/bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"Li_Align_and_Prompt_Video-and-Language_Pre-Training_With_Entity_Prompts_CVPR_2022_paper","paper":null,"title":"arXiv:Li_Align_and_Prompt_Video-and-Language_Pre-Training_With_Entity_Prompts_CVPR_2022_paper","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"salesforce/ALPRO","path":"src/modeling/transformers.py","file_url":"https://github.com/salesforce/ALPRO/blob/HEAD/src/modeling/transformers.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"BSD-3-Clause","inline_ok":true,"code_sha256_prefix":"0766f48ad6e01b56","mcp_get_code":{"code_sha256":"0766f48ad6e01b56"}},{"arxiv_id":"Li_Align_and_Prompt_Video-and-Language_Pre-Training_With_Entity_Prompts_CVPR_2022_paper","paper":null,"title":"arXiv:Li_Align_and_Prompt_Video-and-Language_Pre-Training_With_Entity_Prompts_CVPR_2022_paper","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"salesforce/ALPRO","path":"src/modeling/xbert.py","file_url":"https://github.com/salesforce/ALPRO/blob/HEAD/src/modeling/xbert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"BSD-3-Clause","inline_ok":true,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"Dou_An_Empirical_Study_of_Training_End-to-End_Vision-and-Language_Transformers_CVPR_2022_paper","paper":null,"title":"arXiv:Dou_An_Empirical_Study_of_Training_End-to-End_Vision-and-Language_Transformers_CVPR_2022_paper","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"zdou0830/METER","path":"meter/modules/bert_model.py","file_url":"https://github.com/zdou0830/METER/blob/HEAD/meter/modules/bert_model.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":false,"code_sha256_prefix":"efbb0f3903b5f779","mcp_get_code":{"code_sha256":"efbb0f3903b5f779"}},{"arxiv_id":"2025.findings-emnlp.70","paper":null,"title":"arXiv:2025.findings-emnlp.70","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"passing2961/EmpGPT-3","path":"from_epitome/modeling_bert.py","file_url":"https://github.com/passing2961/EmpGPT-3/blob/HEAD/from_epitome/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"0766f48ad6e01b56","mcp_get_code":{"code_sha256":"0766f48ad6e01b56"}},{"arxiv_id":"2025.findings-emnlp.613","paper":null,"title":"arXiv:2025.findings-emnlp.613","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"hustselab511/SGCD","path":"src/Roberta.py","file_url":"https://github.com/hustselab511/SGCD/blob/HEAD/src/Roberta.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"4db905959447729d","mcp_get_code":{"code_sha256":"4db905959447729d"}},{"arxiv_id":"2024.naacl-long.345","paper":null,"title":"arXiv:2024.naacl-long.345","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"arashardakani/SlimFit","path":"BERT/ILSBERT.py","file_url":"https://github.com/arashardakani/SlimFit/blob/HEAD/BERT/ILSBERT.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"e3919bff018ba0c7","mcp_get_code":{"code_sha256":"e3919bff018ba0c7"}},{"arxiv_id":"2024.findings-naacl.32","paper":null,"title":"arXiv:2024.findings-naacl.32","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"SnowYJ/sem_syn_separation","path":"optimus_separate_graph_sem_syntax_fuse_gpt2/pytorch_transformers/modeling_bert.py","file_url":"https://github.com/SnowYJ/sem_syn_separation/blob/HEAD/optimus_separate_graph_sem_syntax_fuse_gpt2/pytorch_transformers/modeling_bert.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"0c145728a35789fa","mcp_get_code":{"code_sha256":"0c145728a35789fa"}},{"arxiv_id":"2024.findings-acl.966","paper":null,"title":"arXiv:2024.findings-acl.966","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"SIGSDSscau/DMIN","path":"src/Roberta.py","file_url":"https://github.com/SIGSDSscau/DMIN/blob/HEAD/src/Roberta.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"4db905959447729d","mcp_get_code":{"code_sha256":"4db905959447729d"}},{"arxiv_id":"2024.findings-acl.164","paper":null,"title":"arXiv:2024.findings-acl.164","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"potter-Zhang/Selective-Prefix-Tuning","path":"model/bert_select.py","file_url":"https://github.com/potter-Zhang/Selective-Prefix-Tuning/blob/HEAD/model/bert_select.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"efbb0f3903b5f779","mcp_get_code":{"code_sha256":"efbb0f3903b5f779"}},{"arxiv_id":"2023.findings-emnlp.142","paper":null,"title":"arXiv:2023.findings-emnlp.142","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"Banner-Z/G-SPEED","path":"src/modeling_bert.py","file_url":"https://github.com/Banner-Z/G-SPEED/blob/HEAD/src/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"d009b630f4496e64","mcp_get_code":{"code_sha256":"d009b630f4496e64"}},{"arxiv_id":"2023.acl-long.264","paper":null,"title":"arXiv:2023.acl-long.264","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"DAMO-NLP-SG/MVCR","path":"src/modeling_vaebert.py","file_url":"https://github.com/DAMO-NLP-SG/MVCR/blob/HEAD/src/modeling_vaebert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":false,"code_sha256_prefix":"26be70dca3249c0b","mcp_get_code":{"code_sha256":"26be70dca3249c0b"}},{"arxiv_id":"2023.acl-long.182","paper":null,"title":"arXiv:2023.acl-long.182","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"Yuanhy1997/HyPe","path":"hype_modeling_bert.py","file_url":"https://github.com/Yuanhy1997/HyPe/blob/HEAD/hype_modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"efbb0f3903b5f779","mcp_get_code":{"code_sha256":"efbb0f3903b5f779"}},{"arxiv_id":"2022.findings-emnlp.24","paper":null,"title":"arXiv:2022.findings-emnlp.24","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"StanLei52/TQVSR","path":"pytorch_bert/Bert.py","file_url":"https://github.com/StanLei52/TQVSR/blob/HEAD/pytorch_bert/Bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"4db905959447729d","mcp_get_code":{"code_sha256":"4db905959447729d"}},{"arxiv_id":"2021.findings-emnlp.386","paper":null,"title":"arXiv:2021.findings-emnlp.386","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"lbe0613/GCC","path":"utils/Bert.py","file_url":"https://github.com/lbe0613/GCC/blob/HEAD/utils/Bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"fb9398de2966d6de","mcp_get_code":{"code_sha256":"fb9398de2966d6de"}},{"arxiv_id":"2021.findings-acl.216","paper":null,"title":"arXiv:2021.findings-acl.216","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"destwang/DCN","path":"transformers/modeling_dcn.py","file_url":"https://github.com/destwang/DCN/blob/HEAD/transformers/modeling_dcn.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"fb9398de2966d6de","mcp_get_code":{"code_sha256":"fb9398de2966d6de"}},{"arxiv_id":"2021.emnlp-main.721","paper":null,"title":"arXiv:2021.emnlp-main.721","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"lixin4ever/BERT-E2E-ABSA","path":"bert_utils.py","file_url":"https://github.com/lixin4ever/BERT-E2E-ABSA/blob/HEAD/bert_utils.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"e89694e5414e63af","mcp_get_code":{"code_sha256":"e89694e5414e63af"}},{"arxiv_id":"2021.emnlp-main.518","paper":null,"title":"arXiv:2021.emnlp-main.518","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"hyounghk/NDH-FULL","path":"tasks/NDH_full/modeling.py","file_url":"https://github.com/hyounghk/NDH-FULL/blob/HEAD/tasks/NDH_full/modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"7099305544368003","mcp_get_code":{"code_sha256":"7099305544368003"}},{"arxiv_id":"2021.emnlp-main.154","paper":null,"title":"arXiv:2021.emnlp-main.154","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"Hazelsuko07/TextHide","path":"transformers_hide/modeling_bert.py","file_url":"https://github.com/Hazelsuko07/TextHide/blob/HEAD/transformers_hide/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"1967c19619b8d7e1","mcp_get_code":{"code_sha256":"1967c19619b8d7e1"}},{"arxiv_id":"2021.acl-long.390","paper":null,"title":"arXiv:2021.acl-long.390","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"thunlp/MetaAdaptRank","path":"contrastqg/transformers/modeling_bert.py","file_url":"https://github.com/thunlp/MetaAdaptRank/blob/HEAD/contrastqg/transformers/modeling_bert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"0766f48ad6e01b56","mcp_get_code":{"code_sha256":"0766f48ad6e01b56"}},{"arxiv_id":"2020.acl-main.192","paper":null,"title":"arXiv:2020.acl-main.192","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"neulab/cmu-multinlp","path":"brat_multitask/modules/bert_modeling.py","file_url":"https://github.com/neulab/cmu-multinlp/blob/HEAD/brat_multitask/modules/bert_modeling.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"BSD-3-Clause","inline_ok":true,"code_sha256_prefix":"b1a7180868dd8d6a","mcp_get_code":{"code_sha256":"b1a7180868dd8d6a"}},{"arxiv_id":"136960462","paper":null,"title":"arXiv:136960462","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"levymsn/CQA-CRCT","path":"CRCT/backbone/vilbert.py","file_url":"https://github.com/levymsn/CQA-CRCT/blob/HEAD/CRCT/backbone/vilbert.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"63126a3d0d53cf84","mcp_get_code":{"code_sha256":"63126a3d0d53cf84"}}]}