{"about":{"site":"https://codewithpapers.app","non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page"},"url":"/paper/transformer-xl-attentive-language-models","title":"Transformer-XL: Attentive Language Models Beyond a Fixed-Length Context","arxiv_id":"1901.02860","date":"2019-01-09","proceeding":"ACL 2019 7","authors":["Zihang Dai","Zhilin Yang","Yiming Yang","Jaime Carbonell","Quoc V. Le","Ruslan Salakhutdinov"],"abstract":"Transformers have a potential of learning longer-term dependency, but are limited by a fixed-length context in the setting of language modeling. We propose a novel neural architecture Transformer-XL that enables learning dependency beyond a fixed length without disrupting temporal coherence. It consists of a segment-level recurrence mechanism and a novel positional encoding scheme. Our method not only enables capturing longer-term dependency, but also resolves the context fragmentation problem. As a result, Transformer-XL learns dependency that is 80% longer than RNNs and 450% longer than vanilla Transformers, achieves better performance on both short and long sequences, and is up to 1,800+ times faster than vanilla Transformers during evaluation. Notably, we improve the state-of-the-art results of bpc/perplexity to 0.99 on enwiki8, 1.08 on text8, 18.3 on WikiText-103, 21.8 on One Billion Word, and 54.5 on Penn Treebank (without finetuning). When trained only on WikiText-103, Transformer-XL manages to generate reasonably coherent, novel text articles with thousands of tokens. Our code, pretrained models, and hyperparameters are available in both Tensorflow and PyTorch.","url_abs":"https://arxiv.org/abs/1901.02860v3","url_pdf":"https://arxiv.org/pdf/1901.02860v3.pdf","source":{"archive":"pwc-archive (Hugging Face), CC BY-SA 4.0","snapshot":"2025-07-28","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","row_kind":"abstracts"},"code_links":[{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/kimiyoung/transformer-xl","is_official":1,"mentioned_in_paper":1,"mentioned_in_github":1,"framework":"pytorch","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/Jmkernes/PAR-Transformer-XL","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"tf","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/Machine-Learning-Tokyo/Poetry-GAN","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"none","reach":{"status":"ok","spdx":"MIT"}},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/SambhawDrag/XLNet.jl","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":{"status":"unanswered"}},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/TimDettmers/transformer-xl","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":{"status":"ok","spdx":"Apache-2.0"}},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/aiha-lab/Attention-Head-Pruning","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":{"status":"ok","spdx":"GPL-3.0"}},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/benkrause/dynamiceval-transformer","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"tf","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/cedrickchee/pytorch-pretrained-BERT","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/cmunnis/BERT_vs_Transformer-XL","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":{"status":"ok"}},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/facebookresearch/code-prediction-transformer","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/google-research/meliad","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"jax","reach":{"status":"ok","spdx":"Apache-2.0"}},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/huggingface/transformers","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/huggingface/xlnet","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"tf","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/inzva/fake-academic-paper-generation","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/listenviolet/XLNet","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/mustafaaljadery/gemma-2b-10m","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/okkteam/Transformer-Transducer","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/park-cheol/ASR-Conformer","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/samwisegamjeee/pytorch-transformers","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":{"status":"ok","spdx":"Apache-2.0"}},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/sh951011/Attention-Implementation","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":{"status":"ok","spdx":"MIT"}},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/shanghai-digital-brain-laboratory/bdm-db1","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/sooftware/Attention-Implementation","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/sooftware/attentions","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":{"status":"ok","spdx":"MIT"}},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/sooftware/conformer","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/sooftware/nlp-attentions","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":{"status":"ok","spdx":"MIT"}},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/wxt1997/Transformer-Transducer","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"pytorch","reach":{"status":"ok"}},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/zhdbwe/Paper-DailyReading","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":1,"framework":"tf","reach":{"status":"ok"}},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/2023-MindSpore-1/ms-code-220/tree/main/transformer_xl","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":0,"framework":"mindspore","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/AIResearchHub/transformergallery","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":0,"framework":"pytorch","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/NVIDIA/DeepLearningExamples/tree/master/PyTorch/LanguageModeling/Transformer-XL","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":0,"framework":"pytorch","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/NVIDIA/DeepLearningExamples/tree/master/TensorFlow/LanguageModeling/Transformer-XL","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":0,"framework":"pytorch","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/PaddlePaddle/PaddleNLP/tree/develop/examples/language_model/transformer-xl","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":0,"framework":"paddle","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/jiean001/models_m/tree/main/transformer_xl","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":0,"framework":"mindspore","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/jincan333/lot","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":0,"framework":"pytorch","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/labmlai/annotated_deep_learning_paper_implementations","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":0,"framework":"pytorch","reach":null},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/lvyufeng/bert4ms","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":0,"framework":"mindspore","reach":{"status":"ok","spdx":"Apache-2.0"}},{"paper_slug":"transformer-xl-attentive-language-models","repo_url":"https://github.com/opendilab/DI-engine","is_official":0,"mentioned_in_paper":0,"mentioned_in_github":0,"framework":"pytorch","reach":null}],"tasks":[{"task_slug":"articles","task_name":"Articles"},{"task_slug":"language-modeling","task_name":"Language Modeling"},{"task_slug":"language-modelling","task_name":"Language Modelling"}],"methods":[{"method_slug":"adam","method_name":"Adam"},{"method_slug":"adaptive-input-representations","method_name":"Adaptive Input Representations"},{"method_slug":"adaptive-softmax","method_name":"Adaptive Softmax"},{"method_slug":"attention","method_name":"Attention"},{"method_slug":"cosine-annealing","method_name":"Cosine Annealing"},{"method_slug":"dense-connections","method_name":"Dense Connections"},{"method_slug":"dropout","method_name":"Dropout"},{"method_slug":"layer-normalization","method_name":"Layer Normalization"},{"method_slug":"linear-layer","method_name":"Linear Layer"},{"method_slug":"linear-warmup-with-cosine-annealing","method_name":"Linear Warmup With Cosine Annealing"},{"method_slug":"multi-head-attention","method_name":"Multi-Head Attention"},{"method_slug":"relu","method_name":"ReLU"},{"method_slug":"residual-connection","method_name":"Residual Connection"},{"method_slug":"softmax","method_name":"Softmax"},{"method_slug":"transformer-xl","method_name":"Transformer-XL"},{"method_slug":"variational-dropout","method_name":"Variational Dropout"}],"datasets_introduced":[],"methods_introduced":[{"slug":"transformer-xl","name":"Transformer-XL","full_name":"Transformer-XL"}],"results":[{"leaderboard":"/sota/language-modelling-on-hutter-prize","task":"Language Modelling","dataset":"Hutter Prize","model":"24-layer Transformer-XL","rank_in_archive_order":4,"of":18,"metrics":{"Bit per Character (BPC)":"0.99","Number of params":"277M"},"uses_additional_data":false},{"leaderboard":"/sota/language-modelling-on-hutter-prize","task":"Language Modelling","dataset":"Hutter Prize","model":"18-layer Transformer-XL","rank_in_archive_order":7,"of":18,"metrics":{"Bit per Character (BPC)":"1.03","Number of params":"88M"},"uses_additional_data":true},{"leaderboard":"/sota/language-modelling-on-hutter-prize","task":"Language Modelling","dataset":"Hutter Prize","model":"12-layer Transformer-XL","rank_in_archive_order":9,"of":18,"metrics":{"Bit per Character (BPC)":"1.06","Number of params":"41M"},"uses_additional_data":true},{"leaderboard":"/sota/language-modelling-on-one-billion-word","task":"Language Modelling","dataset":"One Billion Word","model":"Transformer-XL Large","rank_in_archive_order":4,"of":27,"metrics":{"Number of params":"0.8B","PPL":"21.8"},"uses_additional_data":false},{"leaderboard":"/sota/language-modelling-on-one-billion-word","task":"Language Modelling","dataset":"One Billion Word","model":"Transformer-XL Base","rank_in_archive_order":8,"of":27,"metrics":{"Number of params":"0.46B","PPL":"23.5"},"uses_additional_data":false},{"leaderboard":"/sota/language-modelling-on-penn-treebank-word","task":"Language Modelling","dataset":"Penn Treebank (Word Level)","model":"Transformer-XL","rank_in_archive_order":22,"of":43,"metrics":{"Params":"24M","Test perplexity":"54.55","Validation perplexity":"56.72"},"uses_additional_data":false},{"leaderboard":"/sota/language-modelling-on-text8","task":"Language Modelling","dataset":"Text8","model":"Transformer-XL - 24 layers","rank_in_archive_order":5,"of":24,"metrics":{"Bit per Character (BPC)":"1.08","Number of params":"277M"},"uses_additional_data":false},{"leaderboard":"/sota/language-modelling-on-wikitext-103","task":"Language Modelling","dataset":"WikiText-103","model":"Transformer-XL Large","rank_in_archive_order":34,"of":89,"metrics":{"Number of params":"257M","Test perplexity":"18.3","Validation perplexity":"18.2"},"uses_additional_data":false},{"leaderboard":"/sota/language-modelling-on-wikitext-103","task":"Language Modelling","dataset":"WikiText-103","model":"Transformer-XL Standard","rank_in_archive_order":54,"of":89,"metrics":{"Number of params":"151M","Test perplexity":"24.0","Validation perplexity":"23.1"},"uses_additional_data":false},{"leaderboard":"/sota/language-modelling-on-enwiki8","task":"Language Modelling","dataset":"enwik8","model":"Transformer-XL (24 layers)","rank_in_archive_order":12,"of":42,"metrics":{"Bit per Character (BPC)":"0.99","Number of params":"277M"},"uses_additional_data":false},{"leaderboard":"/sota/language-modelling-on-enwiki8","task":"Language Modelling","dataset":"enwik8","model":"Transformer-XL (18 layers)","rank_in_archive_order":23,"of":42,"metrics":{"Bit per Character (BPC)":"1.03","Number of params":"88M"},"uses_additional_data":false},{"leaderboard":"/sota/language-modelling-on-enwiki8","task":"Language Modelling","dataset":"enwik8","model":"Transformer-XL (12 layers)","rank_in_archive_order":26,"of":42,"metrics":{"Bit per Character (BPC)":"1.06","Number of params":"41M"},"uses_additional_data":false}],"syntology":{"atlas_url":"https://app.syntology.ai/?focus=1901.02860","mcp":{"get_harvested_code_for_paper":{"arxiv_id":"1901.02860"}},"developers":"https://syntology.ai/developers","read_at":"2026-09-24T18:15:14+00:00","read_at_is":"when the build read Syntology's graph, not when any sample ran","claim":"Per-sample execution status on synthesized fixtures; not a correctness claim about the paper. Samples come from repositories linked to the paper, official or community; repo_kind says which.","repos":[{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/huggingface/transformers","reach":null},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/jiean001/models_m/tree/main/transformer_xl","reach":null},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/sooftware/attentions","reach":{"status":"ok","spdx":"MIT"}},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/lvyufeng/bert4ms","reach":{"status":"ok","spdx":"Apache-2.0"}},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/SambhawDrag/XLNet.jl","reach":{"status":"unanswered"}},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/TimDettmers/transformer-xl","reach":{"status":"ok","spdx":"Apache-2.0"}},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/PaddlePaddle/PaddleNLP/tree/develop/examples/language_model/transformer-xl","reach":null},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/benkrause/dynamiceval-transformer","reach":null},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/mustafaaljadery/gemma-2b-10m","reach":null},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/wxt1997/Transformer-Transducer","reach":{"status":"ok"}},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/okkteam/Transformer-Transducer","reach":null},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/cmunnis/BERT_vs_Transformer-XL","reach":{"status":"ok"}},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/Jmkernes/PAR-Transformer-XL","reach":null},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/kimiyoung/transformer-xl","reach":null},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/2023-MindSpore-1/ms-code-220/tree/main/transformer_xl","reach":null},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/aiha-lab/Attention-Head-Pruning","reach":{"status":"ok","spdx":"GPL-3.0"}},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/AIResearchHub/transformergallery","reach":null},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/sh951011/Attention-Implementation","reach":{"status":"ok","spdx":"MIT"}},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/zhdbwe/Paper-DailyReading","reach":{"status":"ok"}},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/listenviolet/XLNet","reach":null},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/facebookresearch/code-prediction-transformer","reach":null},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/google-research/meliad","reach":{"status":"ok","spdx":"Apache-2.0"}},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/sooftware/conformer","reach":null},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/inzva/fake-academic-paper-generation","reach":null},{"provenance":"external:paperswithcode_snapshot_2025-07-28","url":"https://github.com/samwisegamjeee/pytorch-transformers","reach":{"status":"ok","spdx":"Apache-2.0"}}],"summary":{"ran":40,"ran_fixture":12,"ran_draft_wrong":6,"ran_honours":4,"ran_violates":1,"unverified":80},"by_repo_kind":{"official":{"samples":13,"ran":8,"repositories":1},"listed":{"samples":128,"ran":53,"repositories":19}},"repo_kind_vocabulary":{"official":"The archive marks this repository official for the paper","named_in_paper":"The archive records that the paper mentions this repository; it is not marked official","listed":"In the archive's code links for this paper, not marked official and not recorded as mentioned in the paper","found_in_text":"Syntology found this repository in the paper's own text; whether it is the authors' implementation is not asserted","community":"Not in the archive's code links for this paper; a community repository Syntology harvested"},"n_pointer_only_for_licence":43,"samples":[{"code_sha256_prefix":"e77541c1b4b15830","entry":"AdaptiveEmbedding","repo":"cedrickchee/pytorch-pretrained-BERT","repo_kind":"listed","path":"pytorch_pretrained_bert/modeling_transfo_xl.py","file_url":"https://github.com/cedrickchee/pytorch-pretrained-BERT/blob/HEAD/pytorch_pretrained_bert/modeling_transfo_xl.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"e77541c1b4b15830"}},{"code_sha256_prefix":"1ae137f0cee15e33","entry":"AdaptiveEmbedding","repo":"kimiyoung/transformer-xl","repo_kind":"official","path":"pytorch/mem_transformer.py","file_url":"https://github.com/kimiyoung/transformer-xl/blob/HEAD/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"1ae137f0cee15e33"}},{"code_sha256_prefix":"8a8691f05cb1b5da","entry":"AdaptiveEmbedding","repo":"NVIDIA/DeepLearningExamples","repo_kind":"listed","path":"PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","file_url":"https://github.com/NVIDIA/DeepLearningExamples/blob/HEAD/PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"8a8691f05cb1b5da"}},{"code_sha256_prefix":"e3217ee8bd314909","entry":"Attention","repo":"facebookresearch/code-prediction-transformer","repo_kind":"listed","path":"model.py","file_url":"https://github.com/facebookresearch/code-prediction-transformer/blob/HEAD/model.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NOASSERTION","inline_ok":false,"mcp_get_code":{"code_sha256":"e3217ee8bd314909"}},{"code_sha256_prefix":"548da299b3bc04e9","entry":"Block","repo":"facebookresearch/code-prediction-transformer","repo_kind":"listed","path":"model.py","file_url":"https://github.com/facebookresearch/code-prediction-transformer/blob/HEAD/model.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NOASSERTION","inline_ok":false,"mcp_get_code":{"code_sha256":"548da299b3bc04e9"}},{"code_sha256_prefix":"e8aac29a19d0c2e7","entry":"DecoderLayer","repo":"kimiyoung/transformer-xl","repo_kind":"official","path":"pytorch/mem_transformer.py","file_url":"https://github.com/kimiyoung/transformer-xl/blob/HEAD/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"e8aac29a19d0c2e7"}},{"code_sha256_prefix":"845f84e3a319753d","entry":"GEGLU","repo":"shanghai-digital-brain-laboratory/bdm-db1","repo_kind":"listed","path":"src/model/transformer_xl.py","file_url":"https://github.com/shanghai-digital-brain-laboratory/bdm-db1/blob/HEAD/src/model/transformer_xl.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"845f84e3a319753d"}},{"code_sha256_prefix":"72ccb5501088c2b4","entry":"GPT2Model","repo":"facebookresearch/code-prediction-transformer","repo_kind":"listed","path":"model.py","file_url":"https://github.com/facebookresearch/code-prediction-transformer/blob/HEAD/model.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NOASSERTION","inline_ok":false,"mcp_get_code":{"code_sha256":"72ccb5501088c2b4"}},{"code_sha256_prefix":"6a748d270690866b","entry":"GatoInputBase","repo":"shanghai-digital-brain-laboratory/bdm-db1","repo_kind":"listed","path":"src/model/transformer_xl.py","file_url":"https://github.com/shanghai-digital-brain-laboratory/bdm-db1/blob/HEAD/src/model/transformer_xl.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"6a748d270690866b"}},{"code_sha256_prefix":"709b8a145b15f0ca","entry":"GemmaConfig","repo":"mustafaaljadery/gemma-2b-10m","repo_kind":"listed","path":"src/gemma.py","file_url":"https://github.com/mustafaaljadery/gemma-2b-10m/blob/HEAD/src/gemma.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"709b8a145b15f0ca"}},{"code_sha256_prefix":"39c5be8f7b1c0490","entry":"GemmaRotaryEmbedding","repo":"mustafaaljadery/gemma-2b-10m","repo_kind":"listed","path":"src/gemma.py","file_url":"https://github.com/mustafaaljadery/gemma-2b-10m/blob/HEAD/src/gemma.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"39c5be8f7b1c0490"}},{"code_sha256_prefix":"ad41eff0feadfd69","entry":"ICTaskInput","repo":"shanghai-digital-brain-laboratory/bdm-db1","repo_kind":"listed","path":"src/model/transformer_xl.py","file_url":"https://github.com/shanghai-digital-brain-laboratory/bdm-db1/blob/HEAD/src/model/transformer_xl.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"ad41eff0feadfd69"}},{"code_sha256_prefix":"39480331817170e8","entry":"LayerNorm","repo":"facebookresearch/code-prediction-transformer","repo_kind":"listed","path":"model.py","file_url":"https://github.com/facebookresearch/code-prediction-transformer/blob/HEAD/model.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NOASSERTION","inline_ok":false,"mcp_get_code":{"code_sha256":"39480331817170e8"}},{"code_sha256_prefix":"84585e9be4407fc4","entry":"Linear","repo":"park-cheol/ASR-Conformer","repo_kind":"listed","path":"model/attention.py","file_url":"https://github.com/park-cheol/ASR-Conformer/blob/HEAD/model/attention.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"invariant","behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"84585e9be4407fc4"}},{"code_sha256_prefix":"220657028509cfb1","entry":"LogUniformSampler","repo":"kimiyoung/transformer-xl","repo_kind":"official","path":"pytorch/mem_transformer.py","file_url":"https://github.com/kimiyoung/transformer-xl/blob/HEAD/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"220657028509cfb1"}},{"code_sha256_prefix":"df5a6cf54dd0aca6","entry":"MLP","repo":"facebookresearch/code-prediction-transformer","repo_kind":"listed","path":"model.py","file_url":"https://github.com/facebookresearch/code-prediction-transformer/blob/HEAD/model.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NOASSERTION","inline_ok":false,"mcp_get_code":{"code_sha256":"df5a6cf54dd0aca6"}},{"code_sha256_prefix":"d99c9cc9af9de483","entry":"MultiHeadAttn","repo":"kimiyoung/transformer-xl","repo_kind":"official","path":"pytorch/mem_transformer.py","file_url":"https://github.com/kimiyoung/transformer-xl/blob/HEAD/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"d99c9cc9af9de483"}},{"code_sha256_prefix":"e672e8a20905b62b","entry":"MultiHeadAttn","repo":"NVIDIA/DeepLearningExamples","repo_kind":"listed","path":"PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","file_url":"https://github.com/NVIDIA/DeepLearningExamples/blob/HEAD/PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"e672e8a20905b62b"}},{"code_sha256_prefix":"5597fd8e1219b866","entry":"MultiHeadedAttention","repo":"okkteam/Transformer-Transducer","repo_kind":"listed","path":"tt/transformer/attention.py","file_url":"https://github.com/okkteam/Transformer-Transducer/blob/HEAD/tt/transformer/attention.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"5597fd8e1219b866"}},{"code_sha256_prefix":"7eb33bec45fe09f3","entry":"NLPTaskInput","repo":"shanghai-digital-brain-laboratory/bdm-db1","repo_kind":"listed","path":"src/model/transformer_xl.py","file_url":"https://github.com/shanghai-digital-brain-laboratory/bdm-db1/blob/HEAD/src/model/transformer_xl.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"7eb33bec45fe09f3"}},{"code_sha256_prefix":"b54068382071f8c8","entry":"PatchEmbeddings","repo":"shanghai-digital-brain-laboratory/bdm-db1","repo_kind":"listed","path":"src/model/transformer_xl.py","file_url":"https://github.com/shanghai-digital-brain-laboratory/bdm-db1/blob/HEAD/src/model/transformer_xl.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"b54068382071f8c8"}},{"code_sha256_prefix":"5fb8aacfbced509d","entry":"PathLSTM","repo":"facebookresearch/code-prediction-transformer","repo_kind":"listed","path":"model.py","file_url":"https://github.com/facebookresearch/code-prediction-transformer/blob/HEAD/model.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NOASSERTION","inline_ok":false,"mcp_get_code":{"code_sha256":"5fb8aacfbced509d"}},{"code_sha256_prefix":"142586d370dc7c1e","entry":"PositionalEmbedding","repo":"shanghai-digital-brain-laboratory/bdm-db1","repo_kind":"listed","path":"src/model/transformer_xl.py","file_url":"https://github.com/shanghai-digital-brain-laboratory/bdm-db1/blob/HEAD/src/model/transformer_xl.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"142586d370dc7c1e"}},{"code_sha256_prefix":"06ce2b899569db5b","entry":"PositionalEmbedding","repo":"cedrickchee/pytorch-pretrained-BERT","repo_kind":"listed","path":"pytorch_pretrained_bert/modeling_transfo_xl.py","file_url":"https://github.com/cedrickchee/pytorch-pretrained-BERT/blob/HEAD/pytorch_pretrained_bert/modeling_transfo_xl.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"06ce2b899569db5b"}},{"code_sha256_prefix":"07bf8cf6e731d1bc","entry":"PositionalEncoding","repo":"AIResearchHub/transformergallery","repo_kind":"listed","path":"transformer/transformerxl.py","file_url":"https://github.com/AIResearchHub/transformergallery/blob/HEAD/transformer/transformerxl.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"mcp_get_code":{"code_sha256":"07bf8cf6e731d1bc"}},{"code_sha256_prefix":"eed8c286b97219b7","entry":"PositionwiseFF","repo":"shanghai-digital-brain-laboratory/bdm-db1","repo_kind":"listed","path":"src/model/transformer_xl.py","file_url":"https://github.com/shanghai-digital-brain-laboratory/bdm-db1/blob/HEAD/src/model/transformer_xl.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"eed8c286b97219b7"}},{"code_sha256_prefix":"c96fba039a607703","entry":"PositionwiseFF","repo":"kimiyoung/transformer-xl","repo_kind":"official","path":"pytorch/mem_transformer.py","file_url":"https://github.com/kimiyoung/transformer-xl/blob/HEAD/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"c96fba039a607703"}},{"code_sha256_prefix":"338c39719307318d","entry":"ProjectedAdaptiveLogSoftmax","repo":"kimiyoung/transformer-xl","repo_kind":"official","path":"pytorch/mem_transformer.py","file_url":"https://github.com/kimiyoung/transformer-xl/blob/HEAD/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"338c39719307318d"}},{"code_sha256_prefix":"4088ee884194d7c4","entry":"ProjectedAdaptiveLogSoftmax","repo":"NVIDIA/DeepLearningExamples","repo_kind":"listed","path":"PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","file_url":"https://github.com/NVIDIA/DeepLearningExamples/blob/HEAD/PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"4088ee884194d7c4"}},{"code_sha256_prefix":"7d9e9736e6c57d11","entry":"ProjectedAdaptiveLogSoftmax","repo":"inzva/fake-academic-paper-generation","repo_kind":"listed","path":"transformer-xl/pytorch/mem_transformer.py","file_url":"https://github.com/inzva/fake-academic-paper-generation/blob/HEAD/transformer-xl/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"mcp_get_code":{"code_sha256":"7d9e9736e6c57d11"}},{"code_sha256_prefix":"2e57dbd19f63d3f4","entry":"RLTaskInput","repo":"shanghai-digital-brain-laboratory/bdm-db1","repo_kind":"listed","path":"src/model/transformer_xl.py","file_url":"https://github.com/shanghai-digital-brain-laboratory/bdm-db1/blob/HEAD/src/model/transformer_xl.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"2e57dbd19f63d3f4"}},{"code_sha256_prefix":"4c8b264bb79a35a1","entry":"RelMultiHeadAttention","repo":"Jmkernes/PAR-Transformer-XL","repo_kind":"listed","path":"par_model.py","file_url":"https://github.com/Jmkernes/PAR-Transformer-XL/blob/HEAD/par_model.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"4c8b264bb79a35a1"}},{"code_sha256_prefix":"fe28ba867add05c0","entry":"RelMultiHeadAttn","repo":"kimiyoung/transformer-xl","repo_kind":"official","path":"pytorch/mem_transformer.py","file_url":"https://github.com/kimiyoung/transformer-xl/blob/HEAD/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"fe28ba867add05c0"}},{"code_sha256_prefix":"8fa37260188b5fd8","entry":"RelMultiHeadAttn","repo":"NVIDIA/DeepLearningExamples","repo_kind":"listed","path":"PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","file_url":"https://github.com/NVIDIA/DeepLearningExamples/blob/HEAD/PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"8fa37260188b5fd8"}},{"code_sha256_prefix":"4977fa89216a56fa","entry":"RelPositionMultiHeadedAttention","repo":"okkteam/Transformer-Transducer","repo_kind":"listed","path":"tt/transformer/attention.py","file_url":"https://github.com/okkteam/Transformer-Transducer/blob/HEAD/tt/transformer/attention.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"4977fa89216a56fa"}},{"code_sha256_prefix":"032b78da6979837c","entry":"RelativeMultiHeadAttention","repo":"park-cheol/ASR-Conformer","repo_kind":"listed","path":"model/attention.py","file_url":"https://github.com/park-cheol/ASR-Conformer/blob/HEAD/model/attention.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"invariant","behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"032b78da6979837c"}},{"code_sha256_prefix":"a97a22ac6fb31922","entry":"TransfoXLConfig","repo":"cedrickchee/pytorch-pretrained-BERT","repo_kind":"listed","path":"pytorch_pretrained_bert/modeling_transfo_xl.py","file_url":"https://github.com/cedrickchee/pytorch-pretrained-BERT/blob/HEAD/pytorch_pretrained_bert/modeling_transfo_xl.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"a97a22ac6fb31922"}},{"code_sha256_prefix":"c7b5eb55f15a37de","entry":"TransformerEmbedding","repo":"AIResearchHub/transformergallery","repo_kind":"listed","path":"transformer/transformerxl.py","file_url":"https://github.com/AIResearchHub/transformergallery/blob/HEAD/transformer/transformerxl.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"mcp_get_code":{"code_sha256":"c7b5eb55f15a37de"}},{"code_sha256_prefix":"2a023fc4bac8d229","entry":"VQATaskInput","repo":"shanghai-digital-brain-laboratory/bdm-db1","repo_kind":"listed","path":"src/model/transformer_xl.py","file_url":"https://github.com/shanghai-digital-brain-laboratory/bdm-db1/blob/HEAD/src/model/transformer_xl.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"2a023fc4bac8d229"}},{"code_sha256_prefix":"2a5f4bac2414eb0f","entry":"VisionEmbedding","repo":"shanghai-digital-brain-laboratory/bdm-db1","repo_kind":"listed","path":"src/model/transformer_xl.py","file_url":"https://github.com/shanghai-digital-brain-laboratory/bdm-db1/blob/HEAD/src/model/transformer_xl.py","link_basis":"first_harvest_node","language":"python","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"2a5f4bac2414eb0f"}},{"code_sha256_prefix":"773651748c9618d6","entry":"_cache_mem","repo":"benkrause/dynamiceval-transformer","repo_kind":"listed","path":"tf/model.py","file_url":"https://github.com/benkrause/dynamiceval-transformer/blob/HEAD/tf/model.py","link_basis":"first_harvest_node","language":"python","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"773651748c9618d6"}},{"code_sha256_prefix":"9d5e914b24b8911a","entry":"_cache_mem","repo":"huggingface/xlnet","repo_kind":"listed","path":"modeling.py","file_url":"https://github.com/huggingface/xlnet/blob/HEAD/modeling.py","link_basis":"first_harvest_node","language":"python","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"9d5e914b24b8911a"}},{"code_sha256_prefix":"78d91efd74e4d12a","entry":"add_and_scale","repo":null,"repo_kind":null,"path":null,"file_url":null,"link_basis":"identical_code_first_harvested_elsewhere","language":"python","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":false,"licence":null,"inline_ok":false,"mcp_get_code":{"code_sha256":"78d91efd74e4d12a"}},{"code_sha256_prefix":"c92e4fc990bba2fe","entry":"build_normalization","repo":"opendilab/DI-engine","repo_kind":"listed","path":"ding/torch_utils/network/transformer.py","file_url":"https://github.com/opendilab/DI-engine/blob/HEAD/ding/torch_utils/network/transformer.py","link_basis":"first_harvest_node","language":"python","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"c92e4fc990bba2fe"}},{"code_sha256_prefix":"35ef111fc00c21b4","entry":"build_tf_to_pytorch_map","repo":"cedrickchee/pytorch-pretrained-BERT","repo_kind":"listed","path":"pytorch_pretrained_bert/modeling_transfo_xl.py","file_url":"https://github.com/cedrickchee/pytorch-pretrained-BERT/blob/HEAD/pytorch_pretrained_bert/modeling_transfo_xl.py","link_basis":"first_harvest_node","language":"python","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"deterministic","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"35ef111fc00c21b4"}},{"code_sha256_prefix":"499bf5fee7915c78","entry":"create_lookahead_mask","repo":"Jmkernes/PAR-Transformer-XL","repo_kind":"listed","path":"par_model.py","file_url":"https://github.com/Jmkernes/PAR-Transformer-XL/blob/HEAD/par_model.py","link_basis":"first_harvest_node","language":"python","status":"ran_honours","verification_level":1,"contract_check":"HONOURS","metamorphic_tier":"well_formed","behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"499bf5fee7915c78"}},{"code_sha256_prefix":"9109ba9791e44324","entry":"embedding_lookup","repo":"benkrause/dynamiceval-transformer","repo_kind":"listed","path":"tf/model.py","file_url":"https://github.com/benkrause/dynamiceval-transformer/blob/HEAD/tf/model.py","link_basis":"first_harvest_node","language":"python","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"9109ba9791e44324"}},{"code_sha256_prefix":"c1184d27672a7461","entry":"fc_block","repo":"opendilab/DI-engine","repo_kind":"listed","path":"ding/torch_utils/network/transformer.py","file_url":"https://github.com/opendilab/DI-engine/blob/HEAD/ding/torch_utils/network/transformer.py","link_basis":"first_harvest_node","language":"python","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"c1184d27672a7461"}},{"code_sha256_prefix":"8d59a6d5900428f5","entry":"left_shift","repo":"Jmkernes/PAR-Transformer-XL","repo_kind":"listed","path":"par_model.py","file_url":"https://github.com/Jmkernes/PAR-Transformer-XL/blob/HEAD/par_model.py","link_basis":"first_harvest_node","language":"python","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"8d59a6d5900428f5"}},{"code_sha256_prefix":"d50e8679cde3a927","entry":"positional_embedding","repo":"benkrause/dynamiceval-transformer","repo_kind":"listed","path":"tf/model.py","file_url":"https://github.com/benkrause/dynamiceval-transformer/blob/HEAD/tf/model.py","link_basis":"first_harvest_node","language":"python","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"d50e8679cde3a927"}},{"code_sha256_prefix":"9bf0f6e6298f3fbe","entry":"positional_embedding","repo":"huggingface/xlnet","repo_kind":"listed","path":"modeling.py","file_url":"https://github.com/huggingface/xlnet/blob/HEAD/modeling.py","link_basis":"first_harvest_node","language":"python","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"9bf0f6e6298f3fbe"}},{"code_sha256_prefix":"2398c4a5c285bdc4","entry":"positional_encoding","repo":"Jmkernes/PAR-Transformer-XL","repo_kind":"listed","path":"par_model.py","file_url":"https://github.com/Jmkernes/PAR-Transformer-XL/blob/HEAD/par_model.py","link_basis":"first_harvest_node","language":"python","status":"ran_honours","verification_level":1,"contract_check":"HONOURS","metamorphic_tier":"well_formed","behaviour_fingerprint":true,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"2398c4a5c285bdc4"}},{"code_sha256_prefix":"f7a746d73ab2f28c","entry":"positionwise_ffn","repo":"Jmkernes/PAR-Transformer-XL","repo_kind":"listed","path":"par_model.py","file_url":"https://github.com/Jmkernes/PAR-Transformer-XL/blob/HEAD/par_model.py","link_basis":"first_harvest_node","language":"python","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":"none","behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"f7a746d73ab2f28c"}},{"code_sha256_prefix":"d37883dc58ff9b69","entry":"rel_shift","repo":"benkrause/dynamiceval-transformer","repo_kind":"listed","path":"tf/model.py","file_url":"https://github.com/benkrause/dynamiceval-transformer/blob/HEAD/tf/model.py","link_basis":"first_harvest_node","language":"python","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"d37883dc58ff9b69"}},{"code_sha256_prefix":"5f7c5b38aeb29bf5","entry":"rel_shift","repo":"huggingface/xlnet","repo_kind":"listed","path":"modeling.py","file_url":"https://github.com/huggingface/xlnet/blob/HEAD/modeling.py","link_basis":"first_harvest_node","language":"python","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"5f7c5b38aeb29bf5"}},{"code_sha256_prefix":"edeef97857b7cdca","entry":"relative_position_logits","repo":"Jmkernes/PAR-Transformer-XL","repo_kind":"listed","path":"par_model.py","file_url":"https://github.com/Jmkernes/PAR-Transformer-XL/blob/HEAD/par_model.py","link_basis":"first_harvest_node","language":"python","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"edeef97857b7cdca"}},{"code_sha256_prefix":"8e76562720b0c921","entry":"relative_positional_encoding","repo":"huggingface/xlnet","repo_kind":"listed","path":"modeling.py","file_url":"https://github.com/huggingface/xlnet/blob/HEAD/modeling.py","link_basis":"first_harvest_node","language":"python","status":"ran_honours","verification_level":1,"contract_check":"HONOURS","metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"8e76562720b0c921"}},{"code_sha256_prefix":"4e762613ee907cdb","entry":"repeat_kv","repo":"mustafaaljadery/gemma-2b-10m","repo_kind":"listed","path":"src/gemma.py","file_url":"https://github.com/mustafaaljadery/gemma-2b-10m/blob/HEAD/src/gemma.py","link_basis":"first_harvest_node","language":"python","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"4e762613ee907cdb"}},{"code_sha256_prefix":"df4647a6d9f03c0e","entry":"right_shift","repo":"Jmkernes/PAR-Transformer-XL","repo_kind":"listed","path":"par_model.py","file_url":"https://github.com/Jmkernes/PAR-Transformer-XL/blob/HEAD/par_model.py","link_basis":"first_harvest_node","language":"python","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"df4647a6d9f03c0e"}},{"code_sha256_prefix":"cec833a99feb528c","entry":"rotate_half","repo":"mustafaaljadery/gemma-2b-10m","repo_kind":"listed","path":"src/gemma.py","file_url":"https://github.com/mustafaaljadery/gemma-2b-10m/blob/HEAD/src/gemma.py","link_basis":"first_harvest_node","language":"python","status":"ran_honours","verification_level":1,"contract_check":"HONOURS","metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"cec833a99feb528c"}},{"code_sha256_prefix":"93228a3eb5c4d179","entry":"sample_logits","repo":"kimiyoung/transformer-xl","repo_kind":"official","path":"pytorch/mem_transformer.py","file_url":"https://github.com/kimiyoung/transformer-xl/blob/HEAD/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"ran_draft_wrong","verification_level":1,"contract_check":"MISDECLARED","metamorphic_tier":"invariant","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"93228a3eb5c4d179"}},{"code_sha256_prefix":"a4f0d0fb0e45662a","entry":"sequential_pack","repo":"opendilab/DI-engine","repo_kind":"listed","path":"ding/torch_utils/network/transformer.py","file_url":"https://github.com/opendilab/DI-engine/blob/HEAD/ding/torch_utils/network/transformer.py","link_basis":"first_harvest_node","language":"python","status":"ran_draft_wrong","verification_level":1,"contract_check":"OUTPUT_MISDECLARED","metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"a4f0d0fb0e45662a"}},{"code_sha256_prefix":"4e978f9f7835b10a","entry":"to_2tuple","repo":null,"repo_kind":null,"path":null,"file_url":null,"link_basis":"identical_code_first_harvested_elsewhere","language":"python","status":"ran_violates","verification_level":1,"contract_check":"VIOLATES","metamorphic_tier":"well_formed","behaviour_fingerprint":true,"licence":null,"inline_ok":false,"mcp_get_code":{"code_sha256":"4e978f9f7835b10a"}},{"code_sha256_prefix":"87202268910cb496","entry":"AdaptiveSoftmax","repo":"Jmkernes/PAR-Transformer-XL","repo_kind":"listed","path":"par_model.py","file_url":"https://github.com/Jmkernes/PAR-Transformer-XL/blob/HEAD/par_model.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"87202268910cb496"}},{"code_sha256_prefix":"fe3454282cf0b88e","entry":"Attention","repo":"opendilab/DI-engine","repo_kind":"listed","path":"ding/torch_utils/network/transformer.py","file_url":"https://github.com/opendilab/DI-engine/blob/HEAD/ding/torch_utils/network/transformer.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"fe3454282cf0b88e"}},{"code_sha256_prefix":"fc52846dc775edff","entry":"DecoderLayer","repo":"cedrickchee/pytorch-pretrained-BERT","repo_kind":"listed","path":"pytorch_pretrained_bert/modeling_transfo_xl.py","file_url":"https://github.com/cedrickchee/pytorch-pretrained-BERT/blob/HEAD/pytorch_pretrained_bert/modeling_transfo_xl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"fc52846dc775edff"}},{"code_sha256_prefix":"c614edf5b8c0d3b0","entry":"DecoderLayer","repo":"NVIDIA/DeepLearningExamples","repo_kind":"listed","path":"PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","file_url":"https://github.com/NVIDIA/DeepLearningExamples/blob/HEAD/PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"c614edf5b8c0d3b0"}},{"code_sha256_prefix":"117b06ce2fbc7877","entry":"GPT2LMHead","repo":"facebookresearch/code-prediction-transformer","repo_kind":"listed","path":"model.py","file_url":"https://github.com/facebookresearch/code-prediction-transformer/blob/HEAD/model.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NOASSERTION","inline_ok":false,"mcp_get_code":{"code_sha256":"117b06ce2fbc7877"}},{"code_sha256_prefix":"e4e12108c18eb032","entry":"GemmaAttention","repo":"mustafaaljadery/gemma-2b-10m","repo_kind":"listed","path":"src/gemma.py","file_url":"https://github.com/mustafaaljadery/gemma-2b-10m/blob/HEAD/src/gemma.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"e4e12108c18eb032"}},{"code_sha256_prefix":"de07f82e734e3e2c","entry":"GemmaInfiniAttention","repo":"mustafaaljadery/gemma-2b-10m","repo_kind":"listed","path":"src/gemma.py","file_url":"https://github.com/mustafaaljadery/gemma-2b-10m/blob/HEAD/src/gemma.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"de07f82e734e3e2c"}},{"code_sha256_prefix":"9ef2fc89678fefb2","entry":"MemTransformerLM","repo":"kimiyoung/transformer-xl","repo_kind":"official","path":"pytorch/mem_transformer.py","file_url":"https://github.com/kimiyoung/transformer-xl/blob/HEAD/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"9ef2fc89678fefb2"}},{"code_sha256_prefix":"5ffa84d26ba39532","entry":"MemTransformerLM","repo":"NVIDIA/DeepLearningExamples","repo_kind":"listed","path":"PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","file_url":"https://github.com/NVIDIA/DeepLearningExamples/blob/HEAD/PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"5ffa84d26ba39532"}},{"code_sha256_prefix":"a7430322070cedb5","entry":"MemTransformerLM","repo":"inzva/fake-academic-paper-generation","repo_kind":"listed","path":"transformer-xl/pytorch/mem_transformer.py","file_url":"https://github.com/inzva/fake-academic-paper-generation/blob/HEAD/transformer-xl/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"mcp_get_code":{"code_sha256":"a7430322070cedb5"}},{"code_sha256_prefix":"12dd38874c15490a","entry":"MemTransformerLM","repo":"jincan333/lot","repo_kind":"listed","path":"model/mem_transformer.py","file_url":"https://github.com/jincan333/lot/blob/HEAD/model/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"mcp_get_code":{"code_sha256":"12dd38874c15490a"}},{"code_sha256_prefix":"d4857f57ecefa3d5","entry":"MultiHeadAttn","repo":"cedrickchee/pytorch-pretrained-BERT","repo_kind":"listed","path":"pytorch_pretrained_bert/modeling_transfo_xl.py","file_url":"https://github.com/cedrickchee/pytorch-pretrained-BERT/blob/HEAD/pytorch_pretrained_bert/modeling_transfo_xl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"d4857f57ecefa3d5"}},{"code_sha256_prefix":"de3ab66ec62fc167","entry":"PARTransformerXL","repo":"Jmkernes/PAR-Transformer-XL","repo_kind":"listed","path":"par_model.py","file_url":"https://github.com/Jmkernes/PAR-Transformer-XL/blob/HEAD/par_model.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"de3ab66ec62fc167"}},{"code_sha256_prefix":"62b1b4ab79fdfc8b","entry":"PositionwiseFF","repo":"cedrickchee/pytorch-pretrained-BERT","repo_kind":"listed","path":"pytorch_pretrained_bert/modeling_transfo_xl.py","file_url":"https://github.com/cedrickchee/pytorch-pretrained-BERT/blob/HEAD/pytorch_pretrained_bert/modeling_transfo_xl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"62b1b4ab79fdfc8b"}},{"code_sha256_prefix":"6b820cc9aac66bc1","entry":"ProjectedAdaptiveLogSoftmax","repo":"jincan333/lot","repo_kind":"listed","path":"model/mem_transformer.py","file_url":"https://github.com/jincan333/lot/blob/HEAD/model/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"mcp_get_code":{"code_sha256":"6b820cc9aac66bc1"}},{"code_sha256_prefix":"752529d23a4b3b22","entry":"RelLearnableDecoderLayer","repo":"cedrickchee/pytorch-pretrained-BERT","repo_kind":"listed","path":"pytorch_pretrained_bert/modeling_transfo_xl.py","file_url":"https://github.com/cedrickchee/pytorch-pretrained-BERT/blob/HEAD/pytorch_pretrained_bert/modeling_transfo_xl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"752529d23a4b3b22"}},{"code_sha256_prefix":"17ee18e7e701439f","entry":"RelLearnableDecoderLayer","repo":"kimiyoung/transformer-xl","repo_kind":"official","path":"pytorch/mem_transformer.py","file_url":"https://github.com/kimiyoung/transformer-xl/blob/HEAD/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"17ee18e7e701439f"}},{"code_sha256_prefix":"ea7c8500cbc85ff5","entry":"RelLearnableDecoderLayer","repo":"NVIDIA/DeepLearningExamples","repo_kind":"listed","path":"PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","file_url":"https://github.com/NVIDIA/DeepLearningExamples/blob/HEAD/PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"ea7c8500cbc85ff5"}},{"code_sha256_prefix":"3dafbc50941af43d","entry":"RelLearnableMultiHeadAttn","repo":"cedrickchee/pytorch-pretrained-BERT","repo_kind":"listed","path":"pytorch_pretrained_bert/modeling_transfo_xl.py","file_url":"https://github.com/cedrickchee/pytorch-pretrained-BERT/blob/HEAD/pytorch_pretrained_bert/modeling_transfo_xl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"3dafbc50941af43d"}},{"code_sha256_prefix":"a033a134e9f6452f","entry":"RelLearnableMultiHeadAttn","repo":"kimiyoung/transformer-xl","repo_kind":"official","path":"pytorch/mem_transformer.py","file_url":"https://github.com/kimiyoung/transformer-xl/blob/HEAD/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"a033a134e9f6452f"}},{"code_sha256_prefix":"cb862dd19b1f381a","entry":"RelLearnableMultiHeadAttn","repo":"NVIDIA/DeepLearningExamples","repo_kind":"listed","path":"PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","file_url":"https://github.com/NVIDIA/DeepLearningExamples/blob/HEAD/PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"cb862dd19b1f381a"}},{"code_sha256_prefix":"dc7c9e91c34d6ddf","entry":"RelMultiHeadAttn","repo":"cedrickchee/pytorch-pretrained-BERT","repo_kind":"listed","path":"pytorch_pretrained_bert/modeling_transfo_xl.py","file_url":"https://github.com/cedrickchee/pytorch-pretrained-BERT/blob/HEAD/pytorch_pretrained_bert/modeling_transfo_xl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"dc7c9e91c34d6ddf"}},{"code_sha256_prefix":"9ec384a6bfe40952","entry":"RelPartialLearnableDecoderLayer","repo":"shanghai-digital-brain-laboratory/bdm-db1","repo_kind":"listed","path":"src/model/transformer_xl.py","file_url":"https://github.com/shanghai-digital-brain-laboratory/bdm-db1/blob/HEAD/src/model/transformer_xl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"9ec384a6bfe40952"}},{"code_sha256_prefix":"fd8d58e6a1428332","entry":"RelPartialLearnableDecoderLayer","repo":"cedrickchee/pytorch-pretrained-BERT","repo_kind":"listed","path":"pytorch_pretrained_bert/modeling_transfo_xl.py","file_url":"https://github.com/cedrickchee/pytorch-pretrained-BERT/blob/HEAD/pytorch_pretrained_bert/modeling_transfo_xl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"fd8d58e6a1428332"}},{"code_sha256_prefix":"89afd0bff30e18a9","entry":"RelPartialLearnableDecoderLayer","repo":"kimiyoung/transformer-xl","repo_kind":"official","path":"pytorch/mem_transformer.py","file_url":"https://github.com/kimiyoung/transformer-xl/blob/HEAD/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"89afd0bff30e18a9"}},{"code_sha256_prefix":"5014b04d3358c101","entry":"RelPartialLearnableDecoderLayer","repo":"NVIDIA/DeepLearningExamples","repo_kind":"listed","path":"PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","file_url":"https://github.com/NVIDIA/DeepLearningExamples/blob/HEAD/PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"5014b04d3358c101"}},{"code_sha256_prefix":"fdc345d0da45dd95","entry":"RelPartialLearnableMultiHeadAttn","repo":"shanghai-digital-brain-laboratory/bdm-db1","repo_kind":"listed","path":"src/model/transformer_xl.py","file_url":"https://github.com/shanghai-digital-brain-laboratory/bdm-db1/blob/HEAD/src/model/transformer_xl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"fdc345d0da45dd95"}},{"code_sha256_prefix":"8361fa24d3e06e13","entry":"RelPartialLearnableMultiHeadAttn","repo":"cedrickchee/pytorch-pretrained-BERT","repo_kind":"listed","path":"pytorch_pretrained_bert/modeling_transfo_xl.py","file_url":"https://github.com/cedrickchee/pytorch-pretrained-BERT/blob/HEAD/pytorch_pretrained_bert/modeling_transfo_xl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"8361fa24d3e06e13"}},{"code_sha256_prefix":"fb613dd5bc21371c","entry":"RelPartialLearnableMultiHeadAttn","repo":"kimiyoung/transformer-xl","repo_kind":"official","path":"pytorch/mem_transformer.py","file_url":"https://github.com/kimiyoung/transformer-xl/blob/HEAD/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"fb613dd5bc21371c"}},{"code_sha256_prefix":"5e1b71bde76b69e7","entry":"RelPartialLearnableMultiHeadAttn","repo":"NVIDIA/DeepLearningExamples","repo_kind":"listed","path":"PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","file_url":"https://github.com/NVIDIA/DeepLearningExamples/blob/HEAD/PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"5e1b71bde76b69e7"}},{"code_sha256_prefix":"c018d465b6253b94","entry":"RelativeMultiHeadAttention","repo":"sooftware/Attention-Implementation","repo_kind":"listed","path":"attentions.py","file_url":"https://github.com/sooftware/Attention-Implementation/blob/HEAD/attentions.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"mcp_get_code":{"code_sha256":"c018d465b6253b94"}},{"code_sha256_prefix":"274ae09f88dbb42a","entry":"RelativeMultiHeadAttention","repo":"sooftware/conformer","repo_kind":"listed","path":"conformer/attention.py","file_url":"https://github.com/sooftware/conformer/blob/HEAD/conformer/attention.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"274ae09f88dbb42a"}},{"code_sha256_prefix":"1be1a875d12d10b3","entry":"RelaxedOneHot","repo":"Jmkernes/PAR-Transformer-XL","repo_kind":"listed","path":"par_model.py","file_url":"https://github.com/Jmkernes/PAR-Transformer-XL/blob/HEAD/par_model.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"1be1a875d12d10b3"}},{"code_sha256_prefix":"534b6317f069c394","entry":"StochasticBlock","repo":"Jmkernes/PAR-Transformer-XL","repo_kind":"listed","path":"par_model.py","file_url":"https://github.com/Jmkernes/PAR-Transformer-XL/blob/HEAD/par_model.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"534b6317f069c394"}},{"code_sha256_prefix":"532a59e61c71b7a8","entry":"TransfoXLModel","repo":"cedrickchee/pytorch-pretrained-BERT","repo_kind":"listed","path":"pytorch_pretrained_bert/modeling_transfo_xl.py","file_url":"https://github.com/cedrickchee/pytorch-pretrained-BERT/blob/HEAD/pytorch_pretrained_bert/modeling_transfo_xl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"532a59e61c71b7a8"}},{"code_sha256_prefix":"d7bd7d30264b3658","entry":"TransfoXLPreTrainedModel","repo":"cedrickchee/pytorch-pretrained-BERT","repo_kind":"listed","path":"pytorch_pretrained_bert/modeling_transfo_xl.py","file_url":"https://github.com/cedrickchee/pytorch-pretrained-BERT/blob/HEAD/pytorch_pretrained_bert/modeling_transfo_xl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"d7bd7d30264b3658"}},{"code_sha256_prefix":"b28585d20fefea46","entry":"TransformerLayer","repo":"opendilab/DI-engine","repo_kind":"listed","path":"ding/torch_utils/network/transformer.py","file_url":"https://github.com/opendilab/DI-engine/blob/HEAD/ding/torch_utils/network/transformer.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"b28585d20fefea46"}},{"code_sha256_prefix":"9a2f71717dcf3962","entry":"TransformerModel","repo":"facebookresearch/code-prediction-transformer","repo_kind":"listed","path":"model.py","file_url":"https://github.com/facebookresearch/code-prediction-transformer/blob/HEAD/model.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NOASSERTION","inline_ok":false,"mcp_get_code":{"code_sha256":"9a2f71717dcf3962"}},{"code_sha256_prefix":"a2315dc06271216b","entry":"TransformerXL","repo":"shanghai-digital-brain-laboratory/bdm-db1","repo_kind":"listed","path":"src/model/transformer_xl.py","file_url":"https://github.com/shanghai-digital-brain-laboratory/bdm-db1/blob/HEAD/src/model/transformer_xl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"a2315dc06271216b"}},{"code_sha256_prefix":"fa690903d5ea5d89","entry":"TransformerXL","repo":"AIResearchHub/transformergallery","repo_kind":"listed","path":"transformer/transformerxl.py","file_url":"https://github.com/AIResearchHub/transformergallery/blob/HEAD/transformer/transformerxl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"mcp_get_code":{"code_sha256":"fa690903d5ea5d89"}},{"code_sha256_prefix":"91e5af7605c83b9a","entry":"XLAttentionLayer","repo":"AIResearchHub/transformergallery","repo_kind":"listed","path":"transformer/transformerxl.py","file_url":"https://github.com/AIResearchHub/transformergallery/blob/HEAD/transformer/transformerxl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"mcp_get_code":{"code_sha256":"91e5af7605c83b9a"}},{"code_sha256_prefix":"2b646a664c00ffa8","entry":"XLNet","repo":"listenviolet/XLNet","repo_kind":"listed","path":"xlnet.py","file_url":"https://github.com/listenviolet/XLNet/blob/HEAD/xlnet.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"2b646a664c00ffa8"}},{"code_sha256_prefix":"ed15761e38990647","entry":"_create_mask","repo":"benkrause/dynamiceval-transformer","repo_kind":"listed","path":"tf/model.py","file_url":"https://github.com/benkrause/dynamiceval-transformer/blob/HEAD/tf/model.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"ed15761e38990647"}},{"code_sha256_prefix":"c1f8a649a7a837d5","entry":"_create_mask","repo":"huggingface/xlnet","repo_kind":"listed","path":"modeling.py","file_url":"https://github.com/huggingface/xlnet/blob/HEAD/modeling.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"c1f8a649a7a837d5"}},{"code_sha256_prefix":"5c61a4c30ce59547","entry":"apply_rotary_pos_emb","repo":"mustafaaljadery/gemma-2b-10m","repo_kind":"listed","path":"src/gemma.py","file_url":"https://github.com/mustafaaljadery/gemma-2b-10m/blob/HEAD/src/gemma.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"5c61a4c30ce59547"}},{"code_sha256_prefix":"6b2a8f1c93d0b071","entry":"assign_to_gpu","repo":"TimDettmers/transformer-xl","repo_kind":"listed","path":"tf/gpu_utils.py","file_url":"https://github.com/TimDettmers/transformer-xl/blob/HEAD/tf/gpu_utils.py","link_basis":"harvester_set","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"6b2a8f1c93d0b071"}},{"code_sha256_prefix":"0e3f1e158da4c3b8","entry":"average_grads_and_vars","repo":"TimDettmers/transformer-xl","repo_kind":"listed","path":"tf/gpu_utils.py","file_url":"https://github.com/TimDettmers/transformer-xl/blob/HEAD/tf/gpu_utils.py","link_basis":"harvester_set","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"0e3f1e158da4c3b8"}},{"code_sha256_prefix":"36eed0b265968be7","entry":"batchify","repo":"TimDettmers/transformer-xl","repo_kind":"listed","path":"tf/data_utils.py","file_url":"https://github.com/TimDettmers/transformer-xl/blob/HEAD/tf/data_utils.py","link_basis":"harvester_set","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"36eed0b265968be7"}},{"code_sha256_prefix":"6fee57012e68e835","entry":"cached_path","repo":"cedrickchee/pytorch-pretrained-BERT","repo_kind":"listed","path":"pytorch_pretrained_bert/modeling_transfo_xl.py","file_url":"https://github.com/cedrickchee/pytorch-pretrained-BERT/blob/HEAD/pytorch_pretrained_bert/modeling_transfo_xl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"6fee57012e68e835"}},{"code_sha256_prefix":"e505aeb6374f0f1c","entry":"checkpoint_exists","repo":"TimDettmers/transformer-xl","repo_kind":"listed","path":"tf/avg_checkpoints.py","file_url":"https://github.com/TimDettmers/transformer-xl/blob/HEAD/tf/avg_checkpoints.py","link_basis":"harvester_set","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"e505aeb6374f0f1c"}},{"code_sha256_prefix":"48246428164ddbc5","entry":"create_ordered_tfrecords","repo":"TimDettmers/transformer-xl","repo_kind":"listed","path":"tf/data_utils.py","file_url":"https://github.com/TimDettmers/transformer-xl/blob/HEAD/tf/data_utils.py","link_basis":"harvester_set","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"48246428164ddbc5"}},{"code_sha256_prefix":"5abf0267f0fc7514","entry":"embedding_lookup","repo":"huggingface/xlnet","repo_kind":"listed","path":"modeling.py","file_url":"https://github.com/huggingface/xlnet/blob/HEAD/modeling.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"5abf0267f0fc7514"}},{"code_sha256_prefix":"f07d3c5f67c9a93d","entry":"generate_per_core_enqueue_ops_fn_for_host","repo":"TimDettmers/transformer-xl","repo_kind":"listed","path":"tf/tpu_estimator.py","file_url":"https://github.com/TimDettmers/transformer-xl/blob/HEAD/tf/tpu_estimator.py","link_basis":"harvester_set","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"f07d3c5f67c9a93d"}},{"code_sha256_prefix":"d5a05e8b3b59f012","entry":"generate_per_host_enqueue_ops_fn_for_host","repo":"TimDettmers/transformer-xl","repo_kind":"listed","path":"tf/tpu_estimator.py","file_url":"https://github.com/TimDettmers/transformer-xl/blob/HEAD/tf/tpu_estimator.py","link_basis":"harvester_set","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"d5a05e8b3b59f012"}},{"code_sha256_prefix":"8ca3ba583d69ea38","entry":"generate_per_host_v2_enqueue_ops_fn_for_host","repo":"TimDettmers/transformer-xl","repo_kind":"listed","path":"tf/tpu_estimator.py","file_url":"https://github.com/TimDettmers/transformer-xl/blob/HEAD/tf/tpu_estimator.py","link_basis":"harvester_set","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"8ca3ba583d69ea38"}},{"code_sha256_prefix":"ab8eff277d0925e9","entry":"get_bin_sizes","repo":"TimDettmers/transformer-xl","repo_kind":"listed","path":"tf/data_utils.py","file_url":"https://github.com/TimDettmers/transformer-xl/blob/HEAD/tf/data_utils.py","link_basis":"harvester_set","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"ab8eff277d0925e9"}},{"code_sha256_prefix":"b4bb49d2de702f67","entry":"get_from_cache","repo":"cedrickchee/pytorch-pretrained-BERT","repo_kind":"listed","path":"pytorch_pretrained_bert/modeling_transfo_xl.py","file_url":"https://github.com/cedrickchee/pytorch-pretrained-BERT/blob/HEAD/pytorch_pretrained_bert/modeling_transfo_xl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"b4bb49d2de702f67"}},{"code_sha256_prefix":"6804d62cb7cd8df3","entry":"head_projection","repo":"huggingface/xlnet","repo_kind":"listed","path":"modeling.py","file_url":"https://github.com/huggingface/xlnet/blob/HEAD/modeling.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"6804d62cb7cd8df3"}},{"code_sha256_prefix":"c1c98338b80e7459","entry":"lm_loss","repo":"Machine-Learning-Tokyo/Poetry-GAN","repo_kind":"listed","path":"textgan.py","file_url":"https://github.com/Machine-Learning-Tokyo/Poetry-GAN/blob/HEAD/textgan.py","link_basis":"harvester_set","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"mcp_get_code":{"code_sha256":"c1c98338b80e7459"}},{"code_sha256_prefix":"3d6b054785523852","entry":"load_from_checkpoint","repo":"TimDettmers/transformer-xl","repo_kind":"listed","path":"tf/gpu_utils.py","file_url":"https://github.com/TimDettmers/transformer-xl/blob/HEAD/tf/gpu_utils.py","link_basis":"harvester_set","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"3d6b054785523852"}},{"code_sha256_prefix":"1ebc2bf2c3cddc4d","entry":"load_tf_weights_in_transfo_xl","repo":"cedrickchee/pytorch-pretrained-BERT","repo_kind":"listed","path":"pytorch_pretrained_bert/modeling_transfo_xl.py","file_url":"https://github.com/cedrickchee/pytorch-pretrained-BERT/blob/HEAD/pytorch_pretrained_bert/modeling_transfo_xl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"1ebc2bf2c3cddc4d"}},{"code_sha256_prefix":"99e35dc770639097","entry":"mask_adaptive_embedding_lookup","repo":"benkrause/dynamiceval-transformer","repo_kind":"listed","path":"tf/model.py","file_url":"https://github.com/benkrause/dynamiceval-transformer/blob/HEAD/tf/model.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"99e35dc770639097"}},{"code_sha256_prefix":"fca4d6d03913ae24","entry":"mask_adaptive_logsoftmax","repo":"benkrause/dynamiceval-transformer","repo_kind":"listed","path":"tf/model.py","file_url":"https://github.com/benkrause/dynamiceval-transformer/blob/HEAD/tf/model.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"fca4d6d03913ae24"}},{"code_sha256_prefix":"8d07f1308bd24cbc","entry":"mul_adaptive_embedding_lookup","repo":"benkrause/dynamiceval-transformer","repo_kind":"listed","path":"tf/model.py","file_url":"https://github.com/benkrause/dynamiceval-transformer/blob/HEAD/tf/model.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"8d07f1308bd24cbc"}},{"code_sha256_prefix":"e344186184b46850","entry":"mul_adaptive_logsoftmax","repo":"benkrause/dynamiceval-transformer","repo_kind":"listed","path":"tf/model.py","file_url":"https://github.com/benkrause/dynamiceval-transformer/blob/HEAD/tf/model.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"e344186184b46850"}},{"code_sha256_prefix":"3652bf001c221967","entry":"positionwise_FF","repo":"benkrause/dynamiceval-transformer","repo_kind":"listed","path":"tf/model.py","file_url":"https://github.com/benkrause/dynamiceval-transformer/blob/HEAD/tf/model.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"3652bf001c221967"}},{"code_sha256_prefix":"ddf11fc956cd28ce","entry":"positionwise_ffn","repo":"huggingface/xlnet","repo_kind":"listed","path":"modeling.py","file_url":"https://github.com/huggingface/xlnet/blob/HEAD/modeling.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"ddf11fc956cd28ce"}},{"code_sha256_prefix":"cf208c8c20d52c1b","entry":"post_attention","repo":"huggingface/xlnet","repo_kind":"listed","path":"modeling.py","file_url":"https://github.com/huggingface/xlnet/blob/HEAD/modeling.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"cf208c8c20d52c1b"}},{"code_sha256_prefix":"9d6735f22035b700","entry":"post_process","repo":"Machine-Learning-Tokyo/Poetry-GAN","repo_kind":"listed","path":"lang_model.py","file_url":"https://github.com/Machine-Learning-Tokyo/Poetry-GAN/blob/HEAD/lang_model.py","link_basis":"harvester_set","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"mcp_get_code":{"code_sha256":"9d6735f22035b700"}},{"code_sha256_prefix":"bf75653cc30018e0","entry":"print_with_rank","repo":"shanghai-digital-brain-laboratory/bdm-db1","repo_kind":"listed","path":"src/model/transformer_xl.py","file_url":"https://github.com/shanghai-digital-brain-laboratory/bdm-db1/blob/HEAD/src/model/transformer_xl.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"bf75653cc30018e0"}},{"code_sha256_prefix":"b517847a8c809203","entry":"rel_attn_core","repo":"huggingface/xlnet","repo_kind":"listed","path":"modeling.py","file_url":"https://github.com/huggingface/xlnet/blob/HEAD/modeling.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"b517847a8c809203"}},{"code_sha256_prefix":"b1f1afea05cd968b","entry":"rel_multihead_attn","repo":"benkrause/dynamiceval-transformer","repo_kind":"listed","path":"tf/model.py","file_url":"https://github.com/benkrause/dynamiceval-transformer/blob/HEAD/tf/model.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"b1f1afea05cd968b"}},{"code_sha256_prefix":"6ccb8d28491109b6","entry":"rel_multihead_attn","repo":"huggingface/xlnet","repo_kind":"listed","path":"modeling.py","file_url":"https://github.com/huggingface/xlnet/blob/HEAD/modeling.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"6ccb8d28491109b6"}},{"code_sha256_prefix":"582150577e5bd769","entry":"sample_logits","repo":"NVIDIA/DeepLearningExamples","repo_kind":"listed","path":"PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","file_url":"https://github.com/NVIDIA/DeepLearningExamples/blob/HEAD/PyTorch/LanguageModeling/Transformer-XL/pytorch/mem_transformer.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"mcp_get_code":{"code_sha256":"582150577e5bd769"}},{"code_sha256_prefix":"69598ced7806d8c3","entry":"scatter","repo":"TimDettmers/transformer-xl","repo_kind":"listed","path":"pytorch/utils/data_parallel.py","file_url":"https://github.com/TimDettmers/transformer-xl/blob/HEAD/pytorch/utils/data_parallel.py","link_basis":"harvester_set","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"69598ced7806d8c3"}},{"code_sha256_prefix":"aa1de448b0528802","entry":"scatter_kwargs","repo":"TimDettmers/transformer-xl","repo_kind":"listed","path":"pytorch/utils/data_parallel.py","file_url":"https://github.com/TimDettmers/transformer-xl/blob/HEAD/pytorch/utils/data_parallel.py","link_basis":"harvester_set","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"aa1de448b0528802"}},{"code_sha256_prefix":"e7ebaba541ff0216","entry":"seq_gumbel_softmax","repo":"Machine-Learning-Tokyo/Poetry-GAN","repo_kind":"listed","path":"textgan.py","file_url":"https://github.com/Machine-Learning-Tokyo/Poetry-GAN/blob/HEAD/textgan.py","link_basis":"harvester_set","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"mcp_get_code":{"code_sha256":"e7ebaba541ff0216"}},{"code_sha256_prefix":"d0f56431ab6c3b37","entry":"transformer","repo":"benkrause/dynamiceval-transformer","repo_kind":"listed","path":"tf/model.py","file_url":"https://github.com/benkrause/dynamiceval-transformer/blob/HEAD/tf/model.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"d0f56431ab6c3b37"}},{"code_sha256_prefix":"d077730400326171","entry":"transformer_xl","repo":"huggingface/xlnet","repo_kind":"listed","path":"modeling.py","file_url":"https://github.com/huggingface/xlnet/blob/HEAD/modeling.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"d077730400326171"}},{"code_sha256_prefix":"2d935f29546db9cd","entry":"two_stream_rel_attn","repo":"huggingface/xlnet","repo_kind":"listed","path":"modeling.py","file_url":"https://github.com/huggingface/xlnet/blob/HEAD/modeling.py","link_basis":"first_harvest_node","language":"python","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"mcp_get_code":{"code_sha256":"2d935f29546db9cd"}}]},"arxiv_metadata":null,"syntology_extracted_results":null}