{"about":{"site":"https://codewithpapers.app","non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page"},"url":"/code/create-eva-vit-g","entry":"create_eva_vit_g","source":"Syntology graph, per-sample; not an archive number","read_at":"2026-09-24T18:15:14+00:00","claim":"Names are grouped by exact entry-name string. Same-named routines are NOT asserted to be equivalent; 'ran' means executed on a synthesized fixture, not correctness. n_samples_ran = sum of by_status over every status except 'unverified' (ran_draft_wrong and ran_fixture are failures of Syntology's instrument, not of the code); n_papers_ran = papers with at least one such sample.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"},"n_papers":13,"n_papers_ran":0,"units":"n_samples, n_samples_ran, n_samples_fingerprinted and by_status count distinct code bodies (code_sha256); n_places and n_places_pointer_only count places, one per (paper, code body) pair, which is also the unit of the samples list","n_samples":13,"n_samples_ran":0,"n_samples_fingerprinted":0,"n_places":15,"n_places_pointer_only":4,"by_status":{"ran_honours":0,"ran_violates":0,"ran_draft_wrong":0,"ran_fixture":0,"ran":0,"unverified":13},"syntology":{"atlas_url":null,"mcp":null,"mcp_per_sample":{"tool":"get_code","arguments_in":"samples[].mcp_get_code"},"developers":"https://syntology.ai/developers"},"samples":[{"arxiv_id":"2502.20750","paper":"/paper/mitigating-hallucinations-in-large-vision-4","title":"Mitigating Hallucinations in Large Vision-Language Models by Adaptively Constraining Information Flow","date":"2025-02-28","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"jiaqi5598/adavib","path":"minigpt4/models/eva_vit.py","file_url":"https://github.com/jiaqi5598/adavib/blob/HEAD/minigpt4/models/eva_vit.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"64cd9e71a82a2a94","mcp_get_code":{"code_sha256":"64cd9e71a82a2a94"}},{"arxiv_id":"2411.02327","paper":"/paper/ppllava-varied-video-sequence-understanding","title":"PPLLaVA: Varied Video Sequence Understanding With Prompt Guidance","date":"2024-11-04","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"farewellthree/ppllava","path":"ppllava/models/eva_vit.py","file_url":"https://github.com/farewellthree/ppllava/blob/HEAD/ppllava/models/eva_vit.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"e3d9aac39bcef7a7","mcp_get_code":{"code_sha256":"e3d9aac39bcef7a7"}},{"arxiv_id":"2410.05714","paper":"/paper/enhancing-temporal-modeling-of-video-llms-via","title":"Enhancing Temporal Modeling of Video LLMs via Time Gating","date":"2024-10-08","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"lavi-lab/tg-vid","path":"stllm/models/eva_vit.py","file_url":"https://github.com/lavi-lab/tg-vid/blob/HEAD/stllm/models/eva_vit.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"ce86d2ef6c0e458f","mcp_get_code":{"code_sha256":"ce86d2ef6c0e458f"}},{"arxiv_id":"2407.12709","paper":"/paper/mome-mixture-of-multimodal-experts-for","title":"MoME: Mixture of Multimodal Experts for Generalist Multimodal Large Language Models","date":"2024-07-17","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"jiutian-vl/mome","path":"models/eva_vit.py","file_url":"https://github.com/jiutian-vl/mome/blob/HEAD/models/eva_vit.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"6d14779e4c4e5d4f","mcp_get_code":{"code_sha256":"6d14779e4c4e5d4f"}},{"arxiv_id":"2402.07398","paper":"/paper/vislinginstruct-elevating-zero-shot-learning","title":"VisLingInstruct: Elevating Zero-Shot Learning in Multi-Modal Language Models with Autonomous Instruction Optimization","date":"2024-02-12","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"zhudongsheng75/vislinginstruct","path":"vislinginstruct/models/eva_vit.py","file_url":"https://github.com/zhudongsheng75/vislinginstruct/blob/HEAD/vislinginstruct/models/eva_vit.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"5ff657c46012729d","mcp_get_code":{"code_sha256":"5ff657c46012729d"}},{"arxiv_id":"2312.07132","paper":"/paper/image-content-generation-with-causal","title":"Image Content Generation with Causal Reasoning","date":"2023-12-12","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"ieit-agi/mix-shannon","path":"lavis/models/eva_vit.py","file_url":"https://github.com/ieit-agi/mix-shannon/blob/HEAD/lavis/models/eva_vit.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"5435e3d77040cfbb","mcp_get_code":{"code_sha256":"5435e3d77040cfbb"}},{"arxiv_id":"2311.17005","paper":"/paper/mvbench-a-comprehensive-multi-modal-video","title":"MVBench: A Comprehensive Multi-modal Video Understanding Benchmark","date":"2023-11-28","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"opengvlab/ask-anything","path":"video_chat/models/eva_vit.py","file_url":"https://github.com/opengvlab/ask-anything/blob/HEAD/video_chat/models/eva_vit.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"19a98ad1eb25acff","mcp_get_code":{"code_sha256":"19a98ad1eb25acff"}},{"arxiv_id":"2311.11860","paper":"/paper/lion-empowering-multimodal-large-language","title":"LION : Empowering Multimodal Large Language Model with Dual-Level Visual Knowledge","date":"2023-11-20","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"rshaojimmy/jiutian","path":"models/eva_vit.py","file_url":"https://github.com/rshaojimmy/jiutian/blob/HEAD/models/eva_vit.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"8cf5a47b40101f6b","mcp_get_code":{"code_sha256":"8cf5a47b40101f6b"}},{"arxiv_id":"2310.05863","paper":"/paper/fine-grained-audio-visual-joint","title":"Fine-grained Audio-Visual Joint Representations for Multimodal Large Language Models","date":"2023-10-09","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"the-anonymous-bs/favor","path":"video_llama/models/eva_vit.py","file_url":"https://github.com/the-anonymous-bs/favor/blob/HEAD/video_llama/models/eva_vit.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"0f1417dbe45c5b50","mcp_get_code":{"code_sha256":"0f1417dbe45c5b50"}},{"arxiv_id":"2310.03291","paper":"/paper/simvlg-simple-and-efficient-pretraining-of","title":"Expedited Training of Visual Conditioned Language Generation via Redundancy Reduction","date":"2023-10-05","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"yiren-jian/evlgen","path":"lavis/models/eva_vit.py","file_url":"https://github.com/yiren-jian/evlgen/blob/HEAD/lavis/models/eva_vit.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"BSD-3-Clause","inline_ok":true,"code_sha256_prefix":"ad90eaa1053d7197","mcp_get_code":{"code_sha256":"ad90eaa1053d7197"}},{"arxiv_id":"2310.03291","paper":"/paper/simvlg-simple-and-efficient-pretraining-of","title":"Expedited Training of Visual Conditioned Language Generation via Redundancy Reduction","date":"2023-10-05","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"yiren-jian/evlgen","path":"lavis/models/eva_vit_g.py","file_url":"https://github.com/yiren-jian/evlgen/blob/HEAD/lavis/models/eva_vit_g.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"BSD-3-Clause","inline_ok":true,"code_sha256_prefix":"4acba4919cfe687f","mcp_get_code":{"code_sha256":"4acba4919cfe687f"}},{"arxiv_id":"2310.01218","paper":"/paper/making-llama-see-and-draw-with-seed-tokenizer","title":"Making LLaMA SEE and Draw with SEED Tokenizer","date":"2023-10-02","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"ailab-cvc/seed","path":"models/seed_qformer/eva_vit.py","file_url":"https://github.com/ailab-cvc/seed/blob/HEAD/models/seed_qformer/eva_vit.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NOASSERTION","inline_ok":false,"code_sha256_prefix":"cd33fb877f45ca78","mcp_get_code":{"code_sha256":"cd33fb877f45ca78"}},{"arxiv_id":"2306.04362","paper":"/paper/youku-mplug-a-10-million-large-scale-chinese","title":"Youku-mPLUG: A 10 Million Large-scale Chinese Video-Language Dataset for Pre-training and Benchmarks","date":"2023-06-07","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"x-plug/youku-mplug","path":"models/eva_vit.py","file_url":"https://github.com/x-plug/youku-mplug/blob/HEAD/models/eva_vit.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"9db4a34992ac95df","mcp_get_code":{"code_sha256":"9db4a34992ac95df"}},{"arxiv_id":"2024.acl-long.19","paper":null,"title":"arXiv:2024.acl-long.19","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"yiren-jian/EVLGen","path":"lavis/models/eva_vit.py","file_url":"https://github.com/yiren-jian/EVLGen/blob/HEAD/lavis/models/eva_vit.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"BSD-3-Clause","inline_ok":true,"code_sha256_prefix":"ad90eaa1053d7197","mcp_get_code":{"code_sha256":"ad90eaa1053d7197"}},{"arxiv_id":"2024.acl-long.19","paper":null,"title":"arXiv:2024.acl-long.19","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"yiren-jian/EVLGen","path":"lavis/models/eva_vit_g.py","file_url":"https://github.com/yiren-jian/EVLGen/blob/HEAD/lavis/models/eva_vit_g.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"BSD-3-Clause","inline_ok":true,"code_sha256_prefix":"4acba4919cfe687f","mcp_get_code":{"code_sha256":"4acba4919cfe687f"}}]}