{"about":{"site":"https://codewithpapers.app","non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page"},"url":"/code/sigmoid-ce-loss","entry":"sigmoid_ce_loss","source":"Syntology graph, per-sample; not an archive number","read_at":"2026-09-24T18:15:14+00:00","claim":"Names are grouped by exact entry-name string. Same-named routines are NOT asserted to be equivalent; 'ran' means executed on a synthesized fixture, not correctness. n_samples_ran = sum of by_status over every status except 'unverified' (ran_draft_wrong and ran_fixture are failures of Syntology's instrument, not of the code); n_papers_ran = papers with at least one such sample.","status_vocabulary":{"ran_honours":"ran, honoured the contract we drafted","ran_violates":"ran, violated the contract we drafted","ran_draft_wrong":"ran; our contract draft was wrong, not the code","ran_fixture":"ran; our fixture could not drive it","ran":"ran on a synthesized input","unverified":"unverified (harvested, no recorded run)"},"n_papers":70,"n_papers_ran":20,"units":"n_samples, n_samples_ran, n_samples_fingerprinted and by_status count distinct code bodies (code_sha256); n_places and n_places_pointer_only count places, one per (paper, code body) pair, which is also the unit of the samples list","n_samples":17,"n_samples_ran":11,"n_samples_fingerprinted":10,"n_places":72,"n_places_pointer_only":18,"by_status":{"ran_honours":0,"ran_violates":0,"ran_draft_wrong":1,"ran_fixture":4,"ran":6,"unverified":6},"syntology":{"atlas_url":null,"mcp":null,"mcp_per_sample":{"tool":"get_code","arguments_in":"samples[].mcp_get_code"},"developers":"https://syntology.ai/developers"},"samples":[{"arxiv_id":"2603.20193","paper":"/paper/arxiv-2603-20193","title":"From Masks to Pixels and Meaning: A New Taxonomy, Benchmark, and Metrics for VLM Image Tampering","date":null,"month_inferred_from_arxiv_id":"2026-03","title_source":"syntology","repo":"VILA-Lab/PIXAR","path":"model/PIXAR.py","file_url":"https://github.com/VILA-Lab/PIXAR/blob/HEAD/model/PIXAR.py","status":"ran_draft_wrong","verification_level":1,"contract_check":"MISDECLARED","metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"b9e60254a36a3fb8","mcp_get_code":{"code_sha256":"b9e60254a36a3fb8"}},{"arxiv_id":"2510.03853","paper":"/paper/arxiv-2510-03853","title":"UGround: Towards Unified Visual Grounding with Unrolled Transformers","date":null,"month_inferred_from_arxiv_id":"2025-10","title_source":"syntology","repo":"rui-qian/UGround","path":"model/UGround.py","file_url":"https://github.com/rui-qian/UGround/blob/HEAD/model/UGround.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"3face96ac23ae5bc","mcp_get_code":{"code_sha256":"3face96ac23ae5bc"}},{"arxiv_id":"2510.03853","paper":"/paper/arxiv-2510-03853","title":"UGround: Towards Unified Visual Grounding with Unrolled Transformers","date":null,"month_inferred_from_arxiv_id":"2025-10","title_source":"syntology","repo":"rui-qian/UGround","path":"model/GSVA.py","file_url":"https://github.com/rui-qian/UGround/blob/HEAD/model/GSVA.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"13c0bb91f8009d9c","mcp_get_code":{"code_sha256":"13c0bb91f8009d9c"}},{"arxiv_id":"2508.08612","paper":"/paper/arxiv-2508-08612","title":"Hierarchical Visual Prompt Learning for Continual Video Instance Segmentation","date":null,"month_inferred_from_arxiv_id":"2025-08","title_source":"syntology","repo":"JiahuaDong/HVPL","path":"hvpl/modeling/vita_criterion.py","file_url":"https://github.com/JiahuaDong/HVPL/blob/HEAD/hvpl/modeling/vita_criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2507.12857","paper":"/paper/score-scene-context-matters-in-open","title":"SCORE: Scene Context Matters in Open-Vocabulary Remote Sensing Instance Segmentation","date":"2025-07-17","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"HuangShiqi128/SCORE","path":"score/modeling/criterion.py","file_url":"https://github.com/HuangShiqi128/SCORE/blob/HEAD/score/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2507.08555","paper":"/paper/disentangling-instance-and-scene-contexts-for","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","date":"2025-07-11","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Enyu-Liu/DISC","path":"maskdino/models/criterion.py","file_url":"https://github.com/Enyu-Liu/DISC/blob/HEAD/maskdino/models/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2506.22624","paper":"/paper/seg-r1-segmentation-can-be-surprisingly","title":"Seg-R1: Segmentation Can Be Surprisingly Simple with Reinforcement Learning","date":"2025-06-27","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"geshang777/FOCUS","path":"focus/modeling/criterion.py","file_url":"https://github.com/geshang777/FOCUS/blob/HEAD/focus/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2506.02493","paper":"/paper/towards-in-the-wild-3d-plane-reconstruction-1","title":"Towards In-the-wild 3D Plane Reconstruction from a Single Image","date":"2025-06-03","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"jcliu0428/ZeroPlane","path":"ZeroPlane/modeling/criterion.py","file_url":"https://github.com/jcliu0428/ZeroPlane/blob/HEAD/ZeroPlane/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2501.13925","paper":"/paper/geopixel-pixel-grounding-large-multimodal","title":"GeoPixel: Pixel Grounding Large Multimodal Model in Remote Sensing","date":"2025-01-23","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"mbzuai-oryx/geopixel","path":"model/geopixel.py","file_url":"https://github.com/mbzuai-oryx/geopixel/blob/HEAD/model/geopixel.py","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"a9292f5d89194794","mcp_get_code":{"code_sha256":"a9292f5d89194794"}},{"arxiv_id":"2412.04292","paper":"/paper/sida-social-media-image-deepfake-detection","title":"SIDA: Social Media Image Deepfake Detection, Localization and Explanation with Large Multimodal Model","date":"2024-12-05","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":null,"path":"","file_url":null,"status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":null,"inline_ok":false,"code_sha256_prefix":"a9292f5d89194794","mcp_get_code":{"code_sha256":"a9292f5d89194794"}},{"arxiv_id":"2412.03069","paper":"/paper/tokenflow-unified-image-tokenizer-for","title":"TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation","date":"2024-12-04","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"ruohaoguo/avis","path":"avism/modeling/avism_criterion.py","file_url":"https://github.com/ruohaoguo/avis/blob/HEAD/avism/modeling/avism_criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2410.04842","paper":"/paper/a-simple-image-segmentation-framework-via-in","title":"A Simple Image Segmentation Framework via In-Context Examples","date":"2024-10-07","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"aim-uofa/SINE","path":"sine/model/criterion.py","file_url":"https://github.com/aim-uofa/SINE/blob/HEAD/sine/model/criterion.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"NOASSERTION","inline_ok":false,"code_sha256_prefix":"7130af6c2979dba8","mcp_get_code":{"code_sha256":"7130af6c2979dba8"}},{"arxiv_id":"2409.19603","paper":"/paper/one-token-to-seg-them-all-language-instructed","title":"One Token to Seg Them All: Language Instructed Reasoning Segmentation in Videos","date":"2024-09-29","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"showlab/videolisa","path":"model/VideoLISA.py","file_url":"https://github.com/showlab/videolisa/blob/HEAD/model/VideoLISA.py","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"a9292f5d89194794","mcp_get_code":{"code_sha256":"a9292f5d89194794"}},{"arxiv_id":"2407.16696","paper":"/paper/partglee-a-foundation-model-for-recognizing","title":"PartGLEE: A Foundation Model for Recognizing and Parsing Any Objects","date":"2024-07-23","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"ProvenceStar/PartGLEE","path":"projects/PartGLEE/partglee/models/criterion.py","file_url":"https://github.com/ProvenceStar/PartGLEE/blob/HEAD/projects/PartGLEE/partglee/models/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2407.11325","paper":"/paper/visa-reasoning-video-object-segmentation-via","title":"VISA: Reasoning Video Object Segmentation via Large Language Models","date":"2024-07-16","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"cilinyan/VISA","path":"model/VISA.py","file_url":"https://github.com/cilinyan/VISA/blob/HEAD/model/VISA.py","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"bf7e8883d6ce76b4","mcp_get_code":{"code_sha256":"bf7e8883d6ce76b4"}},{"arxiv_id":"2407.10084","paper":"/paper/part2object-hierarchical-unsupervised-3d","title":"Part2Object: Hierarchical Unsupervised 3D Instance Segmentation","date":"2024-07-14","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"chengshiest/part2object","path":"models/criterion.py","file_url":"https://github.com/chengshiest/part2object/blob/HEAD/models/criterion.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"c0938fc9bc7ebddd","mcp_get_code":{"code_sha256":"c0938fc9bc7ebddd"}},{"arxiv_id":"2406.20076","paper":"/paper/evf-sam-early-vision-language-fusion-for-text","title":"EVF-SAM: Early Vision-Language Fusion for Text-Prompted Segment Anything Model","date":"2024-06-28","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":null,"path":"","file_url":null,"status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":null,"inline_ok":false,"code_sha256_prefix":"a9292f5d89194794","mcp_get_code":{"code_sha256":"a9292f5d89194794"}},{"arxiv_id":"2406.09829","paper":"/paper/open-vocabulary-semantic-segmentation-with-4","title":"Open-Vocabulary Semantic Segmentation with Image Embedding Balancing","date":"2024-06-14","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"slonetime/EBSeg","path":"ebseg/model/criterion.py","file_url":"https://github.com/slonetime/EBSeg/blob/HEAD/ebseg/model/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2405.19783","paper":"/paper/instruction-guided-visual-masking","title":"Instruction-Guided Visual Masking","date":"2024-05-30","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"2toinf/ivm","path":"model/IVM.py","file_url":"https://github.com/2toinf/ivm/blob/HEAD/model/IVM.py","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"1033e9116b1e2573","mcp_get_code":{"code_sha256":"1033e9116b1e2573"}},{"arxiv_id":"2405.10370","paper":"/paper/grounded-3d-llm-with-referent-tokens","title":"Grounded 3D-LLM with Referent Tokens","date":"2024-05-16","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"OpenRobotLab/Grounded_3D-LLM","path":"models/criterion.py","file_url":"https://github.com/OpenRobotLab/Grounded_3D-LLM/blob/HEAD/models/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2405.05803","paper":"/paper/boosting-multimodal-large-language-models","title":"Boosting Multimodal Large Language Models with Visual Tokens Withdrawal for Rapid Inference","date":"2024-05-09","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"lzhxmu/vtw","path":"LISA-VTW/LISA.py","file_url":"https://github.com/lzhxmu/vtw/blob/HEAD/LISA-VTW/LISA.py","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"a9292f5d89194794","mcp_get_code":{"code_sha256":"a9292f5d89194794"}},{"arxiv_id":"2404.14657","paper":"/paper/progressive-token-length-scaling-in","title":"Progressive Token Length Scaling in Transformer Encoders for Efficient Universal Segmentation","date":"2024-04-23","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"abhishekaich27/proscale-pytorch","path":"mask2former/modeling/criterion.py","file_url":"https://github.com/abhishekaich27/proscale-pytorch/blob/HEAD/mask2former/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2404.08506","paper":"/paper/lasagna-language-based-segmentation-assistant","title":"LaSagnA: Language-based Segmentation Assistant for Complex Queries","date":"2024-04-12","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"congvvc/lasagna","path":"model/LaSagnA.py","file_url":"https://github.com/congvvc/lasagna/blob/HEAD/model/LaSagnA.py","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"a9292f5d89194794","mcp_get_code":{"code_sha256":"a9292f5d89194794"}},{"arxiv_id":"2404.05673","paper":"/paper/cores-orchestrating-the-dance-of-reasoning","title":"CoReS: Orchestrating the Dance of Reasoning and Segmentation","date":"2024-04-08","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":null,"path":"","file_url":null,"status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":null,"inline_ok":false,"code_sha256_prefix":"a9292f5d89194794","mcp_get_code":{"code_sha256":"a9292f5d89194794"}},{"arxiv_id":"2404.03645","paper":"/paper/decoupling-static-and-hierarchical-motion","title":"Decoupling Static and Hierarchical Motion Perception for Referring Video Segmentation","date":"2024-04-04","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"heshuting555/DsHmp","path":"dshmp/modeling/vita_criterion.py","file_url":"https://github.com/heshuting555/DsHmp/blob/HEAD/dshmp/modeling/vita_criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2403.02969","paper":"/paper/multi-modal-instruction-tuned-llms-with-fine","title":"Multi-modal Instruction Tuned LLMs with Fine-grained Visual Perception","date":"2024-03-05","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"jwh97nn/AnyRef","path":"model/anyref.py","file_url":"https://github.com/jwh97nn/AnyRef/blob/HEAD/model/anyref.py","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"a9292f5d89194794","mcp_get_code":{"code_sha256":"a9292f5d89194794"}},{"arxiv_id":"2402.19422","paper":"/paper/pem-prototype-based-efficient-maskformer-for","title":"PEM: Prototype-based Efficient MaskFormer for Image Segmentation","date":"2024-02-29","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"niccolocavagnero/pem","path":"pem/modeling/criterion.py","file_url":"https://github.com/niccolocavagnero/pem/blob/HEAD/pem/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2402.18115","paper":"/paper/univs-unified-and-universal-video","title":"UniVS: Unified and Universal Video Segmentation with Prompts as Queries","date":"2024-02-28","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"minghanli/univs","path":"univs/modeling/video_criterion.py","file_url":"https://github.com/minghanli/univs/blob/HEAD/univs/modeling/video_criterion.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"450b62615caa903a","mcp_get_code":{"code_sha256":"450b62615caa903a"}},{"arxiv_id":"2402.18115","paper":"/paper/univs-unified-and-universal-video","title":"UniVS: Unified and Universal Video Segmentation with Prompts as Queries","date":"2024-02-28","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"minghanli/univs","path":"univs/modeling/video_criterion_prompt.py","file_url":"https://github.com/minghanli/univs/blob/HEAD/univs/modeling/video_criterion_prompt.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"46b849406325dd41","mcp_get_code":{"code_sha256":"46b849406325dd41"}},{"arxiv_id":"2401.10556","paper":"/paper/symbol-as-points-panoptic-symbol-spotting-via","title":"Symbol as Points: Panoptic Symbol Spotting via Point-based Representation","date":"2024-01-19","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"nicehuster/sympoint","path":"svgnet/model/criterion.py","file_url":"https://github.com/nicehuster/sympoint/blob/HEAD/svgnet/model/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2401.10222","paper":"/paper/supervised-fine-tuning-in-turn-improves","title":"Supervised Fine-tuning in turn Improves Visual Foundation Models","date":"2024-01-18","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"tencentarc/visft","path":"mmf/models/visft/segment_criterion.py","file_url":"https://github.com/tencentarc/visft/blob/HEAD/mmf/models/visft/segment_criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2401.02416","paper":"/paper/odin-a-single-model-for-2d-and-3d-perception","title":"ODIN: A Single Model for 2D and 3D Segmentation","date":"2024-01-04","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"ayushjain1144/odin","path":"odin/modeling/criterion.py","file_url":"https://github.com/ayushjain1144/odin/blob/HEAD/odin/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2312.17240","paper":"/paper/an-improved-baseline-for-reasoning","title":"LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model","date":"2023-12-28","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"dvlab-research/lisa","path":"model/LISA.py","file_url":"https://github.com/dvlab-research/lisa/blob/HEAD/model/LISA.py","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"a9292f5d89194794","mcp_get_code":{"code_sha256":"a9292f5d89194794"}},{"arxiv_id":"2312.15715","paper":"/paper/uniref-segment-every-reference-object-in","title":"UniRef++: Segment Every Reference Object in Spatial and Temporal Spaces","date":"2023-12-25","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"foundationvision/uniref","path":"projects/UniRef/uniref/models/uniref_sam.py","file_url":"https://github.com/foundationvision/uniref/blob/HEAD/projects/UniRef/uniref/models/uniref_sam.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"e28a878991e1e696","mcp_get_code":{"code_sha256":"e28a878991e1e696"}},{"arxiv_id":"2312.10103","paper":"/paper/gsva-generalized-segmentation-via-multimodal","title":"GSVA: Generalized Segmentation via Multimodal Large Language Models","date":"2023-12-15","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"leaplabthu/gsva","path":"model/losses.py","file_url":"https://github.com/leaplabthu/gsva/blob/HEAD/model/losses.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"13c0bb91f8009d9c","mcp_get_code":{"code_sha256":"13c0bb91f8009d9c"}},{"arxiv_id":"2312.09788","paper":"/paper/collaborating-foundation-models-for-domain","title":"Collaborating Foundation Models for Domain Generalized Semantic Segmentation","date":"2023-12-15","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"yasserben/clouds","path":"clouds/modeling/criterion.py","file_url":"https://github.com/yasserben/clouds/blob/HEAD/clouds/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2312.09158","paper":"/paper/general-object-foundation-model-for-images","title":"General Object Foundation Model for Images and Videos at Scale","date":"2023-12-14","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"FoundationVision/GLEE","path":"projects/GLEE/glee/models/criterion.py","file_url":"https://github.com/FoundationVision/GLEE/blob/HEAD/projects/GLEE/glee/models/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2312.06630","paper":"/paper/tmt-vis-taxonomy-aware-multi-dataset-joint-1","title":"TMT-VIS: Taxonomy-aware Multi-dataset Joint Training for Video Instance Segmentation","date":"2023-12-11","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"rkzheng99/TMT-VIS","path":"tmt/modeling/tmt_criterion.py","file_url":"https://github.com/rkzheng99/TMT-VIS/blob/HEAD/tmt/modeling/tmt_criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2312.04089","paper":"/paper/open-vocabulary-segmentation-with-semantic","title":"Open-Vocabulary Segmentation with Semantic-Assisted Calibration","date":"2023-12-07","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"workforai/scan","path":"scan/modeling/criterion.py","file_url":"https://github.com/workforai/scan/blob/HEAD/scan/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2312.02228","paper":"/paper/pixellm-pixel-reasoning-with-large-multimodal","title":"PixelLM: Pixel Reasoning with Large Multimodal Model","date":"2023-12-04","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"maverickren/pixellm","path":"model/PixelLM.py","file_url":"https://github.com/maverickren/pixellm/blob/HEAD/model/PixelLM.py","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"a9292f5d89194794","mcp_get_code":{"code_sha256":"a9292f5d89194794"}},{"arxiv_id":"2310.18954","paper":"/paper/mask-propagation-for-efficient-video-semantic-1","title":"Mask Propagation for Efficient Video Semantic Segmentation","date":"2023-10-29","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"ziplab/MPVSS","path":"mask2former/modeling/criterion.py","file_url":"https://github.com/ziplab/MPVSS/blob/HEAD/mask2former/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"NONE","inline_ok":false,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2310.00240","paper":"/paper/learning-mask-aware-clip-representations-for","title":"Learning Mask-aware CLIP Representations for Zero-Shot Segmentation","date":"2023-09-30","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"jiaosiyu1999/MAFT-Plus","path":"maft/modeling/criterion.py","file_url":"https://github.com/jiaosiyu1999/MAFT-Plus/blob/HEAD/maft/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2309.14338","paper":"/paper/3d-indoor-instance-segmentation-in-an-open-1","title":"3D Indoor Instance Segmentation in an Open-World","date":"2023-09-25","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"aminebdj/3D-OWIS","path":"models/criterion.py","file_url":"https://github.com/aminebdj/3D-OWIS/blob/HEAD/models/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2309.12969","paper":"/paper/detect-every-thing-with-few-examples","title":"Detect Everything with Few Examples","date":"2023-09-22","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"mlzxy/devit","path":"detectron2/modeling/meta_arch/devit_update.py","file_url":"https://github.com/mlzxy/devit/blob/HEAD/detectron2/modeling/meta_arch/devit_update.py","status":"ran","verification_level":1,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":true,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"847c0c0c48d84c9e","mcp_get_code":{"code_sha256":"847c0c0c48d84c9e"}},{"arxiv_id":"2308.08544","paper":"/paper/mevis-a-large-scale-benchmark-for-video","title":"MeViS: A Large-scale Benchmark for Video Segmentation with Motion Expressions","date":"2023-08-16","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"henghuiding/MeViS","path":"lmpm/modeling/vita_criterion.py","file_url":"https://github.com/henghuiding/MeViS/blob/HEAD/lmpm/modeling/vita_criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2308.06531","paper":"/paper/segprompt-boosting-open-world-segmentation","title":"SegPrompt: Boosting Open-world Segmentation via Category-level Prompt Learning","date":"2023-08-12","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"aim-uofa/segprompt","path":"mask2former/modeling/criterion.py","file_url":"https://github.com/aim-uofa/segprompt/blob/HEAD/mask2former/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"BSD-2-Clause","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2306.15670","paper":"/paper/symphonize-3d-semantic-scene-completion-with","title":"Symphonize 3D Semantic Scene Completion with Contextual Instance Queries","date":"2023-06-27","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"hustvl/symphonies","path":"maskdino/models/criterion.py","file_url":"https://github.com/hustvl/symphonies/blob/HEAD/maskdino/models/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2306.11087","paper":"/paper/primitive-generation-and-semantic-related-1","title":"Primitive Generation and Semantic-related Alignment for Universal Zero-Shot Segmentation","date":"2023-06-19","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"heshuting555/PADing","path":"PADing/modeling/criterion.py","file_url":"https://github.com/heshuting555/PADing/blob/HEAD/PADing/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2306.09347","paper":"/paper/segment-any-point-cloud-sequences-by","title":"Segment Any Point Cloud Sequences by Distilling Vision Foundation Models","date":"2023-06-15","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"IDEA-Research/OpenSeeD","path":"openseed/modules/criterion.py","file_url":"https://github.com/IDEA-Research/OpenSeeD/blob/HEAD/openseed/modules/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2306.07404","paper":"/paper/compositor-bottom-up-clustering-and-1","title":"Compositor: Bottom-up Clustering and Compositing for Robust Part and Object Segmentation","date":"2023-06-12","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"tacju/compositor","path":"Compositor_Mask2Former/compositor/modeling/criterion.py","file_url":"https://github.com/tacju/compositor/blob/HEAD/Compositor_Mask2Former/compositor/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2306.03437","paper":"/paper/dformer-diffusion-guided-transformer-for","title":"DFormer: Diffusion-guided Transformer for Universal Image Segmentation","date":"2023-06-06","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"cp3wan/dformer","path":"dformer/modeling/criterion.py","file_url":"https://github.com/cp3wan/dformer/blob/HEAD/dformer/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2305.04276","paper":"/paper/adaptiveclick-clicks-aware-transformer-with","title":"AdaptiveClick: Clicks-aware Transformer with Adaptive Focal Loss for Interactive Image Segmentation","date":"2023-05-07","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"lab206/adaptiveclick","path":"isegm/model/criterion.py","file_url":"https://github.com/lab206/adaptiveclick/blob/HEAD/isegm/model/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2303.17386","paper":"/paper/complementary-random-masking-for-rgb-thermal","title":"Complementary Random Masking for RGB-Thermal Semantic Segmentation","date":"2023-03-30","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"UkcheolShin/CRM_RGBTSeg","path":"models/mask2former/criterion.py","file_url":"https://github.com/UkcheolShin/CRM_RGBTSeg/blob/HEAD/models/mask2former/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2303.14651","paper":"/paper/you-only-segment-once-towards-real-time","title":"You Only Segment Once: Towards Real-Time Panoptic Segmentation","date":"2023-03-26","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Darth-Kronos/YOSO_TensorRT","path":"projects/YOSO/yoso/loss.py","file_url":"https://github.com/Darth-Kronos/YOSO_TensorRT/blob/HEAD/projects/YOSO/yoso/loss.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2303.11630","paper":"/paper/boxsnake-polygonal-instance-segmentation-with","title":"BoxSnake: Polygonal Instance Segmentation with Box Supervision","date":"2023-03-21","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"Yangr116/BoxSnake","path":"modeling/box_supervisor/box_supervisor.py","file_url":"https://github.com/Yangr116/BoxSnake/blob/HEAD/modeling/box_supervisor/box_supervisor.py","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"18da425e8ba54fbd","mcp_get_code":{"code_sha256":"18da425e8ba54fbd"}},{"arxiv_id":"2303.08594","paper":"/paper/fastinst-a-simple-query-based-model-for-real","title":"FastInst: A Simple Query-Based Model for Real-Time Instance Segmentation","date":"2023-03-15","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"junjiehe96/fastinst","path":"fastinst/modeling/criterion.py","file_url":"https://github.com/junjiehe96/fastinst/blob/HEAD/fastinst/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"a2b19dbf3e1969b9","mcp_get_code":{"code_sha256":"a2b19dbf3e1969b9"}},{"arxiv_id":"2302.12242","paper":"/paper/side-adapter-network-for-open-vocabulary","title":"Side Adapter Network for Open-Vocabulary Semantic Segmentation","date":"2023-02-23","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"blumenstiel/SAN-MESS","path":"san/model/criterion.py","file_url":"https://github.com/blumenstiel/SAN-MESS/blob/HEAD/san/model/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2211.06220","paper":"/paper/oneformer-one-transformer-to-rule-universal","title":"OneFormer: One Transformer to Rule Universal Image Segmentation","date":"2022-11-10","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"SHI-Labs/OneFormer","path":"oneformer/modeling/criterion.py","file_url":"https://github.com/SHI-Labs/OneFormer/blob/HEAD/oneformer/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"dc4a40c394479bd8","mcp_get_code":{"code_sha256":"dc4a40c394479bd8"}},{"arxiv_id":"2210.03105","paper":"/paper/mask3d-for-3d-semantic-instance-segmentation","title":"Mask3D: Mask Transformer for 3D Semantic Instance Segmentation","date":"2022-10-06","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"jonasschult/mask3d","path":"models/criterion.py","file_url":"https://github.com/jonasschult/mask3d/blob/HEAD/models/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2206.04403","paper":"/paper/vita-video-instance-segmentation-via-object","title":"VITA: Video Instance Segmentation via Object Token Association","date":"2022-06-09","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"sukjunhwang/vita","path":"vita/modeling/vita_criterion.py","file_url":"https://github.com/sukjunhwang/vita/blob/HEAD/vita/modeling/vita_criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2203.04187","paper":"/paper/mlseg-image-and-video-segmentation-as-multi","title":"RankSeg: Adaptive Pixel Classification with Image Category Ranking for Segmentation","date":"2022-03-08","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"facebookresearch/Mask2Former","path":"mask2former/modeling/criterion.py","file_url":"https://github.com/facebookresearch/Mask2Former/blob/HEAD/mask2former/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2203.03605","paper":"/paper/dino-detr-with-improved-denoising-anchor-1","title":"DINO: DETR with Improved DeNoising Anchor Boxes for End-to-End Object Detection","date":"2022-03-07","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"IDEACVR/MaskDINO","path":"maskdino/modeling/criterion.py","file_url":"https://github.com/IDEACVR/MaskDINO/blob/HEAD/maskdino/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2112.10764","paper":"/paper/mask2former-for-video-instance-segmentation","title":"Mask2Former for Video Instance Segmentation","date":"2021-12-20","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"nihalsid/mask2former","path":"mask2former/modeling/criterion.py","file_url":"https://github.com/nihalsid/mask2former/blob/HEAD/mask2former/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"2112.01527","paper":"/paper/masked-attention-mask-transformer-for","title":"Masked-attention Mask Transformer for Universal Image Segmentation","date":"2021-12-02","month_inferred_from_arxiv_id":null,"title_source":"archive","repo":"DdeGeus/Mask2Former-IBS","path":"mask2former/modeling/criterion.py","file_url":"https://github.com/DdeGeus/Mask2Former-IBS/blob/HEAD/mask2former/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"aaai_27844","paper":null,"title":"arXiv:aaai_27844","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"retsuh-bqw/SRFormer-Text-Det","path":"adet/modeling/srformer/matcher.py","file_url":"https://github.com/retsuh-bqw/SRFormer-Text-Det/blob/HEAD/adet/modeling/srformer/matcher.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"641305cea54a6936","mcp_get_code":{"code_sha256":"641305cea54a6936"}},{"arxiv_id":"Zhou_LIRA_Reasoning_Reconstruction_via_Multimodal_Large_Language_Models_ICCV_2025_paper","paper":null,"title":"arXiv:Zhou_LIRA_Reasoning_Reconstruction_via_Multimodal_Large_Language_Models_ICCV_2025_paper","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"zhen6618/LIRA","path":"LIRA/models/LISA.py","file_url":"https://github.com/zhen6618/LIRA/blob/HEAD/LIRA/models/LISA.py","status":"ran_fixture","verification_level":1,"contract_check":"RAISES","metamorphic_tier":"invariant","behaviour_fingerprint":true,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"a9292f5d89194794","mcp_get_code":{"code_sha256":"a9292f5d89194794"}},{"arxiv_id":"Zhang_Uni-3D_A_Universal_Model_for_Panoptic_3D_Scene_Reconstruction_ICCV_2023_paper","paper":null,"title":"arXiv:Zhang_Uni-3D_A_Universal_Model_for_Panoptic_3D_Scene_Reconstruction_ICCV_2023_paper","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"mlpc-ucsd/Uni-3D","path":"uni_3d/modeling/criterion.py","file_url":"https://github.com/mlpc-ucsd/Uni-3D/blob/HEAD/uni_3d/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"Zhang_FreePoint_Unsupervised_Point_Cloud_Instance_Segmentation_CVPR_2024_paper","paper":null,"title":"arXiv:Zhang_FreePoint_Unsupervised_Point_Cloud_Instance_Segmentation_CVPR_2024_paper","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"zzk273/FreePoint","path":"models/criterion_freepoint.py","file_url":"https://github.com/zzk273/FreePoint/blob/HEAD/models/criterion_freepoint.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"Xia_GSVA_Generalized_Segmentation_via_Multimodal_Large_Language_Models_CVPR_2024_paper","paper":null,"title":"arXiv:Xia_GSVA_Generalized_Segmentation_via_Multimodal_Large_Language_Models_CVPR_2024_paper","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"LeapLabTHU/GSVA","path":"model/losses.py","file_url":"https://github.com/LeapLabTHU/GSVA/blob/HEAD/model/losses.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"13c0bb91f8009d9c","mcp_get_code":{"code_sha256":"13c0bb91f8009d9c"}},{"arxiv_id":"Qian_Reasoning_to_Attend_Try_to_Understand_How_SEG_Token_Works_CVPR_2025_paper","paper":null,"title":"arXiv:Qian_Reasoning_to_Attend_Try_to_Understand_How_SEG_Token_Works_CVPR_2025_paper","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"rui-qian/READ","path":"model/READ.py","file_url":"https://github.com/rui-qian/READ/blob/HEAD/model/READ.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"MIT","inline_ok":true,"code_sha256_prefix":"3face96ac23ae5bc","mcp_get_code":{"code_sha256":"3face96ac23ae5bc"}},{"arxiv_id":"Li_Mask_DINO_Towards_a_Unified_Transformer-Based_Framework_for_Object_Detection_CVPR_2023_paper","paper":null,"title":"arXiv:Li_Mask_DINO_Towards_a_Unified_Transformer-Based_Framework_for_Object_Detection_CVPR_2023_paper","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"IDEA-Research/MaskDINO","path":"maskdino/modeling/criterion.py","file_url":"https://github.com/IDEA-Research/MaskDINO/blob/HEAD/maskdino/modeling/criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}},{"arxiv_id":"Heo_A_Generalized_Framework_for_Video_Instance_Segmentation_CVPR_2023_paper","paper":null,"title":"arXiv:Heo_A_Generalized_Framework_for_Video_Instance_Segmentation_CVPR_2023_paper","date":null,"month_inferred_from_arxiv_id":null,"title_source":null,"repo":"miranheo/GenVIS","path":"genvis/modeling/genvis_criterion.py","file_url":"https://github.com/miranheo/GenVIS/blob/HEAD/genvis/modeling/genvis_criterion.py","status":"unverified","verification_level":0,"contract_check":null,"metamorphic_tier":null,"behaviour_fingerprint":false,"licence":"Apache-2.0","inline_ok":true,"code_sha256_prefix":"d0c61e8dba511aa3","mcp_get_code":{"code_sha256":"d0c61e8dba511aa3"}}]}