{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/referring-expression/papers/3","list_of":"/task/referring-expression","task":"Referring Expression","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":3,"pages_in_order":4,"rows_per_page":100,"rows":[201,300],"of":364,"counts":{"archive_papers_tagged":364,"with_a_code_link":166,"where_syntology_ran_a_sample":57,"not_listed_spam_title":0,"listed":364,"listed_where_code_ran":57,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":51,"every_run_a_failure_of_syntologys_instrument":6,"listed_with_a_run_with_no_instrument_failure":51,"listed_every_run_a_failure_of_syntologys_instrument":6,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/referring-expression","prev":"/task/referring-expression/papers/2","next":"/task/referring-expression/papers/4","papers":[{"url":null,"slug":"the-solution-for-the-5th-gcaiac-zero-shot","title":"The Solution for the 5th GCAIAC Zero-shot Referring Expression Comprehension Challenge","date":"2024-07-06","arxiv_id":"2407.04998","repositories_listed":0,"syntology":null},{"url":"/paper/safari-adaptive-sequence-transformer-for","slug":"safari-adaptive-sequence-transformer-for","title":"SafaRi:Adaptive Sequence Transformer for Weakly Supervised Referring Expression Segmentation","date":"2024-07-02","arxiv_id":"2407.02389","repositories_listed":0,"syntology":null},{"url":null,"slug":"m-2-ist-multi-modal-interactive-side-tuning","title":"M$^2$IST: Multi-Modal Interactive Side-Tuning for Efficient Referring Expression Comprehension","date":"2024-07-01","arxiv_id":"2407.01131","repositories_listed":0,"syntology":null},{"url":null,"slug":"segment-anything-model-for-automated-image","title":"Segment Anything Model for automated image data annotation: empirical studies using text prompts from Grounding DINO","date":"2024-06-27","arxiv_id":"2406.19057","repositories_listed":0,"syntology":null},{"url":null,"slug":"scanformer-referring-expression-comprehension-1","title":"ScanFormer: Referring Expression Comprehension by Iteratively Scanning","date":"2024-06-26","arxiv_id":"2406.18048","repositories_listed":0,"syntology":null},{"url":null,"slug":"goi-find-3d-gaussians-of-interest-with-an","title":"GOI: Find 3D Gaussians of Interest with an Optimizable Open-vocabulary Semantic-space Hyperplane","date":"2024-05-27","arxiv_id":"2405.17596","repositories_listed":0,"syntology":null},{"url":null,"slug":"transcrib3d-3d-referring-expression","title":"Transcrib3D: 3D Referring Expression Resolution through Large Language Models","date":"2024-04-30","arxiv_id":"2404.19221","repositories_listed":0,"syntology":null},{"url":null,"slug":"text-driven-affordance-learning-from","title":"Text-driven Affordance Learning from Egocentric Vision","date":"2024-04-03","arxiv_id":"2404.02523","repositories_listed":0,"syntology":null},{"url":null,"slug":"sugar-pre-training-3d-visual-representations","title":"SUGAR: Pre-training 3D Visual Representations for Robotics","date":"2024-04-01","arxiv_id":"2404.01491","repositories_listed":0,"syntology":null},{"url":null,"slug":"proptest-automatic-property-testing-for","title":"PropTest: Automatic Property Testing for Improved Visual Programming","date":"2024-03-25","arxiv_id":"2403.16921","repositories_listed":0,"syntology":null},{"url":null,"slug":"watervg-waterway-visual-grounding-based-on","title":"WaterVG: Waterway Visual Grounding based on Text-Guided Vision and mmWave Radar","date":"2024-03-19","arxiv_id":"2403.12686","repositories_listed":0,"syntology":null},{"url":null,"slug":"contrastive-region-guidance-improving","title":"Contrastive Region Guidance: Improving Grounding in Vision-Language Models without Training","date":"2024-03-04","arxiv_id":"2403.02325","repositories_listed":0,"syntology":null},{"url":null,"slug":"intrinsic-task-based-evaluation-for-referring","title":"Intrinsic Task-based Evaluation for Referring Expression Generation","date":"2024-02-12","arxiv_id":"2402.07432","repositories_listed":0,"syntology":null},{"url":null,"slug":"resmatch-referring-expression-segmentation-in","title":"RESMatch: Referring Expression Segmentation in a Semi-Supervised Manner","date":"2024-02-08","arxiv_id":"2402.05589","repositories_listed":0,"syntology":null},{"url":null,"slug":"generalizable-entity-grounding-via-assistance","title":"Generalizable Entity Grounding via Assistance of Large Language Model","date":"2024-02-04","arxiv_id":"2402.02555","repositories_listed":0,"syntology":null},{"url":null,"slug":"viewpoint-aware-visual-grounding-in-3d-scenes","title":"Viewpoint-Aware Visual Grounding in 3D Scenes","date":"2024-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"compositional-zero-shot-learning-for","title":"Compositional Zero-Shot Learning for Attribute-Based Object Reference in Human-Robot Interaction","date":"2023-12-21","arxiv_id":"2312.13655","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-pseudo-labeler-beyond-noun-concepts","title":"Learning Pseudo-Labeler beyond Noun Concepts for Open-Vocabulary Object Detection","date":"2023-12-04","arxiv_id":"2312.02103","repositories_listed":0,"syntology":null},{"url":null,"slug":"instructseq-unifying-vision-tasks-with","title":"InstructSeq: Unifying Vision Tasks with Instruction-conditioned Multi-modal Sequence Generation","date":"2023-11-30","arxiv_id":"2311.18835","repositories_listed":0,"syntology":null},{"url":null,"slug":"vilam-a-vision-language-model-with-enhanced","title":"Enhancing Visual Grounding and Generalization: A Multi-Task Cycle Training Approach for Vision-Language Models","date":"2023-11-21","arxiv_id":"2311.12327","repositories_listed":0,"syntology":null},{"url":null,"slug":"covlm-composing-visual-entities-and","title":"CoVLM: Composing Visual Entities and Relationships in Large Language Models Via Communicative Decoding","date":"2023-11-06","arxiv_id":"2311.03354","repositories_listed":0,"syntology":null},{"url":null,"slug":"text-augmented-spatial-aware-zero-shot","title":"Text Augmented Spatial-aware Zero-shot Referring Image Segmentation","date":"2023-10-27","arxiv_id":"2310.18049","repositories_listed":0,"syntology":null},{"url":null,"slug":"video-referring-expression-comprehension-via-1","title":"Video Referring Expression Comprehension via Transformer with Content-conditioned Query","date":"2023-10-25","arxiv_id":"2310.16402","repositories_listed":0,"syntology":null},{"url":null,"slug":"multi-modal-domain-adaptation-for-reg-via","title":"Multi-modal Domain Adaptation for REG via Relation Transfer","date":"2023-09-23","arxiv_id":"2309.13247","repositories_listed":0,"syntology":null},{"url":null,"slug":"clipunetr-assisting-human-robot-interface-for","title":"CLIPUNetr: Assisting Human-robot Interface for Uncalibrated Visual Servoing Control with CLIP-driven Referring Expression Segmentation","date":"2023-09-17","arxiv_id":"2309.09183","repositories_listed":0,"syntology":null},{"url":null,"slug":"switching-head-tail-funnel-uniter-for-dual","title":"Switching Head-Tail Funnel UNITER for Dual Referring Expression Comprehension with Fetch-and-Carry Tasks","date":"2023-07-14","arxiv_id":"2307.07166","repositories_listed":0,"syntology":null},{"url":null,"slug":"switch-bert-learning-to-model-multimodal","title":"Switch-BERT: Learning to Model Multimodal Interactions by Switching Attention and Input","date":"2023-06-25","arxiv_id":"2306.14182","repositories_listed":0,"syntology":null},{"url":null,"slug":"disclip-open-vocabulary-referring-expression","title":"DisCLIP: Open-Vocabulary Referring Expression Generation","date":"2023-05-30","arxiv_id":"2305.19108","repositories_listed":0,"syntology":null},{"url":null,"slug":"language-guided-3d-object-detection-in-point","title":"Language-Guided 3D Object Detection in Point Cloud for Autonomous Driving","date":"2023-05-25","arxiv_id":"2305.15765","repositories_listed":0,"syntology":null},{"url":null,"slug":"meta-compositional-referring-expression","title":"Meta Compositional Referring Expression Segmentation","date":"2023-04-10","arxiv_id":"2304.04415","repositories_listed":0,"syntology":null},{"url":null,"slug":"dynamic-inference-with-grounding-based-vision","title":"Dynamic Inference With Grounding Based Vision and Language Models","date":"2023-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"refclip-a-universal-teacher-for-weakly","title":"RefCLIP: A Universal Teacher for Weakly Supervised Referring Expression Comprehension","date":"2023-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"refteacher-a-strong-baseline-for-semi","title":"RefTeacher: A Strong Baseline for Semi-Supervised Referring Expression Comprehension","date":"2023-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"fully-and-weakly-supervised-referring","title":"Fully and Weakly Supervised Referring Expression Segmentation with End-to-End Learning","date":"2022-12-17","arxiv_id":"2212.10278","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-unified-mutual-supervision-framework-for","title":"A Unified Mutual Supervision Framework for Referring Expression Segmentation and Generation","date":"2022-11-15","arxiv_id":"2211.07919","repositories_listed":0,"syntology":null},{"url":null,"slug":"assessing-neural-referential-form-selectors","title":"Assessing Neural Referential Form Selectors on a Realistic Multilingual Dataset","date":"2022-10-10","arxiv_id":"2210.04828","repositories_listed":0,"syntology":null},{"url":null,"slug":"video-referring-expression-comprehension-via","title":"Video Referring Expression Comprehension via Transformer with Content-aware Query","date":"2022-10-06","arxiv_id":"2210.02953","repositories_listed":0,"syntology":null},{"url":null,"slug":"one-for-all-one-stage-referring-expression","title":"One for All: One-stage Referring Expression Comprehension with Dynamic Reasoning","date":"2022-07-31","arxiv_id":"2208.00361","repositories_listed":0,"syntology":null},{"url":"/paper/unified-io-a-unified-model-for-vision","slug":"unified-io-a-unified-model-for-vision","title":"Unified-IO: A Unified Model for Vision, Language, and Multi-Modal Tasks","date":"2022-06-17","arxiv_id":"2206.08916","repositories_listed":0,"syntology":null},{"url":null,"slug":"refcrowd-grounding-the-target-in-crowd-with","title":"RefCrowd: Grounding the Target in Crowd with Referring Expressions","date":"2022-06-16","arxiv_id":"2206.08172","repositories_listed":0,"syntology":null},{"url":null,"slug":"constructing-distributions-of-variation-in","title":"Constructing Distributions of Variation in Referring Expression Type from Corpora for Model Evaluation","date":"2022-06-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"referring-expressions-with-rational-speech","title":"Referring Expressions with Rational Speech Act Framework: A Probabilistic Approach","date":"2022-05-16","arxiv_id":"2205.07795","repositories_listed":0,"syntology":null},{"url":null,"slug":"weakly-supervised-segmentation-of-referring","title":"Weakly-supervised segmentation of referring expressions","date":"2022-05-10","arxiv_id":"2205.04725","repositories_listed":0,"syntology":null},{"url":null,"slug":"holm-hallucinating-objects-with-language","title":"HOLM: Hallucinating Objects with Language Models for Referring Expression Recognition in Partially-Observed Scenes","date":"2022-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"referring-expression-comprehension-via-cross","title":"Self-paced Multi-grained Cross-modal Interaction Modeling for Referring Expression Comprehension","date":"2022-04-21","arxiv_id":"2204.09957","repositories_listed":0,"syntology":null},{"url":null,"slug":"findit-generalized-localization-with-natural","title":"FindIt: Generalized Localization with Natural Language Queries","date":"2022-03-31","arxiv_id":"2203.17273","repositories_listed":0,"syntology":null},{"url":null,"slug":"non-neural-models-matter-a-re-evaluation-of","title":"Non-neural Models Matter: A Re-evaluation of Neural Referring Expression Generation Systems","date":"2022-03-15","arxiv_id":"2203.08274","repositories_listed":0,"syntology":null},{"url":null,"slug":"differentiated-relevances-embedding-for-group","title":"Differentiated Relevances Embedding for Group-based Referring Expression Comprehension","date":"2022-03-12","arxiv_id":"2203.06382","repositories_listed":0,"syntology":null},{"url":null,"slug":"unpaired-referring-expression-grounding-via","title":"Unpaired Referring Expression Grounding via Bidirectional Cross-Modal Matching","date":"2022-01-18","arxiv_id":"2201.06686","repositories_listed":0,"syntology":null},{"url":null,"slug":"lite-mdetr-a-lightweight-multi-modal-detector","title":"Lite-MDETR: A Lightweight Multi-Modal Detector","date":"2022-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"deconfounded-visual-grounding","title":"Deconfounded Visual Grounding","date":"2021-12-31","arxiv_id":"2112.15324","repositories_listed":0,"syntology":null},{"url":null,"slug":"robust-visual-reasoning-via-language-guided","title":"Robust Visual Reasoning via Language Guided Neural Module Networks","date":"2021-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"using-referring-expression-generation-to","title":"Using Referring Expression Generation to Model Literary Style","date":"2021-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"reclip-a-strong-zero-shot-baseline-for","title":"ReCLIP: A Strong Zero-Shot Baseline for Referring Expression Comprehension","date":"2021-11-16","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"the-pipeline-model-for-resolution-of","title":"The Pipeline Model for Resolution of Anaphoric Reference and Resolution of Entity Reference","date":"2021-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"come-again-re-query-in-referring-expression","title":"Evaluating and Improving Interactions with Hazy Oracles","date":"2021-10-19","arxiv_id":"2110.10206","repositories_listed":0,"syntology":null},{"url":null,"slug":"decoupling-pragmatics-discriminative-decoding","title":"Decoupling Pragmatics: Discriminative Decoding for Referring Expression Generation","date":"2021-10-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"goal-driven-text-descriptions-for-images","title":"Goal-driven text descriptions for images","date":"2021-08-28","arxiv_id":"2108.12575","repositories_listed":0,"syntology":null},{"url":null,"slug":"what-can-neural-referential-form-selectors","title":"What can Neural Referential Form Selectors Learn?","date":"2021-08-15","arxiv_id":"2108.06806","repositories_listed":0,"syntology":null},{"url":null,"slug":"vln-bert-a-recurrent-vision-and-language-bert","title":"VLN BERT: A Recurrent Vision-and-Language BERT for Navigation","date":"2021-06-19","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"bridging-the-gap-between-object-detection-and","title":"Bridging the Gap Between Object Detection and User Intent via Query-Modulation","date":"2021-06-18","arxiv_id":"2106.10258","repositories_listed":0,"syntology":null},{"url":null,"slug":"vl-nms-breaking-proposal-bottlenecks-in-two","title":"VL-NMS: Breaking Proposal Bottlenecks in Two-Stage Visual-Language Matching","date":"2021-05-12","arxiv_id":"2105.05636","repositories_listed":0,"syntology":null},{"url":null,"slug":"proposal-free-one-stage-referring-expression","title":"Proposal-free One-stage Referring Expression via Grid-Word Cross-Attention","date":"2021-05-05","arxiv_id":"2105.02061","repositories_listed":0,"syntology":null},{"url":null,"slug":"playing-lottery-tickets-with-vision-and","title":"Playing Lottery Tickets with Vision and Language","date":"2021-04-23","arxiv_id":"2104.11832","repositories_listed":0,"syntology":null},{"url":null,"slug":"perspective-corrected-spatial-referring","title":"Perspective-corrected Spatial Referring Expression Generation for Human-Robot Interaction","date":"2021-04-04","arxiv_id":"2104.01558","repositories_listed":0,"syntology":null},{"url":null,"slug":"scene-intuitive-agent-for-remote-embodied","title":"Scene-Intuitive Agent for Remote Embodied Visual Grounding","date":"2021-03-24","arxiv_id":"2103.12944","repositories_listed":0,"syntology":null},{"url":null,"slug":"co-grounding-networks-with-semantic-attention","title":"Co-Grounding Networks with Semantic Attention for Referring Expression Comprehension in Videos","date":"2021-03-23","arxiv_id":"2103.12346","repositories_listed":0,"syntology":null},{"url":"/paper/referring-segmentation-in-images-and-videos","slug":"referring-segmentation-in-images-and-videos","title":"Referring Segmentation in Images and Videos with Cross-Modal Self-Attention Network","date":"2021-02-09","arxiv_id":"2102.04762","repositories_listed":0,"syntology":null},{"url":null,"slug":"visual-question-answering-based-on-local","title":"Visual Question Answering based on Local-Scene-Aware Referring Expression Generation","date":"2021-01-22","arxiv_id":"2101.08978","repositories_listed":0,"syntology":null},{"url":null,"slug":"language-controls-more-than-top-down","title":"Language Controls More Than Top-Down Attention: Modulating Bottom-Up Visual Processing with Referring Expressions","date":"2021-01-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"language-mediated-object-centric-1","title":"Language-Mediated, Object-Centric Representation Learning","date":"2020-12-31","arxiv_id":"2012.15814","repositories_listed":0,"syntology":null},{"url":null,"slug":"ppgn-phrase-guided-proposal-generation","title":"PPGN: Phrase-Guided Proposal Generation Network For Referring Expression Comprehension","date":"2020-12-20","arxiv_id":"2012.10890","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-linguistic-perspective-on-reference","title":"A Linguistic Perspective on Reference: Choosing a Feature Set for Generating Referring Expressions in Context","date":"2020-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"conan-a-complementary-neighboring-based","title":"CoNAN: A Complementary Neighboring-based Attention Network for Referring Expression Generation","date":"2020-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"generating-quantified-referring-expressions-1","title":"Generating Quantified Referring Expressions through Attention-Driven Incremental Perception","date":"2020-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-the-naturalness-and-diversity-of","title":"Improving the Naturalness and Diversity of Referring Expression Generation models using Minimum Risk Training","date":"2020-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"omega-a-probabilistic-approach-to-referring","title":"OMEGA : A probabilistic approach to referring expression generation in a virtual environment","date":"2020-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"referring-to-what-you-know-and-do-not-know","title":"Referring to what you know and do not know: Making Referring Expression Generation Models Generalize To Unseen Entities","date":"2020-12-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"modular-graph-attention-network-for-complex","title":"Modular Graph Attention Network for Complex Visual Relational Reasoning","date":"2020-11-22","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":"/paper/arramon-a-joint-navigation-assembly","slug":"arramon-a-joint-navigation-assembly","title":"ArraMon: A Joint Navigation-Assembly Instruction Interpretation Task in Dynamic Environments","date":"2020-11-15","arxiv_id":"2011.07660","repositories_listed":0,"syntology":null},{"url":null,"slug":"lessons-from-computational-modelling-of","title":"Lessons from Computational Modelling of Reference Production in Mandarin and English","date":"2020-11-14","arxiv_id":"2011.07398","repositories_listed":0,"syntology":null},{"url":null,"slug":"utilizing-every-image-object-for-semi","title":"Utilizing Every Image Object for Semi-supervised Phrase Grounding","date":"2020-11-05","arxiv_id":"2011.02655","repositories_listed":0,"syntology":null},{"url":null,"slug":"computational-interpretations-of-recency-for","title":"Computational Interpretations of Recency for the Choice of Referring Expressions in Discourse","date":"2020-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-to-represent-image-and-text-with","title":"Learning to Represent Image and Text with Denotation Graph","date":"2020-10-06","arxiv_id":"2010.02949","repositories_listed":0,"syntology":null},{"url":null,"slug":"fuzzy-logic-for-vagueness-management-in","title":"Fuzzy Logic for Vagueness Management in Referring Expression Generation","date":"2020-09-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"referring-expression-comprehension-a-survey","title":"Referring Expression Comprehension: A Survey of Methods and Datasets","date":"2020-07-19","arxiv_id":"2007.09554","repositories_listed":0,"syntology":null},{"url":null,"slug":"toward-forgetting-sensitive-referring","title":"Toward Forgetting-Sensitive Referring Expression Generationfor Integrated Robot Architectures","date":"2020-07-16","arxiv_id":"2007.08672","repositories_listed":0,"syntology":null},{"url":null,"slug":"magnet-multi-region-attention-assisted","title":"MAGNet: Multi-Region Attention-Assisted Grounding of Natural Language Queries at Phrase Level","date":"2020-06-06","arxiv_id":"2006.03776","repositories_listed":0,"syntology":null},{"url":"/paper/bi-directional-relationship-inferring-network","slug":"bi-directional-relationship-inferring-network","title":"Bi-Directional Relationship Inferring Network for Referring Image Segmentation","date":"2020-06-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"informativity-in-image-captions-vs-referring","title":"Informativity in Image Captions vs. Referring Expressions","date":"2020-06-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"leveraging-non-specialists-for-accurate-and","title":"Leveraging Non-Specialists for Accurate and Time Efficient AMR Annotation","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"mudoco-corpus-for-multidomain-coreference","title":"MuDoCo: Corpus for Multidomain Coreference Resolution and Referring Expression Generation","date":"2020-05-01","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"referring-image-segmentation-by-generative","title":"Referring Image Segmentation by Generative Adversarial Learning","date":"2020-04-20","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"mutatt-visual-textual-mutual-guidance-for","title":"MUTATT: Visual-Textual Mutual Guidance for Referring Expression Comprehension","date":"2020-03-18","arxiv_id":"2003.08027","repositories_listed":0,"syntology":null},{"url":"/paper/cops-ref-a-new-dataset-and-task-on","slug":"cops-ref-a-new-dataset-and-task-on","title":"Cops-Ref: A new Dataset and Task on Compositional Referring Expression Comprehension","date":"2020-03-01","arxiv_id":"2003.00403","repositories_listed":0,"syntology":null},{"url":null,"slug":"on-the-general-value-of-evidence-and","title":"On the General Value of Evidence, and Bilingual Scene-Text Visual Question Answering","date":"2020-02-24","arxiv_id":"2002.10215","repositories_listed":0,"syntology":null},{"url":null,"slug":"dual-convolutional-lstm-network-for-referring","title":"Dual Convolutional LSTM Network for Referring Image Segmentation","date":"2020-01-30","arxiv_id":"2001.11561","repositories_listed":0,"syntology":null},{"url":null,"slug":"recurrent-instance-segmentation-using","title":"Recurrent Instance Segmentation using Sequences of Referring Expressions","date":"2019-11-05","arxiv_id":"1911.02103","repositories_listed":0,"syntology":null},{"url":null,"slug":"remi-mining-intuitive-referring-expressions","title":"REMI: Mining Intuitive Referring Expressions on Knowledge Bases","date":"2019-11-04","arxiv_id":"1911.01157","repositories_listed":0,"syntology":null},{"url":null,"slug":"leveraging-past-references-for-robust","title":"Leveraging Past References for Robust Language Grounding","date":"2019-11-01","arxiv_id":null,"repositories_listed":0,"syntology":null}],"record_sha256":"4683fb02ad9c6ad3f348272e35ee9ba46dc2c156eb1419dc6ef064a2be3ccec7","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}