Browse State-of-the-Art › Image Captioning › Papers, page 14
Image Captioning
Papers archive 2025-07-28
archive papers tagged: 1,878 · with a code link: 774 · where Syntology ran a sample: 243 (201 with a run with no instrument failure, 42 where every run was a failure of Syntology's instrument) Syntology
Show: all tagged papersonly where code ran (243 of 1,878 tagged: 201 with a run with no instrument failure, 42 where every run was a failure of Syntology's instrument)
Page 14 of 19: papers 1,301 to 1,400 of 1,878, in archive order: by repositories listed in the archive (most first), then newest first, not by stars (the archive holds no stars, so PwC's “Social” and “Latest” sorts cannot be reproduced). Papers that list no repository come after every paper that lists one.
Papers without a page here are shown as plain text. A Syntology line reads “N ran (of which C constructed an object rather than computing a result; K with no instrument failure: H honoured, V violated, P with no contract checked; I where Syntology's instrument failed) · U unverified”; the figure “where Syntology's instrument failed” counts failures of Syntology's instrument, not of the code. When the archive marks a repository official for the paper, the line starts with that repository's state (the archive's flag, not a verdict on who wrote the code); hover it for the repositories the samples that ran came from. Abstracts are on each paper's page.
-
Describing image focused in cognitive and visual details for visually impaired people: An approach to generating inclusive paragraphs10 Feb 2022 0 repositories listed
-
Deep Learning Approaches on Image Captioning: A Review31 Jan 2022 0 repositories listed
-
A Frustratingly Simple Approach for End-to-End Image Captioning30 Jan 2022 0 repositories listed
-
An Integrated Approach for Video Captioning and Applications23 Jan 2022 0 repositories listed
-
Discovering Non-Monotonic Autoregressive Ordering for Text Generation Models using Sinkhorn Distributions17 Jan 2022 0 repositories listed
-
All You May Need for VQA are Image Captions16 Jan 2022 0 repositories listed
-
Bidimensional Leaderboards: Generate and Evaluate Language Hand in Hand16 Jan 2022 0 repositories listed
-
Crossmodal-3600: A Massively Multilingual Multimodal Evaluation Dataset16 Jan 2022 0 repositories listed
-
Long-Tail Classification for Distinctive Image Captioning: A Simple yet Effective Remedy for Side Effects of Reinforcement Learning16 Jan 2022 0 repositories listed
-
Transparent Human Evaluation for Image Captioning16 Jan 2022 0 repositories listed
-
Uni-EDEN: Universal Encoder-Decoder Network by Multi-Granular Vision-Language Pre-training11 Jan 2022 0 repositories listed
-
Repurposing Existing Deep Networks for Caption and Aesthetic-Guided Image Cropping7 Jan 2022 0 repositories listed
-
Synthesizer Based Efficient Self-Attention for Vision Tasks5 Jan 2022 0 repositories listed
-
Interactive Attention AI to translate low light photos to captions for night scene understanding in women safety4 Jan 2022 0 repositories listed
-
StyleM: Stylized Metrics for Image Captioning Built with Contrastive N-grams4 Jan 2022 0 repositories listed
-
DIFNet: Boosting Visual Information Flow for Image Captioning1 Jan 2022 0 repositories listed
-
Knowledge Matters: Radiology Report Generation with General and Specific Knowledge30 Dec 2021 0 repositories listed
-
Extended Self-Critical Pipeline for Transforming Videos to Text (TRECVID-VTT Task 2021) -- Team: MMCUniAugsburg28 Dec 2021 0 repositories listed
-
Synchronized Audio-Visual Frames with Fractional Positional Encoding for Transformers in Video-to-Text Translation28 Dec 2021 0 repositories listed
-
A Fistful of Words: Learning Transferable Visual Models from Bag-of-Words Supervision27 Dec 2021 0 repositories listed
-
MAGIC: Multimodal relAtional Graph adversarIal inferenCe for Diverse and Unpaired Text-based Image Captioning13 Dec 2021 0 repositories listed
-
Consensus Graph Representation Learning for Better Grounded Image Captioning2 Dec 2021 0 repositories listed
-
A Scaled Encoder Decoder Network for Image Captioning in Hindi1 Dec 2021 0 repositories listed
-
Image Caption Generation Framework for Assamese News using Attention Mechanism1 Dec 2021 0 repositories listed
-
Neural Attention for Image Captioning: Review of Outstanding Methods29 Nov 2021 0 repositories listed
-
Scene Graph Generation with Geometric Context25 Nov 2021 0 repositories listed
-
24 Nov 2021 0 repositories listed
-
Generating More Pertinent Captions by Leveraging Semantics and Style on Multi-Source Datasets24 Nov 2021 0 repositories listed
-
UFO: A UniFied TransfOrmer for Vision-Language Representation Learning19 Nov 2021 0 repositories listed
-
Challenges in Region-Specific Image Captioning: A Deep Learning Approach16 Nov 2021 0 repositories listed
-
16 Nov 2021 0 repositories listed
-
Leveraging Visual Knowledge in Language Tasks: An Empirical Study on Intermediate Pre-training for Cross-Modal Knowledge Transfer16 Nov 2021 0 repositories listed
-
Multimodal Learning: Are Captions All You Need?16 Nov 2021 0 repositories listed
-
On Vision Features in Multimodal Machine Translation16 Nov 2021 0 repositories listed
-
Temporal Knowledge-Aware Image Captioning16 Nov 2021 0 repositories listed
-
Retrieval, Analogy, and Composition: A framework for Compositional Generalization in Image Captioning1 Nov 2021 0 repositories listed
-
“Wikily” Supervised Neural Translation Tailored to Cross-Lingual Tasks1 Nov 2021 0 repositories listed
-
Exploiting Cross-Modal Prediction and Relation Consistency for Semi-Supervised Image Captioning22 Oct 2021 0 repositories listed
-
A Self-Explainable Stylish Image Captioning Framework via Multi-References20 Oct 2021 0 repositories listed
-
Self-Annotated Training for Controllable Image Captioning16 Oct 2021 0 repositories listed
-
Is An Image Worth Five Sentences? A New Look into Semantics for Image-Text Matching6 Oct 2021 0 repositories listed
-
Learning Structural Representations for Recipe Generation and Food Retrieval4 Oct 2021 0 repositories listed
-
Decoupling Pragmatics: Discriminative Decoding for Referring Expression Generation1 Oct 2021 0 repositories listed
-
Geometry-Entangled Visual Semantic Transformer for Image Captioning29 Sep 2021 0 repositories listed
-
Google Neural Network Models for Edge Devices: Analyzing and Mitigating Machine Learning Inference Bottlenecks29 Sep 2021 0 repositories listed
-
Learning Visual-Linguistic Adequacy, Fidelity, and Fluency for Novel Object Captioning29 Sep 2021 0 repositories listed
-
Scene Graph Generation for Better Image Captioning?23 Sep 2021 0 repositories listed
-
Cross Modification Attention Based Deliberation Model for Image Captioning17 Sep 2021 0 repositories listed
-
Denoising Large-Scale Image Captioning from Alt-text Data using Content Selection Models17 Sep 2021 0 repositories listed
-
UniMS: A Unified Framework for Multimodal Summarization with Knowledge Distillation13 Sep 2021 0 repositories listed
-
Bornon: Bengali Image Captioning with Transformer-based Deep learning approach11 Sep 2021 0 repositories listed
-
Partially-Supervised Novel Object Captioning Leveraging Context from Paired Data10 Sep 2021 0 repositories listed
-
8 Sep 2021 0 repositories listed
-
IMG2SMI: Translating Molecular Structure Images to Simplified Molecular-input Line-entry System3 Sep 2021 0 repositories listed
-
Similar Scenes arouse Similar Emotions: Parallel Data Augmentation for Stylized Image Captioning26 Aug 2021 0 repositories listed
-
Auto-Parsing Network for Image Captioning and Visual Question Answering24 Aug 2021 0 repositories listed
-
Group-based Distinctive Image Captioning with Memory Attention20 Aug 2021 0 repositories listed
-
VisBuddy -- A Smart Wearable Assistant for the Visually Challenged17 Aug 2021 0 repositories listed
-
O2NA: An Object-Oriented Non-Autoregressive Approach for Controllable Video Captioning5 Aug 2021 0 repositories listed
-
Distributed Attention for Grounded Image Captioning2 Aug 2021 0 repositories listed
-
1 Aug 2021 0 repositories listed
-
Decoding, Fast and Slow: A Case Study on Balancing Trade-Offs in Incremental, Character-level Pragmatic Reasoning1 Aug 2021 0 repositories listed
-
``I've Seen Things You People Wouldn't Believe'': Hallucinating Entities in GuessWhat?!1 Aug 2021 0 repositories listed
-
利用图像描述与知识图谱增强表示的视觉问答(Exploiting Image Captions and External Knowledge as Representation Enhancement for Visual Question Answering)1 Aug 2021 0 repositories listed
-
NLPHut’s Participation at WAT20211 Aug 2021 0 repositories listed
-
A Thorough Review on Recent Deep Learning Methodologies for Image Captioning28 Jul 2021 0 repositories listed
-
Experimenting with Self-Supervision using Rotation Prediction for Image Captioning28 Jul 2021 0 repositories listed
-
Boosting Entity-aware Image Captioning with Multi-modal Knowledge Graph26 Jul 2021 0 repositories listed
-
From Show to Tell: A Survey on Deep Learning-based Image Captioning14 Jul 2021 0 repositories listed
-
9 Jul 2021 0 repositories listed
-
Controlled Caption Generation for Images Through Adversarial Attacks7 Jul 2021 0 repositories listed
-
Diversity as a By-Product: Goal-oriented Language Generation Leads to Linguistic Variation1 Jul 2021 0 repositories listed
-
Egocentric Image Captioning for Privacy-Preserved Passive Dietary Intake Monitoring1 Jul 2021 0 repositories listed
-
Contrastive Semantic Similarity Learning for Image Captioning Evaluation with Intrinsic Auto-encoder29 Jun 2021 0 repositories listed
-
Trust It or Not: Confidence-Guided Automatic Radiology Report Generation21 Jun 2021 0 repositories listed
-
TCIC: Theme Concepts Learning Cross Language and Vision for Image Captioning21 Jun 2021 0 repositories listed
-
Exploring Semantic Relationships for Unpaired Image Captioning20 Jun 2021 0 repositories listed
-
A Self-Boosting Framework for Automated Radiographic Report Generation19 Jun 2021 0 repositories listed
-
FAIEr: Fidelity and Adequacy Ensured Image Caption Evaluation19 Jun 2021 0 repositories listed
-
Improving OCR-Based Image Captioning by Incorporating Geometrical Relationship19 Jun 2021 0 repositories listed
-
19 Jun 2021 0 repositories listed
-
Predicting Visual Futures with Image Captioning and Pre-Trained Language Models16 Jun 2021 0 repositories listed
-
Data augmentation to improve robustness of image captioning solutions10 Jun 2021 0 repositories listed
-
E2E-VLP: End-to-End Vision-Language Pre-training Enhanced by Visual Learning3 Jun 2021 0 repositories listed
-
Learning to Select: A Fully Attentive Approach for Novel Object Captioning2 Jun 2021 0 repositories listed
-
How Vision Affects Language: Comparing Masked Self-Attention in Uni-Modal and Multi-Modal Transformer1 Jun 2021 0 repositories listed
-
Leveraging Partial Dependency Trees to Control Image Captions1 Jun 2021 0 repositories listed
-
On Randomized Classification Layers and Their Implications in Natural Language Generation1 Jun 2021 0 repositories listed
-
Validity-Based Sampling and Smoothing Methods for Multiple Reference Image Captioning1 Jun 2021 0 repositories listed
-
Longer Version for "Deep Context-Encoding Network for Retinal Image Captioning"30 May 2021 0 repositories listed
-
New Encoder Learning for Captioning Heavy Rain Images via Semantic Visual Feature Matching28 May 2021 0 repositories listed
-
Visual representation of negation: Real world data analysis on comic image design21 May 2021 0 repositories listed
-
More Than Just Attention: Improving Cross-Modal Attentions with Contrastive Constraints for Image-Text Matching20 May 2021 0 repositories listed
-
Dependent Multi-Task Learning with Causal Intervention for Image Captioning18 May 2021 0 repositories listed
-
Multi-Modal Image Captioning for the Visually Impaired17 May 2021 0 repositories listed
-
Survey of Visual-Semantic Embedding Methods for Zero-Shot Image Retrieval16 May 2021 0 repositories listed
-
Empirical Analysis of Image Caption Generation using Deep Learning14 May 2021 0 repositories listed
-
Instance-aware Remote Sensing Image Captioning with Cross-hierarchy Attention11 May 2021 0 repositories listed
-
Exploring Explicit and Implicit Visual Relationships for Image Captioning6 May 2021 0 repositories listed
-
Contextualized Keyword Representations for Multi-modal Retinal Image Captioning26 Apr 2021 0 repositories listed