Generating Image Descriptions using Multilingual Data
Code (0)
등록된 구현이 없습니다.
Tasks
Image CaptioningLanguage ModelingLanguage ModellingMachine TranslationMultimodal Machine TranslationSimilar Papers 제목 키워드 기반
On generating coherent multilingual descriptions of museum objects from Semantic Web ontologies
Boosting Text-To-Image Generation via Multilingual Prompting in Large Multimodal Models
Previous work on augmenting large multimodal models (LMMs) for text-to-image (T2I) generation has focused on enriching the input space of in-context learning (ICL). This includes providing a few demonstrations and optimi…
Image GenerationIn-Context LearningRerankingText to Image Generation+1Multi30K: Multilingual English-German Image Descriptions
We introduce the Multi30K dataset to stimulate multilingual multimodal research. Recent advances in image description have been demonstrated on English-language datasets almost exclusively, but image description should n…
Image DescriptionMachine TranslationMultimodal Machine TranslationTranslationImage Pivoting for Learning Multilingual Multimodal Representations
In this paper we propose a model to learn multimodal multilingual representations for matching images and sentences in different languages, with the aim of advancing multilingual versions of image search and image unders…
Image DescriptionImage RetrievalSemantic Textual SimilarityLess is More: Generating Grounded Navigation Instructions from Landmarks
We study the automatic generation of navigation instructions from 360-degree images captured on indoor routes. Existing generators suffer from poor visual grounding, causing them to rely on language priors and hallucinat…
DecoderInstruction FollowingVisual Grounding