ViDataset - Vietnamese Datasets for Natural Language Processing
07/07/2024
ViCLEVR: a visual reasoning dataset and hybrid multimodal fusion model for visual question answering in Vietnamese
Link:https://link.springer.com/article/10.1007/s00530-024-01394-w
ViCLEVR: a visual reasoning dataset and hybrid multimodal fusion model for visual question answering in Vietnamese - Multimedia Systems In recent years, visual question answering (VQA) has gained significant attention for its diverse applications, including intelligent car assistance, aiding visually impaired individuals, and document image information retrieval using natural language queries. VQA requires effective integration of i...
Click here to claim your Sponsored Listing.
Category
Contact the organization
Website
Address
New York, NY
700000