TDIUC 全称 Task Directed Image Understanding Challenge,是一个视觉问答数据集。数据集包括来自 MS COCO 和视觉基因组数据集的 160 万个问题及 17 万张图像;image-question pair 被分为 12 个类别及 4 个额外的评价矩阵 (evaluation matrices),用于评估模型稳健性及推理能力。 TDIUC 数据统计:
12 种不同的问题类型(根据基本任务分组,其中包括一些「absurd」的问题)
167,437 张图像(源自 MS-COCO 及 Visual Genome)
165 万个 question-answer pair(3 个来源)
4 个全新评估指标(旨在补偿偏见)
6 个全新实验设置(回答 VQA 算法相关的关键问题)


雷达卡




京公网安备 11010802022788号







