paper: https://arxiv.org/abs/2502.13059
Dataset: https://huggingface.co/datasets/m-a-p/SimpleVQA
Please consider citing this work in your publications if it helps your research.
@misc{cheng2025simplevqamultimodalfactualityevaluation,
title={SimpleVQA: Multimodal Factuality Evaluation for Multimodal Large Language Models},
author={Xianfu Cheng and Wei Zhang and Shiwei Zhang and Jian Yang and Xiangyuan Guan and Xianjie Wu and Xiang Li and Ge Zhang and Jiaheng Liu and Yuying Mai and Yutao Zeng and Zhoufutu Wen and Ke Jin and Baorui Wang and Weixiao Zhou and Yunhong Lu and Tongliang Li and Wenhao Huang and Zhoujun Li},
year={2025},
eprint={2502.13059},
archivePrefix={arXiv},
primaryClass={cs.CL},
url={https://arxiv.org/abs/2502.13059},
}