{"task":"Visual Question Answering (VQA)","dataset":"IllusionVQA","metric_names":["Accuracy"],"rows":[{"id":25858,"task":"Visual Question Answering (VQA)","parent_task":null,"dataset":"IllusionVQA","model_name":"GPT4-Vision 4-shot","metrics":{"Accuracy":"62.99"},"paper_url":"https://arxiv.org/abs/2403.15952v3","paper_title":"IllusionVQA: A Challenging Optical Illusion Dataset for Vision Language Models","paper_date":"2024-03-23","code_links":[{"title":"csebuetnlp/illusionvqa","url":"https://github.com/csebuetnlp/illusionvqa"}],"metrics_order":"[\"Accuracy\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]},{"id":25859,"task":"Visual Question Answering (VQA)","parent_task":null,"dataset":"IllusionVQA","model_name":"GPT4-Vision","metrics":{"Accuracy":"58.85"},"paper_url":"https://arxiv.org/abs/2403.15952v3","paper_title":"IllusionVQA: A Challenging Optical Illusion Dataset for Vision Language Models","paper_date":"2024-03-23","code_links":[{"title":"csebuetnlp/illusionvqa","url":"https://github.com/csebuetnlp/illusionvqa"}],"metrics_order":"[\"Accuracy\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]},{"id":25860,"task":"Visual Question Answering (VQA)","parent_task":null,"dataset":"IllusionVQA","model_name":"Gemini-Pro 4-shot","metrics":{"Accuracy":"52.87"},"paper_url":"https://arxiv.org/abs/2403.15952v3","paper_title":"IllusionVQA: A Challenging Optical Illusion Dataset for Vision Language Models","paper_date":"2024-03-23","code_links":[{"title":"csebuetnlp/illusionvqa","url":"https://github.com/csebuetnlp/illusionvqa"}],"metrics_order":"[\"Accuracy\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]},{"id":25861,"task":"Visual Question Answering (VQA)","parent_task":null,"dataset":"IllusionVQA","model_name":"Gemini-Pro","metrics":{"Accuracy":"51.26"},"paper_url":"https://arxiv.org/abs/2403.15952v3","paper_title":"IllusionVQA: A Challenging Optical Illusion Dataset for Vision Language Models","paper_date":"2024-03-23","code_links":[{"title":"csebuetnlp/illusionvqa","url":"https://github.com/csebuetnlp/illusionvqa"}],"metrics_order":"[\"Accuracy\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]},{"id":25862,"task":"Visual Question Answering (VQA)","parent_task":null,"dataset":"IllusionVQA","model_name":"LLaVA-1.5-13B","metrics":{"Accuracy":"40"},"paper_url":"https://arxiv.org/abs/2403.15952v3","paper_title":"IllusionVQA: A Challenging Optical Illusion Dataset for Vision Language Models","paper_date":"2024-03-23","code_links":[{"title":"csebuetnlp/illusionvqa","url":"https://github.com/csebuetnlp/illusionvqa"}],"metrics_order":"[\"Accuracy\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]},{"id":25863,"task":"Visual Question Answering (VQA)","parent_task":null,"dataset":"IllusionVQA","model_name":"CogVLM","metrics":{"Accuracy":"38.16"},"paper_url":"https://arxiv.org/abs/2403.15952v3","paper_title":"IllusionVQA: A Challenging Optical Illusion Dataset for Vision Language Models","paper_date":"2024-03-23","code_links":[{"title":"csebuetnlp/illusionvqa","url":"https://github.com/csebuetnlp/illusionvqa"}],"metrics_order":"[\"Accuracy\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]},{"id":25864,"task":"Visual Question Answering (VQA)","parent_task":null,"dataset":"IllusionVQA","model_name":"InstructBLIP-13B","metrics":{"Accuracy":"34.25"},"paper_url":"https://arxiv.org/abs/2403.15952v3","paper_title":"IllusionVQA: A Challenging Optical Illusion Dataset for Vision Language Models","paper_date":"2024-03-23","code_links":[{"title":"csebuetnlp/illusionvqa","url":"https://github.com/csebuetnlp/illusionvqa"}],"metrics_order":"[\"Accuracy\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]}]}