{"task":"Visual Question Answering (VQA)","dataset":"VQA-CP","metric_names":["Score"],"rows":[{"id":25980,"task":"Visual Question Answering (VQA)","parent_task":null,"dataset":"VQA-CP","model_name":"CSS","metrics":{"Score":"58.95"},"paper_url":"https://arxiv.org/abs/2003.06576v1","paper_title":"Counterfactual Samples Synthesizing for Robust Visual Question Answering","paper_date":"2020-03-14","code_links":[{"title":"yanxinzju/CSS-VQA","url":"https://github.com/yanxinzju/CSS-VQA"},{"title":"FengSuSky/CCB-VQA","url":"https://github.com/FengSuSky/CCB-VQA"}],"metrics_order":"[\"Score\"]","area":"Natural Language Processing","uses_additional_data":1,"source":"archive","tags":[]},{"id":25981,"task":"Visual Question Answering (VQA)","parent_task":null,"dataset":"VQA-CP","model_name":"GGE-DQ","metrics":{"Score":"57.32"},"paper_url":"https://arxiv.org/abs/2107.12651v4","paper_title":"Greedy Gradient Ensemble for Robust Visual Question Answering","paper_date":"2021-07-27","code_links":[{"title":"GeraldHan/GGE","url":"https://github.com/GeraldHan/GGE"}],"metrics_order":"[\"Score\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]},{"id":25982,"task":"Visual Question Answering (VQA)","parent_task":null,"dataset":"VQA-CP","model_name":"LMH+Entropy regularization (Ensemble)","metrics":{"Score":"56.74"},"paper_url":"https://arxiv.org/abs/2010.10802v1","paper_title":"Removing Bias in Multi-modal Classifiers: Regularization by Maximizing Functional Entropies","paper_date":"2020-10-21","code_links":[{"title":"itaigat/removing-bias-in-multi-modal-classifiers","url":"https://github.com/itaigat/removing-bias-in-multi-modal-classifiers"}],"metrics_order":"[\"Score\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]},{"id":25983,"task":"Visual Question Answering (VQA)","parent_task":null,"dataset":"VQA-CP","model_name":"LMH+Entropy regularization","metrics":{"Score":"54.55"},"paper_url":"https://arxiv.org/abs/2010.10802v1","paper_title":"Removing Bias in Multi-modal Classifiers: Regularization by Maximizing Functional Entropies","paper_date":"2020-10-21","code_links":[{"title":"itaigat/removing-bias-in-multi-modal-classifiers","url":"https://github.com/itaigat/removing-bias-in-multi-modal-classifiers"}],"metrics_order":"[\"Score\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]},{"id":25984,"task":"Visual Question Answering (VQA)","parent_task":null,"dataset":"VQA-CP","model_name":"Learned-Mixin +H","metrics":{"Score":"52.05"},"paper_url":"https://arxiv.org/abs/1909.03683v1","paper_title":"Don't Take the Easy Way Out: Ensemble Based Methods for Avoiding Known Dataset Biases","paper_date":"2019-09-09","code_links":[{"title":"chrisc36/debias","url":"https://github.com/chrisc36/debias"},{"title":"itaigat/removing-bias-in-multi-modal-classifiers","url":"https://github.com/itaigat/removing-bias-in-multi-modal-classifiers"},{"title":"chrisc36/bottom-up-attention-vqa","url":"https://github.com/chrisc36/bottom-up-attention-vqa"}],"metrics_order":"[\"Score\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]},{"id":25985,"task":"Visual Question Answering (VQA)","parent_task":null,"dataset":"VQA-CP","model_name":"UpDn+SCR (VQA-X)","metrics":{"Score":"49.45"},"paper_url":"https://arxiv.org/abs/1905.09998v3","paper_title":"Self-Critical Reasoning for Robust Visual Question Answering","paper_date":"2019-05-24","code_links":[{"title":"jialinwu17/Self_Critical_VQA","url":"https://github.com/jialinwu17/Self_Critical_VQA"}],"metrics_order":"[\"Score\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]},{"id":25986,"task":"Visual Question Answering (VQA)","parent_task":null,"dataset":"VQA-CP","model_name":"RUBi","metrics":{"Score":"47.11"},"paper_url":"https://arxiv.org/abs/1906.10169v2","paper_title":"RUBi: Reducing Unimodal Biases in Visual Question Answering","paper_date":"2019-06-24","code_links":[{"title":"cdancette/rubi.bootstrap.pytorch","url":"https://github.com/cdancette/rubi.bootstrap.pytorch"}],"metrics_order":"[\"Score\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]},{"id":25987,"task":"Visual Question Answering (VQA)","parent_task":null,"dataset":"VQA-CP","model_name":"NSM","metrics":{"Score":"45.8"},"paper_url":"https://arxiv.org/abs/1907.03950v4","paper_title":"Learning by Abstraction: The Neural State Machine","paper_date":"2019-07-09","code_links":[{"title":"stanfordnlp/mac-network","url":"https://github.com/stanfordnlp/mac-network"},{"title":"ceyzaguirre4/NSM","url":"https://github.com/ceyzaguirre4/NSM"},{"title":"abwilf/social-iq-2.0-challenge","url":"https://github.com/abwilf/social-iq-2.0-challenge"},{"title":"gchaperon/neural-state-machine","url":"https://github.com/gchaperon/neural-state-machine"}],"metrics_order":"[\"Score\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]},{"id":25988,"task":"Visual Question Answering (VQA)","parent_task":null,"dataset":"VQA-CP","model_name":"MuRel","metrics":{"Score":"39.54"},"paper_url":"http://arxiv.org/abs/1902.09487v1","paper_title":"MUREL: Multimodal Relational Reasoning for Visual Question Answering","paper_date":"2019-02-25","code_links":[{"title":"Cadene/murel.bootstrap.pytorch","url":"https://github.com/Cadene/murel.bootstrap.pytorch"}],"metrics_order":"[\"Score\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]},{"id":25989,"task":"Visual Question Answering (VQA)","parent_task":null,"dataset":"VQA-CP","model_name":"HAN","metrics":{"Score":"28.65"},"paper_url":"http://arxiv.org/abs/1808.00300v1","paper_title":"Learning Visual Question Answering by Bootstrapping Hard Attention","paper_date":"2018-08-01","code_links":[{"title":"lienchibao1998/new","url":"https://github.com/lienchibao1998/new"}],"metrics_order":"[\"Score\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]}]}