{"task":"Question Answering","dataset":"TweetQA","metric_names":["BLEU-1","ROUGE-L"],"rows":[{"id":23176,"task":"Question Answering","parent_task":null,"dataset":"TweetQA","model_name":"ByT5 (small)","metrics":{"BLEU-1":"72.0"},"paper_url":"https://arxiv.org/abs/2105.13626v3","paper_title":"ByT5: Towards a token-free future with pre-trained byte-to-byte models","paper_date":"2021-05-28","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers/tree/master/src/transformers/models/byt5"},{"title":"google-research/byt5","url":"https://github.com/google-research/byt5"},{"title":"ufal/multilexnorm2021","url":"https://github.com/ufal/multilexnorm2021"},{"title":"2024-MindSpore-1/Code2","url":"https://github.com/2024-MindSpore-1/Code2/tree/main/model-1/byt5"},{"title":"yoreG123/Paddle-ByT5","url":"https://github.com/yoreG123/Paddle-ByT5"}],"metrics_order":"[\"BLEU-1\", \"ROUGE-L\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]},{"id":23177,"task":"Question Answering","parent_task":null,"dataset":"TweetQA","model_name":"mT5","metrics":{"BLEU-1":"70.8","ROUGE-L":"74.3"},"paper_url":"https://arxiv.org/abs/2105.13626v3","paper_title":"ByT5: Towards a token-free future with pre-trained byte-to-byte models","paper_date":"2021-05-28","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers/tree/master/src/transformers/models/byt5"},{"title":"google-research/byt5","url":"https://github.com/google-research/byt5"},{"title":"ufal/multilexnorm2021","url":"https://github.com/ufal/multilexnorm2021"},{"title":"2024-MindSpore-1/Code2","url":"https://github.com/2024-MindSpore-1/Code2/tree/main/model-1/byt5"},{"title":"yoreG123/Paddle-ByT5","url":"https://github.com/yoreG123/Paddle-ByT5"}],"metrics_order":"[\"BLEU-1\", \"ROUGE-L\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]},{"id":23178,"task":"Question Answering","parent_task":null,"dataset":"TweetQA","model_name":"ByT5","metrics":{"ROUGE-L":"75.7"},"paper_url":"https://arxiv.org/abs/2105.13626v3","paper_title":"ByT5: Towards a token-free future with pre-trained byte-to-byte models","paper_date":"2021-05-28","code_links":[{"title":"huggingface/transformers","url":"https://github.com/huggingface/transformers/tree/master/src/transformers/models/byt5"},{"title":"google-research/byt5","url":"https://github.com/google-research/byt5"},{"title":"ufal/multilexnorm2021","url":"https://github.com/ufal/multilexnorm2021"},{"title":"2024-MindSpore-1/Code2","url":"https://github.com/2024-MindSpore-1/Code2/tree/main/model-1/byt5"},{"title":"yoreG123/Paddle-ByT5","url":"https://github.com/yoreG123/Paddle-ByT5"}],"metrics_order":"[\"BLEU-1\", \"ROUGE-L\"]","area":"Natural Language Processing","uses_additional_data":0,"source":"archive","tags":[]}]}