Multi-lingual Wikipedia Summarization and Title Generation On Low Resource Corpus
MultiLing 2019 Headline Generation Task on Wikipedia Corpus raised a critical and practical problem: multilingual task on low resource corpus. In this paper we proposed QDAS extractive summarization model enhanced by sentence2vec and try to apply transfer learning based on large multilingual pre-trained language model for Wikipedia Headline Generation task. We treat it as sequence labeling task and develop two schemes to handle with it. Experimental results have shown that large pre-trained model can effectively utilize learned knowledge to extract certain phrase using low resource supervised data.
Code (0)
등록된 구현이 없습니다.
Tasks
Extractive SummarizationHeadline GenerationLanguage ModelingLanguage ModellingTransfer LearningWikipedia SummarizationSimilar Papers 제목 키워드 기반
XWikiGen: Cross-lingual Summarization for Encyclopedic Text Generation in Low Resource Languages
Lack of encyclopedic text contributors, especially on Wikipedia, makes automated text generation for low resource (LR) languages a critical problem. Existing work on Wikipedia text generation has focused on English only …
ArticlesCross-Lingual Abstractive SummarizationDocument SummarizationExtractive Summarization+3A Novel Wikipedia based Dataset for Monolingual and Cross-Lingual Summarization
Cross-lingual summarization is a challenging task for which there are no cross-lingual scientific resources currently available. To overcome the lack of a high-quality resource, we present a new dataset for monolingual a…
Abstractive Text SummarizationArticlesDSGPT: Domain-Specific Generative Pre-Training of Transformers for Text Generation in E-commerce Title and Review Summarization
We propose a novel domain-specific generative pre-training (DS-GPT) method for text generation and apply it to the product titleand review summarization problems on E-commerce mobile display.First, we adopt a decoder-onl…
DecoderText GenerationMTG: A Benchmarking Suite for Multilingual Text Generation
We introduce MTG, a new benchmark suite for training and evaluating multilingual text generation. It is the first and largest multilingual multiway text generation benchmark with 400k human-annotated data for four tasks …
BenchmarkingQuestion GenerationQuestion-GenerationStory Generation+3WikiMulti: a Corpus for Cross-Lingual Summarization
Cross-lingual summarization (CLS) is the task to produce a summary in one particular language for a source document in a different language. We introduce WikiMulti - a new dataset for cross-lingual summarization based on…
Abstractive Text SummarizationArticlesCross-Lingual Abstractive Summarization