paper-with-me

Papers

Multi-lingual Wikipedia Summarization and Title Generation On Low Resource Corpus

2019-09-01 · RANLP 2019 9 · Wei Liu, Lei LI, Zuying Huang, Yinan Liu

MultiLing 2019 Headline Generation Task on Wikipedia Corpus raised a critical and practical problem: multilingual task on low resource corpus. In this paper we proposed QDAS extractive summarization model enhanced by sentence2vec and try to apply transfer learning based on large multilingual pre-trained language model for Wikipedia Headline Generation task. We treat it as sequence labeling task and develop two schemes to handle with it. Experimental results have shown that large pre-trained model can effectively utilize learned knowledge to extract certain phrase using low resource supervised data.

📄 PDF Abstract BibTeX

Code (0)

등록된 구현이 없습니다.

Tasks

Extractive SummarizationHeadline GenerationLanguage ModelingLanguage ModellingTransfer LearningWikipedia Summarization

Similar Papers 제목 키워드 기반

XWikiGen: Cross-lingual Summarization for Encyclopedic Text Generation in Low Resource Languages

2023-03-22 · Dhaval Taunk, Shivprasad Sagare, Anupam Patil, Shivansh Subramanian 외

Lack of encyclopedic text contributors, especially on Wikipedia, makes automated text generation for low resource (LR) languages a critical problem. Existing work on Wikipedia text generation has focused on English only …

ArticlesCross-Lingual Abstractive SummarizationDocument SummarizationExtractive Summarization+3

A Novel Wikipedia based Dataset for Monolingual and Cross-Lingual Summarization

2021-11-01 · EMNLP (newsum) 2021 11 · Mehwish Fatima, Michael Strube

Cross-lingual summarization is a challenging task for which there are no cross-lingual scientific resources currently available. To overcome the lack of a high-quality resource, we present a new dataset for monolingual a…

Abstractive Text SummarizationArticles

DSGPT: Domain-Specific Generative Pre-Training of Transformers for Text Generation in E-commerce Title and Review Summarization

2021-12-15 · SIGIR 2021 7 · Xueying Zhang, Yunjiang Jiang, Yue Shang, Zhaomeng Cheng 외

We propose a novel domain-specific generative pre-training (DS-GPT) method for text generation and apply it to the product titleand review summarization problems on E-commerce mobile display.First, we adopt a decoder-onl…

DecoderText Generation

MTG: A Benchmarking Suite for Multilingual Text Generation

2021-10-16 · ACL ARR October 2021 10 · Anonymous

We introduce MTG, a new benchmark suite for training and evaluating multilingual text generation. It is the first and largest multilingual multiway text generation benchmark with 400k human-annotated data for four tasks …

BenchmarkingQuestion GenerationQuestion-GenerationStory Generation+3

WikiMulti: a Corpus for Cross-Lingual Summarization

2022-04-23 · Pavel Tikhonov, Valentin Malykh

Cross-lingual summarization (CLS) is the task to produce a summary in one particular language for a source document in a different language. We introduce WikiMulti - a new dataset for cross-lingual summarization based on…

Abstractive Text SummarizationArticlesCross-Lingual Abstractive Summarization