paper-with-me

Papers

Parameter Efficient Multi-task Model Fusion with Partial Linearization

2023-10-07 · Anke Tang, Li Shen, Yong Luo, Yibing Zhan, Han Hu, Bo Du, Yixin Chen, DaCheng Tao

Large pre-trained models have enabled significant advances in machine learning and served as foundation components. Model fusion methods, such as task arithmetic, have been proven to be powerful and scalable to incorporate fine-tuned weights from different tasks into a multi-task model. However, efficiently fine-tuning large pre-trained models on multiple downstream tasks remains challenging, leading to inefficient multi-task model fusion. In this work, we propose a novel method to improve multi-task fusion for parameter-efficient fine-tuning techniques like LoRA fine-tuning. Specifically, our approach partially linearizes only the adapter modules and applies task arithmetic over the linearized adapters. This allows us to leverage the the advantages of model fusion over linearized fine-tuning, while still performing fine-tuning and inference efficiently. We demonstrate that our partial linearization technique enables a more effective fusion of multiple tasks into a single model, outperforming standard adapter tuning and task arithmetic alone. Experimental results demonstrate the capabilities of our proposed partial linearization technique to effectively construct unified multi-task models via the fusion of fine-tuned task vectors. We evaluate performance over an increasing number of tasks and find that our approach outperforms standard parameter-efficient fine-tuning techniques. The results highlight the benefits of partial linearization for scalable and efficient multi-task model fusion. The code is available at https://github.com/tanganke/peta

📄 PDF Abstract BibTeX arXiv:2310.04742

Code (1)

tanganke/peta 공식 구현 pytorch

Tasks

parameter-efficient fine-tuningTask Arithmetic

Methods 이 논문이 사용한 방법론

Adapter 설명 없음

Similar Papers 제목 키워드 기반

Physics-Aware Linearized ADMM and Its Unrolling

2026-06-01 · Satoshi Takabe, Shunta Arai, Tadashi Wadayama arxiv

Recently, partial differential equations (PDEs) have been used to directly model the measurement process in signal processing, although their evaluation is costly. In this paper, we propose a novel alternating direction …

Image Restoration

Approximating the Minimum Breakpoint Linearization Problem for Genetic Maps without Gene Strandedness

2015-02-25

The study of genetic map linearization leads to a combinatorial hard problem, called the {\em minimum breakpoint linearization} (MBL) problem. It is aimed at finding a linearization of a partial order which attains the m…

Abstractive Multi-document Summarization by Partial Tree Extraction, Recombination and Linearization

2017-11-01 · IJCNLP 2017 11 · Litton J Kurisinkel, Yue Zhang, Vasudeva Varma

Existing work for abstractive multidocument summarization utilise existing phrase structures directly extracted from input documents to generate summary sentences. These methods can suffer from lack of consistence and co…

Abstractive Text SummarizationDocument SummarizationMulti-Document Summarization

Not All Linearizations Are Equally Data-Hungry in Sequence Labeling Parsing

2021-08-17 · RANLP 2021 9 · Alberto Muñoz-Ortiz, Michalina Strzyz, David Vilares

Different linearizations have been proposed to cast dependency parsing as sequence labeling and solve the task as: (i) a head selection problem, (ii) finding a representation of the token arcs as bracket strings, or (iii…

AllDependency Parsing

Efficient Model Editing with Task-Localized Sparse Fine-tuning

2025-04-03 · Leonardo Iurada, Marco Ciccone, Tatiana Tommasi

Task arithmetic has emerged as a promising approach for editing models by representing task-specific knowledge as composable task vectors. However, existing methods rely on network linearization to derive task vectors, l…

DisentanglementModel EditingNegationTask Arithmetic