paper-with-me

Papers

GO4Align: Group Optimization for Multi-Task Alignment

2024-04-09 · Jiayi Shen, Cheems Wang, Zehao Xiao, Nanne van Noord, Marcel Worring

This paper proposes \textit{GO4Align}, a multi-task optimization approach that tackles task imbalance by explicitly aligning the optimization across tasks. To achieve this, we design an adaptive group risk minimization strategy, comprising two techniques in implementation: (i) dynamical group assignment, which clusters similar tasks based on task interactions; (ii) risk-guided group indicators, which exploit consistent task correlations with risk information from previous iterations. Comprehensive experimental results on diverse benchmarks demonstrate our method's performance superiority with even lower computational costs.

📄 PDF Abstract BibTeX arXiv:2404.06486

Code (1)

autumn9999/go4align 공식 구현 pytorch

Similar Papers 제목 키워드 기반

APPA: Adaptive Preference Pluralistic Alignment for Fair Federated RLHF of LLMs

2026-04-05 · Mahmoud Srewa, Tianyu Zhao, Salma Elmalaki arxiv

Aligning large language models (LLMs) with diverse human preferences requires pluralistic alignment, where a single model must respect the values of multiple distinct groups simultaneously. In federated reinforcement lea…

Reinforcement Learning

Learning to Align, Aligning to Learn: A Unified Approach for Self-Optimized Alignment

2025-08-11 · Haowen Wang, Yun Yue, Zhiling Ye, Shuowen Zhang 외 arxiv

Alignment methodologies have emerged as a critical pathway for enhancing language model alignment capabilities. While SFT (supervised fine-tuning) accelerates convergence through direct token-level loss intervention, its…

Reinforcement Learning

Group Preference Optimization: Few-Shot Alignment of Large Language Models

2023-10-17 · Siyan Zhao, John Dang, Aditya Grover

Many applications of large language models (LLMs), ranging from chatbots to creative writing, require nuanced subjective judgments that can differ significantly across different groups. Existing alignment algorithms can …

Few-Shot LearningMeta-Learning

No Preference Left Behind: Group Distributional Preference Optimization

2024-12-28 · Binwei Yao, Zefan Cai, Yun-Shiuan Chuang, Shanglin Yang 외

Preferences within a group of people are not uniform but follow a distribution. While existing alignment methods like Direct Preference Optimization (DPO) attempt to steer models to reflect human preferences, they strugg…

DiversityLanguage ModelingLanguage Modelling

Vulnerability-Aware Alignment: Mitigating Uneven Forgetting in Harmful Fine-Tuning

2025-06-04 · Liang Chen, Xueting Han, Li Shen, Jing Bai 외

Harmful fine-tuning (HFT), performed directly on open-source LLMs or through Fine-tuning-as-a-Service, breaks safety alignment and poses significant threats. Existing methods aim to mitigate HFT risks by learning robust …

Safety Alignment