RECHERCHE
Séquençage automatique pour le fine-tuning multi-politique des LLM
Un nouveau cadre organise les chemins d'optimation pour améliorer l'efficacité du Parameter-Efficient Fine-Tuning.
arXiv cs.AI · cs.LG · cs.CL·Jiajia Tang, Sizhe Yuen, Francisco Gomez Medina, Yali Du·31 juillet 2026
Cette recherche propose un cadre de séquençage automatique des tâches pour le Parameter-Efficient Fine-Tuning (PEFT) des LLM. Utilisant des QLoRA indépendants et des chemins d'optimation découplés, il évite l'interférence entre tâches hétérogènes. Les expériences sur le benchmark TRACE montrent que cette approche surpasse les méthodes classiques à capacité équivalente.