RECHERCHE
PPL-Factory : sélection de données pour le fine-tuning
Un framework task-aware et budget-aware qui optimise le fine-tuning des LLM en sélectionnant 1% à 10% des données.
arXiv cs.AI · cs.LG · cs.CL·Hang Zhang, Warren J. Gross·20 juillet 2026

Image · Source originale
PPL-Factory est un cadre de sélection de données qui combine des scores basés sur la perplexité et des critères de budget. Sur GSM8K, il surpasse les méthodes existantes avec seulement 1 % des données d'entraînement et dépasse le fine-tuning complet sur MATH avec 10 %.