Cours 06
Alignement des LLM
- jeudi 14 janvier 2027
- 14:00 – 15:30
- Présentiel
Un modèle pré-entraîné sait produire du texte, mais cela ne signifie pas qu'il suit correctement une consigne ou qu'il produit toujours une réponse adaptée.
Nous verrons comment l'alignement permet d'adapter le modèle à des préférences humaines, d'abord avec RLHF puis avec des méthodes plus directes comme DPO.
Au programme
- 01Preference tuning
- 02Vue d'ensemble du RLHF
- 03Modélisation de la récompense
- 04Approches par renforcement (PPO et variantes)
- 05DPO