FLORIAN BASTIN
Toutes les séances

Cours 01

Le Transformer

On commence par les principales tâches du NLP et les architectures utilisées avant les Transformers. On verra ensuite pourquoi les réseaux récurrents sont limités sur les dépendances longues, puis comment fonctionne l'attention et comment elle mène à l'architecture Transformer.

Au programme
  1. 01Panorama du NLP et de ses tâches
  2. 02Tokenisation
  3. 03Plongements
  4. 04Word2vec, RNN, LSTM
  5. 05Mécanisme d'attention
  6. 06Architecture du Transformer