Optimisation d'un système de dialogue basé sur LSTM avec apprentissage supervisé et par renforcement | Factae