Un hyperparamètre se choisit avant l’entraînement, un paramètre s’apprend pendant. La distinction se lit dans le code, et elle décide de ce que vous avez le droit de régler.
Réentraîner n’est pas relancer le notebook. Choisir le déclencheur, la fenêtre de données et le critère de bascule — et ne jamais promouvoir un modèle parce qu’il est récent.
Un modèle qui récite ses données d’entraînement a besoin d’un frein. alpha en règle l’intensité, l1_ratio choisit entre Ridge et Lasso. Trop freiner nuit autant que pas assez.
Trois jours plus tard, personne ne sait quel réglage a donné 0,93. Ce qu’il faut enregistrer pour que deux essais soient comparables, et quand MLflow devient utile.
Dates incohérentes, doublons partiels, valeurs manquantes structurées : le nettoyage n’est pas une liste de méthodes, c’est une suite de choix à poser.