
Chapitre 7 : Apprentissage d’ensemble et forêts aléatoires
277
© Dunod – Toute reproduction non autorisée est un délit.
K =(10m log(10m))/ mlog(m)=10 log(10m)/log(m)
.
Pour m=10
6
, K est égal à 10 × 7/6, soit environ 11,7. Vous pouvez
vous attendre à ce que l’entraînement dure environ 12heures.
6. Le tri préalable des données n’accélère l’entraînement que si le jeu
de données comporte quelques milliers d’observations tout au plus.
Dans votre cas, il en comporte 100000. Spécier presort=True
ralentirait considérablement l’apprentissage.
Pour les solutions des exercices 7 et 8, reportez-vous aux notebooks Jupyter publiés
sur https://github.com/ageron/handson-ml2 ...