Import massif avec _bulk

6 min
Public
débutant qui a compris mapping et refresh (leçons 02 et 03)
Durée
25 à 30 min
Module
2/7
Compétence visée
charger des milliers de documents en une requête, lire la réponse de _bulk sans se faire piéger, et copier un index avec _reindex

En une image

Livrer 504 colis un par un, c'est 504 allers-retours du camion : la route (la connexion HTTP) coûte plus cher que le colis. _bulk, c'est charger le camion : une seule requête qui transporte des centaines d'opérations, chacune écrite sur deux lignes, l'étiquette (« indexer dans cours avec l'id C0001 ») puis le colis (le document). Le chauffeur revient avec un bordereau, items, qui dit colis par colis ce qui s'est passé, et un voyant global, errors, qui s'allume dès qu'un seul colis a été refusé. C'est exactement ce que fait labo.sh importer avec les trois fichiers .ndjson du kit ; et _reindex, c'est le même camion qui charge directement dans un index pour décharger dans un autre.

Aperçu — la suite de la leçon est réservée aux inscrits.

Déjà inscrit avec un code ?

Votre accès est rattaché à votre compte, pas à ce lien. Connectez-vous avec le même courriel qu'en classe : votre cours vous attend, inutile de ré-entrer le code.

Se connecterPas encore de compte ? En créer un
Cette leçon fait partie du module « Elasticsearch : indexer et retrouver des documents »

Les premiers modules du cours sont en accès libre. Pour la suite, trois possibilités : acheter ce cours une fois pour toutes, vous abonner pour tout ouvrir, ou entrer le code si vous suivez le cours en classe.

M’abonner — 19 $ US/moisRetour au plan
Vous êtes étudiant du cours ?

Le code se rattache à votre compte : connectez-vous ou créez un compte, il sera validé automatiquement au retour.

Pas encore de compte ? En créer un