Importación masiva con _bulk

6 min
Público
principiante que entendió mapping y refresh (lecciones 02 y 03)
Duración
25 a 30 min
Módulo
2/7
Competencia objetivo
cargar miles de documentos en una sola consulta, leer la respuesta de _bulk sin caer en la trampa, y copiar un índice con _reindex

En una imagen

Entregar 504 paquetes uno por uno son 504 idas y vueltas del camión: la ruta (la conexión HTTP) cuesta más que el paquete. _bulk es cargar el camión: una sola consulta que transporta cientos de operaciones, cada una escrita en dos líneas, la etiqueta («indexar en cours con el id C0001») y luego el paquete (el documento). El chofer vuelve con un albarán, items, que dice paquete por paquete qué pasó, y una luz global, errors, que se enciende en cuanto un solo paquete fue rechazado. Es exactamente lo que hace labo.sh importer con los tres archivos .ndjson del kit; y _reindex es el mismo camión que carga directamente de un índice para descargar en otro.

Vista previa: el resto de la lección está reservado a los inscritos.

¿Ya te inscribiste con un código?

Tu acceso está vinculado a tu cuenta, no a este enlace. Inicia sesión con el mismo correo que usaste en clase: tu curso te espera, no hace falta volver a introducir el código.

Iniciar sesión¿Aún no tienes cuenta? Crear una
Esta lección forma parte del módulo «Elasticsearch: indexar y recuperar documentos»

Los primeros módulos del curso son de acceso libre. Para el resto hay tres opciones: comprar este curso de una vez, suscribirte, o introducir el código entregado en clase.

Suscribirme — 19 $ US/mesVolver al plan
¿Eres estudiante del curso?

El código se vincula a tu cuenta: inicia sesión o crea una cuenta y se aplicará automáticamente al volver.

¿Aún no tienes cuenta? Crear una