Elasticsearch: Recuperar el documento con el contenido del adjunto

Esta documentación forma parte de la guía Plugin de Ingest attachment. Consulte la guía completa aquí: Cómo extraer datos de archivos PPT, XLS y PDF a Elasticsearch.

👋 Bienvenido a la documentación de Stackhero

Stackhero ofrece un servicio de Elasticsearch cloud totalmente gestionado, diseñado para profesionales que necesitan búsqueda, analítica y registro de logs fiables a gran escala.

  • Rendimiento constante y seguridad avanzada con una infraestructura privada y dedicada.
  • Configuración sencilla de un nombre de dominio personalizado protegido por HTTPS.

Empieza rápidamente y céntrate en tu trabajo: puedes disponer de un entorno de Elasticsearch cloud hosting listo para producción en unos 5 minutos, con el mantenimiento rutinario y la seguridad gestionados por nosotros.

Para ver el documento procesado, recupérelo usando su ID:

GET my_index/_doc/my_id

La respuesta debería ser similar a la siguiente:

{
  "_index" : "my_index",
  "_type" : "_doc",
  "_id" : "my_id",
  "_version" : 1,
  "found" : true,
  "_source" : {
    "data" : "e1xydGYxXGFuc2kKVGhpcyBpcyB0aGUgY29udGVudCBvZiBhIFJURiBmaWxlClxwYXIgfQ==",
    "attachment" : {
      "content_type" : "application/rtf",
      "language" : "en",
      "content" : "This is the content of a RTF file",
      "content_length" : 35
    }
  }
}

Observe que el campo _source ahora incluye tanto los datos originales en Base64 como los detalles del adjunto extraído, como el tipo de archivo y el contenido.