Elasticsearch: Haal het document met de bijlage-inhoud op

Deze documentatie maakt deel uit van de Ingest attachment plugin-gids. Bekijk de volledige gids hier: Hoe gegevens uit PPT-, XLS- en PDF-bestanden naar Elasticsearch te extraheren.

👋 Welkom bij de Stackhero-documentatie

Stackhero biedt een volledig beheerde Elasticsearch cloud dienst, speciaal ontwikkeld voor professionals die behoefte hebben aan betrouwbare zoekfunctionaliteit, analytics en logging op schaal.

  • Consistente performance en sterke beveiliging dankzij een privé, dedicated infrastructuur.
  • Eenvoudig een eigen domeinnaam instellen, beveiligd met HTTPS.

Snel aan de slag en focus op uw werk: binnen ongeveer 5 minuten beschikt u over een productieklare Elasticsearch cloud hosting omgeving, waarbij routineonderhoud en beveiliging voor u geregeld zijn.

Om het verwerkte document te bekijken, haalt u het op met behulp van zijn ID:

GET my_index/_doc/my_id

De reactie zou er als volgt uit moeten zien:

{
  "_index" : "my_index",
  "_type" : "_doc",
  "_id" : "my_id",
  "_version" : 1,
  "found" : true,
  "_source" : {
    "data" : "e1xydGYxXGFuc2kKVGhpcyBpcyB0aGUgY29udGVudCBvZiBhIFJURiBmaWxlClxwYXIgfQ==",
    "attachment" : {
      "content_type" : "application/rtf",
      "language" : "en",
      "content" : "This is the content of a RTF file",
      "content_length" : 35
    }
  }
}

Merk op dat het _source-veld nu zowel de originele Base64-gegevens als de geëxtraheerde bijlagegegevens zoals bestandstype en inhoud bevat.