Elasticsearch: Haal het document met de bijlage-inhoud op
Deze documentatie maakt deel uit van de Ingest attachment plugin-gids. Bekijk de volledige gids hier: Hoe gegevens uit PPT-, XLS- en PDF-bestanden naar Elasticsearch te extraheren.
👋 Welkom bij de Stackhero-documentatie
Stackhero biedt een volledig beheerde Elasticsearch cloud dienst, speciaal ontwikkeld voor professionals die behoefte hebben aan betrouwbare zoekfunctionaliteit, analytics en logging op schaal.
- Consistente performance en sterke beveiliging dankzij een privé, dedicated infrastructuur.
- Eenvoudig een eigen domeinnaam instellen, beveiligd met HTTPS.
Snel aan de slag en focus op uw werk: binnen ongeveer 5 minuten beschikt u over een productieklare Elasticsearch cloud hosting omgeving, waarbij routineonderhoud en beveiliging voor u geregeld zijn.
Om het verwerkte document te bekijken, haalt u het op met behulp van zijn ID:
GET my_index/_doc/my_id
De reactie zou er als volgt uit moeten zien:
{
"_index" : "my_index",
"_type" : "_doc",
"_id" : "my_id",
"_version" : 1,
"found" : true,
"_source" : {
"data" : "e1xydGYxXGFuc2kKVGhpcyBpcyB0aGUgY29udGVudCBvZiBhIFJURiBmaWxlClxwYXIgfQ==",
"attachment" : {
"content_type" : "application/rtf",
"language" : "en",
"content" : "This is the content of a RTF file",
"content_length" : 35
}
}
}
Merk op dat het _source-veld nu zowel de originele Base64-gegevens als de geëxtraheerde bijlagegegevens zoals bestandstype en inhoud bevat.