Valkey: Dimensionamento del servizio
Questa documentazione fa parte della guida Ricerca vettoriale e RAG. Consulta la guida completa qui: Ricerca semantica, raccomandazioni e retrieval-augmented generation con Valkey.
👋 Benvenuto nella documentazione di Stackhero!
Stackhero offre una soluzione Valkey cloud pronta all'uso che garantisce numerosi vantaggi, tra cui:
- Interfaccia web Valkey Admin inclusa.
- Dimensione e trasferimento dei messaggi illimitati.
- Aggiornamenti semplici con un solo clic.
- Prestazioni ottimali e sicurezza avanzata grazie a un'infrastruttura privata e dedicata.
Risparmia tempo e semplificati la vita: bastano 5 minuti per provare la soluzione Valkey cloud hosting di Stackhero!
I vettori vengono memorizzati in memoria, quindi è importante pianificare il loro impatto. Una stima approssimativa per vettori float32 è:
numberOfVectors x dimensions x 4 bytes, più circa il 30-50% in più per il grafo HNSW.
Ad esempio, un milione di vettori da 1536 dimensioni richiedono circa 6 GB per i vettori grezzi. Un piano da 20 GB rappresenta un punto di partenza confortevole. Potete ridurre l'utilizzo di memoria scegliendo un modello con meno dimensioni: un modello da 768 dimensioni utilizza solo la metà della memoria rispetto a uno da 1536.
Potete verificare l'utilizzo reale della memoria con FT.INFO chunksIndex e con la metrica used_memory nel vostro monitoraggio Prometheus. Se avete bisogno di più memoria, potete aggiornare il vostro piano in qualsiasi momento dalla dashboard.