Valkey: Dimensionamento del servizio

Questa documentazione fa parte della guida Ricerca vettoriale e RAG. Consulta la guida completa qui: Ricerca semantica, raccomandazioni e retrieval-augmented generation con Valkey.

👋 Benvenuto nella documentazione di Stackhero!

Stackhero offre una soluzione Valkey cloud pronta all'uso che garantisce numerosi vantaggi, tra cui:

  • Interfaccia web Valkey Admin inclusa.
  • Dimensione e trasferimento dei messaggi illimitati.
  • Aggiornamenti semplici con un solo clic.
  • Prestazioni ottimali e sicurezza avanzata grazie a un'infrastruttura privata e dedicata.

Risparmia tempo e semplificati la vita: bastano 5 minuti per provare la soluzione Valkey cloud hosting di Stackhero!

I vettori vengono memorizzati in memoria, quindi è importante pianificare il loro impatto. Una stima approssimativa per vettori float32 è:

numberOfVectors x dimensions x 4 bytes, più circa il 30-50% in più per il grafo HNSW.

Ad esempio, un milione di vettori da 1536 dimensioni richiedono circa 6 GB per i vettori grezzi. Un piano da 20 GB rappresenta un punto di partenza confortevole. Potete ridurre l'utilizzo di memoria scegliendo un modello con meno dimensioni: un modello da 768 dimensioni utilizza solo la metà della memoria rispetto a uno da 1536.

Potete verificare l'utilizzo reale della memoria con FT.INFO chunksIndex e con la metrica used_memory nel vostro monitoraggio Prometheus. Se avete bisogno di più memoria, potete aggiornare il vostro piano in qualsiasi momento dalla dashboard.