Valkey: Dobór rozmiaru usługi

Ta dokumentacja jest częścią przewodnika Wyszukiwanie wektorowe i RAG. Pełny przewodnik znajdziesz tutaj: Wyszukiwanie semantyczne, rekomendacje i retrieval-augmented generation z Valkey.

👋 Witamy w dokumentacji Stackhero!

Stackhero oferuje gotowe do użycia rozwiązanie Valkey cloud, które zapewnia szereg korzyści, w tym:

  • Wbudowany web UI Valkey Admin.
  • Nieograniczony rozmiar i transfer wiadomości.
  • Bezproblemowe aktualizacje jednym kliknięciem.
  • Optymalna wydajność i wysoki poziom bezpieczeństwa dzięki prywatnej, dedykowanej infrastrukturze.

Oszczędzaj czas i uprość sobie życie: wystarczy 5 minut, aby przetestować rozwiązanie Valkey cloud hosting od Stackhero!

Wektory są przechowywane w pamięci RAM, dlatego ważne jest, aby zaplanować ich zużycie. Przybliżone oszacowanie dla wektorów float32 to:

numberOfVectors x dimensions x 4 bajty, plus około 30 do 50 procent dodatkowo na graf HNSW.

Na przykład milion wektorów o wymiarze 1536 wymaga około 6 GB na surowe wektory. Plan 20 GB to komfortowy punkt wyjścia. Możesz zmniejszyć zużycie pamięci, wybierając model o mniejszej liczbie wymiarów: model 768-wymiarowy zużywa tylko połowę pamięci modelu 1536-wymiarowego.

Rzeczywiste zużycie pamięci możesz sprawdzić poleceniem FT.INFO chunksIndex oraz metryką used_memory w swoim monitoringu Prometheus. Jeśli potrzebujesz więcej pamięci, możesz w każdej chwili zwiększyć plan z poziomu dashboardu.