Redis®*: Dobór rozmiaru usługi

Ta dokumentacja jest częścią przewodnika Wyszukiwanie wektorowe i RAG. Pełny przewodnik znajdziesz tutaj: Wyszukiwanie semantyczne, rekomendacje i retrieval-augmented generation z Redis.

👋 Witamy w dokumentacji Stackhero!

Stackhero oferuje gotowe do użycia rozwiązanie Redis cloud, które zapewnia szereg korzyści, w tym:

  • Wbudowany web UI Redis Commander.
  • Nieograniczona wielkość i transfer wiadomości.
  • Bezproblemowe aktualizacje za pomocą jednego kliknięcia.
  • Optymalna wydajność i wysoki poziom bezpieczeństwa dzięki prywatnej, dedykowanej infrastrukturze.

Oszczędzaj czas i uprość sobie życie: wystarczy 5 minut, aby przetestować rozwiązanie hostingu Redis cloud od Stackhero!

Wektory są przechowywane w pamięci RAM. Możesz oszacować zapotrzebowanie na pamięć według wzoru:

numberOfVectors x dimensions x 4 bytes, plus około 30–50% dodatkowo na graf HNSW.

Na przykład milion wektorów o wymiarze 1536 zajmuje około 6 GB na surowe wektory. Plan 20 GB to komfortowy punkt wyjścia dla tej skali. Możesz zmniejszyć zużycie pamięci poprzez:

  • Użycie mniejszego modelu. Na przykład model o 768 wymiarach zużywa połowę pamięci w porównaniu do modelu o 1536 wymiarach.
  • Przechowywanie w FLOAT16 zamiast FLOAT32, jeśli Twój model to obsługuje, co ponownie zmniejsza zużycie o połowę.

Możesz monitorować rzeczywiste zużycie za pomocą FT.INFO chunksIndex oraz metryki used_memory w swoim monitoringu Prometheus. Jeśli Twoje potrzeby rosną, podniesienie planu jest proste i możliwe bezpośrednio z panelu.