Redis®*: Dobór rozmiaru usługi
Ta dokumentacja jest częścią przewodnika Wyszukiwanie wektorowe i RAG. Pełny przewodnik znajdziesz tutaj: Wyszukiwanie semantyczne, rekomendacje i retrieval-augmented generation z Redis.
👋 Witamy w dokumentacji Stackhero!
Stackhero oferuje gotowe do użycia rozwiązanie Redis cloud, które zapewnia szereg korzyści, w tym:
- Wbudowany web UI
Redis Commander.- Nieograniczona wielkość i transfer wiadomości.
- Bezproblemowe aktualizacje za pomocą jednego kliknięcia.
- Optymalna wydajność i wysoki poziom bezpieczeństwa dzięki prywatnej, dedykowanej infrastrukturze.
Oszczędzaj czas i uprość sobie życie: wystarczy 5 minut, aby przetestować rozwiązanie hostingu Redis cloud od Stackhero!
Wektory są przechowywane w pamięci RAM. Możesz oszacować zapotrzebowanie na pamięć według wzoru:
numberOfVectors x dimensions x 4 bytes, plus około 30–50% dodatkowo na graf HNSW.
Na przykład milion wektorów o wymiarze 1536 zajmuje około 6 GB na surowe wektory. Plan 20 GB to komfortowy punkt wyjścia dla tej skali. Możesz zmniejszyć zużycie pamięci poprzez:
- Użycie mniejszego modelu. Na przykład model o 768 wymiarach zużywa połowę pamięci w porównaniu do modelu o 1536 wymiarach.
- Przechowywanie w
FLOAT16zamiastFLOAT32, jeśli Twój model to obsługuje, co ponownie zmniejsza zużycie o połowę.
Możesz monitorować rzeczywiste zużycie za pomocą FT.INFO chunksIndex oraz metryki used_memory w swoim monitoringu Prometheus. Jeśli Twoje potrzeby rosną, podniesienie planu jest proste i możliwe bezpośrednio z panelu.