Valkey: Dobór rozmiaru usługi
Ta dokumentacja jest częścią przewodnika Wyszukiwanie wektorowe i RAG. Pełny przewodnik znajdziesz tutaj: Wyszukiwanie semantyczne, rekomendacje i retrieval-augmented generation z Valkey.
👋 Witamy w dokumentacji Stackhero!
Stackhero oferuje gotowe do użycia rozwiązanie Valkey cloud, które zapewnia szereg korzyści, w tym:
- Wbudowany web UI
Valkey Admin.- Nieograniczony rozmiar i transfer wiadomości.
- Bezproblemowe aktualizacje jednym kliknięciem.
- Optymalna wydajność i wysoki poziom bezpieczeństwa dzięki prywatnej, dedykowanej infrastrukturze.
Oszczędzaj czas i uprość sobie życie: wystarczy 5 minut, aby przetestować rozwiązanie Valkey cloud hosting od Stackhero!
Wektory są przechowywane w pamięci RAM, dlatego ważne jest, aby zaplanować ich zużycie. Przybliżone oszacowanie dla wektorów float32 to:
numberOfVectors x dimensions x 4 bajty, plus około 30 do 50 procent dodatkowo na graf HNSW.
Na przykład milion wektorów o wymiarze 1536 wymaga około 6 GB na surowe wektory. Plan 20 GB to komfortowy punkt wyjścia. Możesz zmniejszyć zużycie pamięci, wybierając model o mniejszej liczbie wymiarów: model 768-wymiarowy zużywa tylko połowę pamięci modelu 1536-wymiarowego.
Rzeczywiste zużycie pamięci możesz sprawdzić poleceniem FT.INFO chunksIndex oraz metryką used_memory w swoim monitoringu Prometheus. Jeśli potrzebujesz więcej pamięci, możesz w każdej chwili zwiększyć plan z poziomu dashboardu.