Bazy danych wektorowych

Zarządzana baza danych wektorowych, która jest po prostu PostgreSQL

Przechowuj wektory osadzone i wyszukuj je według znaczenia w bazie pgvector, którą uruchamiamy i kopiujemy dla Ciebie. Żadnej nowej bazy danych do nauki, żadnego klastra do skalowania – utwórz indeks, zapisz wektory i wysyłaj zapytania za pomocą klucza API, który już masz.

Baza danych, której już ufasz, z jednym dodatkowym typem kolumny

Baza wektorowa to zazwyczaj drugi system uruchamiany obok pierwszego: kolejny klaster, kolejna strategia tworzenia kopii zapasowych, kolejna rzecz, do której trzeba wstać w nocy. Tak właśnie działa pgvector wewnątrz PostgreSQL — ten sam silnik, ta sama trwałość, te same nocne kopie zapasowe i ciągła archiwizacja dziennika transakcji (write-ahead log), które otrzymuje wszystko inne. Twój indeks to zwykła tabela z indeksem HNSW, dzięki czemu działa szybko przy wyszukiwaniu przybliżonych najbliższych sąsiadów i jest nudna pod każdym innym względem, co jest pożądaną cechą o trzeciej nad ranem.

Szerokość Twojego modelu, a nie wyznaczona przez nas

Większość zarządzanych usług wektorowych zmusza do wyboru spośród krótkiej listy wymiarów. Twój nie musi być równą liczbą: akceptowana i dokładnie zachowywana jest każda wartość od 1 do 3072, ponieważ węższy wektor jest uzupełniany do następnej szerokości fizycznej zerami — co dokładnie w niczym nie zmienia cosinusowej, euklidesowej ani iloczynu skalarnego odległości. Model o 1408 wymiarach plasuje się identycznie jak ten zaprojektowany dla niego natywnie, a odczyty zwracają dokładnie te 1408 wartości, które zapisano, a nigdy uzupełnienia.

W cenie każdego planu wektorowego

  • Dowolna szerokość osadzania do 3072 oraz odległość cosinusowa, euklidesowa lub iloczynu skalarnego
  • Metadane przechowywane przy każdym wektorze i filtrowane w momencie zapytania
  • Codzienne kopie zapasowe z 30-dniowym okresem przechowywania i przywracaniem do konkretnego punktu w czasie
  • Zabezpieczenie na poziomie wiersza, dzięki czemu wektory jednej organizacji są niedostępne dla innej

Plany i cennik

Trzy plany, których ceny zależą od dwóch rzeczy, które faktycznie nas kosztują: ile przechowujesz i ile wyszukujesz.

Cena zależy od konfiguracji

Koszt zależy od wybranego regionu, rozmiaru maszyny, przepustowości oraz pamięci masowej, dlatego nie możemy uczciwie podać tutaj jednej stałej kwoty miesięcznej. Powiedz nam, jakie jest Twoje obciążenie, a my przygotujemy wycenę.

Zasilane w 100% energią odnawialną

Każdy uruchamiany przez nas serwer, w przypadku każdego produktu, jest zasilany energią elektryczną ze źródeł odnawialnych. Nie kompensowaną po fakcie — pozyskiwaną w ten sposób.

  • 100% energii odnawialnej we wszystkich naszych usługach hostingowych
  • Centra danych działające ze wskaźnikiem PUE na poziomie od 1,1 do 1,2
  • Witryny na naszej platformie współdzielonej przechodzą testy Green Web Foundation — to niezależna organizacja, którą możesz sprawdzić samodzielnie

Przeczytaj, jak zarządzamy platformą

Pytania, które klienci zadają przed zakupem

Z którymi modelami osadzania to działa?

Każdy z nich. Przesyłasz nam liczby wygenerowane przez Twój model, więc OpenAI, Cohere, Voyage, model Sentence-Transformers na własnym serwerze i wszystko inne są dla nas bez różnicy. Podczas tworzenia indeksu podajesz nam szerokość – powszechne są wartości 384, 768, 1024, 1536 i 3072, podobnie jak wartości pośrednie.

Czy mogę później zmienić szerokość lub funkcję odległości indeksu?

Nie, i wolimy powiedzieć to otwarcie, niż pozwolić Ci to odkryć. Oba te elementy decydują o tym, gdzie fizycznie przechowywane są Twoje wektory oraz w jaki sposób są pozycjonowane, więc zmiana któregokolwiek z nich po cichu unieważniłaby wszystko, co znajduje się już w indeksie. Jeśli przełączasz się na inny model wektorowy, utwórz drugi indeks i zapisuj do niego — tego samego wymaga każda baza danych wektorów i z tego samego powodu.

Czy bardzo szerokie wektory czymś się różnią?

Tak, i warto o tym wiedzieć. Powyżej 2000 wymiarów wartości są zapisywane z połowioną precyzją, ponieważ indeks HNSW w bazie PostgreSQL nie obsługuje kolumny o pełnej precyzji szerszej niż ta wartość. W przypadku modeli 3072-wymiarowych jest to podejście zalecane przez samego pgvector, a wpływ na ranking jest pomijalny – jest to jednak realny kompromis i lepiej, abyś usłyszał o nim od nas, niż miał go domyślać się samodzielnie.

Czy otrzymam ciąg połączenia z bazą danych?

Nie dzisiaj. Uzyskujesz dostęp do swojego indeksu przez HTTPS za pomocą klucza API Zinn®, ograniczonego w taki sposób, że klucz przeznaczony do wyszukiwania nie może wykonywać żadnych innych operacji na Twoim koncie. To właśnie pozwala nam rzetelnie rozliczać zapytania i uniemożliwia dostęp do wierszy jednego dzierżawcy z poziomu konta innego dzierżawcy. Jeśli potrzebujesz bezpośredniego połączenia, daj nam znać – wolimy je zbudować, ponieważ ktoś o to poprosił, niż zgadywać.

Jak jest to mierzone i czy mogę samodzielnie sprawdzić te dane?

Na dwóch metrach: ile przechowujesz i ile wyszukiwań wykonujesz w miesiącu kalendarzowym. Oba parametry są widoczne na Twoim panelu w czasie rzeczywistym. Pamięć masowa opiera się na publikowanej formule, a nie na fizycznym rozmiarze tabeli – narzut na wiersz, plus przechowywana szerokość, plus długość własnych identyfikatorów i metadanych – dokładnie po to, abyś mógł odtworzyć kwotę, którą Ci naliczamy, zamiast wierzyć nam na słowo.