Vektorové databáze
Spravovaná vektorová databáze, která je prostě jen PostgreSQL
Ukládejte vložení a vyhledávejte v nich podle významu pomocí pgvector, který spravujeme a zálohujeme za vás. Žádné nové datové úložiště, které byste se museli učit, žádné dimenzování clusteru – vytvořte index, zapište své vektory a vyhledejte je pomocí API klíče, který již máte.
Databáze, které už důvěřujete, s jedním typem sloupce navíc
Vektorová databáze bývá obvykle druhým systémem, který běží vedle toho prvního: další cluster, další zálohovací strategie, další věc, kvůli které vás probudí. Tohle je pgvector uvnitř PostgreSQL — stejný engine, stejná odolnost, stejné každodenní noční zálohy a průběžná archivace transakčního protokolu (WAL), kterou dostává všechno ostatní. Vaše indexování probíhá v běžné tabulce s HNSW indexem, takže je rychlé pro přibližné vyhledávání nejbližších sousedů a nudné v každém dalším ohledu, což je vlastnost, kterou ve tři ráno oceníte.
Šířka vašeho modelu, nikoli šířka, kterou jsme zvolili my
Většina spravovaných vektorových služeb vás nutí vybírat z krátkého seznamu dimenzí. Ta vaše nemusí mít kulaté číslo: akceptováno je cokoli od 1 do 3072 a je to přesně uloženo, protože užší vektor se doplní nulami na nejbližší fyzickou šířku – což kosinovou, euklidovskou a vnitřní součinovou vzdálenost nezmění vůbec ničím. Model se 1408 dimenzemi se řadí identicky jako model pro tuto velikost nativně vytvořený a čtení vám vrátí 1408 hodnot, které jste uložili, nikdy výplň.
Zahrnuto v každém vektorovém plánu
- Libovolná šířka vkládání do 3072 a kosinová, euklidovská nebo vnitřní součinová vzdálenost
- Metadata uložená s každým vektorem a filtrovaná při dotazu
- Noční zálohy s 30denní dobou uchování a obnovením k určitému okamžiku
- Zabezpečení na úrovni řádků, takže vektory jedné organizace jsou pro jinou nedostupné
Tarify a ceny
Tři úrovně, naceněné podle dvou věcí, které nás skutečně něco stojí: kolik toho uložit a kolik toho prohledat.
Cena podle vaší konfigurace
Cena závisí na regionu, velikosti serveru, přenosu dat a úložišti, které zvolíte, takže zde nemůžeme poctivě uvést jedinou měsíční částku. Řekněte nám, jakou zátěž plánujete, a my vám připravíme cenovou nabídku.
Poháněno 100% obnovitelnou energií
Každý server, který provozujeme u každého produktu, je napájen elektřinou z obnovitelných zdrojů. Žádné kompenzace až dodatečně – energie je takto odebírána přímo.
- 100% obnovitelná elektřina u celého našeho hostingu
- Datová centra fungující s PUE 1,1 až 1,2
- Weby na naší sdílené platformě procházejí kontrolami Green Web Foundation – jedná se o třetí stranu, kterou si můžete sami ověřit
Často kladené otázky před nákupem
Se kterými modely vkládání to funguje?
Kterýkoli z nich. Pošlete nám čísla, která váš model vygeneroval, takže OpenAI, Cohere, Voyage, model Sentence-Transformers na vašem vlastním stroji a cokoli dalšího je pro nás jedno a totéž. Při vytváření indexu nám sdělíte šířku – 384, 768, 1024, 1536 a 3072 jsou běžné hodnoty a totéž platí pro jakoukoli hodnotu mezi nimi.
Lze šířku indexu nebo distanční funkci později změnit?
Ne, a raději to řekneme otevřeně, než abyste na to přišli sami. Obě volby určují, kde jsou vaše vektory fyzicky uloženy a jak jsou řazeny, takže změna kterékoliv z nich by tiše zneplatnila vše, co již v indexu je. Pokud přepnete na jiný model vkládání, vytvořte druhý index a pište do něj – totéž, co po vás požaduje každá vektorová databáze, a ze stejného důvodu.
Je na velmi širokých vektorech něco jiného?
Ano, a stojí za to to vědět. Nad 2 000 dimenzí jsou hodnoty uloženy v poloviční přesnosti, protože index HNSW v databázi PostgreSQL nepřijímá sloupec s plnou přesností širší než tato hodnota. U modelů s 3072 dimenzemi je to přístup, který doporučuje samotný pgvector, a vliv na hodnocení je zanedbatelný – jde však o reálný kompromis a je lepší, když se o něm dozvíte od nás, než abyste si ho domýšleli.
Získám připojovací řetězec k databázi?
Dnes ne. K našemu indexu přistupujete přes HTTPS pomocí svého klíče API Zinn®, který má omezený rozsah, takže klíč určený pro vyhledávání nemůže ve vašem účtu dělat nic jiného. Právě to nám umožňuje poctivě měřit počet dotazů a zajistit, aby řádky jednoho tenanta nebyly dostupné pro jiného. Pokud potřebujete přímé připojení, dejte nám vědět – raději ho vytvoříme, protože si o něj někdo řekl, než abychom hádali.
Jak se to měří a mohu si sám zkontrolovat údaje?
Na dvou metrech: kolik toho uložíte a kolik vyhledávání provedete za kalendářní měsíc. Obojí najdete na svém panelu v reálném čase. Úložiště se řídí zveřejněným vzorcem namísto fyzické velikosti tabulky – režie řádků plus uložená šířka plus délka vašich vlastních ID a metadat – přesně proto, abyste si mohli údaj, který vám fakturujeme, sami spočítat a nemuseli nám věřit na slovo.