Vektorové databáze

Spravovaná vektorová databáze, která je prostě jen PostgreSQL

Ukládejte vložení a vyhledávejte v nich podle významu pomocí pgvector, který spravujeme a zálohujeme za vás. Žádné nové datové úložiště, které byste se museli učit, žádné dimenzování clusteru – vytvořte index, zapište své vektory a vyhledejte je pomocí API klíče, který již máte.

Databáze, které už důvěřujete, s jedním typem sloupce navíc

Vektorová databáze bývá obvykle druhým systémem, který běží vedle toho prvního: další cluster, další zálohovací strategie, další věc, kvůli které vás probudí. Tohle je pgvector uvnitř PostgreSQL — stejný engine, stejná odolnost, stejné každodenní noční zálohy a průběžná archivace transakčního protokolu (WAL), kterou dostává všechno ostatní. Vaše indexování probíhá v běžné tabulce s HNSW indexem, takže je rychlé pro přibližné vyhledávání nejbližších sousedů a nudné v každém dalším ohledu, což je vlastnost, kterou ve tři ráno oceníte.

Šířka vašeho modelu, nikoli šířka, kterou jsme zvolili my

Většina spravovaných vektorových služeb vás nutí vybírat z krátkého seznamu dimenzí. Ta vaše nemusí mít kulaté číslo: akceptováno je cokoli od 1 do 3072 a je to přesně uloženo, protože užší vektor se doplní nulami na nejbližší fyzickou šířku – což kosinovou, euklidovskou a vnitřní součinovou vzdálenost nezmění vůbec ničím. Model se 1408 dimenzemi se řadí identicky jako model pro tuto velikost nativně vytvořený a čtení vám vrátí 1408 hodnot, které jste uložili, nikdy výplň.

Zahrnuto v každém vektorovém plánu

  • Libovolná šířka vkládání do 3072 a kosinová, euklidovská nebo vnitřní součinová vzdálenost
  • Metadata uložená s každým vektorem a filtrovaná při dotazu
  • Noční zálohy s 30denní dobou uchování a obnovením k určitému okamžiku
  • Zabezpečení na úrovni řádků, takže vektory jedné organizace jsou pro jinou nedostupné

Tarify a ceny

Tři úrovně, naceněné podle dvou věcí, které nás skutečně něco stojí: kolik toho uložit a kolik toho prohledat.

Cena podle vaší konfigurace

Cena závisí na regionu, velikosti serveru, přenosu dat a úložišti, které zvolíte, takže zde nemůžeme poctivě uvést jedinou měsíční částku. Řekněte nám, jakou zátěž plánujete, a my vám připravíme cenovou nabídku.

Poháněno 100% obnovitelnou energií

Každý server, který provozujeme u každého produktu, je napájen elektřinou z obnovitelných zdrojů. Žádné kompenzace až dodatečně – energie je takto odebírána přímo.

  • 100% obnovitelná elektřina u celého našeho hostingu
  • Datová centra fungující s PUE 1,1 až 1,2
  • Weby na naší sdílené platformě procházejí kontrolami Green Web Foundation – jedná se o třetí stranu, kterou si můžete sami ověřit

Přečtěte si, jak provozujeme tuto platformu

Často kladené otázky před nákupem

Se kterými modely vkládání to funguje?

Kterýkoli z nich. Pošlete nám čísla, která váš model vygeneroval, takže OpenAI, Cohere, Voyage, model Sentence-Transformers na vašem vlastním stroji a cokoli dalšího je pro nás jedno a totéž. Při vytváření indexu nám sdělíte šířku – 384, 768, 1024, 1536 a 3072 jsou běžné hodnoty a totéž platí pro jakoukoli hodnotu mezi nimi.

Lze šířku indexu nebo distanční funkci později změnit?

Ne, a raději to řekneme otevřeně, než abyste na to přišli sami. Obě volby určují, kde jsou vaše vektory fyzicky uloženy a jak jsou řazeny, takže změna kterékoliv z nich by tiše zneplatnila vše, co již v indexu je. Pokud přepnete na jiný model vkládání, vytvořte druhý index a pište do něj – totéž, co po vás požaduje každá vektorová databáze, a ze stejného důvodu.

Je na velmi širokých vektorech něco jiného?

Ano, a stojí za to to vědět. Nad 2 000 dimenzí jsou hodnoty uloženy v poloviční přesnosti, protože index HNSW v databázi PostgreSQL nepřijímá sloupec s plnou přesností širší než tato hodnota. U modelů s 3072 dimenzemi je to přístup, který doporučuje samotný pgvector, a vliv na hodnocení je zanedbatelný – jde však o reálný kompromis a je lepší, když se o něm dozvíte od nás, než abyste si ho domýšleli.

Získám připojovací řetězec k databázi?

Dnes ne. K našemu indexu přistupujete přes HTTPS pomocí svého klíče API Zinn®, který má omezený rozsah, takže klíč určený pro vyhledávání nemůže ve vašem účtu dělat nic jiného. Právě to nám umožňuje poctivě měřit počet dotazů a zajistit, aby řádky jednoho tenanta nebyly dostupné pro jiného. Pokud potřebujete přímé připojení, dejte nám vědět – raději ho vytvoříme, protože si o něj někdo řekl, než abychom hádali.

Jak se to měří a mohu si sám zkontrolovat údaje?

Na dvou metrech: kolik toho uložíte a kolik vyhledávání provedete za kalendářní měsíc. Obojí najdete na svém panelu v reálném čase. Úložiště se řídí zveřejněným vzorcem namísto fyzické velikosti tabulky – režie řádků plus uložená šířka plus délka vašich vlastních ID a metadat – přesně proto, abyste si mohli údaj, který vám fakturujeme, sami spočítat a nemuseli nám věřit na slovo.