Vektoradatbázisok
Egy felügyelt vektorialapú adatbázis, ami nem más, mint a PostgreSQL
Tárolja a beágyazásokat, és keressen közöttük értelem szerint a pgvector segítségével, amelyet mi üzemeltetünk és mentünk az Ön számára. Nem kell új adatbázist megtanulnia, sem klasztert méreteznie – hozzon létre egy indexet, írja be a vektorait, és kérdezze le a már meglévő API-kulcsával.
Az adatbázis, amelyben már megbízhat, egy extra oszloptípussal
A vektorialis adatbazis altalaban egy masodik rendszer, amelyet az elso mellett kell futtatni: egy ujabb fürt, egy ujabb mentesi tortenet, egy ujabb dolog, ami miatt fel kell ebreszteni. Ez a pgvector a PostgreSQL belsejeben – ugyanaz a motor, ugyanaz a tartossag, ugyanaz az ejszakai alapmentes es a folyamatos iraseloztetesi naplo archivalas, amit minden mas kap itt. Az on indexe egy atlagos tabla rajta egy HNSW indexszel, igy gyors a kozelitett legkozelebbi szomszed kereseshez, es minden mas tekintetben unalmas, ami az a tulajdonsag, amit hajnali haromkor ker.
A modellje szélessége, nem pedig egy általunk választott szélesség
A legtöbb felügyelt vektorszolgáltatás rövid dimenziólistából enged választani. Az Öné nem kell, hogy kerek szám legyen: 1-től 3072-ig bármi elfogadható és pontosan megőrizhető, mivel a szűkebb vektort a rendszer nullákkal egészíti ki a következő fizikai szélességig – ami pontosan nullával változtatja meg a koszinusz-, euklideszi és belső szorzat szerinti távolságot. Egy 1408 dimenziós modell teljesen azonosan rangsorol, mint a natívan ahhoz méretezett, és az olvasások során pontosan a letárolt 1408 értéket kapja vissza, a kiegészítés (padding) nélkül.
Minden vektoros csomag tartalmazza
- Bármilyen beágyazási szélesség 3072-ig, valamint koszinusz, euklideszi vagy belső szorzatos távolság
- Minden vektorhoz tárolt és a lekérdezés időpontjában szűrt metaadatok
- Éjszakai biztonsági mentések 30 napos megőrzéssel és pillanatnyi állapotra való visszaállítással
- Sor szintű biztonság, így az egyik szervezet vektorai nem érhetők el a másik számára
Csomagok és árak
Három csomag, amelynek ára a két olyan tényezőn alapul, ami nekünk valójában pénzbe kerül: mennyi az adatmennyiség, amit tárol, és mennyi a keresés, amit indít.
A beállítása alapján árazva
A költség a kiválasztott régiótól, a gép méretétől, a sávszélességtől és a tárhelytől függ, így nincsen olyan egyetlen havi összeg, amelyet őszintén feltüntethetnénk itt. Mondja el nekünk a munkaterhelést, és adunk rá egy árajánlatot.
100%-ban megújuló energiával működik
Minden általunk üzemeltetett szerver, minden termékünk esetében, megújuló villamos energiával működik. Nem utólag kompenzálva – már eleve így beszerezve.
- 100%-ban megújuló villamos energia az összes tárhelyünkön
- 1,1 és 1,2 közötti PUE-értéken futó adatközpontok
- A megosztott platformunkon található webhelyek megfelelnek a Green Web Foundation ellenőrzésén – ezt a független felet Ön is ellenőrizheti
Gyakori kérdések a vásárlás előtt
Melyik beágyazási modellekkel működik ez?
Bármelyiket. Ön elküldi nekünk a modellje által előállított számokat, így az OpenAI, a Cohere, a Voyage, egy saját gépén futó Sentence-Transformers modell és bármi más is teljesen egyforma számunkra. Az index létrehozásakor megadja nekünk a szélességet – a 384, 768, 1024, 1536 és 3072 mind gyakoriak, csakúgy, mint bármi a kettő között.
Módosíthatom később az index szélességét vagy távolságfüggvényét?
Nem, és inkább megmondjuk ezt őszintén, semhogy hagynánk, hogy ön fedezze fel. Mindkettő meghatározza, hogy a vektorok fizikailag hol vannak tárolva, és hogyan vannak rangsorolva, így bármelyik megváltoztatása csendben érvénytelenítene mindent, ami már az indexben van. Ha másik beágyazási modellre vált, hozzon létre egy második indexet, és írjon abba – ugyanez az, amit minden vektoriális adatbázis kér öntől, és ugyanabból az okból.
Van bármi különbség a nagyon széles vektorok esetében?
Igen, és érdemes tudni. 2000 dimenzió felett az értékek félpontosságúak, mivel a PostgreSQL HNSW indexe nem fogad el ennél szélesebb, teljes pontosságú oszlopot. A 3072 dimenziós modellek esetében ez az a megközelítés, amelyet maga a pgvector javasol, és a rangsorolásra gyakorolt hatása elhanyagolható – ez azonban valós kompromisszum, és jobb, ha tőlünk hallja, mint ha saját maga jönne rá.
Kapok adatbázis-kapcsolati karakterláncot?
Ma még nem. HTTPS-en keresztül éri el az indexét a Zinn® API-kulcsával, amely úgy van korlátozva, hogy a keresésre képes kulcs semmi mást nem tehet a fiókjában. Ez teszi lehetővé számunkra a lekérdezések pontos mérését, valamint azt, hogy az egyik bérlő sorai elérhetetlenek maradjanak a másik számára. Ha közvetlen kapcsolatra van szüksége, jelezze nekünk – szívesebben építjük meg azért, mert valaki kérte, minthogy találgassunk.
Hogyan történik a mérés, és ellenőrizhetem én magam a számokat?
Két mutató alapján: mennyi adatot tárol és hány keresést futtat egy naptári hónapban. Mindkettő megjelenik a vezérlőpultján, amint megtörténnek. A tárhely egy publikált képlet alapján számítódik, nem pedig egy fizikai táblaméret szerint – sorok többletköltsége, a tárolt szélesség, valamint saját azonosítói és metaadatai hossza –, pontosan azért, hogy ön is reprodukálni tudja azt az összeget, amelyet számlázunk önnek, ahelyett hogy vakon hinne nekünk.