Վեկտորային տվյալների բազաներ

Կառավարվող վեկտորային տվյալների բազա, որը պարզապես PostgreSQL է

Պահպանեք ներդրումները և որոնեք դրանք իմաստով՝ pgvector-ում, որը մենք գործարկում և պահուստավորում ենք ձեզ համար: Նոր տվյալների պահոց սովորելու կարիք չկա, չափսավորելու կլաստեր չկա. ստեղծեք ինդեքս, գրեք ձեր վեկտորները և հարցում արեք արդեն իսկ ունեցած API բանալիով:

Ձեր արդեն իսկ վստահելի տվյալների բազան՝ ևս մեկ լրացուցիչ սյան տեսակով

Վեկտորային տվյալների բազան սովորաբար երկրորդ համակարգն է, որը գործարկվում է առաջինի կողքին՝ ևս մեկ կլաստեր, ևս մեկ կրկնօրինակման պատմություն, ևս մեկ բան, որի համար պետք է արթնանալ: Սա pgvector-ն է PostgreSQL-ի ներսում. նույն շարժիչը, նույն ամրությունը, նույն գիշերային բազային կրկնօրինակումը և գրելուց առաջ մատյանի (WAL) անընդհատ արխիվացումը, որն ստանում է այստեղի մնացած ամեն ինչ: Ձեր ինդեքսը սովորական աղյուսակ է՝ դրա վրա HNSW ինդեքսով, ուստի այն արագ է մոտավոր ամենամոտ հարևանի որոնման համար և ձանձրալի՝ մյուս բոլոր առումներով, ինչն այն հատկությունն է, որը ցանկանում եք գիշերվա ժամը երեքին:

Ձեր մոդելի լայնությունը, ոչ թե մեր ընտրած լայնությունը

Կառավարվող վեկտորային ծառայությունների մեծ մասը ստիպում է ձեզ ընտրել չափումների կարճ ցանկից: Ձերինը պարտադիր չէ, որ կլոր թիվ լինի. 1-ից մինչև 3072 ցանկացած արժեք ընդունվում և պահպանվում է ճշգրիտ կերպով, քանի որ ավելի նեղ վեկտորը զրոներով լրացվում է մինչև հաջորդ ֆիզիկական լայնությունը, ինչը կոսինուսային, էվկլիդեսյան և ներքին արտադրյալի հեռավորությունները փոխում է ուղիղ զրոյով: 1408 չափման մոդելը դասակարգվում է ճիշտ այնպես, ինչպես դրա համար բնիկ ձևով չափսավորվածը, և ընթերցումները ձեզ են վերադարձնում ձեր պահպանված 1408 արժեքները, այլ ոչ թե լրացումը:

Ներառված է յուրաքանչյուր վեկտորային պլանում

  • Ցանկացած ներդրման լայնություն մինչև 3072, և կոսինուսային, էվկլիդյան կամ ներքին արտադրյալի հեռավորություն
  • Մetaդատվություններ, որոնք պահվում են յուրաքանչյուր վեկտորի հետ և ֆիլտրվում հարցման ժամանակ
  • Գիշերային պահուստային պատճեններ 30-օրյա պահպանման ժամկետով և տվյալների վերականգնում մինչև որոշակի պահ
  • Տողային մակարդակի անվտանգություն, որպեսզի մի կազմակերպության վեկտորները հասանելի չլինեն մյուսին

Պլաններ և գներ

Երեք մակարդակ, որոնց գինը որոշվում է այն երկու բանով, որոնք իրականում մեզ արժեն ինչ-որ բան՝ որքան եք պահպանում և որքան եք որոնում:

Գնագոյացված է ըստ ձեր կազմաձևման

Ծախսը կախված է տարածաշրջանից, սարքի չափից, թողունակությունից և ձեր ընտրած պահեստից, ուստի չկա մեկ ամսական գումար, որը մենք կարող ենք ազնվորեն նշել այստեղ: Ասացեք մեզ աշխատանքային ծանրաբեռնվածությունը, և մենք կհաշվարկենք այն:

Աշխատում է 100% վերականգնվող էներգիայով

Մեր գործարկած յուրաքանչյուր սերվեր, յուրաքանչյուր ապրանքի դեպքում, աշխատում է վերականգնվող էլեկտրաէներգիայով: Ոչ թե հետագայում փոխհատուցված, այլ հենց սկզբից այդպես ստացված:

  • 100% վերականգնվող էլեկտրաէներգիա մեր բոլոր հոսթինգներում
  • Տվյալների կենտրոններ, որոնք աշխատում են 1.1-ից 1.2 PUE ցուցանիշով
  • Մեր համատեղ հարթակի կայքերը հաջողությամբ անցնում են Green Web Foundation-ի ստուգումները․ դա երրորդ կողմ է, որը կարող եք ինքնուրույն ստուգել։

Կարդացեք, թե ինչպես ենք մենք գործարկում հարթակը

Հարցեր, որոնք մարդիկ տալիս են գնումից առաջ

Ո՞ր ներդրման մոդելների հետ է սա աշխատում:

Դրանցից ցանկացածը: Դուք մեզ ուղարկում եք Ձեր մոդելի ստացած թվերը, այնպես որ OpenAI-ը, Cohere-ը, Voyage-ը, Ձեր սեփական մեքենայի վրա գտնվող Sentence-Transformers մոդելը և ցանկացած այլ բան մեզ համար նույնն են: Դուք նշում եք լայնությունը ինդեքսը ստեղծելիս՝ 384, 768, 1024, 1536 և 3072 թվերը տարածված են, ինչպես նաև դրանցմիջև եղած այլ արժեքները:

Կարո՞ղ եմ արդյոք ավելի ուշ փոխել ինդեքսի լայնությունը կամ հեռավորության ֆունկցիան:

Ո՛չ, և մենք նախընտրում ենք դա ուղղակիորեն ասել, քան թույլ տալ, որ ինքներդ բացահայտեք: Երկուսն էլ որոշում են, թե որտեղ են ֆիզիկապես պահվում ձեր վեկտորները և ինչպես են դասակարգվում, ուստի որևէ մեկի փոփոխությունը աննկատորեն անվավեր կդարձնի ինդեքսում արդեն առկա ամեն ինչ: Եթե անցնում եք այլ ներդրման մոդելի, ստեղծեք երկրորդ ինդեքս և գրեք դրա մեջ. նույն բանը, ինչ պահանջում է ցանկացած վեկտորային տվյալների բազա, և նույն պատճառով:

Կա՞ արդյոք որևէ տարբերություն շատ լայն վեկտորների միջև:

Այո՛, և արժե իմանալ այդ մասին։ 2,000 չափումից բարձր արժեքները պահվում են կիսաճշգրտությամբ, քանի որ PostgreSQL-ի HNSW ինդեքսը չի ընդունում դրանից լայն լրիվ ճշգրտության սյունակ։ 3072 չափման մոդելների դեպքում սա հենց այն մոտեցումն է, որն առաջարկում է pgvector-ը, և վարկանիշի վրա ազդեցությունը աննշան է, սակայն սա իրական փոխզիջում է, և դուք պետք է դրա մասին իմանաք մեզնից, այլ ոչ թե ինքներդ գուշակեք։

Արդյո՞ք ստանում եմ տվյալների բազայի միացման տող:

Այսօր ոչ։ Դուք մուտք եք գործում ձեր ինդեքս HTTPS-ի միջոցով ձեր Zinn® API բանալիով, որն այնպես է սահմանափակված, որ որոնում կատարելու հնարավորություն ունեցող բանալին չի կարող այլևս որևէ բան անել ձեր հաշվում: Հենց սա է թույլ տալիս մեզ արդարացիորեն հաշվարկել հարցումները և մեկ վարձակալի տողերն անմատչելի պահել մյուսի համար: Եթե ձեզ ուղղակի միացում է հարկավոր, ասե՛ք մեզ. մենք նախընտրում ենք այն կառուցել, քանի որ ինչ-որ մեկը խնդրել է, քան գուշակել:

Ի՞նչ սկզբունքով է չափվում, և արդյոք կարո՞ղ եմ ինքս ստուգել տվյալները:

Երկու մետրիկայով․ որքան եք պահեստավորում և քանի որոնում եք կատարում օրացուցային ամսվա ընթացքում։ Երկուսն էլ հասանելի են ձեր վահանակում՝ իրական ժամանակում։ Պահեստավորումը ֆիզիկական աղյուսակի չափի փոխարեն հրապարակված բանաձև է՝ տողի վերադիր, գումարած պահեստավորված լայնությունը, գումարած ձեր սեփական id-ների և մետատվյալների երկարությունը, հենց այն պատճառով, որ դուք կարողանաք վերարտադրել այն գումարը, որի համար մենք հաշիվ ենք ներկայացնում, այլ ոչ թե պարզապես հավատաք մեր խոսքին։