വെക്ടർ ഡാറ്റാബേസുകൾ

നിManaged വെക്ടര്‍ ഡാറ്റാബേസ് ആയ PostgreSQL

pgvector ഉപയോഗിച്ച് എംബെഡിംഗുകൾ സ്റ്റോർ ചെയ്യുകയും അർത്ഥത്തിന്റെ അടിസ്ഥാനത്തിൽ തിരയുകയും ചെയ്യുക, ഇത് ഞങ്ങൾ നിങ്ങൾക്കായി റൺ ചെയ്യുകയും ബാക്ക് അപ്പ് ചെയ്യുകയും ചെയ്യുന്നു. പഠിക്കാൻ പുതിയ ഡാറ്റാ സ്റ്റോറുകളില്ല, സൈസ് ചെയ്യാൻ ക്ലസ്റ്ററുകളില്ല — ഒരു ഇൻഡക്സ് സൃഷ്ടിക്കുക, നിങ്ങളുടെ വെക്ടറുകൾ എഴുതുക, നിങ്ങളുടെ കൈവശമുള്ള API കീ ഉപയോഗിച്ച് അത് ക്വറി ചെയ്യുക.

നിങ്ങൾ ഇതിനകം വിശ്വസിക്കുന്ന ഡേറ്റാബേസ്, ഒരു അധിക കോളം ടൈപ്പുകൂടിയുണ്ട്

ഒരു വെക്ടര്‍ ഡാറ്റാബേസ് സാധാരണയായി ആദ്യത്തേതിനൊപ്പം പ്രവര്‍ത്തിപ്പിക്കാനുള്ള രണ്ടാമത്തെ സിസ്റ്റമാണ്: മറ്റൊരു ക്ലസ്റ്റര്‍, മറ്റൊരു ബാക്കപ്പ് സ്റ്റോറി, രാത്രിയില്‍ ഉണര്‍ത്തേണ്ട മറ്റൊരു കാര്യം. PostgreSQL-നുള്ളിലെ pgvector ഇതാണ് — ഒരേ എഞ്ചിന്‍, ഒരേ ഡ്യൂറബിലിറ്റി, ഇവിടെയുള്ള മറ്റെല്ലാത്തിനും ലഭിക്കുന്ന അതേ പ്രതിവാര അടിസ്ഥാന ബാക്കപ്പും തുടര്‍ച്ചയായ റൈറ്റ്-എഹെഡ് ലോഗ് ആര്‍ക്കൈവിങ്ങും. നിങ്ങളുടെ ഇന്‍ഡക്സ് അതില്‍ ഒരു HNSW ഇന്‍ഡക്സ് ഉള്ള ഒരു സാധാരണ ടേബിളാണ്, അതിനാല്‍ ഇത് ഏകദേശ അടുത്തുള്ള അയല്‍പക്ക തിരച്ചിലിന് വേഗതയേറിയതും മറ്റെല്ലാ കാര്യങ്ങളിലും ലളിതവുമാണ്, രാത്രി മൂന്ന് മണിക്ക് നിങ്ങള്‍ ആഗ്രഹിക്കുന്ന ഗുണവിശേഷവും ഇതാണ്.

ഞങ്ങൾ തിരഞ്ഞെടുത്ത വീതിയല്ല, നിങ്ങളുടെ മോഡലിന്റെ വീതി

പല മാനേജ്ഡ് വെക്ടർ സേവനങ്ങളും ചുരുക്കം ചില അളവുകളിൽ നിന്ന് തിരഞ്ഞെടുക്കാൻ നിങ്ങളെ നിർബന്ധിക്കുന്നു. നിങ്ങളുടേത് ഒരു പൂർണ്ണസംഖ്യ ആയിരിക്കണമെന്നില്ല: 1 മുതൽ 3072 വരെയുള്ള ഏത് സംഖ്യയും സ്വീകരിക്കുകയും കൃത്യമായി സൂക്ഷിക്കുകയും ചെയ്യും, കാരണം ഒരു ഇടുങ്ങിയ വെക്ടർ അടുത്ത ഭൗതിക വീടിലേക്ക് പൂജ്യങ്ങൾ ചേർത്ത് പാഡ് ചെയ്യപ്പെടുന്നു - ഇത് കൊസൈൻ, യൂക്ലിഡിയൻ, ഇന്നർ-പ്രൊഡക്റ്റ് ദൂരങ്ങളെ ഒട്ടും മാറ്റുന്നില്ല. 1408 ഡയമൻഷൻ മോഡൽ അതിനായി നേറ്റീവ് ആയി നിർമ്മിച്ചതുപോലെ കൃത്യമായി റാങ്ക് ചെയ്യുന്നു, കൂടാതെ റീഡുകൾ പാഡിംഗുകളല്ല, നിങ്ങൾ സംഭരിച്ച 1408 മൂല്യങ്ങൾ തന്നെ തിരികെ നൽകുന്നു.

എല്ലാ വെക്ടര്‍ പ്ലാനുകളിലും ഉള്‍പ്പെടുത്തിയിരിക്കുന്നു

  • 3072 വരെയുള്ള ഏത് എംബെഡിംഗ് വീതിയും, ഒപ്പം കൊസൈൻ, യൂക്ലിഡിയൻ അല്ലെങ്കിൽ ഇന്നർ-പ്രൊഡക്റ്റ് ദൂരവും
  • ഓരോ വെക്ടറിലും സൂക്ഷിച്ചിരിക്കുന്ന മെറ്റാഡാറ്റ, ക്വറി സമയത്ത് ഫിൽട്ടർ ചെയ്യപ്പെടുന്നു
  • 30 ദിവസത്തെ നിലനിർത്തലും പോയിന്റ്-ഇൻ-ടൈം വീണ്ടെടുക്കലുമുള്ള പ്രതിവാര ബാക്കപ്പുകൾ
  • വരി-തല സുരക്ഷ (Row-level security), അതിനാൽ ഒരു സ്ഥാപനത്തിന്റെ വെക്റ്ററുകൾ മറ്റൊരു സ്ഥാപനത്തിന് ലഭ്യമാകില്ല

പ്ലാനുകളും വിലനിർണ്ണയവും

ഞങ്ങൾക്ക് യഥാർത്ഥത്തിൽ ചിലവ് വരുന്ന രണ്ട് കാര്യങ്ങളുടെ അടിസ്ഥാനത്തിൽ വിലയിട്ടിരിക്കുന്ന മൂന്ന് ടയറുകൾ: നിങ്ങൾ എത്രത്തോളം സ്റ്റോർ ചെയ്യുന്നു, എത്രത്തോളം തിരയുന്നു.

നിങ്ങളുടെ കോൺഫിഗറേഷന്റെ അടിസ്ഥാനത്തിൽ വില നിശ്ചയിച്ചിരിക്കുന്നു

ചെലവ് നിങ്ങൾ തിരഞ്ഞെടുക്കുന്ന പ്രദേശം, മെഷീൻ വലിപ്പം, ബാൻഡ്‌വിഡ്ത്ത്, സ്റ്റോറേജ് എന്നിവയെ ആശ്രയിച്ചിരിക്കുന്നു, അതിനാൽ ഇവിടെ ഞങ്ങൾക്ക് കൃത്യമായി ഒരു പ്രതിമാസ തുക നൽകാൻ കഴിയില്ല. നിങ്ങളുടെ വർക്ക്ലോഡ് ഞങ്ങളോട് പറയൂ, ഞങ്ങൾ അതിനുള്ള തുക കണക്കാക്കി നൽകാം.

100% പുനരുപയോഗ ഊർജ്ജത്തിൽ പ്രവർത്തിക്കുന്നത്

ഞങ്ങൾ പ്രവർത്തിപ്പിക്കുന്ന എല്ലാ സെർവറും, എല്ലാ ഉൽപ്പന്നത്തിലും, പുനരുപയോഗ ഊർജ്ജത്തിലാണ് പ്രവർത്തിക്കുന്നത്. പിന്നീട് ഓഫ്‌സെറ്റ് ചെയ്യുന്നതല്ല — തുടക്കം മുതലേ അങ്ങനെ സ്രോതസ്സു കണ്ടെത്തിയതാണ്.

  • ഞങ്ങളുടെ എല്ലാ ഹോസ്റ്റിംഗിലുമുള്ള 100% പുനരുപയോഗ ഊർജ്ജം
  • 1.1 മുതൽ 1.2 വരെയുള്ള പി.യു.ഇ-യിൽ (PUE) പ്രവർത്തിക്കുന്ന ഡാറ്റാ സെന്ററുകൾ
  • ഞങ്ങളുടെ പങ്കിട്ട പ്ലാറ്റ്‌ഫോമിലെ സൈറ്റുകൾ ഗ്രീൻ വെബ് ഫൗണ്ടേഷന്റെ പരിശോധനകൾ വിജയിക്കുന്നു — നിങ്ങൾക്ക് സ്വയം പരിശോധിക്കാവുന്ന ഒരു മൂന്നാം കക്ഷി ഇത്

ഞങ്ങളുടെ പ്ലാറ്റ്‌ഫോം ഞങ്ങൾ എങ്ങനെ പ്രവർത്തിപ്പിക്കുന്നു എന്ന് വായിക്കുക

ഉപഭോക്താക്കൾ വാങ്ങുന്നതിന് മുൻപ് ചോദിക്കുന്ന ചോദ്യങ്ങൾ

ഇത് ഏതെല്ലാം എംബെഡിംഗ് മോഡലുകളിലാണ് പ്രവർത്തിക്കുന്നത്?

അവയിൽ ഏതെങ്കിലും ഒന്ന്. നിങ്ങളുടെ മോഡൽ നിർമ്മിച്ച നമ്പറുകൾ നിങ്ങൾ ഞങ്ങൾക്ക് അയച്ചുതരുന്നു, അതിനാൽ OpenAI, Cohere, Voyage, നിങ്ങളുടെ സ്വന്തം മെഷീനിലെ ഒരു Sentence-Transformers മോഡൽ എന്നിവയും മറ്റും ഞങ്ങൾക്ക് ഒന്നുതന്നെയാണ്. നിങ്ങൾ ഇൻഡക്സ് സൃഷ്ടിക്കുമ്പോൾ അതിന്റെ വീതി ഞങ്ങളോട് പറയുക — 384, 768, 1024, 1536, 3072 എന്നിവയും അവയ്ക്കിടയിലുള്ളവയും സാധാരണമാണ്.

ഒരു ഇൻഡക്സിന്റെ വീതിയോ ദൂര പ്രവർത്തനമോ (distance function) പിന്നീട് മാറ്റാൻ എനിക്ക് കഴിയുമോ?

ഇല്ല, ഇത് നിങ്ങളെ കണ്ടെത്താൻ അനുവദിക്കുന്നതിനേക്കാൾ വ്യക്തമായി ഞങ്ങൾ പറയാൻ ആഗ്രഹിക്കുന്നു. രണ്ടും നിങ്ങളുടെ വെക്ടറുകൾ എവിടെയാണ് ഭൗതികമായി സംഭരിച്ചിരിക്കുന്നതെന്നും അവ എങ്ങനെ റാങ്ക് ചെയ്യപ്പെടുന്നുവെന്നും തീരുമാനിക്കുന്നു, അതിനാൽ അവയിലേതെങ്കിലും മാറ്റുന്നത് സൂചികയിലുള്ള എല്ലാറ്റിനെയും നിശബ്ദമായി അസാധുവാക്കും. നിങ്ങൾ മറ്റൊരു എംബെഡിംഗ് മോഡലിലേക്ക് മാറുകയാണെങ്കിൽ, രണ്ടാമത്തെ സൂചിക സൃഷ്‌ടിച്ച് അതിലേക്ക് എഴുതുക — എല്ലാ വെക്ടർ ഡാറ്റാബേസും നിങ്ങളോട് ആവശ്യപ്പെടുന്ന അതേ കാര്യം, അതേ കാരണത്താൽ തന്നെ.

വളരെ വീതിയുള്ള വെക്ടറുകളെക്കുറിച്ച് എന്തെങ്കിലും വ്യത്യാസമുണ്ടോ?

അതെ, ഇത് അറിയേണ്ടത് ആവശ്യമാണ്. 2,000 അളവുകൾക്ക് മുകളിൽ, മൂല്യങ്ങൾ പകുതി കൃത്യതയോടെയാണ് (half precision) സംഭരിക്കുന്നത്, കാരണം PostgreSQL-ന്റെ HNSW സൂചികയ്ക്ക് അതിലും വീതിയുള്ള പൂർണ്ണ-കൃത്യതയുള്ള കോളം സ്വീകരിക്കാൻ കഴിയില്ല. 3072 അളവുകളുള്ള മോഡലുകൾക്കായി pgvector തന്നെ ശുപാർശ ചെയ്യുന്ന സമീപനമാണിത്, റാങ്കിംഗിൽ ഇതിന്റെ സ്വാധീനം വളരെ കുറവാണ് — എങ്കിലും ഇതൊരു യഥാർത്ഥ വിട്ടുവീഴ്ചയാണ്, അത് ഞങ്ങൾ നിങ്ങളെ അറിയിക്കേണ്ടതാണ്.

എനിക്ക് ഡാറ്റാബേസ് കണക്ഷൻ സ്ട്രിംഗ് ലഭിക്കുമോ?

ഇന്നല്ല. നിങ്ങളുടെ Zinn® API കീ ഉപയോഗിച്ച് HTTPS വഴി നിങ്ങൾ നിങ്ങളുടെ ഇൻഡക്സ് ആക്സസ് ചെയ്യുന്നു, തിരച്ചിൽ നടത്താൻ കഴിയുന്ന ഒരു കീ ഉപയോഗിച്ച് നിങ്ങളുടെ അക്കൗണ്ടിൽ മറ്റൊന്നും ചെയ്യാൻ കഴിയാത്ത വിധമാണ് ഇതിന്റെ സ്കോപ് നിർണ്ണയിച്ചിരിക്കുന്നത്. ഇതാണ് അന്വേഷണങ്ങൾ കൃത്യമായി അളക്കാനും ഒരു ഉപഭോക്താവിന്റെ വിവരങ്ങൾ മറ്റൊരാൾക്ക് ആക്സസ് ചെയ്യാൻ കഴിയാത്ത വിധം സുരക്ഷിതമാക്കാനും ഞങ്ങളെ സഹായിക്കുന്നത്. നിങ്ങൾക്ക് ഒരു ഡയറക്ട് കണക്ഷൻ ആണ് ആവശ്യമെങ്കിൽ, ഞങ്ങളോട് പറയൂ — ഊഹിച്ചെടുക്കുന്നതിനേക്കാൾ ആരോടെങ്കിലും ചോദിച്ചറിഞ്ഞ് അത് നിർമ്മിക്കാനാണ് ഞങ്ങൾ ആഗ്രഹിക്കുന്നത്.

ഇത് എങ്ങനെയാണ് അളക്കുന്നത്, എനിക്ക് കണക്കുകൾ സ്വയം പരിശോധിക്കാൻ കഴിയുമോ?

രണ്ട് മീറ്ററുകളിൽ: ഒരു കലണ്ടർ മാസത്തിൽ നിങ്ങൾ എത്രമാത്രം സ്റ്റോർ ചെയ്യുന്നു, എത്ര തിരയലുകൾ നടത്തുന്നു എന്നത്. രണ്ടും സംഭവിക്കുമ്പോൾ തന്നെ നിങ്ങളുടെ ഡാഷ്‌ബോർഡിൽ ഉണ്ടാകും. ഫിസിക്കൽ ടേബിൾ സൈസിനേക്കാൾ ഉപരി പ്രസിദ്ധീകരിച്ച ഒരു ഫോർമുലയാണ് സ്റ്റോർ ചെയ്യുന്നതിന് ഉപയോഗിക്കുന്നത് - റോ ഓവർഹെഡ്, സ്റ്റോർ ചെയ്ത വീതി, നിങ്ങളുടെ സ്വന്തം ഐഡികളുടെയും മെറ്റാഡാറ്റയുടെയും നീളം എന്നിവ ഉൾപ്പെടുന്നതാണ് ഇത് - അങ്ങനെ ഞങ്ങളുടെ വാക്ക് മാത്രം വിശ്വസിക്കുന്നതിന് പകരം, ഞങ്ങൾ ബില്ല് ചെയ്യുന്ന തുക നിങ്ങൾക്ക് കൃത്യമായി പരിശോധിച്ചറിയാൻ സാധിക്കുന്നു.