پایگاه‌های داده برداری

یک پایگاه داده برداری مدیریت شده که صرفاً PostgreSQL است

امبیّددینگ‌ها را ذخیره کنید و بر اساس معنا در آن‌ها جستجو کنید؛ روی pgvector که ما آن را اجرا کرده و برایتان پشتیبان‌گیری می‌کنیم. هیچ پایگاه داده جدیدی برای یادگیری وجود ندارد، هیچ خوشه‌ای برای اندازه‌گذاری نیست — یک نمایه بسازید، بردارهای خود را بنویسید و با کلید API که از قبل دارید، آن را جستجو کنید.

همان پایگاه‌داده‌ای که از قبل به آن اعتماد دارید، با یک نوع ستون اضافی

پایگاه داده برداری معمولاً سامانه دومی است که در کنار سامانه اول اجرا می‌شود: یک کلاستر دیگر، یک پشتیبان دیگر، و چیز دیگری که باید برای آن بیدار شد. این قابلیت pgvector در داخل PostgreSQL است؛ همان موتور، همان دوام، همان نسخه پشتیبان پایه شبانه و بایگانی مداوم گزارش پیش‌نویس نوشتن که هر چیز دیگری در اینجا دریافت می‌کند. نمایه شما یک جدول معمولی است که یک نمایه HNSW روی آن قرار دارد، بنابراین برای جستجوی تقریبی نزدیک‌ترین همسایه سریع است و در سایر جنبه‌ها کس‌کننده است، که همان ویژگی مطلوبی است که ساعت سه بامداد به آن نیاز دارید.

عرض مدل شما، نه عرضی که ما انتخاب کرده‌ایم

اکثر سرویس‌های بردار مدیریت‌شده شما را مجبور می‌کنند که از بین فهرستی کوتاه از ابعاد یکی را انتخاب کنید. ابعاد شما نیازی نیست که یک عدد رند باشد: هر مقداری از ۱ تا ۳۰۷۲ پذیرفته می‌شود و دقیقاً حفظ می‌گردد، زیرا یک بردار باریک‌تر تا عرض فیزیکی بعدی با صفرها پر می‌شود؛ این کار فاصله کسینوسی، اقلیدسی و ضرب داخلی را دقیقاً به میزان صفر تغییر می‌دهد. یک مدل ۱۴۰۸ بعدی رتبه‌بندی کاملاً یکسانی با مدل دارای اندازه بومی خود دارد و خواندن‌ها همان ۱۴۰۸ مقداری را که ذخیره کرده‌اید به شما پس می‌دهند، نه هرگز مقادیر پرکننده را.

در تمامی طرح‌های وکتور گنجانده شده است

  • هر عرض تعبیه‌ای تا ۳۰۷۲، و فاصله کسینوسی، اقلیدسی یا ضرب داخلی
  • فراداده‌های ذخیره‌شده با هر بردار و فیلتر شده در زمان پرس‌و‌جو
  • پشتیبان‌گیری شبانه با قابلیت نگهداری ۳۰ روزه و بازیابی در نقطه زمانی مشخص
  • امنیت در سطح سطر، به‌طوری که بردارهای یک سازمان از سازمان دیگر قابل دسترسی نباشند

طرح‌ها و قیمت‌گذاری

سه سطح، قیمت‌گذاری شده بر اساس دو موردی که واقعاً برای ما هزینه دارند: میزان فضای ذخیره‌سازی و میزان جست‌وجوی شما.

قیمت‌گذاری براساس پیکربندی شما

هزینه به منطقه، اندازه سرور، پهنای باند و فضای ذخیره‌سازی انتخابی شما بستگی دارد، بنابراین هیچ رقم ماهانه ثابتی وجود ندارد که بتوانیم با اطمینان در اینجا اعلام کنیم. نوع بار کاری خود را به ما بگویید تا قیمت را اعلام کنیم.

توسط ۱۰۰٪ انرژی تجدیدپذیر پشتیبانی می‌شود

هر سروری که ما اجرا می‌کنیم، روی هر محصولی، با برق تجدیدپذیر تأمین می‌شود. نه اینکه بعد از وقوع جبران شود، بلکه از همان ابتدا از همین منبع تأمین شده است.

  • ۱۰۰٪ برق تجدیدپذیر در تمام میزبانی‌های ما
  • دیتاسنترهایی که با PUE بین ۱.۱ تا ۱.۲ کار می‌کنند
  • وب‌سایت‌های روی پلتفرم اشتراکی ما آزمون‌های بنیاد وب سبز را با موفقیت پشت سر می‌گذارند؛ شخص ثالثی که خودتان می‌توانید آن را راستی‌آزمایی کنید

بخوانید چگونه پلتفرم را مدیریت می‌کنیم

سوالاتی که افراد پیش از خرید می‌پرسند

این با کدام مدل‌های امبدینگ کار می‌کند؟

هرکدام از آن‌ها. شما اعدادی را که مدل خودتان تولید کرده است برای ما ارسال می‌کنید، بنابراین OpenAI، Cohere، Voyage، یک مدل Sentence-Transformers روی رایانه خودتان و هر چیز دیگری برای ما یکسان است. هنگام ایجاد ایندکس، عرض را به ما می‌گویید — ۳۸۴، ۷۶۸، ۱۰۲۴، ۱۵۳۶ و ۳۰۷۲ همگی رایج هستند و مقادیر مابین آن‌ها نیز به همین صورت است.

آیا بعداً می‌توانم عرض یا تابع فاصله یک نمایه (index) را تغییر دهم؟

خیر، و ترجیح می‌دهیم صراحتاً این را بگوییم تا اینکه اجازه دهیم خودتان متوجه آن شوید. هر دو مشخص می‌کنند که بردارها در کجا به صورت فیزیکی ذخیره می‌شوند و چگونه رتبه‌بندی می‌شوند، بنابراین تغییر هر یک از آن‌ها به‌طور ناخودآگاه تمام داده‌های موجود در ایندکس را بی‌اعتبار می‌کند. اگر به مدل جاسازی متفاوتی تغییر وضعیت می‌دهید، ایندکس دومی ایجاد کرده و داده‌ها را در آن بنویسید؛ این همان کاری است که هر پایگاه داده برداری از شما می‌خواهد و به همان دلیل.

آیا نکته متفاوتی درباره بردارهای بسیار عریض وجود دارد؟

بله، و ارزش دانستن را دارد. بالاتر از ۲۰۰۰ بعد، مقادیر با دقت نیمه ذخیره می‌شوند، زیرا ایندکس HNSW در PostgreSQL ستونی با دقت کامل پهن‌تر از آن را نمی‌پذیرد. برای مدل‌های ۳۰۷۲ بعدی، این رویکردی است که خود pgvector توصیه می‌کند و تأثیر آن بر رتبه‌بندی ناچیز است — اما این یک معاوضه واقعی است و بهتر است آن را از ما بشنوید تا اینکه خودتان حدس بزنید.

آیا رشته اتصال پایگاه داده دریافت می‌کنم؟

امروز نه. شما از طریق پروتکل HTTPS و با استفاده از کلید API مربوط به Zinn® خود، که به‌گونه‌ای محدود شده است که کلید مخصوص جستجو نتواند هیچ کار دیگری در حساب شما انجام دهد، به نمایه (index) خود دسترسی پیدا می‌کنید. این همان چیزی است که به ما اجازه می‌دهد پرس‌وجوها را به‌طور منصفانه اندازه‌گیری کنیم و ردیف‌های یک مشتری را از دسترس مشتری دیگر دور نگه داریم. اگر اتصال مستقیم چیزی است که به آن نیاز دارید، به ما بگویید — ما ترجیح می‌دهیم آن را بر اساس درخواست بسازیم تا اینکه حدس بزنیم.

چگونه اندازه‌گیری می‌شود و آیا می‌توانم خودم ارقام را بررسی کنم؟

در دو معیار: میزان ذخیره‌سازی و تعداد جستجوهایی که در یک ماه تقویمی انجام می‌دهید. هر دو به محض وقوع در داشبورد شما نمایش داده می‌شوند. فضای ذخیره‌سازی به جای اندازه جدول فیزیکی، بر اساس فرمولی مشخص محاسبه می‌شود — سربار رطر، به علاوه عرض ذخیره‌شده، به علاوه طول شناسه‌ها و فراداده‌های خودتان — دقیقا به این دلیل که بتوانید به جای اعتماد به حرف ما، رقمی را که برای آن صورت‌حساب دریافت می‌کنید، خودتان محاسبه کنید.