Векторні бази даних
Керована векторна база даних, яка є просто PostgreSQL
Зберігайте ембединги та шукайте за змістом у pgvector, який ми підтримуємо та резервно копіюємо для вас. Жодного нового сховища даних для вивчення, жодних кластерів для налаштування розміру — створіть індекс, запишіть свої вектори та робіть запити за допомогою ключа API, який у вас уже є.
База даних, якій ви вже довіряєте, з одним додатковим типом стовпця
Векторна база даних зазвичай є другою системою, яка працює паралельно з першою: ще один кластер, інша історія резервного копіювання, ще один привід прокинутися вночі. Це pgvector всередині PostgreSQL — той самий рушій, та сама надійність, те саме нічне базове резервне копіювання та безперервне архівування журналу випереджальних записів (WAL), яке отримує все інше тут. Ваш індекс є звичайною таблицею з індексом HNSW на ній, тому він працює швидко для наближеного пошуку найближчих сусідів і є нудним в усіх інших аспектах, що й потрібно о третій годині ночі.
Ширина вашої моделі, а не та, яку обрали ми
Більшість керованих векторних сервисів змушують вас обирати з обмеженого переліку розмірностей. Ваша не обов'язково має бути круглим числом: приймається та зберігається точно будь-яке значення від 1 до 3072, оскільки вужчий вектор доповнюється до наступної фізичної ширини нулями — що абсолютно не змінює косинусну, евклідову відстань та скалярний добуток. 1408-вимірна модель ранжується ідентично тій, що створена для неї за замовчуванням, а зчитування повертає саме ті 1408 значень, які ви зберегли, а не доповнення.
Входить до кожного векторного плану
- Будь-яка ширина вбудовування до 3072 та косинусна, евклідова відстань або відстань внутрішнього добутку
- Метадані, що зберігаються з кожним вектором і фільтруються під час запиту
- Щоденне резервне копіювання зі збереженням протягом 30 днів та можливістю відновлення на певний момент часу
- Безпека на рівні рядків, що робить вектори однієї організації недоступними для іншої
Тарифи та ціни
Три тарифні плани, вартість яких залежить від двох речей, які справді нам дорого коштують: обсягу вашого сховища та кількості пошукових запитів.
Ціна залежить від вашої конфігурації
Вартість залежить від обраного регіону, розміру сервера, пропускної спроможності та сховища, тому ми не можемо чесно вказати тут якусь єдину місячну суму. Розкажіть нам про своє навантаження, і ми підготуємо кошторис.
Працює на 100% відновлюваній енергії
Кожен наш сервер для кожного продукту працює на відновлюваній електроенергії. Не компенсованій постфактум, а одразу отриманій з таких джерел.
- 100% відновлювана електрика на всьому нашому хостингу
- Дата-центри, що працюють з PUE від 1,1 до 1,2
- Сайти на нашій спільній платформі проходять перевірку Green Web Foundation — сторонньої організації, яку ви можете перевірити самостійно
Поширені запитання перед покупкою
З якими вбудованими моделями це працює?
Будь-які з них. Ви надсилаєте нам числа, які згенерувала ваша модель, тож OpenAI, Cohere, Voyage, модель Sentence-Transformers на вашому власному комп'ютері чи будь-що інше для нас однакові. Ви вказуєте розмірність під час створення індексу — 384, 768, 1024, 1536 і 3072 є поширеними варіантами, як і будь-яке значення між ними.
Чи можна змінити ширину індексу або функцію відстані пізніше?
Ні, і ми воліємо сказати про це прямо, ніж дозволити вам дізнатися про це самостійно. Обидва елементи визначають, де фізично зберігаються ваші вектори та як вони ранжуються, тому зміна будь-якого з них мовчки зведе нанівець усе, що вже є в індексі. Якщо ви переходите на іншу модель вбудовування, створіть другий індекс і записуйте в нього — те саме, про що вас просить будь-яка векторна база даних, і з тієї самої причини.
Чи є щось особливе в дуже широких векторах?
Так, і це варто знати. Понад 2000 вимірів значення зберігаються з половинною точністю, оскільки індекс HNSW у PostgreSQL не приймає повноточкові стовпці більшої ширини. Для моделей із 3072 вимірами це підхід, який рекомендує сам pgvector, і вплив на ранжування є незначним, проте це реальний компроміс, і краще вам почути про нього від нас, ніж здогадуватися самостійно.
Чи отримаю я рядок підключення до бази даних?
Не сьогодні. Ви звертаєтеся до свого індексу через HTTPS за допомогою свого ключа API Zinn®, обмеженого таким чином, що ключ, який може виконувати пошук, не може робити нічого іншого у вашому обліковому записі. Саме це дозволяє нам чесно тарифікувати запити й забезпечувати недоступність рядків одного орендаря для іншого. Якщо вам потрібне пряме з'єднання, скажіть нам про це — ми краще створимо його тому, що хтось попросив, ніж вгадуватимемо.
Як це тарифікується, і чи можу я самостійно перевірити ці цифри?
На двох метрах: скільки ви зберігаєте та скільки пошукових запитів виконуєте за календарний місяць. Обидва показники відображаються на вашій панелі керування в режимі реального часу. Обсяг сховища визначається за опублікованою формулою, а не за фактичним розміром таблиці в базі даних (накладні витрати на рядки, збережена ширина, а також довжина ваших власних ідентифікаторів і метаданих). Це зроблено спеціально для того, щоб ви могли самостійно перевірити суму в рахунку, замість того щоб вірити нам на слово.