Векторные базы данных
Управляемая векторная база данных, которая представляет собой просто PostgreSQL
Храните эмбеддинги и ищите их по смыслу в pgvector, который мы обслуживаем и резервно копируем для вас. Никаких новых баз данных для изучения, никаких кластеров для настройки — создайте индекс, запишите свои векторы и выполняйте запросы с помощью уже имеющегося у вас API-ключа.
База данных, которой вы уже доверяете, с одним дополнительным типом столбцов
Векторная база данных — это обычно вторая система, работающая параллельно с первой: еще один кластер, еще одна схема резервного копирования, еще один повод для ночного пробуждения. Это pgvector внутри PostgreSQL — тот же движок, та же надежность, то же ночное базовое резервное копирование и непрерывное архивирование журналов упереддительной записи (WAL), которые получают все остальные компоненты. Ваш индекс представляет собой обычную таблицу с индексом HNSW, поэтому она работает быстро при поиске ближайших соседей по приближению и скучна во всех остальных отношениях — именно такое свойство вам и нужно в три часа ночи.
Ширина вашей модели, а не та, которую выбрали мы
Большинство управляемых векторных служб заставляют вас выбирать из небольшого списка размерностей. Ваша не обязательно должна быть круглым числом: принимается и сохраняется ровно любое значение от 1 до 3072, поскольку более узкий вектор дополняется до следующей физической ширины нулями — что ровно ничего не меняет в косинусном, евклидовом расстоянии и расстоянии по скалярному произведению. Модель с размерностью 1408 ранжируется точно так же, как модель, изначально созданная для нее, а при чтении вы получаете обратно те 1408 значений, которые сохранили, но никак не заполнение нулями.
Включено в каждый план векторных услуг
- Любая ширина встраивания до 3072 и косинусное, евклидово расстояние или расстояние внутреннего произведения
- Метаданные, сохраняемые с каждым вектором и фильтруемые во время запроса
- Ежедневные резервные копии с хранением в течение 30 дней и восстановлением на определенный момент времени
- Безопасность на уровне строк, благодаря чему векторы одной организации недоступны для другой
Тарифы и цены
Три тарифных плана, стоимость которых зависит от двух действительно затратных для нас факторов: объёма хранения и объёма поиска.
Цена зависит от вашей конфигурации
Стоимость зависит от выбранного региона, размера машины, пропускной способности и объема хранилища, поэтому мы не можем честно указать здесь какую-то одну фиксированную сумму за месяц. Расскажите нам о вашей рабочей нагрузке, и мы рассчитаем цену.
Работает на 100% возобновляемой энергии
Каждый сервер, который мы используем для любого продукта, работает на возобновляемой электроэнергии. Не за счет компенсации выбросов постфактум — она изначально получена из возобновляемых источников.
- 100% возобновляемая электроэнергия для всех наших услуг хостинга
- Дата-центры, работающие с PUE от 1,1 до 1,2
- Сайты на нашей общей платформе проходят проверки Green Web Foundation — это сторонний сервис, работу которого вы можете проверить самостоятельно
Вопросы перед покупкой
С какими моделями встраивания это работает?
Любые из них. Вы отправляете нам числа, созданные вашей моделью, поэтому OpenAI, Cohere, Voyage, модель Sentence-Transformers на вашем собственном компьютере и любые другие для нас совершенно одинаковы. Вы указываете размерность при создании индекса — 384, 768, 1024, 1536 и 3072 являются обычными значениями, как и любые промежуточные варианты.
Можно ли изменить ширину индекса или функцию расстояния позже?
Нет, и мы предпочитаем сказать об этом прямо, чем позволить вам узнать это самим. И то, и другое определяет, где физически хранятся ваши векторы и как они ранжируются, поэтому изменение любого из них молча сделает недействительным всё, что уже находится в индексе. Если вы переходите на другую модель эмбеддингов, создайте второй индекс и записывайте в него — этого же требует любая векторная база данных и по той же причине.
Есть ли что-то особенное в очень широких векторах?
Да, и об этом стоит знать. Свыше 2000 измерений значения сохраняются с половинной точностью, поскольку индекс HNSW в PostgreSQL не принимает колонку полной точности шире этого значения. Для моделей с 3072 измерениями это подход, который рекомендует сам pgvector, и влияние на ранжирование ничтожно, но это реальный компромисс, и лучше вы узнаете об этом от нас, чем догадаетесь сами.
Выдаётся ли мне строка подключения к базе данных?
Не сегодня. Вы обращаетесь к своему индексу по протоколу HTTPS с помощью ключа API Zinn®, права которого ограничены таким образом, что ключ, предназначенный для поиска, не может выполнять никаких других действий в вашей учетной записи. Именно это позволяет нам честно тарифицировать запросы и делать строки одного арендатора недоступными для другого. Если вам требуется именно прямое подключение, сообщите нам — мы предпочтем реализовать его по запросу, чем заниматься догадками.
Как это тарифицируется, и могу ли я самостоятельно проверить показатели?
В двух словах: сколько вы храните данных и сколько поисковых запросов выполняете за календарный месяц. И то, и другое отображается на вашей панели управления в режиме реального времени. Объем памяти рассчитывается по опубликованной формуле, а не по физическому размеру таблиц — накладные расходы на строки плюс сохраненная ширина, плюс длина ваших собственных идентификаторов и метаданных, — именно для того, чтобы вы могли самостоятельно проверить сумму, которую мы вам выставляем, а не верить нам на слово.