벡터 데이터베이스

오직 PostgreSQL 기반의 관리형 벡터 데이터베이스

저희가 직접 운영하고 백업해 드리는 pgvector에서 임베딩을 저장하고 의미 기반으로 검색하세요. 새로운 데이터 저장소를 배우거나 클러스터 규모를 산정할 필요 없이, 인덱스를 생성하고 벡터를 작성한 뒤 이미 보유하고 있는 API 키로 쿼리하세요.

이미 신뢰하고 있는 데이터베이스에 하나의 열 유형이 추가되었습니다

벡터 데이터베이스는 대개 첫 번째 시스템과 나란히 실행해야 하는 두 번째 시스템, 즉 또 하나의 클러스터, 또 하나의 백업 스토리, 새벽에 깨어날 이유를 하나 더 만드는 존재입니다. 이것이 PostgreSQL 내부의 pgvector입니다. 여기 있는 다른 모든 것과 동일한 엔진, 동일한 내구성, 동일한 야간 기본 백업 및 지속적인 쓰기 ahead 로그 아키텍처를 제공합니다. 사용자의 인덱스는 HNSW 인덱스가 있는 일반 테이블이므로 대략적인 근접 이웃 검색에 빠르고 다른 모든 측면에서는 평범하며, 이는 새벽 3시에 정확히 원하는 특성입니다.

우리가 선택한 너비가 아닌, 회원님의 모델 너비

대부분의 관리형 벡터 서비스는 제한된 차원 목록 중에서 선택하도록 강제합니다. 귀하의 서비스는 둥근 숫자를 선택할 필요가 없습니다. 1부터 3072 사이의 어떤 값이든 허용되고 정확하게 유지됩니다. 더 좁은 벡터는 다음 물리적 너비만큼 0으로 패딩되기 때문이며, 이는 코사인, 유클리드 및 내적 거리를 전혀 변화시키지 않습니다. 1408차원 모델은 이에 맞춰 네이티브로 크기가 지정된 모델과 동일하게 순위가 매겨지며, 읽기 작업 시 패딩이 아니라 저장했던 1408개의 값이 그대로 반환됩니다.

모든 벡터 플랜에 포함됨

  • 최대 3072의 모든 임베딩 너비와 코사인, 유클리드 또는 내적 거리
  • 모든 벡터와 함께 저장되며 쿼리 시점에 필터링되는 메타데이터
  • 30일 보관 및 시점 복구가 포함된 야간 백업
  • 행 단위 보안을 적용하여 한 조직의 벡터에 다른 조직이 접근할 수 없습니다.

요금제 및 가격

실실제 비용이 발생하는 두 가지 요소, 즉 저장 용량과 검색량에 따라 책정된 세 가지 요금제입니다.

구성에 따른 가격 책정

비용은 선택하시는 리전, 서버 사양, 대역폭 및 스토리지에 따라 다르므로, 이곳에 정해진 월 요금을 명시할 수 없습니다. 워크로드 종류를 알려주시면 견적을 안내해 드리겠습니다.

100% 재생 에너지로 구동됩니다.

우리가 운영하는 모든 제품의 모든 서버는 재생 가능 전력으로 구동됩니다. 사후 상쇄 방식이 아니라 처음부터 그렇게 조달됩니다.

  • 모든 호스팅에 100% 재생 가능 전력 사용
  • PUE 1.1에서 1.2 사이로 가동되는 데이터 센터
  • 공용 플랫폼의 사이트들은 직접 확인하실 수 있는 제3자 기관인 Green Web Foundation의 검증을 통과합니다.

플랫폼 운영 방식 알아보기

구매하기 전에 사람들이 자주 묻는 질문

어떤 임베딩 모델과 호환됩니까?

어떤 것이든 상관없습니다. 모델이 생성한 숫자를 보내주시면 OpenAI, Cohere, Voyage, 혹은 사용자 컴퓨터의 Sentence-Transformers 모델 및 기타 모든 모델을 동일하게 처리합니다. 인덱스를 생성할 때 차원(width)을 지정하시면 됩니다. 384, 768, 1024, 1536, 3072는 물론 그 사이의 값도 일반적으로 많이 사용됩니다.

나중에 인덱스의 너비나 거리 함수를 변경할 수 있나요?

아니요, 그렇게 되도록 내버려두는 것보다 솔직하게 말씀드리는 편이 낫습니다. 둘 다 벡터가 물리적으로 저장되는 위치와 순위가 매겨지는 방식을 결정하므로, 둘 중 하나라도 변경하면 이미 색인된 모든 내용이 조용히 무효화됩니다. 다른 임베딩 모델로 전환하는 경우, 두 번째 인덱스를 생성하여 그곳에 기록하세요. 이는 모든 벡터 데이터베이스가 동일한 이유로 요구하는 사항입니다.

매우 넓은 벡터에는 다른 점이 있나요?

네, 그렇고 알아둘 가치가 있습니다. 2,000차원을 초과하는 값은 절반 정밀도로 저장되는데, PostgreSQL의 HNSW 인덱스가 그보다 넓은 전체 정밀도 열을 허용하지 않기 때문입니다. 3072차원 모델의 경우 이는 pgvector 자체가 권장하는 접근 방식이며 순위에 미치는 영향은 미미하지만, 이는 실제 트레이드오프이므로 유추하기 전에 저희로부터 직접 들으셔야 합니다.

데이터베이스 연결 문자열을 제공받을 수 있나요?

오늘은 아닙니다. HTTPS를 통해 Zinn® API 키로 인덱스에 접근하므로, 검색 가능한 키는 계정 내 다른 작업을 수행할 수 없도록 권한이 제한됩니다. 이것이 당사에서 쿼리를 공정하게 측정하고 한 테넌트의 행을 다른 테넌트가 접근할 수 없도록 유지하는 방식입니다. 직접 연결이 필요한 경우 당사에 알려주세요. 추측하여 만드는 것보다 요청에 따라 만드는 것을 선호합니다.

어떻게 측정되며, 수치를 직접 확인할 수 있나요?

2미터 기준: 달력 월 기준으로 저장하는 용량과 실행하는 검색 횟수입니다. 두 가지 모두 발생하는 대로 대시보드에 표시됩니다. 저장 용량은 물리적인 테이블 크기라기보다는 공개된 공식을 따릅니다(행 오버헤드, 저장된 너비, 고유 ID 및 메타데이터의 길이의 합). 이는 저희의 말을 맹신하는 대신 청구되는 수치를 직접 재현하실 수 있도록 하기 위함입니다.