paradedb

Vector DatabasesDevOpsRust

★ 9,256주당 +32조회 5

무엇인가

ParadeDB는 Postgres를 검색 엔진으로 확장하는 오픈소스 프로젝트이자 pg_search 확장의 배포처다. 애플리케이션 데이터와 검색 인덱스를 같은 Postgres 인스턴스에 두는 것을 목표로 하며, 전문 검색·벡터 검색·집계를 SQL 질의로 처리하는 확장 계열에 속한다.

어떻게 동작하나

구성은 세 개의 외부 라이브러리에 의존한다. pgrx가 Postgres와 Rust 사이를 연결하고, Tantivy가 전문 검색과 벡터 검색 인덱스 및 BM25 스코어링을 담당하며, Apache DataFusion이 컬럼형 저장과 OLAP 집계를 처리한다. 검색 대상 컬럼에 커스텀 인덱스를 생성하면 인덱스가 Postgres 내부에 존재하고 질의는 SQL로 들어온다. BM25 스코어링, Top K, 하이라이팅, 토크나이저와 토큰 필터, 벡터 검색, 하이브리드 검색, 필터링, 버킷·메트릭·패싯 집계, JOIN이 이 인덱스를 통해 수행된다.

무엇과 다른가

일반적인 구성에서는 Elasticsearch나 OpenSearch 같은 별도 검색 클러스터를 띄우고 애플리케이션 데이터를 복제·동기화한다. ParadeDB는 그 두 번째 시스템을 두지 않는다. 데이터와 인덱스가 같은 Postgres에 있으므로 시스템 간 동기화 파이프라인이 필요 없고, 검색 결과와 원본 데이터의 JOIN도 같은 데이터베이스 안에서 실행된다.

어떻게 쓰나

로컬에서는 Docker 컨테이너로 ParadeDB를 띄운 뒤 psql 세션에 바로 접속하는 방식으로 시작하고, 배포 시에는 별도 호스팅 옵션을 쓴다. 기존 도구와의 연동을 위해 Drizzle, Django, SQLAlchemy, Rails, EF Core 같은 ORM·프레임워크를 지원하며, Agent Skills·MCP Integration·Cursor Plugin 같은 AI 에이전트 연동과 Railway, Render, Fly.io, DigitalOcean, Dokku 같은 PaaS 배포 경로를 제공한다.

전제와 한계

Postgres 확장이므로 Postgres 인스턴스 위에서만 동작하고 다른 데이터베이스로 옮겨 쓸 수 없다. ParadeDB Community는 GNU AGPL v3.0으로 배포되며 엔터프라이즈 라이선스는 별도 문의로 제공된다. 지원하는 Postgres 버전 범위는 README에 명시되어 있지 않다.

관련 논문 1

유사 도구