paradedb
무엇인가
ParadeDB는 Postgres를 검색 엔진으로 확장하는 오픈소스 프로젝트이자 pg_search 확장의 배포처다. 애플리케이션 데이터와 검색 인덱스를 같은 Postgres 인스턴스에 두는 것을 목표로 하며, 전문 검색·벡터 검색·집계를 SQL 질의로 처리하는 확장 계열에 속한다.
어떻게 동작하나
구성은 세 개의 외부 라이브러리에 의존한다. pgrx가 Postgres와 Rust 사이를 연결하고, Tantivy가 전문 검색과 벡터 검색 인덱스 및 BM25 스코어링을 담당하며, Apache DataFusion이 컬럼형 저장과 OLAP 집계를 처리한다. 검색 대상 컬럼에 커스텀 인덱스를 생성하면 인덱스가 Postgres 내부에 존재하고 질의는 SQL로 들어온다. BM25 스코어링, Top K, 하이라이팅, 토크나이저와 토큰 필터, 벡터 검색, 하이브리드 검색, 필터링, 버킷·메트릭·패싯 집계, JOIN이 이 인덱스를 통해 수행된다.
무엇과 다른가
일반적인 구성에서는 Elasticsearch나 OpenSearch 같은 별도 검색 클러스터를 띄우고 애플리케이션 데이터를 복제·동기화한다. ParadeDB는 그 두 번째 시스템을 두지 않는다. 데이터와 인덱스가 같은 Postgres에 있으므로 시스템 간 동기화 파이프라인이 필요 없고, 검색 결과와 원본 데이터의 JOIN도 같은 데이터베이스 안에서 실행된다.
어떻게 쓰나
로컬에서는 Docker 컨테이너로 ParadeDB를 띄운 뒤 psql 세션에 바로 접속하는 방식으로 시작하고, 배포 시에는 별도 호스팅 옵션을 쓴다. 기존 도구와의 연동을 위해 Drizzle, Django, SQLAlchemy, Rails, EF Core 같은 ORM·프레임워크를 지원하며, Agent Skills·MCP Integration·Cursor Plugin 같은 AI 에이전트 연동과 Railway, Render, Fly.io, DigitalOcean, Dokku 같은 PaaS 배포 경로를 제공한다.
전제와 한계
Postgres 확장이므로 Postgres 인스턴스 위에서만 동작하고 다른 데이터베이스로 옮겨 쓸 수 없다. ParadeDB Community는 GNU AGPL v3.0으로 배포되며 엔터프라이즈 라이선스는 별도 문의로 제공된다. 지원하는 Postgres 버전 범위는 README에 명시되어 있지 않다.
관련 논문 1
유사 도구
- pgvectorPostgres에 벡터 컬럼 타입과 거리 연산자, 근사 최근접 이웃 인덱스를 추가하는 C 확장이다. HNSW와 IVFFlat으로 유사도 검색을 SQL 안에서 처리한다.
- helix-db그래프와 벡터를 한 엔진에 담은 Rust OLTP 데이터베이스다. 객체 스토리지 위에서 동작하며 벡터·전문 검색을 내장하고 KV·문서·관계형 데이터도 함께 다룬다.
- RediSearchRedis 해시에 보조 인덱스와 전문 검색, 벡터 유사도 검색, 집계를 붙이는 쿼리·인덱싱 엔진이다. Redis 8부터 코어에 포함된다.
- AutoRAGPDF·위키·노트·논문을 검색해 근거를 직접 읽고 번호 붙은 지식 단위로 큐레이션하는 자가 진화형 사서 에이전트 CLI다.
- orama브라우저·서버·엣지에서 도는 TypeScript 검색 엔진 라이브러리다. 전문 검색·벡터 검색·하이브리드 검색을 2KB 미만 코어로 처리한다.
- cocoindex코드베이스·회의록·Slack·PDF·영상 같은 소스를 증분 처리해 AI 에이전트가 참조할 컨텍스트를 계속 최신으로 유지하는 Rust 기반 엔진이다.