CLUE 기술 문서
통합 AI 데이터 엔진의 구조와 성능
그래프, 벡터, 키워드 검색 구조부터 데이터 인제스트, 이전, 배포 사양과 벤치마크 조건까지 확인합니다.
관계까지 저장해야 AI가 제대로 답합니다.
그래프 DB, 벡터 DB, 검색엔진을 따로 세우지 마세요. CLUE 한 엔진이면 됩니다.
지식 그래프 · n-hop 순회
엔티티와 관계를 그래프로 저장하고 n-hop으로 순회합니다. 그래프 전용 DB를 따로 세우지 않아도 됩니다.
RAG 4 검색 모드
그래프(엔티티 연결)·다단계 추론(연관 탐색)·하이브리드(벡터+키워드)·벡터를 모드 하나로 바꿉니다.
그래프 · 벡터 · 키워드, 같은 데이터베이스
세 검색 방식을 PostgreSQL 안에서 운영합니다. 별도 데이터 시스템 사이의 복제와 동기화 부담을 줄입니다.
57개 확장자 · 배치 처리
문서와 미디어를 비동기로 처리하고 진행 상태를 보여줍니다. 처리시간은 파일 크기와 형식, 모델 및 장비에 따라 달라집니다.
테넌트 격리 (데이터·키 분리)
테넌트별 실행 환경과 데이터베이스를 분리하고, 역할에 따라 데이터 접근을 관리합니다.
외부 소스 10종 이전
소스 연결, 대상 적재 구조, 샘플 데이터를 확인한 뒤 배치로 옮깁니다. 내부 AICLUDE용 어댑터는 별도 1종입니다.
원문 확인부터 검색까지, 단계가 보이는 처리.
원문 추출, 명제와 관계 추출, 임베딩과 검색 준비를 순차 진행합니다. 전체 과정이 하나의 트랜잭션이나 고정 시간으로 끝나는 것은 아닙니다.
원문과 검색 준비 상태는 다를 수 있습니다. 파일 처리 및 그래프 구성 상태를 확인한 뒤 검색 결과를 검토하세요.
같은 환경에서 측정한 탐색과 검색 성능
동일한 데이터와 컴퓨팅 환경에서 측정한 처리시간을 비교합니다.
키워드 검색 100개 쿼리
엣지 3,187개 적재
- Graph: 노드 3,595개, 엣지 3,187개, 동일 컨테이너 4 vCPU, 8GB, 동일 CSV, 20회 반복.
- Keyword: 동일 문서 4,000건, 동일 쿼리 100개, EXPLAIN ANALYZE 3회 중앙값.
- 내부 비교 측정값으로, Apache AGE와 VectorChord-BM25만 비교했습니다. Neo4j·Elastic·Pinecone과의 직접 성능 비교는 하지 않았으며, 실제 결과는 데이터 규모와 쿼리에 따라 달라집니다.
Podman 셀프 호스팅 스택
단일 노드 기준에서 시작합니다. HA·샤딩·Kubernetes는 아래 계획 사양을 바탕으로 적용 가능성과 복구 목표를 검토합니다.
| 프로파일 | vCPU | 메모리 | 디스크 | 노드 / 라이선스 |
|---|---|---|---|---|
최소 (single) | 4 vCPU | 16 GB | 100 GB SSD | 단일 노드, Community 라이선스 이상. |
권장 (HA)권장 | 4 vCPU | 16 GB | 200 GB SSD | 3노드 계획 기준. Professional 기능 범위와 복구 목표는 별도 검증. |
대용량 (샤딩) | 8 vCPU | 32 GB | 500 GB SSD | 1 코디네이터 + 3 워커, Enterprise 라이선스. |
Kubernetes | K8s 1.27+ | K8s Operator | PVC | 쿠버네티스 운영, Enterprise 라이선스. |
- 최소 (single)
- vCPU
- 4 vCPU
- 메모리
- 16 GB
- 디스크
- 100 GB SSD
단일 노드, Community 라이선스 이상.
- 권장 (HA)권장
- vCPU
- 4 vCPU
- 메모리
- 16 GB
- 디스크
- 200 GB SSD
3노드 계획 기준. Professional 기능 범위와 복구 목표는 별도 검증.
- 대용량 (샤딩)
- vCPU
- 8 vCPU
- 메모리
- 32 GB
- 디스크
- 500 GB SSD
1 코디네이터 + 3 워커, Enterprise 라이선스.
- Kubernetes
- vCPU
- K8s 1.27+
- 메모리
- K8s Operator
- 디스크
- PVC
쿠버네티스 운영, Enterprise 라이선스.
- 한 데이터베이스에서 벡터·키워드·지식 그래프를 모두 처리하므로 별도 검색 엔진이 필요 없습니다.
- 외부 임베딩 모델 컨테이너를 재사용해 GPU 노드를 공유합니다.
- 표의 수치는 계획 검토용입니다. 데이터 규모·모델·확장 기능에 맞춰 장비와 라이선스, 장애 복구를 검증하세요.
관계가 중요한 데이터라면.
AICLUDE 플랫폼 자체가 CLUE 위에서 돌아갑니다.
법령 · 규정 지식 그래프
조항·고시·지침을 참조 관계로 이어 답변과 함께 근거 조항을 짚어 줍니다.
조직 지식 베이스
위키·보고서·매뉴얼을 한 번에 인제스트하고 부서 권한별로 답변을 나눕니다.
코드 · 기술 문서
코드와 기술 문서에서 추출한 내용을 함께 검색해 변경 배경과 관련 자료를 찾습니다.
멀티모달 지식 베이스
PDF·이미지·영상·오디오를 같은 컬렉션에 임베딩해 포맷을 가리지 않고 찾습니다.