Private
AI Infrastructure.

사내 문서와 데이터를 외부 API에 노출시키지 않고, 운영 환경 안에서 작동하는 LLM·RAG 인프라를 구축합니다.

외부 API에
의존하지 않는
AI 스택.

OpenAI, Anthropic, Google API에 사내 문서를 보내는 순간 데이터의 통제권은 외부 벤더로 넘어갑니다. 많은 공공기관·금융·의료·법무 영역에서는 이 자체가 불가능한 구조입니다.

THE ONE은 온프레미스·VPC·에어갭 환경에서 작동하는 AI 인프라를 구축합니다. Apache 2.0 라이선스 모델만 사용해 라이선스 종속 리스크도 제거합니다.

실제 운영 데이터 위에서 정확도를 검증한 후, 고객사 보유 인프라에 배포 가능한 형태로 인계합니다.

5단계
RAG 파이프라인.

  • 01
    Parse — 한국어 PDF 최적화

    MinerU 기반 한국어 문서 구조 파싱. 표·이미지·수식까지 의미 단위로 분해합니다.

  • 02
    Embed — 다국어 임베딩

    BGE-M3 또는 KURE-v1 임베딩 모델. 한국어 검색 정확도에 최적화되어 있습니다.

  • 03
    Retrieve — 하이브리드 검색

    Qdrant(벡터) + OpenSearch Nori(키워드) 하이브리드. 권한 인지형(ACL) 필터링이 검색 단계에서 동작합니다.

  • 04
    Rerank — BGE 리랭커

    1차 검색 결과를 리랭킹 모델로 재정렬. 상위 K개 정확도를 크게 끌어올립니다.

  • 05
    Generate — 인용 기반 생성

    SGLang LLM 서빙 + Qwen3 모델. 모든 답변에 출처 인용을 강제, 할루시네이션 탐지가 기본 내장됩니다.

Technical
specification.

[PARSE]MinerU · table/formula/image-aware
[EMBED]BGE-M3 · KURE-v1 · multilingual
[VECTOR DB]Qdrant · scalable HNSW index
[KEYWORD]OpenSearch · Nori analyzer (KR)
[RERANK]BGE-Reranker-v2
[SERVE]SGLang · vLLM compatible
[MODEL]Qwen3-32B/72B · Apache-2.0
[ACL]field-level permission-aware
[CITATION]enforced · hallucination filter
[DEPLOY]on-premise · VPC · air-gapped
[LATENCY]< 240ms · p90
240ms
inference
p90 latency
94%
korean PDF
parsing accuracy
99.9%
ACL precision
4 wks
PoC →
production

운영 데이터 위에서 검증하세요.

2주 PoC로 정확도·지연·ACL 정밀도를 직접 측정합니다.

Schedule discovery call
TOP