홈으로

프로젝트 아키텍처

AI 역학조사관 시스템의 전체 구조와 인프라 현황

시스템 아키텍처 다이어그램

AI 역학조사관 시스템 아키텍처

디렉토리 구조

arcvip/

docs/문서 및 계획
common/공통 모듈 (OCR, 비식별화, RAG, 유틸리티)
backend/FastAPI API 서버
frontend/Next.js 웹 대시보드
cope/COPE 전문 역학조사관
cancer/직업성암 전문 역학조사관

인프라 구성

서비스설명포트GPU
vLLMGemma 4 31B 추론8000GPU 0
Qdrant벡터 데이터베이스6333CPU
Next.js프론트엔드3000
nginx리버스 프록시443

GPU 할당

GPU 0 — "The Brain"

RTX PRO 6000 Blackwell · 96GB VRAM

  • Gemma 4 31B (FP8) — vLLM 추론
  • 보고서 작성, 인과관계 추론, 대화 응답

GPU 1 — "The Lab"

RTX PRO 6000 Blackwell · 96GB VRAM

  • Vision 모델 (문서/이미지 분석)
  • OCR · Coding · Speech (Whisper) · Fine-tuning

프로젝트 진행 단계

Phase 0 — 인프라 구축

하드웨어, OS, CUDA, Docker

완료

Phase 1 — vLLM + Qdrant

LLM 서빙, 벡터 DB 안정화

진행중

Phase 2 — 비전 모델 + OCR

문서 이미지 → 텍스트 파이프라인

예정

Phase 3 — RAG + 보고서 자동화

지식 검색, 보고서 생성

예정

Phase 4 — 웹 대시보드

최종 사용자 인터페이스

예정

보안 모델

로컬 모드

민감 데이터(의무기록)는 100% 로컬 GPU에서 처리. 외부 API 호출 없음.

하이브리드 모드

일반 정보 검색만 외부 API 허용. OCR 직후 PII 마스킹 즉시 적용.