시스템 아키텍처 다이어그램
디렉토리 구조
arcvip/
docs/문서 및 계획
common/공통 모듈 (OCR, 비식별화, RAG, 유틸리티)
backend/FastAPI API 서버
frontend/Next.js 웹 대시보드
cope/COPE 전문 역학조사관
cancer/직업성암 전문 역학조사관
인프라 구성
| 서비스 | 설명 | 포트 | GPU |
|---|---|---|---|
| vLLM | Gemma 4 31B 추론 | 8000 | GPU 0 |
| Qdrant | 벡터 데이터베이스 | 6333 | CPU |
| Next.js | 프론트엔드 | 3000 | — |
| nginx | 리버스 프록시 | 443 | — |
GPU 할당
GPU 0 — "The Brain"
RTX PRO 6000 Blackwell · 96GB VRAM
- Gemma 4 31B (FP8) — vLLM 추론
- 보고서 작성, 인과관계 추론, 대화 응답
GPU 1 — "The Lab"
RTX PRO 6000 Blackwell · 96GB VRAM
- Vision 모델 (문서/이미지 분석)
- OCR · Coding · Speech (Whisper) · Fine-tuning
프로젝트 진행 단계
Phase 0 — 인프라 구축
하드웨어, OS, CUDA, Docker
Phase 1 — vLLM + Qdrant
LLM 서빙, 벡터 DB 안정화
Phase 2 — 비전 모델 + OCR
문서 이미지 → 텍스트 파이프라인
Phase 3 — RAG + 보고서 자동화
지식 검색, 보고서 생성
Phase 4 — 웹 대시보드
최종 사용자 인터페이스
보안 모델
로컬 모드
민감 데이터(의무기록)는 100% 로컬 GPU에서 처리. 외부 API 호출 없음.
하이브리드 모드
일반 정보 검색만 외부 API 허용. OCR 직후 PII 마스킹 즉시 적용.