H200
온프레미스 GPU
7건
진단·대응한 취약점
24/7
운영 모니터링
백엔드에서 인프라로
- 백엔드 API·환경 구성으로 합류 (Jenkins CI, 브랜치별 포트 배포, ERD 설계)
- AI 모델 구동을 위해 온프레미스 인프라가 필요해지며 서버·보안 담당으로 전환
온프레미스 GPU 서버 구축
- NVIDIA H200 + CUDA 서버를 하드웨어 조립부터 OS·드라이버·Docker까지 단독 구축
- GitHub Actions → GHCR → SSH 배포 파이프라인, Caddy 자동 HTTPS
- Prometheus·Grafana·dcgm-exporter GPU 모니터링, pg_dump+cron 백업 자동화
보안 운영
- 서비스 침투 테스트로 IDOR·Stored XSS·Rate Limiting 부재 등 7건 진단·보완
- 실제 코인 채굴 악성코드 침해사고를 직접 분석·봉쇄 (계정 격리·악성 cron 제거)
- fail2ban·SSH 강화·rkhunter로 재발 방지 체계 수립
Stack
PythonJenkinsPostgreSQLDockerNVIDIA H200CUDACaddyPrometheus