주요업무
1. 연산 속도 최적화 및 병렬 처리
영상처리 알고리즘 성능 프로파일링 및 병목 분석 (CPU, GPU, 메모리, I/O)
Multi-thread / SIMD 기반 CPU 병렬화, CUDA / cuDNN / TensorRT GPU 가속 최적화
이종 컴퓨팅(CPU + 다중 GPU) 환경의 작업 분할 및 파이프라이닝 설계
대용량 데이터 처리를 위한 메모리·스토리지 I/O 최적화
2. 컴퓨팅 시스템 구성
알고리즘 요구사항에 맞는 컴퓨팅 노드 사양 검토 및 선정
개발/검증/양산 환경 간 런타임 환경 표준화 (드라이버, CUDA, 라이브러리 버전)
성능 회귀 모니터링: 알고리즘 변경 시 처리 시간·메모리 사용량 자동 측정
3. 모듈 설계 및 안정성 개선
알고리즘 모듈의 SW 아키텍처 설계 (입출력 경계, 인터페이스, 데이터 구조)
복원-검사 파이프라인 구성, 모듈 간 결합도 최소화 및 인터페이스 추상화
예외 처리, 자원 누수 방지, 안전한 동시성 제어로 장기 가동 안정성 확보
4. 알고리즘 코드의 제품화
프로토타입(Python/MATLAB) → 양산용 C++/CUDA 모듈 이식 및 최적화
단위 테스트, 회귀 테스트, 성능 벤치마크 자동화 (CI 연동)
형상 관리(Git), 빌드 자동화, 릴리스 패키징 등 SW 인프라 운영