Edge AI Engineer는 최신 AI 모델이 실제 디바이스에서 정확하고 빠르게 동작하도록 만드는 핵심 역할을 수행합니다. PyTorch 기반의 동적 모델을 ONNX 중심의 정적 그래프로 변환하고 최적화하며, 이를 다양한 하드웨어 환경에 맞게 컴파일하고 배포하는 End to End 모델 실현 과정을 직접 설계하고 구현하게 됩니다. 모델 구조 분석부터 그래프 레벨 최적화, 벤더별 컴파일러 대응, 디바이스 성능 튜닝까지 단순한 변환 작업을 넘어 이 모델이 이 디바이스에서 왜, 어떻게, 얼마나 잘 동작하는지를 끝까지 책임지는 역할입니다.
모델 변환 및 최적화 파이프라인 설계
다양한 LLM / Computer Vision 모델을 기준으로 Torch → ONNX → Vendor Compiler → Device Runtime 전체 플로우를 빠르게 이해하고 설계
모델 구조 분석 후, 하드웨어 제한사항에 맞도록 front/middle-end 수준의 graph transformation 및 rewriting 수행