ML Engineer
실시간 생성 영상·음성·대화를 하나의 제품 경험으로 연결합니다. AI 컴패니언의 자연스러운 반응, 대화 품질, 속도를 직접 개선하는 ML Engineer 역할입니다.
팀과 제품
이 팀은 실시간 생성 비디오로 AI 캐릭터와 얼굴을 마주하고 대화하는 소셜 경험을 만들고 있습니다. 글로벌 영상 커뮤니케이션 서비스를 창업하고 개발해 본 창업자와 팀원들이 함께하며, 영상·음성·대화를 자연스럽게 연결하는 제품에 집중합니다.
이 역할에서 만드는 것
AI 컴패니언과의 대화가 화면 속 상대와 실시간으로 소통하는 경험에 가까워지도록 만듭니다. 사용자의 말과 대화 맥락에 맞춰 캐릭터가 자연스럽게 말하고 움직여야 하며, 영상·음성·대화 모델이 이어지는 과정에서 생기는 지연과 비용도 제품 수준으로 관리해야 합니다. 영상·음성·대화 모델을 하나의 서비스로 연결해 실제 사용자가 느끼는 상호작용의 품질을 개선하는 역할입니다.
주요 업무
실시간 영상 인터랙션
- 사용자 발화와 대화 맥락에 맞는 Talking Head, 립싱크, 모션을 실시간 영상 경험으로 구현합니다.
- 영상·음성·대화 모델을 연결하는 end-to-end 파이프라인을 개발합니다.
- 실제 사용 환경에서 지연 시간, 영상 품질, 운영 비용 사이의 균형을 지속적으로 개선합니다.
대화와 관계 경험
- 영상 통화 환경에 맞는 대화 로직과 패턴을 설계하고 고도화합니다.
- 장기 기억과 관계 변화가 대화에 자연스럽게 반영되도록 구현합니다.
- 서비스에서 대화 품질과 사용자 반응을 살피고, 관찰한 결과를 다음 개선에 반영합니다.
모델의 제품 적용
- 연구·개발한 ML 모델을 실제 서비스에 서빙하고 운영합니다.
- 모델, 실시간 파이프라인, 사용자 경험 사이에서 발생하는 문제를 함께 풀어갑니다.
이런 분과 잘 맞습니다
실시간 생성 기술을 논문이나 데모에서 멈추지 않고 사용자에게 닿는 제품으로 만들고 싶은 분에게 잘 맞습니다. 모델 성능뿐 아니라 사용자가 체감하는 반응 속도와 대화의 자연스러움에 관심이 있고, 기술과 제품의 관점에서 아직 정답이 없는 문제를 정의하고 풀어가는 분을 찾습니다.
필수 역량
- 석·박사 과정을 포함해 AI/ML 관련 경력 3년 이상이며, 그중 현업 경력이 2년 이상인 분
- AI/ML의 기본기를 갖추고 최소 한 가지 도메인을 깊이 있게 다뤄 본 분
- ML 모델을 실제 서비스 환경에 서빙한 경험이 있는 분
- 모델을 실제 제품에 적용하고 서비스화하는 과정에 관심과 경험이 있는 분
- 한국어로 원활하게 협업할 수 있는 분
우대 경험
- Talking Head, 립싱크 등 Virtual Human·Avatar 관련 연구 또는 개발 경험
- Flow-based·Diffusion 기반 영상·이미지 생성 모델을 이해하고 활용한 경험
- STT·LLM·TTS 또는 end-to-end 음성 대화 시스템 연구·개발 경험
- 페르소나, 엔터테인먼트, 장기 기억 등 대화 중심 서비스 설계 경험
- 생성형 AI를 활용한 B2B·B2C 서비스나 기능을 개발·운영한 경험
- 클라우드·컨테이너·Kubernetes 등을 활용해 ML 모델을 마이크로서비스로 구현·배포·운영한 경험
- ML을 통해 실제 서비스의 리텐션·체류 시간 등 지표 개선에 기여한 경험
- AI/ML 주요 학회 또는 저널 게재 실적
근무 조건과 채용 절차
서울 현장 근무, 정규직입니다. 회사가 안내한 절차는 서류 전형 → 1차 면접 → 2차 면접 → 처우 협의 → 최종 합격이며, 필요에 따라 추가 인터뷰·직무 테스트 또는 지원자 동의 하의 레퍼런스 체크가 진행될 수 있습니다.
정규직에는 3개월 수습기간이 있으며, 회사 JD에 따르면 수습 중 급여 등 처우 차이는 없습니다. 평가 결과에 따라 수습기간이 연장되거나 종료될 수 있습니다. 구체적인 보상은 처우 협의 단계에서 논의됩니다.