42dot Jobs logo
Posted 1h ago•Pangyo (Software Dream Center), South Korea

Deep Learning Engineer (음성 합성 개발)

MiddleOn-site (Pangyo)Salary undisclosed
Required Skills
PythonLinuxPyTorchLLMs
Job Description

About the Team & Mission

Gleo AI는 다양한 차량 환경에서 사용자가 자연스럽고 풍부한 음성 경험을 할 수 있도록, 차세대 Text-to-Speech(TTS) 기술을 연구하고 실제 제품과 서비스로 연결하고 있습니다.

우리는 단순히 텍스트를 음성으로 변환하는 것을 넘어, 자연스러운 발화와 다양한 표현력을 제공하고 다양한 환경에서 안정적으로 동작하는 TTS 기술을 연구합니다. 특히 Neural Audio Codec, Speech Language Model, On-device AI 등 최신 음성 생성 기술을 빠르게 실험하고, 가능성이 확인된 기술을 실제 서비스에 적용할 수 있도록 발전시키고 있습니다.

새로운 기술이 연구에 머무르지 않도록 데이터 구축, 모델 학습, 추론 최적화, 음질 및 발음 개선부터 서비스 적용까지 TTS 개발 전 과정을 직접 연결하며, 다양한 언어와 화자 환경에서 사용자가 체감할 수 있는 음성 경험을 만들어가고 있습니다.

어려운 문제를 끝까지 파고들고 새로운 기술을 주도적으로 실험하는 것을 즐기는 분과 함께하고 싶습니다. 연구와 개발의 경계를 넘나들며 최신 TTS 기술을 제품까지 연결하고, 미래 모빌리티의 새로운 음성 경험을 함께 만들어갈 엔지니어를 기다립니다.

Responsibilities

  • On-device / Server 환경을 위한 TTS 모델 최적화

  • NPU 등 AI Accelerator 환경 모델 포팅 및 최적화

  • Quantization 기반 모델 경량화 및 성능 최적화

  • 실시간(streaming) 음성 합성 시스템 개발 및 latency 최적화

  • 다국어 / 다화자 TTS 모델 개발 및 서비스 적용

  • LLM 및 Flow Matching 기반 최신 TTS 모델 연구 및 개발

  • 최신 생성 모델 기반의 음성 합성 데이터 구축 및 품질 개선

  • 양산 환경에서 발생하는

Similar Openings in AI & Machine Learning

View all in category➔