클레온

클레온

Posted via WANTED

Research Engineer

Posted Sep 18, 2026

Role at a glance

Salary
Not Disclosed
Location
지하 1층, Seoul, South Korea
Work arrangement
On-site
Employment
Full-time
Experience
3–8 years

Spotted an issue?

We’ll check it against the original posting.

Log in to report

Qualifications

Required

  • 딥러닝 관련 경력 2년 이상이 있으신 분 (석사 이상 학위는 경력 인정 가능)
  • Python 기반 음성 처리(Audio Processing) 및 머신러닝 파이프라인 개발 경험이 필수적이신 분
  • ASR(STT) 또는 TTS(음성합성) 중 최소 한 가지 분야에 깊은 전문성이 있으며, 두 기술의 연동에 대한 이해도가 높으신 분
  • PyTorch 기반 모델 서빙 및 추론 최적화(TensorRT, ONNX 등) 경험이 있으신 분
  • 음성 입출력이 디지털 휴먼의 반응(애니메이션, 렌더링)으로 이어지는 전체 실시간 인터랙션 흐름에 관심이 많으신 분

Preferred

  • Proxy 서버 및 TTS 서버를 직접 개발하거나 아키텍처를 설계해 본 경험이 있으신 분
  • 실시간 대화 서비스 환경에서 지연 시간(Latency) 단축, 안정성, 음질을 모두 고려해 시스템을 개선한 경험이 있으신 분
  • 실시간 인터랙션 품질 개선 경험이 있으신 분 (EoT, Turn-taking, Barge-in(말 끊기) 등)
  • 최신 음성 모델 활용 및 커스터마이징 경험이 있으신 분
  • Speaker Diarization(화자 분리) 및 Speaker Identification(화자 식별) 관련 프로젝트 경험이 있으신 분
  • Claude, Gemini, GPT 등 최신 LLM API 및 오픈소스 LLM을 활용해 음성 에이전트 서비스를 고도화해 본 경험이 있으신 분

About the role

Original posting provided by 클레온

View original

About the role

클레온은 AI 기반 디지털 휴먼 기술과 서비스를 실제 서비스 현장에 적용하고 있습니다. 디지털 휴먼이 더 자연스럽게 듣고(ASR), 생각하고(LLM), 말할 수 있도록(TTS) 하는 실시간 오디오 인터랙션 엔진을 함께 고도화할 TTS/ASR 전문가를 모십니다.

클레온 홈페이지에서 디지털 휴먼을 직접 경험해보세요!
https://www.klleon.io

What you'll do

디지털 휴먼의 '청각'과 '목소리'를 담당하는 ASR 및 TTS 파이프라인의 전반적인 연구 개발 및 최적화를 담당합니다.

음성 인식 및 전처리 (ASR)
• 실시간 ASR 파이프라인 구축 및 최적화
• VAD(Voice Activity Detection), Noise Reduction 등 음성 전처리 로직 개선
• 사용자 발화 종료 시점(EoT) 및 화자 분리(Diarization)·식별 기술을 통한 대화 맥락 개선

음성 합성 및 후처리 (TTS)
• 실시간/고품질 TTS 파이프라인 구축 및 음성 합성 모델 고도화
• 디지털 휴먼의 페르소나에 맞춘 감정, 억양(Prosody) 제어 및 Voice Cloning 기술 적용
• 스트리밍 방식의 TTS 오디오 출력 최적화

인터랙션 루프 최적화
• ASR 결과를 Claude, GPT 등 LLM과 연동하고, 이를 다시 TTS로 연결하는 시스템 설계
• ASR – LLM – TTS – 디지털 휴먼 렌더링으로 이어지는 전체 인터랙션 루프의 지연 시간(Latency) 최소화 및 오디오 품질 개선

Requirements

• 딥러닝 관련 경력 2년 이상이 있으신 분 (석사 이상 학위는 경력 인정 가능)
• Python 기반 음성 처리(Audio Processing) 및 머신러닝 파이프라인 개발 경험이 필수적이신 분
• ASR(STT) 또는 TTS(음성합성) 중 최소 한 가지 분야에 깊은 전문성이 있으며, 두 기술의 연동에 대한 이해도가 높으신 분
• PyTorch 기반 모델 서빙 및 추론 최적화(TensorRT, ONNX 등) 경험이 있으신 분
• 음성 입출력이 디지털 휴먼의 반응(애니메이션, 렌더링)으로 이어지는 전체 실시간 인터랙션 흐름에 관심이 많으신 분

Preferred qualifications

Proxy 서버 및 TTS 서버를 직접 개발하거나 아키텍처를 설계해 본 경험이 있으신 분
• 실시간 대화 서비스 환경에서 지연 시간(Latency) 단축, 안정성, 음질을 모두 고려해 시스템을 개선한 경험이 있으신 분
• 실시간 인터랙션 품질 개선 경험이 있으신 분 (EoT, Turn-taking, Barge-in(말 끊기) 등)
• 최신 음성 모델 활용 및 커스터마이징 경험이 있으신 분
• Speaker Diarization(화자 분리) 및 Speaker Identification(화자 식별) 관련 프로젝트 경험이 있으신 분
• Claude, Gemini, GPT 등 최신 LLM API 및 오픈소스 LLM을 활용해 음성 에이전트 서비스를 고도화해 본 경험이 있으신 분

Benefits

• 유연근무제 : 코어타임을 준수하며 월 총 근무시간내에서 유연하게 근무합니다.
• 생일 유급 휴가 : 생일을 축하하는 마음을 담아 1영업일 휴가를 제공합니다.
• 경조휴가 : 영업일 기준으로 지급
• 유급병가 : 연간 최대 2주까지 (본인 또는 배우자/자녀 2일이상 아픈 경우 가능)
• 종합건강검진 : 당해년도 대상자에 한하여 제휴 병원에서 무료 외 검진 진행

위 혜택 및 복지는 정규직에 한함

Hiring process

서류전형 - 1차면접 - 2차면접 - 처우안내 - 입사

클레온

About the company

클레온

사람과 기술이 보다 자연스럽고 직관적으로 소통하는 새로운 경험을 만드는 인공지능 기업, 클레온(Klleon)입니다. 클레온은 LLM과 결합 가능한 실시간 대화형 디지털 휴먼 기술을 중심으로, 사람처럼 보고 듣고 말하며 상호작용할 수 있는 최첨단 AI 솔루션을 개발하고 있습니다. 자체 연구·개발한 영상 생성 및 디지털 휴먼 기술을 바탕으로, 실제 사용자와 실시간으로 대화하고 반응하는 인터랙티브 AI 경험을 구현하는 데 집중하고 있습니다. 특히 음성 인식, LLM, 영상 생성 등 다양한 AI 기술을 하나로 연결한 올인원 통합 솔루션을 제공하며, 기술 연구에 그치지 않고 실제 기업의 문제를 해결하는 제품과 서비스로 빠르게 연결하는 강력한 실행력을 보유하고 있습니다. 이미 삼성화재, 삼성메디슨 등 국내 주요 기업 및 기관과의 협업을 통해 기술력과 비즈니스 적용성을 입증했으며, 금융, 교육, 헬스케어, 세일즈, 고객 상담 등 다양한 산업군의 특성에 맞춰 기술을 커스터마이징하며 현장 중심의 AI 혁신을 선도하고 있습니다. 클레온은 기술 연구·서비스 기획·디자인·콘텐츠·사업 개발 등 다양한 직군이 하나의 프로젝트를 중심으로 긴밀히 협업하는 수평적이고 자율적인 조직 문화를 지향합니다. 빠르게 변화하는 생성형 AI 시장에서 기존 방식에 안주하기보다 더 좋은 방법을 적극적으로 제안하고, 빠른 실험과 제품 반영을 통해 개인과 조직이 함께 성장해 나갑니다. 단순한 기능 개발을 넘어, 최신 AI 기술로 고객사의 비즈니스 과제를 해결하고 세상에 없던 새로운 소통 경험을 함께 만들어갈 NEXT 클레오너를 기다립니다. 본인의 분야에서 최고의 전문가를 꿈꾸며 주도적으로 성장하고 싶은 분이라면, 언제나 문이 열려있는 클레온으로 지금 지원하세요!