voice pocket
AI 음성 학습 모델을 활용한 커스텀 TTS(text-to-speech) 서비스
5
0 팔로워
소개
**Info**
- AI 음성 합성 모델을 활용한 커스텀 TTS 어플리케이션 서비스
- glow-tts 모델과 hifi-GAN 모델을 활용하여 사용자가 직접 자신의 커스텀 모델을 만들기 용이하도록 만들어주는 서비스입니다.
- 만들어진 개개인별 모델을 서로 공유하여 자신이 원하는 문장을 특정 사람의 목소리로 합성할 수 있습니다.
**Contents**
- Django를 이용한 REST API 구현
- 텍스트와 유저 정보가 들어왔을 때, coqui-TTS 라이브러리를 활용하여 특정 유저의 목소리로 해당 문구를 읽어주는 음성파일을 합성하는 REST API 구현
- 음성파일 및 모델파일 관리를 위한 google Cloud Strogage 버킷 사용
- AI 음성 모델(.tar) 및 음성 파일(.wav)들의 저장 및 관리의 용이함을 위해 google cloud storage의 버킷을 활용함
- RabbitMQ, Celery를 활용한 비동기 처리
- rabbitMQ를 활용하여 음성 파일 합성 및 버킷에 업로드하는 요청을 celery worker가 수행함으로써 python 환경에서 task 간의 비동기 처리가 가능하도록 구현
- Docker를 사용한 개발 및 배포 전체 환경 구축
- django api server, mysql, celery, rabbitMQ 각각 다른 실행환경을 컨테이너로 분리하여 Docker 위에 돌아가도록 환경 구축
- Flutter를 사용하여 ios, android 환경 모두 배포가 가능하도록 만들었습니다.
팀
포스트
아직 포스트가 없습니다.
댓글
로그인 후 댓글을 남길 수 있습니다.
아직 댓글이 없습니다.