voice pocket

AI 음성 학습 모델을 활용한 커스텀 TTS(text-to-speech) 서비스

0 팔로워

1 / 5

소개

**Info** - AI 음성 합성 모델을 활용한 커스텀 TTS 어플리케이션 서비스 - glow-tts 모델과 hifi-GAN 모델을 활용하여 사용자가 직접 자신의 커스텀 모델을 만들기 용이하도록 만들어주는 서비스입니다. - 만들어진 개개인별 모델을 서로 공유하여 자신이 원하는 문장을 특정 사람의 목소리로 합성할 수 있습니다. **Contents** - Django를 이용한 REST API 구현 - 텍스트와 유저 정보가 들어왔을 때, coqui-TTS 라이브러리를 활용하여 특정 유저의 목소리로 해당 문구를 읽어주는 음성파일을 합성하는 REST API 구현 - 음성파일 및 모델파일 관리를 위한 google Cloud Strogage 버킷 사용 - AI 음성 모델(.tar) 및 음성 파일(.wav)들의 저장 및 관리의 용이함을 위해 google cloud storage의 버킷을 활용함 - RabbitMQ, Celery를 활용한 비동기 처리 - rabbitMQ를 활용하여 음성 파일 합성 및 버킷에 업로드하는 요청을 celery worker가 수행함으로써 python 환경에서 task 간의 비동기 처리가 가능하도록 구현 - Docker를 사용한 개발 및 배포 전체 환경 구축 - django api server, mysql, celery, rabbitMQ 각각 다른 실행환경을 컨테이너로 분리하여 Docker 위에 돌아가도록 환경 구축 - Flutter를 사용하여 ios, android 환경 모두 배포가 가능하도록 만들었습니다.

포스트

아직 포스트가 없습니다.

댓글

로그인 후 댓글을 남길 수 있습니다.

아직 댓글이 없습니다.