Engineering
Text to Speech 서비스 소개
2022년 3월 11일
원문에서 보기 ↗Text to Speech는 NHN Cloud의 문자 인식 및 음성 합성 기술을 통해, 입력된 텍스트를 인식하고 인식된 문자를 자연스러운 음성으로 합성하여 제공합니다. 자동 응답 서비스, 오디오 콘텐츠 제작이 필요한 서비스 등 다양한 분야에서 활용할 수 있습니다.
주요 기능 및 특징
NHN Cloud 웹 콘솔을 통해 텍스트를 입력하고 음성 합성 결과를 들어 볼 수 있는 페이지가 존재합니다. 입력된 텍스트에서 NHN Cloud의 Text to Speech Engine을 통해 음소 단위별로 음성을 합성하여, 실제 사람과 같은 자연스러운 음성을 제공합니다. 음성 합성 API는 실제 서비스에서 사용할 수 있도록 REST API 형식으로 제공됩니다.

세분화된 음성 합성 조건 설정
- 음성: 음성의 종류(남성, 여성)를 설정할 수 있습니다.
- 높낮이: 음성의 어조를 구현할 수 있도록 높낮이 값을 설정할 수 있습니다.
- 속도: 음성의 속도(1배속, 2배속 등) 값을 설정할 수 있습니다.
- 음량: 음량 값을 설정할 수 있습니다.
음성 합성 결과 다운로드
- 입력한 텍스트를 변환한 음성 파일을 WAV 또는 MP3 형식으로 받으실 수 있습니다.
Text to Speech 서비스 활용 예
- 음성 합성 자동화가 필요한 경우
- 자동 응답 서비스를 구축하는 경우
- 책, 인터넷, 문서 등 음성 관련 콘텐츠 생성이 필요한 경우
API 가이드
- 한글 텍스트 입력을 음성 파일로 쉽게 변환하실 수 있도록 API를 제공합니다. 자세한 내용은 다음 사용자 가이드를 참고하시기 바랍니다. https://docs.toast.com/ko/AI%20Service/Text%20to%20Speech/ko/api-guide/