2026년 7월 21일 화요일

MeloTTS




 여기에 작성하신 마크다운 원본을 그대로 붙여넣으세요.
 
 # 1단계 제목
 ```python
 def backup():
     print("마크다운 원본 유지")
 ```
 [링크 주소](https://example.com)

# MeloTTS 설치 및 한국어 TTS 실행 가이드

## 1. 프로젝트 개요

* 정의: MyShell.ai와 MIT 연구진이 개발한 고품질 다국어 TTS 라이브러리입니다.
* 지원 언어: 한국어(KR), 영어(미국/영국/인도/호주), 중국어, 일본어, 스페인어, 프랑스어.
* 주요 특징: 중국어/영어 혼용 지원, CPU 환경에서도 실시간 추론이 가능할 만큼 빠른 속도.
* 라이선스: MIT License (상업적/비상업적 이용 모두 무료).

## 2. 환경 구축 및 설치 (Conda/Terminal)

가상 환경을 생성하고 소스 코드를 설치하는 과정입니다.

① 가상 환경 생성 및 활성화

```bash
# Python 3.11 또는 3.13 환경 생성 (3.13 사용 시 conda init 필요할 수 있음)
conda create -n melotts python=3.11
conda activate melotts

# 활성화 오류 발생 시 해결법
source ~/.anaconda3/etc/profile.d/conda.sh
conda activate melotts
```

② 패키지 설치 및 사전 학습 모델 다운로드

```bash
# 소스 코드 다운로드
git clone https://github.com/myshell-ai/MeloTTS.git
cd MeloTTS

# 라이브러리 및 종속성 설치
pip install -e .
python -m unidic download
```

## 3. 한국어 음성 생성 예제 코드 (Python API)

제공된 텍스트를 바탕으로 한국어 음성 파일(kr.wav)을 생성하는 전체 코드입니다.

```python
from melo.api import TTS

# 1. 설정: 속도 및 연산 장치(CPU/GPU)
speed = 1.5
device = 'cpu' # 또는 'cuda:0' (NVIDIA GPU 사용 시)

# 2. 모델 로드 (한국어 설정)
model = TTS(language='KR', device=device)
speaker_ids = model.hps.data.spk2id

# 3. 변환할 텍스트 정의 (오픈에이아이 관련 뉴스 내용)
text = "챗지피티 개발사 오픈에이아이는 중국과 인공지능 경쟁에서 앞서기 위해서는..."

# 4. 음성 파일 생성 및 저장
output_path = 'kr.wav'
model.tts_to_file(text, speaker_ids['KR'], output_path, speed=speed)
```

## 4. 코드 실행 결과 확인

* 결과물: 실행 경로에 kr.wav 파일이 생성됩니다.
* 커스터마이징: speed 변수를 조절하여 말하기 속도를 변경할 수 있으며,  device 설정을 통해 GPU 가속을 활용할 수 있습니다.

* 💡 추가 정보: MeloTTS는 HuggingFace에서도 모델 카드를 제공하며, 설치 없이도 웹 인터페이스를 통해 기능을 테스트해 볼 수 있습니다. 다른 언어(예: 영어-중국어 혼용) 설정이나 사용자 정의 데이터셋 학습 방법이 필요하신가요?


Cargo.toml

# curl --proto '=https' --tlsv1.2 -sSf https://sh.rustup.rs | sh # rustup update # cargo update [pack...