mirror of
https://github.com/2noise/ChatTTS.git
synced 2026-08-31 01:12:28 +08:00
00b2dfd1a3
Co-authored-by: github-actions[bot] <github-actions[bot]@users.noreply.github.com>
97 lines
2.5 KiB
Python
97 lines
2.5 KiB
Python
import os, sys
|
|
|
|
if sys.platform == "darwin":
|
|
os.environ["PYTORCH_ENABLE_MPS_FALLBACK"] = "1"
|
|
|
|
now_dir = os.getcwd()
|
|
sys.path.append(now_dir)
|
|
|
|
import argparse
|
|
from typing import Optional, List
|
|
|
|
import numpy as np
|
|
|
|
import ChatTTS
|
|
|
|
from tools.audio import wav_arr_to_mp3_view
|
|
from tools.logger import get_logger
|
|
|
|
logger = get_logger("Command")
|
|
|
|
|
|
def save_mp3_file(wav, index):
|
|
data = wav_arr_to_mp3_view(wav)
|
|
mp3_filename = f"output_audio_{index}.mp3"
|
|
with open(mp3_filename, "wb") as f:
|
|
f.write(data)
|
|
logger.info(f"Audio saved to {mp3_filename}")
|
|
|
|
|
|
def main(texts: List[str], spk: Optional[str] = None, stream=False):
|
|
logger.info("Text input: %s", str(texts))
|
|
|
|
chat = ChatTTS.Chat(get_logger("ChatTTS"))
|
|
logger.info("Initializing ChatTTS...")
|
|
if chat.load():
|
|
logger.info("Models loaded successfully.")
|
|
else:
|
|
logger.error("Models load failed.")
|
|
sys.exit(1)
|
|
|
|
if spk is None:
|
|
spk = chat.sample_random_speaker()
|
|
logger.info("Use speaker:")
|
|
print(spk)
|
|
|
|
logger.info("Start inference.")
|
|
wavs = chat.infer(
|
|
texts,
|
|
stream,
|
|
params_infer_code=ChatTTS.Chat.InferCodeParams(
|
|
spk_emb=spk,
|
|
),
|
|
)
|
|
logger.info("Inference completed.")
|
|
# Save each generated wav file to a local file
|
|
if stream:
|
|
wavs_list = []
|
|
for index, wav in enumerate(wavs):
|
|
if stream:
|
|
for i, w in enumerate(wav):
|
|
save_mp3_file(w, (i + 1) * 1000 + index)
|
|
wavs_list.append(wav)
|
|
else:
|
|
save_mp3_file(wav, index)
|
|
if stream:
|
|
for index, wav in enumerate(np.concatenate(wavs_list, axis=1)):
|
|
save_mp3_file(wav, index)
|
|
logger.info("Audio generation successful.")
|
|
|
|
|
|
if __name__ == "__main__":
|
|
logger.info("Starting ChatTTS commandline demo...")
|
|
parser = argparse.ArgumentParser(
|
|
description="ChatTTS Command",
|
|
usage='[--spk xxx] [--stream] "Your text 1." " Your text 2."',
|
|
)
|
|
parser.add_argument(
|
|
"--spk",
|
|
help="Speaker (empty to sample a random one)",
|
|
type=Optional[str],
|
|
default=None,
|
|
)
|
|
parser.add_argument(
|
|
"--stream",
|
|
help="Use stream mode",
|
|
action="store_true",
|
|
)
|
|
parser.add_argument(
|
|
"texts",
|
|
help="Original text",
|
|
default=["YOUR TEXT HERE"],
|
|
nargs=argparse.REMAINDER,
|
|
)
|
|
args = parser.parse_args()
|
|
main(args.texts, args.spk, args.stream)
|
|
logger.info("ChatTTS process finished.")
|