日本語 / English / 한국어/ 中文/ Deutsch/ العربية/ Ελληνικά/ Español/ Français/ Italiano/ Latina/ Bahasa Melayu/ Русский *Bahasa lain diterjemahkan oleh mesin.
Perisian klien Teks ke Pertuturan (TTS). Dijangka menyokong pelbagai model AI (kini hanya GPT-SoVITS v2, v3).
- AI Disokong
- GPT-SoVITS
- akan datang...
out_woman.mp4
out1_multi.mp4
-
v.1.0.21
- ciri baru:
- Ditambah sokongan untuk memuat turun Zundamon dari contoh zundamon-speech-webui.
- ciri baru:
-
v.1.0.20
- ciri baru:
- Ditambah sokongan untuk pelarasan intonasi dalam GPT-SoVITS.
- ciri baru:
-
v.1.0.13
- ciri baru:
- Sokongan untuk GPT-SoVITS v3, termasuk model yang dioptimumkan dengan LoRA.
- Penambahbaikan rakaman suara rujukan. Kini anda boleh merakam terus dari mikrofon atau audio PC, dan transkripsi teks dilakukan secara automatik.
- ciri baru:
チュートリアル 日本語 / Tutorial English / 튜토리얼 한국어/ 教程 中文(zh)/ 教程 中文(yue)/
Sila muat turun dari repositori Hugging Face.
- edisi win_std: Edisi Windows yang berjalan pada CPU. Lebih perlahan berbanding edisi CUDA, tetapi berfungsi pada CPU terkini dengan spesifikasi yang baik.
- edisi win_cuda: Edisi Windows yang berjalan pada GPU NVIDIA. Berjalan lebih pantas dengan pecutan perkakasan GPU.
- edisi mac: Edisi untuk Mac (Apple silicon (M1, M2, M3, etc)).
- Selepas mengekstrak fail zip, jalankan
start_http.bat. Akses URL yang dipaparkan dalam pelayar anda. - Menggunakan
start_https.batanda boleh mengakses dari lokasi jauh. - (Lanjutan) Menggunakan
start_http_with_ngrok.batanda boleh mengakses melalui terowong ngrok. - Jika anda ingin menggunakan bahasa Korea di Windows, jalankan download_korean_module.bat terlebih dahulu. Nota: Untuk edisi mac, gantikan .bat dengan .command.
Untuk butiran model, rujuk repositori rasmi GPT-SoVITS.
Dalam GPT-SoVITS, anda memilih model, suara rujukan dan teks rujukan sebelum menjana suara. TTSClient mempunyai konsep penutur rujukan, di mana penutur rujukan boleh mempunyai pelbagai suara dan teks rujukan.
- Pilih model dan penutur rujukan ((1), (2)).
- Pilih suara rujukan dan teks rujukan yang telah direkodkan untuk penutur rujukan (3).
- Masukkan teks yang anda ingin jana dan cipta suara (4).
Daftar dari butang edit dalam kawasan pemilihan model.
Daftar dari butang edit dalam kawasan pendaftaran penutur rujukan.
Pilih slot yang belum didaftarkan dalam kawasan pemilihan suara rujukan untuk mendaftar.
-
Keperluan
cmake
$ git clone https://github.com/w-okada/ttsclient.git
$ cd ttsclient/
$ git submodule update --init --recursive
$ sed -i '/pyopenjtalk/d' pyproject.toml
$ poetry install
$ wget "https://files.pythonhosted.org/packages/source/p/pyopenjtalk/pyopenjtalk-0.4.0.tar.gz"
$ tar xzf pyopenjtalk-0.4.0.tar.gz
$ sed -i -E 's/cmake_minimum_required\(VERSION[^\)]*\)/cmake_minimum_required(VERSION 3.5...3.31)/' pyopenjtalk-0.4.0/lib/open_jtalk/src/CMakeLists.txt
$ rm pyopenjtalk-0.4.0.tar.gz
$ tar czf pyopenjtalk-0.4.0.tar.gz pyopenjtalk-0.4.0/
$ poetry run pip install pyopenjtalk-0.4.0.tar.gz
$ poetry run main cui
---
Untuk akses jauh, tambah `--https true`.
---
$ poetry run main cui --https true
Gantikan modul seperti berikut:
$ poetry add onnxruntime-gpu==1.20.1
$ poetry remove torch
$ poetry add torch==2.4.1 torchaudio==2.4.1 --source torch_cuda12
Gantikan modul seperti berikut:
$ poetry add onnxruntime-directml==1.19.2
