aboutsummaryrefslogtreecommitdiff
path: root/app/docs
diff options
context:
space:
mode:
authorhistoria <historiavg@proton.me>2026-08-25 13:28:42 -0400
committerhistoria <historiavg@proton.me>2026-08-25 13:28:42 -0400
commitd4dbc1a158d1dd6babcba7333a4ed7d719b65d3e (patch)
treeccba2efaef9a265f7cbc754cf70d8071d09e9612 /app/docs
parent0cc01d1da0a629e104202053feb0bb0db91d578d (diff)
downloadtts-audiobook-generator-d4dbc1a158d1dd6babcba7333a4ed7d719b65d3e.tar.gz
feat: automatically name audio.cpp model ids with long name
Diffstat (limited to 'app/docs')
-rw-r--r--app/docs/backend-audiocpp.md16
1 files changed, 8 insertions, 8 deletions
diff --git a/app/docs/backend-audiocpp.md b/app/docs/backend-audiocpp.md
index c9ef883..3323887 100644
--- a/app/docs/backend-audiocpp.md
+++ b/app/docs/backend-audiocpp.md
@@ -32,7 +32,7 @@ You can run `python tools/model_manager_v2.py list` to see all available models.
### Create server.json
-Create a `server.json` config file. One server can host multiple models and multiple cloned voices. The `id:` fields are the model names you will set for `tts-audiobook-generator` with `--model`.
+Create a `server.json` config file. One server can host multiple models and multiple cloned voices. The `id:` fields are the model names you will set for `tts-audiobook-generator` with `--model` (the setup wizard names each entry after its model package directory).
```json
{
@@ -43,21 +43,21 @@ Create a `server.json` config file. One server can host multiple models and mult
"voice_dir": "/path/to/clone/wavs",
"models": [
{
- "id": "higgs",
+ "id": "Higgs-Audio-v3-TTS-4B-GGUF",
"family": "higgs_audio_tts",
"path": "models/Higgs-Audio-v3-TTS-4B-GGUF",
"task": "tts",
"mode": "offline"
},
{
- "id": "qwen",
+ "id": "Qwen3-TTS-12Hz-1.7B-CustomVoice-GGUF",
"family": "qwen3_tts",
"path": "models/Qwen3-TTS-12Hz-1.7B-CustomVoice-GGUF",
"task": "tts",
"mode": "offline"
},
{
- "id": "qwen-clone",
+ "id": "Qwen3-TTS-12Hz-1.7B-Base-GGUF",
"family": "qwen3_tts",
"path": "models/Qwen3-TTS-12Hz-1.7B-Base-GGUF",
"task": "tts",
@@ -79,16 +79,16 @@ In a different terminal, run `audiobook.py`. Pick the TTS `--model` and `--voice
```bash
# Higgs Audio (clone-only)
-python audiobook.py --backend audiocpp --model higgs --voice narrator
+python audiobook.py --backend audiocpp --model Higgs-Audio-v3-TTS-4B-GGUF --voice narrator
# Qwen3-TTS built-in speaker
-python audiobook.py --backend audiocpp --model qwen
+python audiobook.py --backend audiocpp --model Qwen3-TTS-12Hz-1.7B-CustomVoice-GGUF
# Qwen3-TTS voice cloning
-python audiobook.py --backend audiocpp --model qwen-clone --voice narrator
+python audiobook.py --backend audiocpp --model Qwen3-TTS-12Hz-1.7B-Base-GGUF --voice narrator
# Qwen-TTS voice design
-python audiobook.py --backend audiocpp --model qwen-design \
+python audiobook.py --backend audiocpp --model Qwen3-TTS-12Hz-1.7B-VoiceDesign-GGUF \
--instructions "A warm adult female narrator with a British accent"
```