From d4dbc1a158d1dd6babcba7333a4ed7d719b65d3e Mon Sep 17 00:00:00 2001 From: historia Date: Tue, 25 Aug 2026 13:28:42 -0400 Subject: feat: automatically name audio.cpp model ids with long name --- app/docs/backend-audiocpp.md | 16 ++++++++-------- 1 file changed, 8 insertions(+), 8 deletions(-) (limited to 'app/docs/backend-audiocpp.md') diff --git a/app/docs/backend-audiocpp.md b/app/docs/backend-audiocpp.md index c9ef883..3323887 100644 --- a/app/docs/backend-audiocpp.md +++ b/app/docs/backend-audiocpp.md @@ -32,7 +32,7 @@ You can run `python tools/model_manager_v2.py list` to see all available models. ### Create server.json -Create a `server.json` config file. One server can host multiple models and multiple cloned voices. The `id:` fields are the model names you will set for `tts-audiobook-generator` with `--model`. +Create a `server.json` config file. One server can host multiple models and multiple cloned voices. The `id:` fields are the model names you will set for `tts-audiobook-generator` with `--model` (the setup wizard names each entry after its model package directory). ```json { @@ -43,21 +43,21 @@ Create a `server.json` config file. One server can host multiple models and mult "voice_dir": "/path/to/clone/wavs", "models": [ { - "id": "higgs", + "id": "Higgs-Audio-v3-TTS-4B-GGUF", "family": "higgs_audio_tts", "path": "models/Higgs-Audio-v3-TTS-4B-GGUF", "task": "tts", "mode": "offline" }, { - "id": "qwen", + "id": "Qwen3-TTS-12Hz-1.7B-CustomVoice-GGUF", "family": "qwen3_tts", "path": "models/Qwen3-TTS-12Hz-1.7B-CustomVoice-GGUF", "task": "tts", "mode": "offline" }, { - "id": "qwen-clone", + "id": "Qwen3-TTS-12Hz-1.7B-Base-GGUF", "family": "qwen3_tts", "path": "models/Qwen3-TTS-12Hz-1.7B-Base-GGUF", "task": "tts", @@ -79,16 +79,16 @@ In a different terminal, run `audiobook.py`. Pick the TTS `--model` and `--voice ```bash # Higgs Audio (clone-only) -python audiobook.py --backend audiocpp --model higgs --voice narrator +python audiobook.py --backend audiocpp --model Higgs-Audio-v3-TTS-4B-GGUF --voice narrator # Qwen3-TTS built-in speaker -python audiobook.py --backend audiocpp --model qwen +python audiobook.py --backend audiocpp --model Qwen3-TTS-12Hz-1.7B-CustomVoice-GGUF # Qwen3-TTS voice cloning -python audiobook.py --backend audiocpp --model qwen-clone --voice narrator +python audiobook.py --backend audiocpp --model Qwen3-TTS-12Hz-1.7B-Base-GGUF --voice narrator # Qwen-TTS voice design -python audiobook.py --backend audiocpp --model qwen-design \ +python audiobook.py --backend audiocpp --model Qwen3-TTS-12Hz-1.7B-VoiceDesign-GGUF \ --instructions "A warm adult female narrator with a British accent" ``` -- cgit v1.2.3