aboutsummaryrefslogtreecommitdiff
path: root/converter/converter.py
diff options
context:
space:
mode:
authorhistoria <historiavg@proton.me>2026-08-21 02:31:54 -0400
committerhistoria <historiavg@proton.me>2026-08-21 02:31:54 -0400
commitf7021704b6b26ee747558d9ad701c2b25baedd2a (patch)
treefeda79e97ad0d6601558123bfe9093cfc4ac66e9 /converter/converter.py
parentfea9222740da007f1d7befcd7dee035265c0e5d1 (diff)
downloadtts-audiobook-generator-f7021704b6b26ee747558d9ad701c2b25baedd2a.tar.gz
feat: catalog-driven audio.cpp server.json creation
Diffstat (limited to 'converter/converter.py')
-rw-r--r--converter/converter.py6
1 files changed, 4 insertions, 2 deletions
diff --git a/converter/converter.py b/converter/converter.py
index c5f1788..4da3626 100644
--- a/converter/converter.py
+++ b/converter/converter.py
@@ -138,7 +138,7 @@ class AudiobookConverter:
speed: float = 1.0, single_file: bool = False, output_format: str = config.AUDIO_FORMAT,
language: Optional[str] = None, backend: str = BACKEND_GRADIO,
voice: Optional[str] = None, debug: bool = False,
- chunk: bool = False):
+ chunk: bool = False, model_id: Optional[str] = None):
if speed <= 0:
raise ValueError(f"Speed must be a positive number, got {speed}")
if output_format not in AUDIO_FORMATS:
@@ -172,8 +172,10 @@ class AudiobookConverter:
elif backend == BACKEND_AUDIOCPP:
# Speaker mode (no voice) uses a built-in CustomVoice speaker;
# an explicit voice selects a server-side preset (cloning).
+ # model_id overrides AUDIOCPP_MODEL_ID for multi-model servers.
self.tts = AudioCppTTSClient(voice=voice, language=self.language,
- chunk_text=self.client_chunks)
+ chunk_text=self.client_chunks,
+ model_id=model_id)
else:
self.tts = QwenTTSClient(
voice_mode=voice_mode,