diff options
| author | historia <historiavg@proton.me> | 2026-09-02 20:46:42 -0400 |
|---|---|---|
| committer | historia <historiavg@proton.me> | 2026-09-02 20:46:42 -0400 |
| commit | 7a7dca313750ee75e0f8a2a5442ca5d78e743294 (patch) | |
| tree | 5847a83a58cf9191ed8268dcde3a85cb0d300b5a /app/tests/test_tts_sglomni.py | |
| parent | dfce6c38a9a67ea2760fedae73ee9f5989d52f13 (diff) | |
| download | tts-audiobook-generator-7a7dca313750ee75e0f8a2a5442ca5d78e743294.tar.gz | |
feat: reserve 20% vram when running higgs with sglang-omni
Diffstat (limited to 'app/tests/test_tts_sglomni.py')
| -rw-r--r-- | app/tests/test_tts_sglomni.py | 9 |
1 files changed, 8 insertions, 1 deletions
diff --git a/app/tests/test_tts_sglomni.py b/app/tests/test_tts_sglomni.py index 58ca57c..85327e1 100644 --- a/app/tests/test_tts_sglomni.py +++ b/app/tests/test_tts_sglomni.py @@ -254,8 +254,15 @@ class PayloadTests(unittest.TestCase): payload = client._request_payload("Hello.") self.assertEqual(payload["max_new_tokens"], 12288) - def test_models_without_a_cap_send_no_max_new_tokens(self): + def test_higgs_payload_raises_the_generation_cap(self): + """Higgs's 2048-frame engine default caps a request at ~27 s + (75 fps), below a full 250-word sub-chunk.""" client = self._make_client("higgs_audio_v3_tts") + payload = client._request_payload("Hello.") + self.assertEqual(payload["max_new_tokens"], 12288) + + def test_models_without_a_cap_send_no_max_new_tokens(self): + client = self._make_client("moss_tts") self.assertNotIn("max_new_tokens", client._request_payload("Hello.")) |
