tts-dgx-spark-faster-qwen3-tts/config
mARTin 60db1b181f Initial release: Faster-Qwen3-TTS for DGX Spark GB10
Run Qwen3-TTS with CUDA graph acceleration on NVIDIA DGX Spark
(ARM64 / SM 121 / CUDA 13) as an OpenAI-compatible TTS API server.

- Dockerfile targeting nvidia/cuda:13.0.2-base-ubuntu24.04 with ARM64 cu130 PyTorch wheels
- Patch for max-seq-len support to handle long reference audio without crashes
- OpenWebUI + SillyTavern compatible API endpoints (/v1/models, /v1/audio/voices, /speakers)
- Voice management: auto-generate voices.json from speaker reference audio files
- Auto-transcription helper script for generating reference text from audio

Co-Authored-By: Claude Opus 4.6 <noreply@anthropic.com>
2026-04-14 00:06:05 +02:00
..
speakers Initial release: Faster-Qwen3-TTS for DGX Spark GB10 2026-04-14 00:06:05 +02:00
auto_transcribe.py Initial release: Faster-Qwen3-TTS for DGX Spark GB10 2026-04-14 00:06:05 +02:00
generate_voices.py Initial release: Faster-Qwen3-TTS for DGX Spark GB10 2026-04-14 00:06:05 +02:00
run_server.py Initial release: Faster-Qwen3-TTS for DGX Spark GB10 2026-04-14 00:06:05 +02:00