fix(customvoice): override max_seq_len to 1024 to prevent CUDA OOM

This commit is contained in:
mARTin-B78 2026-06-22 11:17:39 +02:00
parent 377b9f16e5
commit 79d8d2cd96

View File

@ -252,6 +252,8 @@ def main():
parser.add_argument("--device", default="cuda")
parser.add_argument("--max-seq-len", type=int, default=2048)
args = parser.parse_args()
# Force a smaller max_seq_len to save VRAM and prevent OOM
args.max_seq_len = 1024
DEFAULT_MAX_NEW_TOKENS = args.max_seq_len
_load_model_kwargs = args