fix(customvoice): override max_seq_len to 1024 to prevent CUDA OOM
This commit is contained in:
parent
377b9f16e5
commit
79d8d2cd96
@ -252,6 +252,8 @@ def main():
|
|||||||
parser.add_argument("--device", default="cuda")
|
parser.add_argument("--device", default="cuda")
|
||||||
parser.add_argument("--max-seq-len", type=int, default=2048)
|
parser.add_argument("--max-seq-len", type=int, default=2048)
|
||||||
args = parser.parse_args()
|
args = parser.parse_args()
|
||||||
|
# Force a smaller max_seq_len to save VRAM and prevent OOM
|
||||||
|
args.max_seq_len = 1024
|
||||||
DEFAULT_MAX_NEW_TOKENS = args.max_seq_len
|
DEFAULT_MAX_NEW_TOKENS = args.max_seq_len
|
||||||
_load_model_kwargs = args
|
_load_model_kwargs = args
|
||||||
|
|
||||||
|
|||||||
Loading…
Reference in New Issue
Block a user