fix: check for zero param and set to None

This commit is contained in:
velaraptor-runpod
2026-02-13 15:23:54 -06:00
parent b749aa5718
commit e705c9494b
+7
View File
@@ -288,6 +288,13 @@ def get_engine_args():
# Set max_num_batched_tokens to max_model_len for unlimited batching.
# vLLM defaults max_num_batched_tokens to 2048 when None, which is too low.
if args.get("max_model_len") == 0:
args["max_model_len"] = None
if args.get("max_num_batched_tokens") == 0:
args["max_num_batched_tokens"] = None
if args.get("max_num_batched_tokens") is None:
max_model_len = args.get("max_model_len")
if max_model_len is None: