From e2e111b942396ca9f1bdde38565fa6746e0f4805 Mon Sep 17 00:00:00 2001 From: Tim Pietrusky Date: Wed, 13 Aug 2025 10:27:00 +0200 Subject: [PATCH 1/2] fix: allow "None" as string for setting env variables (like quantization) --- src/engine_args.py | 2 +- 1 file changed, 1 insertion(+), 1 deletion(-) diff --git a/src/engine_args.py b/src/engine_args.py index 8105a09..b7cc991 100644 --- a/src/engine_args.py +++ b/src/engine_args.py @@ -111,7 +111,7 @@ def match_vllm_args(args): """ renamed_args = {RENAME_ARGS_MAP.get(k, k): v for k, v in args.items()} matched_args = {k: v for k, v in renamed_args.items() if k in AsyncEngineArgs.__dataclass_fields__} - return {k: v for k, v in matched_args.items() if v not in [None, ""]} + return {k: v for k, v in matched_args.items() if v not in [None, "", "None"]} def get_local_args(): """ Retrieve local arguments from a JSON file. From 121a3dd44b60f9fb5afe84b4d23dc3b78a405680 Mon Sep 17 00:00:00 2001 From: Tim Pietrusky Date: Wed, 13 Aug 2025 12:20:44 +0200 Subject: [PATCH 2/2] fix: parse value for RAW_OPENAI_OUTPUT correctly --- src/engine.py | 7 ++++++- 1 file changed, 6 insertions(+), 1 deletion(-) diff --git a/src/engine.py b/src/engine.py index 073f0d5..99d9132 100644 --- a/src/engine.py +++ b/src/engine.py @@ -178,7 +178,12 @@ class OpenAIvLLMEngine(vLLMEngine): self.response_role = os.getenv("OPENAI_RESPONSE_ROLE") or "assistant" self.lora_adapters = self._load_lora_adapters() asyncio.run(self._initialize_engines()) - self.raw_openai_output = bool(int(os.getenv("RAW_OPENAI_OUTPUT", 1))) + # Handle both integer and boolean string values for RAW_OPENAI_OUTPUT + raw_output_env = os.getenv("RAW_OPENAI_OUTPUT", "1") + if raw_output_env.lower() in ('true', 'false'): + self.raw_openai_output = raw_output_env.lower() == 'true' + else: + self.raw_openai_output = bool(int(raw_output_env)) def _load_lora_adapters(self): adapters = []