fix: served model name

This commit is contained in:
velaraptor-runpod
2026-02-10 21:42:58 -06:00
parent e1e9ef74ad
commit 340bc0b3c6
2 changed files with 3 additions and 3 deletions
+1 -1
View File
@@ -11,5 +11,5 @@ hf-transfer
transformers>=4.56.0,<5
bitsandbytes>=0.45.0
kernels
torch>=2.10.0
torch>=2.9.1
torch-c-dlpack-ext
+2 -2
View File
@@ -176,7 +176,7 @@ class vLLMEngine:
class OpenAIvLLMEngine(vLLMEngine):
def __init__(self, vllm_engine):
super().__init__(vllm_engine)
self.served_model_name = os.getenv("OPENAI_SERVED_MODEL_NAME_OVERRIDE") or self.engine_args.model
self.served_model_name = os.getenv("OPENAI_SERVED_MODEL_NAME_OVERRIDE") or self.engine_args.served_model_name or self.engine_args.model
self.response_role = os.getenv("OPENAI_RESPONSE_ROLE") or "assistant"
self.lora_adapters = self._load_lora_adapters()
self._engines_initialized = False
@@ -215,7 +215,7 @@ class OpenAIvLLMEngine(vLLMEngine):
async def _initialize_engines(self):
logging.info("Initializing OpenAI serving engines...")
self.base_model_paths = [
BaseModelPath(name=self.engine_args.model, model_path=self.engine_args.model)
BaseModelPath(name=self.served_model_name, model_path=self.engine_args.model)
]
self.serving_models = OpenAIServingModels(