Fix vLLM 0.4.1 bug for OpenAI /models route

This commit is contained in:
alpayariyak
2024-06-10 20:38:49 +00:00
parent f19ce12ab0
commit bad5ddd892
+3
View File
@@ -141,6 +141,9 @@ class OpenAIvLLMEngine:
async def _handle_model_request(self):
models = await self.chat_engine.show_available_models()
fixed_model = models.data[0]
fixed_model.id = self.served_model_name
models.data = [fixed_model]
return models.model_dump()
async def _handle_chat_or_completion_request(self, openai_request: JobInput):