Fix vLLM 0.4.1 bug for OpenAI /models route
This commit is contained in:
@@ -141,6 +141,9 @@ class OpenAIvLLMEngine:
|
|||||||
|
|
||||||
async def _handle_model_request(self):
|
async def _handle_model_request(self):
|
||||||
models = await self.chat_engine.show_available_models()
|
models = await self.chat_engine.show_available_models()
|
||||||
|
fixed_model = models.data[0]
|
||||||
|
fixed_model.id = self.served_model_name
|
||||||
|
models.data = [fixed_model]
|
||||||
return models.model_dump()
|
return models.model_dump()
|
||||||
|
|
||||||
async def _handle_chat_or_completion_request(self, openai_request: JobInput):
|
async def _handle_chat_or_completion_request(self, openai_request: JobInput):
|
||||||
|
|||||||
Reference in New Issue
Block a user