This website requires JavaScript.
Explore
Help
Sign In
owen
/
worker-vllm
Watch
1
Star
0
Fork
0
Code
Issues
Pull Requests
Packages
Projects
Releases
Wiki
Activity
Files
fb4e7000909c9766e918b81ce76b898bed54a36a
worker-vllm
/
src
T
History
pandyamarut
99b952e55e
set default max_token size
...
Signed-off-by: pandyamarut <
pandyamarut@gmail.com
>
2025-02-24 17:22:44 -08:00
..
__init__.py
Add __init__.py
2024-02-06 02:44:35 +00:00
constants.py
Small refactor
2024-03-06 17:08:57 +00:00
download_model.py
0.5.3, any vllm arg as env var, refactor and fixes, moving away from building separate image from vLLM fork
2024-07-25 12:41:48 -07:00
engine_args.py
dynamic lora loading
2025-01-28 19:00:57 -08:00
engine.py
Revert "Enabling model caching."
2025-02-18 10:45:47 -08:00
handler.py
OpenAI Compatibility, Dynamic Batching, Refactor
2024-02-21 04:36:04 +00:00
tokenizer.py
0.5.3, any vllm arg as env var, refactor and fixes, moving away from building separate image from vLLM fork
2024-07-25 12:41:48 -07:00
utils.py
set default max_token size
2025-02-24 17:22:44 -08:00