Logo
Explore Help
Sign In
owen/worker-vllm
Watch 1
Star 0
Fork 0
Code Issues Pull Requests Packages Projects Releases Wiki Activity
Files
fb4e7000909c9766e918b81ce76b898bed54a36a
worker-vllm/src
T
History
pandyamarut 99b952e55e set default max_token size
Signed-off-by: pandyamarut <pandyamarut@gmail.com>
2025-02-24 17:22:44 -08:00
..
__init__.py
Add __init__.py
2024-02-06 02:44:35 +00:00
constants.py
Small refactor
2024-03-06 17:08:57 +00:00
download_model.py
0.5.3, any vllm arg as env var, refactor and fixes, moving away from building separate image from vLLM fork
2024-07-25 12:41:48 -07:00
engine_args.py
dynamic lora loading
2025-01-28 19:00:57 -08:00
engine.py
Revert "Enabling model caching."
2025-02-18 10:45:47 -08:00
handler.py
OpenAI Compatibility, Dynamic Batching, Refactor
2024-02-21 04:36:04 +00:00
tokenizer.py
0.5.3, any vllm arg as env var, refactor and fixes, moving away from building separate image from vLLM fork
2024-07-25 12:41:48 -07:00
utils.py
set default max_token size
2025-02-24 17:22:44 -08:00
Powered by Gitea Version: 1.27.1 Page: 44ms Template: 1ms
Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API