This website requires JavaScript.
Explore
Help
Register
Sign In
wassname
/
vllm
Watch
1
Star
0
Fork
0
mirror of
https://github.com/wassname/vllm.git
synced
2026-08-12 12:30:29 +08:00
Code
Issues
Packages
Projects
Releases
Wiki
Activity
Files
3c5ab9b811da7a72af6459bc0c344644ebdc1ef6
vllm
/
vllm
/
engine
T
History
3 people
Antoni Baum
GitHub
MeloYang
bfdb1ba5c3
[Core] Improve detokenization performance for prefill (
#3469
)
...
Co-authored-by: MeloYang <
meloyang05@gmail.com
>
2024-03-22 13:44:12 -07:00
..
__init__.py
Change the name to vLLM (
#150
)
2023-06-17 03:07:40 -07:00
arg_utils.py
Dynamic scheduler delay to improve ITL performance (
#3279
)
2024-03-22 12:28:14 -07:00
async_llm_engine.py
[Hardware][Neuron] Refactor neuron support (
#3471
)
2024-03-22 01:22:17 +00:00
llm_engine.py
[Core] Improve detokenization performance for prefill (
#3469
)
2024-03-22 13:44:12 -07:00
metrics.py
Re-enable the 80 char line width limit (
#3305
)
2024-03-10 19:49:14 -07:00
ray_utils.py
[Core] print error before deadlock (
#3459
)
2024-03-19 04:06:23 +00:00