Logo
Explore Help
Register Sign In
wassname/vllm
Watch 1
Star 0
Fork 0
mirror of https://github.com/wassname/vllm.git synced 2026-07-21 12:50:05 +08:00
Code Issues Packages Projects Releases Wiki Activity
117 Commits 1 Branch 0 Tags
189ae231336857bcc4c6f6157bf7868cdf56fb5f
Commit Graph
11 Commits
Author SHA1 Message Date
Woosuk KwonandGitHub 189ae23133 Use dtype from model config & Add Dolly V2 (#63) 2023-05-04 03:05:37 -07:00
Woosuk KwonandGitHub e070829ae8 Support bfloat16 data type (#54) 2023-05-03 14:09:44 -07:00
Zhuohan LiandGitHub 27f1410d06 New weight loader without np copy (#52) 2023-05-03 15:32:04 +08:00
Zhuohan LiandGitHub 4858f3bb45 Add an option to launch cacheflow without ray (#51) 2023-04-30 15:42:17 +08:00
Woosuk KwonandGitHub 0f4b32199e Support various block sizes & Change default block size to 16 (#38) 2023-04-15 09:03:24 -07:00
Woosuk KwonandGitHub 84eee24e20 Collect system stats in scheduler & Add scripts for experiments (#30) 2023-04-12 15:03:49 -07:00
Woosuk KwonandGitHub b9926f7f66 Support block size 32 (#35) 2023-04-09 23:07:18 -07:00
Woosuk KwonandGitHub ee88a7e5f3 Add an option to use dummy model weights (#33) 2023-04-08 23:36:12 -07:00
Woosuk KwonandGitHub 12659a0bd7 Add CUDA graph-based all reduce launcher (#26) 2023-04-05 11:16:57 -07:00
Woosuk KwonandGitHub 7a7929abe8 Implement preemption via recomputation & Refactor scheduling logic (#12) 2023-03-30 14:51:46 -07:00
Zhuohan LiandGitHub 721fa3df15 FastAPI-based working frontend (#10) 2023-03-29 14:48:56 +08:00
Powered by Gitea Version: 1.27.0 Page: 17ms Template: 2ms
Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API