Logo
Explore Help
Register Sign In
wassname/vllm
Watch 1
Star 0
Fork 0
mirror of https://github.com/wassname/vllm.git synced 2026-08-02 13:10:42 +08:00
Code Issues Packages Projects Releases Wiki Activity
Files
21877b0d7523a1202ed279c046d9268baaee3d5c
vllm/vllm/model_executor
T
History
Lily LiuGitHubWing LianWoosuk Kwon
21877b0d75 Support Longchat and RoPE scaling (#555)
Co-authored-by: Wing Lian <wing.lian@gmail.com>
Co-authored-by: Woosuk Kwon <woosuk.kwon@berkeley.edu>
2023-09-27 03:36:02 -07:00
..
layers
Support Longchat and RoPE scaling (#555)
2023-09-27 03:36:02 -07:00
models
Support Longchat and RoPE scaling (#555)
2023-09-27 03:36:02 -07:00
parallel_utils
[FIX] Don't initialize parameter by default (#1067)
2023-09-17 17:15:38 -07:00
quantization_utils
Add minimum capability requirement for AWQ (#1064)
2023-09-18 12:02:01 -07:00
__init__.py
[Quality] Add code formatter and linter (#326)
2023-07-03 11:31:55 -07:00
input_metadata.py
Add support for BLOOM (#331)
2023-07-03 13:12:35 -07:00
model_loader.py
Add minimum capability requirement for AWQ (#1064)
2023-09-18 12:02:01 -07:00
utils.py
Change the name to vLLM (#150)
2023-06-17 03:07:40 -07:00
weight_utils.py
Implement AWQ quantization support for LLaMA (#1032)
2023-09-16 00:03:37 -07:00
Powered by Gitea Version: 1.27.1 Page: 40ms Template: 2ms
Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API