This website requires JavaScript.
Explore
Help
Sign In
wassname
/
vllm
Watch
1
Star
0
Fork
0
mirror of
https://github.com/wassname/vllm.git
synced
2026-10-03 13:02:20 +08:00
Code
Issues
Packages
Projects
Releases
Wiki
Activity
Files
5fa6e9876ed8212d74a71a7df7654fd4b94dd659
vllm
/
csrc
/
quantization
T
History
Tyler Michael Smith
9dad5cc859
[Kernel] Turn off CUTLASS scaled_mm for Ada Lovelace (
#6384
)
2024-07-14 13:37:19 +00:00
..
aqlm
…
awq
…
compressed_tensors
…
cutlass_w8a8
[Kernel] Turn off CUTLASS scaled_mm for Ada Lovelace (
#6384
)
2024-07-14 13:37:19 +00:00
fp8
[Kernel] Expand FP8 support to Ampere GPUs using FP8 Marlin (
#5975
)
2024-07-03 17:38:00 +00:00
gptq
…
gptq_marlin
…
marlin
[Bugfix] Fix CUDA version check for mma warning suppression (
#5642
)
2024-06-18 23:48:49 +00:00
squeezellm
…