Logo
Explore Help
Register Sign In
wassname/vllm
Watch 1
Star 0
Fork 0
mirror of https://github.com/wassname/vllm.git synced 2026-07-28 11:27:56 +08:00
Code Issues Packages Projects Releases Wiki Activity
Files
925f3332cac488e5ad2dbc8f5c6d5f42d2556816
vllm/tests/kernels
T
History
Woosuk KwonandGitHub 925f3332ca [Core] Refactor Attention Take 2 (#3462)
2024-03-25 04:39:33 +00:00
..
allclose_default.py
[ROCm] Fix some kernels failed unit tests (#2498)
2024-02-05 14:25:36 -08:00
conftest.py
Support FP8-E5M2 KV Cache (#2279)
2024-01-28 16:43:54 -08:00
test_activation.py
Add kernel for GeGLU with approximate GELU (#3337)
2024-03-12 22:06:17 -07:00
test_attention.py
[ROCm] Fix some kernels failed unit tests (#2498)
2024-02-05 14:25:36 -08:00
test_cache.py
[CI] typo fix: is_hip --> is_hip() (#3595)
2024-03-24 16:03:06 -07:00
test_layernorm.py
Remove hardcoded device="cuda" to support more devices (#2503)
2024-02-01 15:46:39 -08:00
test_moe.py
[BugFix] 1D query fix for MoE models (#3597)
2024-03-24 16:00:16 -07:00
test_pos_encoding.py
Add batched RoPE kernel (#3095)
2024-03-13 13:45:26 -07:00
test_prefix_prefill.py
[Core] Refactor Attention Take 2 (#3462)
2024-03-25 04:39:33 +00:00
test_rand.py
[1/n] Triton sampling kernel (#3186)
2024-03-20 14:45:08 -07:00
test_sampler.py
[1/n] Triton sampling kernel (#3186)
2024-03-20 14:45:08 -07:00
Powered by Gitea Version: 1.27.0 Page: 35ms Template: 1ms
Auto
English
Bahasa Indonesia Deutsch English Español Français Gaeilge Italiano Latviešu Magyar nyelv Nederlands Polski Português de Portugal Português do Brasil Suomi Svenska Türkçe Čeština Ελληνικά Български Русский Українська فارسی മലയാളം 日本語 简体中文 繁體中文(台灣) 繁體中文(香港) 한국어
Licenses API