vllm
[Misc][Quark] Upstream Quark format to VLLM
#10765
Merged

[Misc][Quark] Upstream Quark format to VLLM #10765

kewang-amd
github-actions
DarkLight1337 DarkLight1337 requested a review from mgoin mgoin 1 year ago
mergify
mergify mergify added needs-rebase
kewang-amd kewang-amd force pushed 1 year ago
mergify mergify removed needs-rebase
kewang-amd kewang-amd force pushed 1 year ago
kewang-amd kewang-amd force pushed 1 year ago
kewang-amd kewang-amd force pushed 1 year ago
kewang-amd kewang-amd changed the title [feature]:upstream quark format to vllm [Misc][Quark] Upstream Quark format to VLLM 1 year ago
robertgshaw2-redhat
kewang-amd
mgoin
mgoin
mgoin commented on 2024-12-16
mergify
mergify mergify added needs-rebase
kewang-amd
kewang-amd kewang-amd force pushed 1 year ago
mergify mergify removed needs-rebase
kewang-amd kewang-amd force pushed 1 year ago
mergify
mergify mergify added needs-rebase
kewang-amd kewang-amd force pushed 1 year ago
mergify mergify removed needs-rebase
kewang-amd kewang-amd force pushed 1 year ago
kewang-amd kewang-amd force pushed 1 year ago
kewang-amd kewang-amd force pushed to 58b9221b 1 year ago
mgoin mgoin requested a review from mgoin mgoin 1 year ago
mgoin
mgoin approved these changes on 2024-12-24
mgoin mgoin added ready
kewang-amd kewang-amd force pushed from 58b9221b 1 year ago
kewang-amd kewang-amd requested a review from robertgshaw2-redhat robertgshaw2-redhat 1 year ago
[AMD] support Quark quantized format
5016a297
[Model] add param_name remap in experts in dbrx model
90250831
[Model] support quark kv cache format in dbrx
05cf03d6
add kv cache remap method for quark format
b6593cc0
[AMD][Quark] Fix fails in pr checks
68ab9b95
kewang-amd [AMD][Quark] replace get_compressed_tensors_cache_scale with get_cach…
ea86886c
[AMD][Quark] remove quark dependency
3488f13e
[AMD][Quark] fix mypy error
ccd214da
auto fix yapf
5172a429
fix mypy error
33dd3738
fix code format
a86314fa
Update vllm/model_executor/layers/quantization/compressed_tensors/tri…
044041f0
Modify based on PR comments
1ad3cf8a
fix mypy error
975c7c22
delete comments of get_cache_scale in compressed_tensors.py
48c6ba7a
fix mypy error
e2d511be
change get_compressed_tensors_cache_scale to get_cache_scale in gemma…
1ffab057
add CI test for quark format
011da4f8
fix mypy error in CI tests
2c614654
be consistent with origin vllm
f3d9e58c
kewang-amd kewang-amd force pushed to f3d9e58c 1 year ago
mgoin
mgoin mgoin merged de0526f6 into main 1 year ago

Login to write a write a comment.

Login via GitHub

Assignees
No one assigned
Labels
Milestone