vllm
[Bugfix] Avoid Warnings in SparseML Activation Quantization
#5120
Merged

[Bugfix] Avoid Warnings in SparseML Activation Quantization #5120

robertgshaw2-redhat merged 2 commits into main from sparseml-avoid-warning
robertgshaw2-redhat
avoid warnings related to replicating scales for multi-gpu
bcb96487
format
ff1c4463
robertgshaw2-redhat robertgshaw2-redhat marked this pull request as ready for review 2 years ago
robertgshaw2-redhat robertgshaw2-redhat requested a review from mgoin mgoin 2 years ago
ywang96
ywang96 approved these changes on 2024-05-31
robertgshaw2-redhat robertgshaw2-redhat merged b35be540 into main 2 years ago
simon-mo simon-mo deleted the sparseml-avoid-warning branch 1 year ago

Login to write a write a comment.

Login via GitHub

Reviewers
Assignees
No one assigned
Labels
Milestone