vllm
d9dabfa3
- [Kimi-K3][Kernel] Optimize the low-M fused latent MoE tail (#54168)
Go
Login via GitHub
Home
Pricing
FAQ
Install
Login
via GitHub
Commit
View On
GitHub
Commit
8 days ago
[Kimi-K3][Kernel] Optimize the low-M fused latent MoE tail (#54168) Signed-off-by: Yongye Zhu <zyy1102000@gmail.com> Co-authored-by: OpenAI Codex <codex@openai.com>
References
#54168 - [Kimi-K3][Kernel] Optimize the low-M fused latent MoE tail
Author
zyongye
Parents
6f91e3d9
Loading