vllm
d9dabfa3 - [Kimi-K3][Kernel] Optimize the low-M fused latent MoE tail (#54168)

Commit
8 days ago
[Kimi-K3][Kernel] Optimize the low-M fused latent MoE tail (#54168) Signed-off-by: Yongye Zhu <zyy1102000@gmail.com> Co-authored-by: OpenAI Codex <codex@openai.com>
Author
Parents
Loading