Fix LinearAttention output shape inference for standard GQA (q > kv) #29892
Fix LinearAttention output shape inference for standard GQA (q > kv)
24f9b884
[Webgpu] Fix LinearAttention output shape for standard GQA (q > kv)
a6acfff9
mirounga
merged
b725f3d3
into main 9 days ago
Login to write a write a comment.
Login via GitHub