llama.cpp
models: fix GDN normalization from `max` to `rsqrt`
#28068
Merged

models: fix GDN normalization from `max` to `rsqrt` #28068

danielhanchen
danielhanchen models: use flash-linear-attention's l2norm for gated delta net q/k
c03dc68b
github-actions github-actions added model
danielhanchen danielhanchen marked this pull request as ready for review 13 days ago
danielhanchen danielhanchen requested a review from CISC CISC 13 days ago
ggerganov
ggerganov commented on 2026-08-31
CISC
danielhanchen Update src/models/models.h
757abc99
danielhanchen
danielhanchen
CISC
danielhanchen
danielhanchen
ovidiu-morar
CISC
pwilkin
danielhanchen
ggerganov
ovidiu-morar
CISC
CISC approved these changes on 2026-08-31
ovidiu-morar
ggerganov
ggerganov approved these changes on 2026-08-31
CISC CISC merged 5fdfa628 into master 7 days ago
ovidiu-morar
ovidiu-morar

Login to write a write a comment.

Login via GitHub

Reviewers
Assignees
No one assigned
Labels
Milestone