llama.cpp
metal: minor q4 optimization and reduce code size
#2248
Merged

metal: minor q4 optimization and reduce code size #2248

lshzh-ww
lshzh-ww metal: use uint16_t instead of uint8_t.
bbce3928
lshzh-ww metal: update rms_norm kernel
4088df14
lshzh-ww lshzh-ww requested a review from ikawrakow ikawrakow 3 years ago
lshzh-ww
lshzh-ww lshzh-ww force pushed 3 years ago
lshzh-ww
ggerganov
ggerganov
lshzh-ww
ikawrakow
ikawrakow approved these changes on 2023-07-18
lshzh-ww lshzh-ww force pushed 3 years ago
lshzh-ww lshzh-ww force pushed 3 years ago
lshzh-ww metal: use template to reduce size
f3f2e8ee
lshzh-ww lshzh-ww force pushed to f3f2e8ee 3 years ago
lshzh-ww
ikawrakow ikawrakow merged 417a85a0 into master 3 years ago
lshzh-ww lshzh-ww deleted the mps-q4-optimize branch 3 years ago

Login to write a write a comment.

Login via GitHub

Reviewers
Assignees
No one assigned
Labels
Milestone