onnxruntime
Add microbenchmark for layer normalization and improve latency
#22223
Merged

Add microbenchmark for layer normalization and improve latency #22223

amarin16
amarin16 Add microbenchmark for layer normalization
2b8cd170
github-advanced-security
github-advanced-security commented on 2024-09-25
amarin16 fix warnings
0c89631e
amarin16 initialize test input data at compile time
bca13ca0
amarin16 remove unused specialization that fails on pipeline
680cf4fc
amarin16 fix build on linux
f0df5263
amarin16 convert all inputs to float efficiently if needed
87725c37
amarin16 convert output buffer efficiently in layer_norm_impl
8aa80daa
amarin16 convert output buffer efficiently in skip_layer_norm
295d6527
amarin16 amarin16 changed the title Add microbenchmark for layer normalization Add microbenchmark for layer normalization and improve latency 1 year ago
github-advanced-security
github-advanced-security commented on 2024-09-30
amarin16 add inline and fix some lint issues
405a0a0c
amarin16 fix some lint errors
245f298e
amarin16 fix warning
f398b643
github-advanced-security
github-advanced-security commented on 2024-09-30
amarin16 maybe_unused
a483ca48
amarin16 Fix bug
19d225a0
amarin16 separate MLFloat16 implementation in skip_layer_norm
05b5037b
amarin16 fix linter issues
ab2e5f2e
amarin16 fix precision warning
63e9644c
amarin16 cast
11eb7fbc
amarin16 separate implementation for MLFloat16 inside layer_norm_impl
46775a76
amarin16 don't use vectors
fd904f69
amarin16 reuse allocated arrays when possible
a41b802b
amarin16 make_unique instead of new
6aece952
amarin16 Revert "make_unique instead of new" for latency
766c4b23
amarin16 lint
cb55d4bd
amarin16 fix bug
2895f37f
amarin16 fix bug
f93ccb7c
amarin16 amarin16 marked this pull request as ready for review 1 year ago
github-advanced-security
github-advanced-security commented on 2024-10-02
amarin16 handle errors
4be02551
amarin16 remove checks on tensor data
48ce9790
amarin16 remove try/catch due to -fno-exceptions
3d6b990e
amarin16 Prepack scale and bias in layer_norm_impl
f04aac04
amarin16 Prepack skip, gamma, beta, bias in skip_layer_norm
1eaa63ff
amarin16 return void from ComputeJob
26ddc6c1
amarin16 lint
3231cffe
fajin-corp
fajin-corp
fajin-corp commented on 2024-10-11
fajin-corp
fajin-corp commented on 2024-10-11
fajin-corp
fajin-corp commented on 2024-10-11
fajin-corp
fajin-corp commented on 2024-10-11
fajin-corp
fajin-corp commented on 2024-10-11
fajin-corp
amarin16 Use GenerateArrayWithRandomValue in microbenchmark
2a37a92f
amarin16 Use allocator instead of new
d8b11abb
amarin16 lint
402b65d6
amarin16
github-advanced-security
github-advanced-security commented on 2024-10-14
fajin-corp
fajin-corp commented on 2024-10-14
fajin-corp
fajin-corp commented on 2024-10-14
amarin16 switch to IAllocator::MakeUniquePtr
57c3e637
fajin-corp
fajin-corp approved these changes on 2024-10-14
amarin16 amarin16 merged 7d17c466 into main 1 year ago

Login to write a write a comment.

Login via GitHub

Assignees
No one assigned
Labels
Milestone