Fix llama4 bnb mode (#44588)
* check float before using normal op
Signed-off-by: jiqing-feng <jiqing.feng@intel.com>
* fix llama4 weight
Signed-off-by: jiqing-feng <jiqing.feng@intel.com>
* add bnb quant skip module for llama4
Signed-off-by: jiqing-feng <jiqing.feng@intel.com>
* revert bnb integration
Signed-off-by: jiqing-feng <jiqing.feng@intel.com>
* revert initialization.py
Signed-off-by: jiqing-feng <jiqing.feng@intel.com>
* total revert init
Signed-off-by: jiqing-feng <jiqing.feng@intel.com>
* fix _keep_in_fp32_modules
Signed-off-by: jiqing-feng <jiqing.feng@intel.com>
* add _modules_to_not_quantize
Signed-off-by: jiqing-feng <jiqing.feng@intel.com>
* fix modules_to_not_convert
Signed-off-by: jiqing-feng <jiqing.feng@intel.com>
* update bnb quantize condition
Signed-off-by: jiqing-feng <jiqing.feng@intel.com>
---------
Signed-off-by: jiqing-feng <jiqing.feng@intel.com>