Keras 推出量化低精度加速模型,支持 int4/8/float8/GPTQ
使用 Keras 中的量化低精度加速运行模型!
你可以通过 `model.quantize(mode)` 量化任何模型(你自己的模型或 KerasHub 预训练模型)。
支持 int4、int8、float8、GPTQ。适用于 JAX、TF 和 torch。
指南链接在下一推文中。
你可以通过 `model.quantize(mode)` 量化任何模型(你自己的模型或 KerasHub 预训练模型)。
支持 int4、int8、float8、GPTQ。适用于 JAX、TF 和 torch。
指南链接在下一推文中。