动态

Keras 推出量化低精度加速模型,支持 int4/8/float8/GPTQ

Keras 推出量化低精度加速模型,支持 int4/8/float8/GPTQ
François Chollet
使用 Keras 中的量化低精度加速运行模型!

你可以通过 `model.quantize(mode)` 量化任何模型(你自己的模型或 KerasHub 预训练模型)。

支持 int4、int8、float8、GPTQ。适用于 JAX、TF 和 torch。

指南链接在下一推文中。
动态François Chollet2025-10-16原文

相关内容