Hugging Face Hub 推出 Kernel 功能,简化 GPU 内核发布
在 Hugging Face Hub 上推出 Kernels
如果发布 GPU 内核像推送模型一样简单会怎样?
- 针对你的确切 GPU、PyTorch 和操作系统预编译
- 多个内核版本可在同一进程中共存
- torch.compile 兼容
- 相比 PyTorch 基线有 1.7 倍至 2.5 倍加速
如果发布 GPU 内核像推送模型一样简单会怎样?
- 针对你的确切 GPU、PyTorch 和操作系统预编译
- 多个内核版本可在同一进程中共存
- torch.compile 兼容
- 相比 PyTorch 基线有 1.7 倍至 2.5 倍加速