TensorFlow Blog· TensorFlow Blog·· 2023-11-30AI 评分48
TensorFlow Lite XNNPack 半精度推理正式可用,ARM CPU 端侧性能翻倍
Half-precision Inference Doubles On-Device Inference Performance
AI 导读
TensorFlow Lite 的 XNNPack 后端在 ARM CPU 上启用半精度(FP16)推理,浮点模型端侧推理性能提升 2 倍,现已正式可用。
来源:TensorFlow Blog · blog.tensorflow.org