Skip to main content
Qualcomm AI Runtime SDK 是一款一体化 SDK,用于将 ML 模型移植到 Qualcomm 硬件加速器上运行。该 SDK 包含 Qualcomm Neural Processing Engine(也称为 SNPE)和 AI Engine Direct(也称为 QNN),提供用于转换和量化在 PyTorch 与 TensorFlow 中训练的模型的工具,以及在 CPU、GPU 和 HTP 上运行这些模型的运行时。了解更多有关 SNPE 和 QNN 的信息。 QAIRT 工作流

设置

下载 SDK

下载并安装 Qualcomm AI Runtime SDK。

设置 SDK

配置 SDK 环境以进行模型优化。

转换和量化模型

转换和量化模型

从 PyTorch、TensorFlow、ONNX 或 LiteRT 转换模型,并使用 SNPE 或 QNN 对其进行量化以便部署。

运行推理

运行模型

在 CPU、GPU 或 HTP 上,使用 SNPE 或 QNN 对已转换的模型运行推理。

API 参考

Qualcomm Neural Processing Engine C/C++

SNPE C/C++ API 参考文档。

Qualcomm AI Engine Direct C/C++

QNN C/C++ API 参考文档。