Skip to main content
这是选择您的旅程流程中的运行推理步骤。在您的模型完成准备之后,选择在设备上执行它的方式。合适的路径取决于您使用的语言、模型格式,以及是否要构建完整的摄像头/视频管道。所有运行时均可面向 Qualcomm Kryo CPU、Adreno GPU 和 Hexagon NPU(HTP)。 请选择与您的应用程序相匹配的运行时。

LiteRT

使用 Qualcomm AI Engine Direct delegate,通过 Python 或 C++ 实现高性能端侧推理。最适合快速、Python 友好的工作流。

QAIRT SDK C++ API

以底层 C++ 方式控制模型执行和推理后端(QNN 或 SNPE)。

Qualcomm IM SDK

使用 GStreamer 构建实时摄像头、视频和视觉管道:零拷贝缓冲区和 GPU 前/后处理。适用于任何 AI 媒体管道。
正在构建机器人应用程序?Qualcomm Intelligent Robotics(QIR)SDK 在这些运行时之上增加了基于 ROS 的模块和硬件加速节点。