| 术语 | 说明 |
|---|---|
| AI | 人工智能 (Artificial Intelligence) |
| AIMET | Qualcomm AI 模型效率工具包 (AI Model Efficiency Toolkit)。用于提高量化模型准确性的工具,包括 PTQ 和 QAT 工作流。 |
| API | 应用程序编程接口 (Application Programming Interface) |
| ASR | 自动语音识别 (Automatic Speech Recognition) |
| Backend | 运行时为推理选择的执行目标,例如 CPU、GPU 或 NPU/HTP。 |
| CPU | 中央处理单元 (Central Processing Unit)。用于应用程序逻辑以及必要时的 AI 推理的通用处理器。 |
| CSV | 逗号分隔值 (Comma-Separated Value) |
| Delegate | 一种运行时插件,可将框架(例如 LiteRT)中支持的模型操作卸载到 NPU 或 GPU 等硬件加速器。 |
| DL | 深度学习 (Deep Learning) |
| DLC | 深度学习容器 (Deep Learning Container) |
| DSP | 数字信号处理器 (Digital Signal Processor) |
| GenAI | 生成式 AI 工作负载(例如文本/图像生成),通常由 LLM 或多模态模型提供支持。 |
| GPU | 图形处理单元 (Graphics Processing Unit)。一种并行处理器,用于特定的 AI 操作以及图像/视频的前后处理任务。 |
| HMX | Hexagon 矩阵扩展 (Hexagon Matrix Extensions) |
| HTA | Hexagon 张量加速器 (Hexagon Tensor Accelerator) |
| HTP | Hexagon 张量处理器 (Hexagon Tensor Processor)。Qualcomm 面向 AI 优化的计算模块,用作高效推理的主要 NPU 目标。 |
| IM SDK | Qualcomm 智能多媒体 SDK,用于具有零拷贝缓冲区和 GPU 加速前后处理的摄像头/视频 AI 流水线。 |
| Inference | 运行已训练的模型,从新的输入数据生成预测或输出。 |
| IOT | 物联网 (Internet Of Things) |
| LiteRT | 一种用于设备端推理的轻量级运行时和模型格式,通常与代理 (delegate) 一起使用以实现硬件加速。 |
| Llama.cpp | 一个 C/C++ 库和 CLI,用于在 CPU/GPU 上使用量化的 GGUF 模型本地运行 LLM 和 VLM。 |
| LLM | 大语言模型 (Large Language Model)。在大规模文本语料库上训练的生成式模型,用于聊天、摘要和编码辅助等任务。 |
| ML | 机器学习 (Machine Learning) |
| Multimodal | 跨多种数据类型进行处理或生成的模型,例如文本 + 图像或文本 + 音频。 |
| NDK | 原生开发工具包 (Native Development Kit) |
| NN | 神经网络 (Neural Network) |
| NPU | 神经处理单元 (Neural Processing Unit)。一种专门用于以低功耗高效运行 AI 推理的加速器(在 Qualcomm 平台上,通常为 Hexagon HTP)。 |
| ONNX | 开放神经网络交换 (Open Neural Network Exchange) 格式,用于在框架和工具之间表示和交换训练模型。 |
| OpenCL | 开放计算语言 (Open Computing Language) |
| PD | 进程域 (Process Domain) |
| PPA | 个人软件包存档 (Personal Package Archive) |
| Preprocessing / Post-processing | 在模型推理前后执行的步骤,例如调整大小、归一化、解码输出、过滤或绘制叠加层。 |
| PTQ | 训练后量化 (Post-Training Quantization)。在无需重新训练的情况下量化已训练的模型。 |
| QAIRT | Qualcomm AI 运行时 SDK。用于在 Qualcomm 平台上转换、量化、编译和运行 AI 模型的工具链和运行时堆栈。 |
| QAT | 量化感知训练 (Quantization-Aware Training)。在训练或微调中模拟量化效果,以在量化后保持准确性。 |
| QNN | Qualcomm 神经网络 (Qualcomm® AI Engine Direct 的同义词) |
| QTI | Qualcomm Technologies Incorporated |
| Quantization | 将模型权重/激活从更高精度的数据类型(例如 FP32)转换为更低精度的类型(例如 INT8),以提高性能并减少内存使用。 |
| RPC | 远程过程调用 (Remote Procedure Call) |
| SDK | 软件开发工具包 (Software Development Kit) |
| SNPE | Snapdragon 神经处理引擎 (Qualcomm® Neural Processing SDK 的同义词) |
| T2T | 文本到文本 (Text-to-Text) |
| TF | Tensorflow |
| TTS | 文本转语音 (Text-to-Speech) |
| UDO | 用户自定义操作 (User Defined Operations) |
| ViT | Vision Transformer |
| VLM | 视觉语言模型 (Vision-Language Model) |
| Voice AI SDK | Qualcomm 的设备端自动语音识别引擎 (VoiceAI ASR),在 NPU 上运行。 |
| VTCM | 紧密耦合内存 (Very Tightly Coupled Memory) |
| WSL | Windows Subsystem for Linux |
| XML | 可扩展标记语言 (Extensible Markup Language) |
术语表
针对 Dragonwing IoT 平台的 Qualcomm AI/ML 开发者工作流文档中所使用的缩略语、工具和术语的定义。
此页面对您有帮助吗?

