> ## Documentation Index
> Fetch the complete documentation index at: https://dragonwingdocs.qualcomm.com/llms.txt
> Use this file to discover all available pages before exploring further.

# 术语表

> 针对 Dragonwing IoT 平台的 Qualcomm AI/ML 开发者工作流文档中所使用的缩略语、工具和术语的定义。

| **术语**                          | **说明**                                                                                    |
| ------------------------------- | ----------------------------------------------------------------------------------------- |
| AI                              | 人工智能 (Artificial Intelligence)                                                            |
| AIMET                           | Qualcomm AI 模型效率工具包 (AI Model Efficiency Toolkit)。用于提高量化模型准确性的工具，包括 PTQ 和 QAT 工作流。        |
| API                             | 应用程序编程接口 (Application Programming Interface)                                              |
| ASR                             | 自动语音识别 (Automatic Speech Recognition)                                                     |
| Backend                         | 运行时为推理选择的执行目标，例如 CPU、GPU 或 NPU/HTP。                                                       |
| CPU                             | 中央处理单元 (Central Processing Unit)。用于应用程序逻辑以及必要时的 AI 推理的通用处理器。                              |
| CSV                             | 逗号分隔值 (Comma-Separated Value)                                                             |
| Delegate                        | 一种运行时插件，可将框架（例如 LiteRT）中支持的模型操作卸载到 NPU 或 GPU 等硬件加速器。                                      |
| DL                              | 深度学习 (Deep Learning)                                                                      |
| DLC                             | 深度学习容器 (Deep Learning Container)                                                          |
| DSP                             | 数字信号处理器 (Digital Signal Processor)                                                        |
| GenAI                           | 生成式 AI 工作负载（例如文本/图像生成），通常由 LLM 或多模态模型提供支持。                                                |
| GPU                             | 图形处理单元 (Graphics Processing Unit)。一种并行处理器，用于特定的 AI 操作以及图像/视频的前后处理任务。                      |
| HMX                             | Hexagon 矩阵扩展 (Hexagon Matrix Extensions)                                                  |
| HTA                             | Hexagon 张量加速器 (Hexagon Tensor Accelerator)                                                |
| HTP                             | Hexagon 张量处理器 (Hexagon Tensor Processor)。Qualcomm 面向 AI 优化的计算模块，用作高效推理的主要 NPU 目标。         |
| IM SDK                          | Qualcomm 智能多媒体 SDK，用于具有零拷贝缓冲区和 GPU 加速前后处理的摄像头/视频 AI 流水线。                                  |
| Inference                       | 运行已训练的模型，从新的输入数据生成预测或输出。                                                                  |
| IOT                             | 物联网 (Internet Of Things)                                                                  |
| LiteRT                          | 一种用于设备端推理的轻量级运行时和模型格式，通常与代理 (delegate) 一起使用以实现硬件加速。                                       |
| Llama.cpp                       | 一个 C/C++ 库和 CLI，用于在 CPU/GPU 上使用量化的 GGUF 模型本地运行 LLM 和 VLM。                                 |
| LLM                             | 大语言模型 (Large Language Model)。在大规模文本语料库上训练的生成式模型，用于聊天、摘要和编码辅助等任务。                          |
| ML                              | 机器学习 (Machine Learning)                                                                   |
| Multimodal                      | 跨多种数据类型进行处理或生成的模型，例如文本 + 图像或文本 + 音频。                                                      |
| NDK                             | 原生开发工具包 (Native Development Kit)                                                          |
| NN                              | 神经网络 (Neural Network)                                                                     |
| NPU                             | 神经处理单元 (Neural Processing Unit)。一种专门用于以低功耗高效运行 AI 推理的加速器（在 Qualcomm 平台上，通常为 Hexagon HTP）。 |
| ONNX                            | 开放神经网络交换 (Open Neural Network Exchange) 格式，用于在框架和工具之间表示和交换训练模型。                           |
| OpenCL                          | 开放计算语言 (Open Computing Language)                                                          |
| PD                              | 进程域 (Process Domain)                                                                      |
| PPA                             | 个人软件包存档 (Personal Package Archive)                                                        |
| Preprocessing / Post-processing | 在模型推理前后执行的步骤，例如调整大小、归一化、解码输出、过滤或绘制叠加层。                                                    |
| PTQ                             | 训练后量化 (Post-Training Quantization)。在无需重新训练的情况下量化已训练的模型。                                   |
| QAIRT                           | Qualcomm AI 运行时 SDK。用于在 Qualcomm 平台上转换、量化、编译和运行 AI 模型的工具链和运行时堆栈。                          |
| QAT                             | 量化感知训练 (Quantization-Aware Training)。在训练或微调中模拟量化效果，以在量化后保持准确性。                            |
| QNN                             | Qualcomm 神经网络 (Qualcomm® AI Engine Direct 的同义词)                                           |
| QTI                             | Qualcomm Technologies Incorporated                                                        |
| Quantization                    | 将模型权重/激活从更高精度的数据类型（例如 FP32）转换为更低精度的类型（例如 INT8），以提高性能并减少内存使用。                              |
| RPC                             | 远程过程调用 (Remote Procedure Call)                                                            |
| SDK                             | 软件开发工具包 (Software Development Kit)                                                        |
| SNPE                            | Snapdragon 神经处理引擎 (Qualcomm® Neural Processing SDK 的同义词)                                  |
| T2T                             | 文本到文本 (Text-to-Text)                                                                      |
| TF                              | Tensorflow                                                                                |
| TTS                             | 文本转语音 (Text-to-Speech)                                                                    |
| UDO                             | 用户自定义操作 (User Defined Operations)                                                         |
| ViT                             | Vision Transformer                                                                        |
| VLM                             | 视觉语言模型 (Vision-Language Model)                                                            |
| Voice AI SDK                    | Qualcomm 的设备端自动语音识别引擎 (VoiceAI ASR)，在 NPU 上运行。                                            |
| VTCM                            | 紧密耦合内存 (Very Tightly Coupled Memory)                                                      |
| WSL                             | Windows Subsystem for Linux                                                               |
| XML                             | 可扩展标记语言 (Extensible Markup Language)                                                      |
