大语言模型
SNM980 × Deepseek-qwen-1.5b
QNN · — · 测试环境:qnn_android · NPU_W4A16
Deepseek-qwen-1.5b @ SNM980 QNN/HTP 59.03 tok/s
初始化
0.98 ms
推理指标
59.03 tok/s
内存占用
2.42 GB
CPU max
35.25 %
CPU avg
34.38 %
GPU max
—
NPU
96 %
关联信息
- 模型
- Deepseek-qwen-1.5b
- 芯片平台
- SNM980
- 芯片
- SM8750P (Snapdragon 8 Elite)
- 推理框架
- QNN
- 量化精度
- —
- 测试日期
- 2026-08-28