检测项目

1. FP32浮点算力(10~1000 TFLOPS)

2. 显存带宽(200~3500 GB/s)

3. 能效比(5~50 GFLOPS/W)

4. 并行扩展效率(60~99%)

5. 精度误差(0~1e-6)

检测范围

1. 数据中心GPU卡:NVIDIA A100/H100

2. 专业图形卡:NVIDIA RTX A6000

3. 消费级GPU:GeForce RTX 4090

4. 国产加速卡:昇腾910系列

5. 嵌入式GPU:Jetson AGX Orin

检测方法

1. SPECaccel 2021 基准测试方法

2. SPECviewperf 2020 图形性能基准

3. MLPerf Inference 3.1 深度学习推理基准

4. ISO/IEC 25023:2017 性效率测试

5. GB/T 30972-2014 性能测试规范

检测设备

1. GPU服务器(Supermicro AS-4124GS-TNR):8×PCIe5.0

2. 功率分析仪(Yokogawa WT500):0~30A

3. 高带宽示波器(Keysight UXR1104A):110GHz

4. 热成像仪(FLIR A700):640×512

5. 网络抓包仪(Solarflare SFN8522):100GbE

6. 内存测试仪(Advantech MIC-7U-210A):DDR5

7. 压力测试工作站(Dell Precision 7865):Threadripper

8. 液冷循环机(Alphacool Eiszeit 2000):400W

9. 时钟频率计(Keysight 53220A):350MHz

10. 逻辑分析仪(R&S MXO 5):500MHz