单卡四核,5,851 MiB/s 压缩吞吐

测试数据集:eVIIRS 遥感影像,24 个 GeoTIFF 文件,共 25.97 GB

5,851
MiB/s
四核聚合吞吐
1,658
MiB/s
单核吞吐
3.57:1
压缩比
≈11
W
FPGA 片上功耗

测试条件与配置

完整披露测试环境与参数,测试结果可复现、可验证

加速卡 域磐 CY-C-U1200(单卡集成 4 个独立 Gzip 压缩核心)
主机接口 PCIe Gen3 x16
测试数据集 eVIIRS 遥感影像数据,24 个 GeoTIFF 文件,共 25.97 GB
存储介质 NVMe SSD(U.2 / M.2 / PCIe 接口)
压缩格式 Gzip
软件配置 RING SLOTS = 16,H2C 单槽位传输 = 512 KB
设备驱动 Xilinx XDMA

说明:所有吞吐指标均为端到端聚合吞吐,已包含文件读入、PCIe 数据传输、FPGA 硬件压缩与结果落盘的完整链路,非仅硬件内部处理速率。

单核 / 四核配置对比

同一数据集、同一参数下,逐步开启压缩核心的横向对比

配置 压缩核心 端到端耗时 聚合吞吐 压缩后体积 相对单核加速
单核 1 14.94 s 1,657.81 MiB/s 27.32% 1.00×
四核 · FIFO 4K 4 4.95 s 5,004.32 MiB/s 28.00% 3.02×
四核 · FIFO 8K 4 4.23 s 5,851.46 MiB/s 28.00% 3.53×

数据取自压缩工具输出的原始统计日志(GZIP DIRECTORY RESULT)。压缩后体积占比 = 压缩后字节数 ÷ 原始字节数; 以最优配置为例:25,971,153,240 字节原始数据压缩至 7,271,246,883 字节,体积占比 28.00%,压缩比约 3.57:1。
单位换算参考:5,851.46 MiB/s ≈ 5.71 GiB/s ≈ 6.14 GB/s ≈ 45.7 Gbps,与域磐 45 Gbps 的单卡标称压缩性能一致。

单核
1,658
1,657.81 MiB/s
四核 · FIFO 4K
5,004
5,004.32 MiB/s
四核 · FIFO 8K
5,851
5,851.46 MiB/s

实测终端输出

压缩工具运行时的原始统计输出,含核心数、文件数、字节数、耗时与吞吐

域磐 CY-C-U1200 单核 / 四核 FIFO 4K / 四核 FIFO 8K 三种配置的实测终端输出截图
单核 / 四核 FIFO 4K / 四核 FIFO 8K 实测终端输出(eVIIRS 遥感影像,25.97 GB,24 个文件)

压缩核心数 1 → 4 24 个文件全部成功输出 Fsync 状态 OK 4 个核心返回码均为 0

四核满载,片上功耗约 11 W

压缩任务全部由 FPGA 承担,主机 CPU 不参与计算,整体功耗远低于软件压缩方案

配置 FPGA 片上总功耗 其中动态功耗 结温
单核工程 8.53 W 7.87 W 39.8 ℃
四核 · FIFO 4K 10.84 W 10.14 W 43.7 ℃
四核 · FIFO 8K 10.96 W 10.26 W 44.0 ℃

说明:以上为 FPGA 片上总功耗(含 PCIe Hard IP 与高速收发器),由 FPGA 开发工具在 Medium 置信度下估算, 并非整卡实测功耗;实际整卡功耗会随负载、环境温度与散热条件变化,具体数值以实测为准。

这组数据说明了什么

3.53×

多核并行加速

单卡四核并行处理,端到端耗时从 14.94 s 降至 4.23 s,吞吐接近单核的 3.5 倍,加速比接近核心数线性扩展。

3.57:1

稳定压缩收益

遥感影像数据压缩后体积降至 28.00%,存储空间与传输带宽同步节省约 72%,且多核并发放大后压缩比基本不衰减。

0%

主机 CPU 占用

压缩计算全部由 FPGA 硬件流水线承担,主机 CPU 占用接近于零,不占用业务算力,无需为压缩额外扩容 CPU。

≈11 W

低功耗高能效

四核满载时 FPGA 片上功耗仅约 11 W,压缩能效远高于 CPU 软件压缩方案,适合高密度部署场景。

用你自己的数据测一遍

我们提供 POC 实测服务:提交你的业务数据样本,我们会在真实环境下完成压缩测试,并出具包含吞吐、压缩比与资源占用的完整测试报告。