域磐 CY-C-U1200 FPGA 高通量硬件压缩卡 · 真实业务数据端到端测试
测试数据集:eVIIRS 遥感影像,24 个 GeoTIFF 文件,共 25.97 GB
完整披露测试环境与参数,测试结果可复现、可验证
| 加速卡 | 域磐 CY-C-U1200(单卡集成 4 个独立 Gzip 压缩核心) |
|---|---|
| 主机接口 | PCIe Gen3 x16 |
| 测试数据集 | eVIIRS 遥感影像数据,24 个 GeoTIFF 文件,共 25.97 GB |
| 存储介质 | NVMe SSD(U.2 / M.2 / PCIe 接口) |
| 压缩格式 | Gzip |
| 软件配置 | RING SLOTS = 16,H2C 单槽位传输 = 512 KB |
| 设备驱动 | Xilinx XDMA |
说明:所有吞吐指标均为端到端聚合吞吐,已包含文件读入、PCIe 数据传输、FPGA 硬件压缩与结果落盘的完整链路,非仅硬件内部处理速率。
同一数据集、同一参数下,逐步开启压缩核心的横向对比
| 配置 | 压缩核心 | 端到端耗时 | 聚合吞吐 | 压缩后体积 | 相对单核加速 |
|---|---|---|---|---|---|
| 单核 | 1 | 14.94 s | 1,657.81 MiB/s | 27.32% | 1.00× |
| 四核 · FIFO 4K | 4 | 4.95 s | 5,004.32 MiB/s | 28.00% | 3.02× |
| 四核 · FIFO 8K | 4 | 4.23 s | 5,851.46 MiB/s | 28.00% | 3.53× |
数据取自压缩工具输出的原始统计日志(GZIP DIRECTORY RESULT)。压缩后体积占比 = 压缩后字节数 ÷ 原始字节数;
以最优配置为例:25,971,153,240 字节原始数据压缩至 7,271,246,883 字节,体积占比 28.00%,压缩比约 3.57:1。
单位换算参考:5,851.46 MiB/s ≈ 5.71 GiB/s ≈ 6.14 GB/s ≈ 45.7 Gbps,与域磐 45 Gbps 的单卡标称压缩性能一致。
压缩工具运行时的原始统计输出,含核心数、文件数、字节数、耗时与吞吐
压缩核心数 1 → 4 24 个文件全部成功输出 Fsync 状态 OK 4 个核心返回码均为 0
压缩任务全部由 FPGA 承担,主机 CPU 不参与计算,整体功耗远低于软件压缩方案
| 配置 | FPGA 片上总功耗 | 其中动态功耗 | 结温 |
|---|---|---|---|
| 单核工程 | 8.53 W | 7.87 W | 39.8 ℃ |
| 四核 · FIFO 4K | 10.84 W | 10.14 W | 43.7 ℃ |
| 四核 · FIFO 8K | 10.96 W | 10.26 W | 44.0 ℃ |
说明:以上为 FPGA 片上总功耗(含 PCIe Hard IP 与高速收发器),由 FPGA 开发工具在 Medium 置信度下估算, 并非整卡实测功耗;实际整卡功耗会随负载、环境温度与散热条件变化,具体数值以实测为准。
单卡四核并行处理,端到端耗时从 14.94 s 降至 4.23 s,吞吐接近单核的 3.5 倍,加速比接近核心数线性扩展。
遥感影像数据压缩后体积降至 28.00%,存储空间与传输带宽同步节省约 72%,且多核并发放大后压缩比基本不衰减。
压缩计算全部由 FPGA 硬件流水线承担,主机 CPU 占用接近于零,不占用业务算力,无需为压缩额外扩容 CPU。
四核满载时 FPGA 片上功耗仅约 11 W,压缩能效远高于 CPU 软件压缩方案,适合高密度部署场景。
我们提供 POC 实测服务:提交你的业务数据样本,我们会在真实环境下完成压缩测试,并出具包含吞吐、压缩比与资源占用的完整测试报告。