English · 架构 · RTL 导读 · 验证 · 结果 · 研究快照 · 限制
面向多源共享高速链路的 512-bit 多通道 DMA,覆盖 SHDR64 RX 分流、Descriptor TX 回放、AXI4-Lite 控制、AXI4 DDR 搬运及 CQ/IRQ 软硬件交接。
多个传感器、基带处理单元或本地 endpoint 可以先复用为一条 SHDR64 segment stream。SLVC DMA 依据 header metadata 选择 channel 与 DDR ring,在固定通道缓冲和共享 frame pool 之间管理资源,并通过 Completion Queue 向软件发布完成事件。
该图把 shared-link RX、descriptor-driven TX、联合准入、混合缓存和 DDR/CQ ownership 放在同一系统边界中;正式数字仍以公开表格和 Evidence 为准。
| 贡献 | 量化结果 | Profile / 边界 | 直接 Evidence |
|---|---|---|---|
| 多流准入与缓存生命周期 | 最多 16 路 flow_id context;联合检查并预留 ingress、DDR Ring 与 CQ;Fixed/Shared 整帧 commit/release;CQ body-first、owner-last |
16 路是架构能力;公开验证是 channel 0 满时 channel 1 继续前进并发布 CQE 的有界定向场景 | 架构 · 验证 · 结果 · Evidence |
| 512-bit Writer 与 PPA | 4 KiB split、16-beat Burst、4 Outstanding、AW/W/B 独立推进;reservation 32 -> 7 bit;Writer-only 总/组合面积 -7.97% / -15.84% |
同库同约束 1.5 ns Nangate45 DC OOC 组件 A/B;不能外推至 C2B4 或完整 DMA | 后端 · 验证 · 结果 · CSV · Manifest |
| RX Memory Profiles / CDC | Same-clock512、Async64、Async512;跨域 Command、按序 512-bit Payload 与 Tagged Completion;512-bit profile 为 64 B/cycle、W utilization 100%、peak outstanding 4 |
ready ideal-memory RTL/interface 结果;Async64 为 8 B/cycle;不是板级 DDR 或 10G 实测 |
架构 · 验证 · 结果 · Evidence |
| C2B4 ASIC implementation | 两通道、4 KiB/channel、register-expanded;550 MHz DC handoff,450 MHz route/OpenRCX/PT;setup/hold WNS +0.041322/+0.000341 ns;standard-cell area 1.04207 mm²;DRC/antenna/electrical 0 |
固定两通道 RX512 memory-subsystem 实现点;不是完整 DMA、SRAM、Fmax 或 foundry signoff | 架构 · ASIC · 结果 · Evidence |
双平台 RTL 仿真:3.831177 MB/s/MHz;383.117735 MB/s;3.064942 Gb/s;95.779434%。详见结果。
RX 从 64-byte SHDR64 header 解析 flow_id 与长度,只有 ingress、目标 DDR Ring 和 CQ credit 同时可预留时才接收整帧。Payload 进入 per-channel Fixed ingress 或 block free-list 管理的 Shared Frame Pool;整帧 commit 后,source selector 才会锁定一个 source 直到 frame end。AXI response 完成后先写 CQE body,再发布 owner/valid;下一 writer state 释放 source frame ownership,IRQ status 随后经寄存器化 event path 置位。
详细帧生命周期图 · Fixed/Shared 虚拟通道图 · 完整数据路径、资源边界和阻塞条件
Legacy64 和 Same-clock512 在 aclk 内完成 AXI 写入;Async64/Async512 只跨越 command、ordered 512-bit payload 和 tagged completion transaction。AW/W/B 始终留在 mem_clk,Async64 仅在该域内序列化为 64 bit;completion 返回前不会释放 source frame。它不是把 AXI 五通道分别跨域。
Same-clock512 与 Async512 在 ready-memory model 下为 64 B/cycle,Async64 为 8 B/cycle。这些是 RTL/interface 速率,不是板级 DDR throughput。
图中的 32 -> 7 bit 与面积变化属于 Writer-only paired DC,不能外推为 C2B4 或完整 DMA 结果。
详细 Memory Profile 矩阵 · 查看 512-bit Writer · 查看 CDC Backend
正式量化结果按三个互不外推的 scope 管理:Writer-only paired DC 说明局部记账结构的面积变化;ideal-memory workload 说明接口供数能力;C2B4 说明固定两通道 RX512 子系统的 DC handoff 和 route/PT 实现点。三者不组合成“完整 DMA 同时获得全部结果”的结论。
| 固定 Profile | 已验证固定点 | Evidence | 边界 |
|---|---|---|---|
| Frozen Core FPGA OOC | frame_dma_wrapper 在 XC7Z100 上完成 Vivado 2018.3 routed OOC 200 MHz |
FPGA summary | 不含 UDP adapter;不是 bitstream、板级 timing 或吞吐 |
| RX Memory development OOC | Same-clock512、Async64、Async512 在 Vivado 2018.3 routed OOC 200 MHz;Async64 另有 Vivado 2022.2 固定点 | Profile summary · Async64 summary | Development OOC;不是完整 DMA 或板级实现 |
| C2B4 register-expanded ASIC | 550 MHz DC handoff;450 MHz OpenROAD/OpenRCX/PT internal closure | C2B4 summary | 两通道 RX512 subsystem;不是 Fmax、MMMC/OCV 或 signoff |
| SRAM A5 research | 单宏 clock-delivery canary 已验证;完整 C4B4 仍被 proxy minimum-pulse 检查阻塞 | A5 summary | partial/blocked;没有 C4B4 SRAM DC/P&R/PT 结果 |
ASIC Storage-Bank Clock Gating 是两通道 C2B4 register-expanded RX512 子系统上的独立 Mapped-DC 研究快照。该结果已通过不可变 Archive Tag 和固定 Commit 归档,不属于生产 Profile、P&R/CTS、post-route power 或正式 main Claim;Production RTL 未修改。
研究快照说明 · 固定研究提交 · Archive Tag archive/slvc-dma-storage-clock-gating-positive-2026-08
结果作用层级与 Nonclaim
| 层级 | 结果覆盖范围 | 不可外推的结论 |
|---|---|---|
| Writer-only OOC | 单独综合 dma_axi_write_engine_512 的 1.5 ns paired-DC |
不能外推为 C2B4 或完整 DMA 面积下降 |
| C2B4 RX512 subsystem | 两通道、4 KiB/channel、Shared Pool 64 blocks、register-expanded 固定实现点 | 不是完整 DMA、C4B4、SRAM 或 Fmax |
| 完整 SLVC DMA | 16-channel 架构与有界 directed regression | 尚无完整 DMA ASIC PPA、P&R 或 signoff Claim |
| FPGA Async64 OOC | XC7Z100 上的 200 MHz routed OOC development profile | 不是 bitstream、板级 DDR/10G 或 ASIC 结果 |
C2B4 Writer paired A/B 未满足 subsystem promotion 条件:W0 本身已闭合固定 550 MHz 点,详细负结果仍保留在结果文档。Writer bounded SpyGlass 为 0 fatal / 0 error;完整 C2B4 common scope 未声明 clean,详见验证合同。
快速公开检查
以下命令不运行 ModelSim/Questa、Vivado、DC、OpenROAD 或 PrimeTime:
make showcase-assets-check
make showcase-check
make slvc_dma_512_defconfig
make sim-dry-run
make asic-evidence-checkasic-evidence-check 只校验脱敏 Evidence、哈希和身份合同,不重新运行商业 EDA 或物理实现。安装 ModelSim/Questa 后,可分别运行默认、RX-wide、Async64 和 Async512 的 make <profile>_defconfig sim。
10 分钟 RTL 阅读路径
| 顺序 | 文件与阅读重点 |
|---|---|
| 1 | slvc_dma_wrapper.v:512-bit stream、AXI-Lite、memory master、control-message 与 clock/reset 系统边界。 |
| 2 | dma_rx_parser_pipe.v · dma_rx_channel_match.v · dma_rx_channel_table.v:SHDR64 metadata、flow_id 命中和 channel context。 |
| 3 | frame_dma_rx_top.v:ring/free-space、buffer/CQ credit、reservation 与 commit。 |
| 4 | dma_rx_ingress_queue.v · dma_rx_frame_shared_adapter.v · dma_frame_shared_pool.v:Fixed/Shared、block free list 和整帧 commit/release。 |
| 5 | dma_rx_ingress_source_selector.v:Fixed/Shared source 选择和 frame lock。 |
| 6 | dma_axi_write_engine_512.v:4 KiB split、burst planner、AW/W/B、outstanding 与 reservation credit。 |
| 7 | dma_rx_payload_cdc_bridge.v · dma_async_fifo.v:command/payload/completion transaction 与 Gray-pointer CDC。 |
| 8 | tb_rtl_v33e20a107_udp_to_dma_smoke.v · tb_rtl_rx_payload_writer_512.v:admission/CQE 场景和 2028 个 Writer case。 |
| 目标 | Canonical top / boundary | 配置与检查 |
|---|---|---|
| 完整 512-bit Shared-Link DMA | slvc_dma_wrapper |
slvc_dma_512.f · make sim-dry-run |
| FPGA OOC timing top | frame_dma_wrapper |
make fpga-ooc-dry-run |
| 固定 Ethernet/IPv4/UDP RX adaptation | dma_udp_ipv4_to_shdr64_adapter -> slvc_dma_wrapper |
默认 defconfig · 协议边界 |
| 同频或双时钟 RX memory backend | frame_dma_rx_top |
slvc_dma_512_rx_{wide,async64,async512}_defconfig |
查看端口、时钟/reset、bring-up 和 ownership 合同
接口 · RTL 阅读指南 · 验证矩阵 · 双时钟后端 · FPGA 实现 · ASIC 实现 · Delivery 状态 · 研究快照 · Evidence · Claims
当前 main 是 v0.1.0-rc1 之后的展示与开发线。不可变 annotated tag v0.1.0-rc1 仍固定原始 release source、Evidence 和 checksum。完整 nonclaim 见限制与公开范围。