End-to-end benchmark for AI-generated GPU kernels, drawn from real production traces — turn a PyTorch reference into a DSL kernel (Triton, Gluon, FlyDSL, CuteDSL) and grade it on compilation, numerical correctness, and speed-of-light efficiency, on both AMD and NVIDIA GPUs.
agent nvidia-gpus benchmark-suite domain-specific-languages amd-gpus production-trace kernel-generation
-
Updated
Sep 6, 2026 - Python