Skip to content

perf(ggml-cuda): skip shared reduction and barrier for single-wave mu… #1510

perf(ggml-cuda): skip shared reduction and barrier for single-wave mu…

perf(ggml-cuda): skip shared reduction and barrier for single-wave mu… #1510

Triggered via push July 16, 2026 01:32
Status Success
Total duration 19m 45s
Artifacts

ci.yml

on: push
uv workspace (lock + sync + import smoke)
48s
uv workspace (lock + sync + import smoke)
Build (cmake + uv sync --extra megakernel)
19m 41s
Build (cmake + uv sync --extra megakernel)
GPU tests (self-hosted RTX 3090, sm_86)
2m 9s
GPU tests (self-hosted RTX 3090, sm_86)
GPU tests (self-hosted Radeon 8060S, gfx1151 / ROCm)
9s
GPU tests (self-hosted Radeon 8060S, gfx1151 / ROCm)
Fit to window
Zoom out
Zoom in