Standard tile rasterization leaves most SMs idle while a few warps choke on dense geometry. Kakeya polynomial partitioning redistributes work so every warp finishes simultaneously — 0.41ms overhead, benchmarked on RTX 3090.