Loading dataset details…
harbor run -d open-design/open-designOpen Design Benchmark — AI agent evaluation on design-asset generation tasks (landing pages, dashboards, mobile onboarding, PPT reports, text layouts, incremental patches, multi-format export)
harbor run -d open-design/open-design