Align Arena
Built at OpenAI GPT-5 Startup Hackathon · Aug 9, 2025

Agentic ai evals at scale is hard. You have to manage infra, eval datasets, agents, and runs. Do it all in one helpful platform with huggingface datasets, docker hub containers, and saved agents. Specify custom scorers and environments and view detailed logs too