eval

Evaluate and rank agent results by metric or LLM judge for an AgentHub session. Use when the user runs /hub:eval or asks to score, compare, or pick a winner among completed AgentHub agents.

By alirezarezvani · 1,424 installs

npx skills add alirezarezvani/claude-skills --skill eval

Source repository · Upstream listing