eval
Evaluate and rank agent results by metric or LLM judge for an AgentHub session. Use when the user runs /hub:eval or asks to score, compare, or pick a winner among completed…
- Industry
- software-engineering
- License
- Unverified
- Source repo
- alirezarezvani/claude-skills · ★ 22,559
- Source file
- .gemini/skills/eval/SKILL.md
不会安装?看中文图文教程 →