SkillEvaluator — fiche et historique
Multi-tier framework for evaluating AI agent skills with quality gates, semantic overlap detection, synthetic evaluation dataset generation, and live agent evaluation that measures how skills affect agent behavior.
- Langage
- Python
- Licence
- Apache-2.0
- Création
- Dernière activité
- Topics
- agent-evaluation
- agent-security
- agent-skills
- agentic-ai
- benchmark
- claude-code
- codex
- evaluate
- evaluation
- security-scanner
- skill-eval
- skill-evals
- skill-evaluation
- skill-evaluator
- skills
Installer git clone https://github.com/NVIDIA/SkillEvaluator ~/.claude/skills/SkillEvaluator
Mesure actuelle
389étoiles GitHub+63 (+19.3 %)
progression mesuréeLe momentum utilise les relevés disponibles des 7 derniers jours : mesuré avec au moins deux relevés comparables, estimé sinon.
Historique des relevés
| Date | Valeur | Métrique |
|---|---|---|
| 389 | étoiles GitHub | |
| 363 | étoiles GitHub | |
| 351 | étoiles GitHub | |
| 348 | étoiles GitHub | |
| 332 | étoiles GitHub | |
| 326 | étoiles GitHub | |
| 305 | étoiles GitHub | |
| 293 | étoiles GitHub | |
| 266 | étoiles GitHub | |
| 245 | étoiles GitHub | |
| 209 | étoiles GitHub | |
| 168 | étoiles GitHub | |
| 94 | étoiles GitHub |
Classements
- Domaines
- Type
- Skills pour agents
- Usages