Die Werkzeugbeschreibungen sind auf Englisch.
SkillEvaluator — Werkzeugprofil und Verlauf
Multi-tier framework for evaluating AI agent skills with quality gates, semantic overlap detection, synthetic evaluation dataset generation, and live agent evaluation that measures how skills affect agent behavior.
- Sprache
- Python
- Lizenz
- Apache-2.0
- Erstellt
- Letzte Aktivität
- Themen
- agent-evaluation
- agent-security
- agent-skills
- agentic-ai
- benchmark
- claude-code
- codex
- evaluate
- evaluation
- security-scanner
- skill-eval
- skill-evals
- skill-evaluation
- skill-evaluator
- skills
Installieren git clone https://github.com/NVIDIA/SkillEvaluator ~/.claude/skills/SkillEvaluator
Aktuelle Messung
363GitHub-Sterne+70 (+23.9 %)
gemessenes WachstumMomentum uses available readings from the last 7 days: measured with at least two comparable readings, estimated otherwise.
Messverlauf
| Datum | Wert | Metrik |
|---|---|---|
| 363 | GitHub-Sterne | |
| 351 | GitHub-Sterne | |
| 348 | GitHub-Sterne | |
| 332 | GitHub-Sterne | |
| 326 | GitHub-Sterne | |
| 305 | GitHub-Sterne | |
| 293 | GitHub-Sterne | |
| 266 | GitHub-Sterne | |
| 245 | GitHub-Sterne | |
| 209 | GitHub-Sterne | |
| 168 | GitHub-Sterne | |
| 94 | GitHub-Sterne |
Klassifikationen
- Bereiche
- Typ
- Agent-Skills
- Anwendungsfälle