Die Werkzeugbeschreibungen sind auf Englisch.

SkillEvaluator — Werkzeugprofil und Verlauf

Multi-tier framework for evaluating AI agent skills with quality gates, semantic overlap detection, synthetic evaluation dataset generation, and live agent evaluation that measures how skills affect agent behavior.

Aktiv

Kanonische Quelle ↗

Sprache
Python
Lizenz
Apache-2.0
Erstellt
Letzte Aktivität
Themen
  • agent-evaluation
  • agent-security
  • agent-skills
  • agentic-ai
  • benchmark
  • claude-code
  • codex
  • evaluate
  • evaluation
  • security-scanner
  • skill-eval
  • skill-evals
  • skill-evaluation
  • skill-evaluator
  • skills

Installieren git clone https://github.com/NVIDIA/SkillEvaluator ~/.claude/skills/SkillEvaluator

Aktuelle Messung

363GitHub-Sterne+70 (+23.9 %)
gemessenes Wachstum

Momentum uses available readings from the last 7 days: measured with at least two comparable readings, estimated otherwise.

Messverlauf

90 Tage · 90 Messungen maximal
DatumWertMetrik
363GitHub-Sterne
351GitHub-Sterne
348GitHub-Sterne
332GitHub-Sterne
326GitHub-Sterne
305GitHub-Sterne
293GitHub-Sterne
266GitHub-Sterne
245GitHub-Sterne
209GitHub-Sterne
168GitHub-Sterne
94GitHub-Sterne

Klassifikationen

Bereiche
Typ
Agent-Skills
Anwendungsfälle