Die Werkzeugbeschreibungen sind auf Englisch.

eval-layer — Werkzeugprofil und Verlauf

A Claude Code skill that adds a rubric-based eval layer to any agent project. Framework-agnostic — generates rubric, test cases, judge prompt, and harness. Returns a weighted score plus a judge-leniency signal.

Ruhend

Kanonische Quelle ↗

Sprache
HTML
Erstellt
Letzte Aktivität
Themen
  • agent-evaluation
  • anthropic
  • claude-code
  • claude-code-skill
  • evals
  • llm-agents
  • llm-as-a-judge
  • rubric

Aktuelle Messung

13GitHub-Sternestabil
gemessenes Wachstum

Momentum uses available readings from the last 7 days: measured with at least two comparable readings, estimated otherwise.

Messverlauf

90 Tage · 90 Messungen maximal
DatumWertMetrik
13GitHub-Sterne
13GitHub-Sterne
13GitHub-Sterne
13GitHub-Sterne
13GitHub-Sterne
13GitHub-Sterne
12GitHub-Sterne
12GitHub-Sterne
12GitHub-Sterne
12GitHub-Sterne
12GitHub-Sterne
12GitHub-Sterne
12GitHub-Sterne
12GitHub-Sterne
12GitHub-Sterne
12GitHub-Sterne
12GitHub-Sterne
12GitHub-Sterne
12GitHub-Sterne
12GitHub-Sterne
12GitHub-Sterne
12GitHub-Sterne

Klassifikationen

Bereiche
Typ
Sonstige
Anwendungsfälle

Diese Einträge führen dieselben Themen. Es wird keine Ähnlichkeit abgeleitet: genannt werden nur die gemeinsamen Themen.