Die Werkzeugbeschreibungen sind auf Englisch.

coder_eval — Werkzeugprofil und Verlauf

Test that your Claude Code skills, MCP servers, and CLIs actually work when an agent uses them — sandboxed YAML suites, activation checks, A/B experiments, CI gates.

Aktiv

Kanonische Quelle ↗

Sprache
Python
Lizenz
Apache-2.0
Erstellt
Letzte Aktivität
Themen
  • agent-evaluation
  • agent-skills
  • agent-testing
  • anthropic
  • claude
  • claude-agent-sdk
  • claude-code
  • claude-code-plugins-marketplace
  • claude-code-skills
  • claude-skills
  • codex
  • coding-agents
  • evaluation-framework
  • gemini
  • github-actions
  • long-horizon-agents
  • regression-testing
  • skill-testing
  • swe-bench
  • terminal-bench

Aktuelle Messung

119GitHub-Sterne+3 (+2.6 %)
gemessenes Wachstum

Momentum uses available readings from the last 7 days: measured with at least two comparable readings, estimated otherwise.

Messverlauf

90 Tage · 90 Messungen maximal
DatumWertMetrik
119GitHub-Sterne
119GitHub-Sterne
118GitHub-Sterne
116GitHub-Sterne
116GitHub-Sterne
116GitHub-Sterne
116GitHub-Sterne
116GitHub-Sterne
116GitHub-Sterne
116GitHub-Sterne
116GitHub-Sterne
116GitHub-Sterne
116GitHub-Sterne
115GitHub-Sterne
115GitHub-Sterne
113GitHub-Sterne
113GitHub-Sterne
113GitHub-Sterne
111GitHub-Sterne
110GitHub-Sterne
109GitHub-Sterne
109GitHub-Sterne

Klassifikationen

Bereiche
Typ
MCP-Server
Anwendungsfälle

Diese Einträge führen dieselben Themen. Es wird keine Ähnlichkeit abgeleitet: genannt werden nur die gemeinsamen Themen.