coder_eval — fiche et historique

Teste que tes compétences Claude Code, serveurs MCP et CLIs fonctionnent réellement quand un agent les utilise : suites YAML sandboxées, vérifications d'activation, expériences A/B, gates CI.

Actif

Reformulée en français

Source canonique ↗

Langage
Python
Licence
Apache-2.0
Création
Dernière activité
Topics
  • agent-evaluation
  • agent-skills
  • agent-testing
  • anthropic
  • claude
  • claude-agent-sdk
  • claude-code
  • claude-code-plugins-marketplace
  • claude-code-skills
  • claude-skills
  • codex
  • coding-agents
  • evaluation-framework
  • gemini
  • github-actions
  • long-horizon-agents
  • regression-testing
  • skill-testing
  • swe-bench
  • terminal-bench

Mesure actuelle

119étoiles GitHub+3 (+2.6 %)
progression mesurée

Le momentum utilise les relevés disponibles des 7 derniers jours : mesuré avec au moins deux relevés comparables, estimé sinon.

Historique des relevés

90 jours · 90 relevés maximum
DateValeurMétrique
119étoiles GitHub
119étoiles GitHub
118étoiles GitHub
116étoiles GitHub
116étoiles GitHub
116étoiles GitHub
116étoiles GitHub
116étoiles GitHub
116étoiles GitHub
116étoiles GitHub
116étoiles GitHub
116étoiles GitHub
116étoiles GitHub
115étoiles GitHub
115étoiles GitHub
113étoiles GitHub
113étoiles GitHub
113étoiles GitHub
111étoiles GitHub
110étoiles GitHub
109étoiles GitHub
109étoiles GitHub

Classements

Domaines
Type
Serveurs MCP
Usages

Ces entrées déclarent les mêmes sujets. Aucune similarité n’est déduite : seuls les sujets communs sont indiqués.