Observabilité LLM : outils pour développeurs
Supervision, traces, évaluation et suivi de la qualité des applications LLM. Une entrée peut apparaître dans plusieurs usages lorsque ses topics ou sa description fournissent plusieurs signaux explicites.
Usage
Activité
Trier par
121 entrées dans cette vue.
Classement des outils
Classement par progressions mesurées, normalisées entre sources. Les valeurs brutes gardent leur fenêtre propre, indiquée sous chaque outil ; une variation exige au moins deux relevés sur les 7 derniers jours.
- 1Actif
Compétence Claude Code qui mesure le respect des règles établies d'un agent en analysant son historique de sessions.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add jleonceo/skill-adherencia-reglas1étoiles GitHubstable - 2Actif
sre-on-call
AgentSystème multi-agents SRE d'investigation sur appel qui classe automatiquement les alertes d'infrastructure Slack/Discord via AWS Bedrock AgentCore en les distribuant à des agents spécialisés pour investigation parallèle.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
3étoiles GitHubstable - 3Actif
adherencia-reglas
SkillOutil qui évalue le respect des règles par un agent IA en analysant l'historique local de Claude Code et en retournant un pourcentage de conformité par règle, sans installation ni dépendance réseau.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/jleonceo/adherencia-reglas ~/.claude/skills/adherencia-reglas1étoiles GitHubstable - 4Actif
homestream
AutreFramework multi-agent auto-hébergé et open-source avec streaming d'événements, mémoire causale et observabilité.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
0étoiles GitHubstable - 50étoiles GitHubstable
- 61étoiles GitHubstable
- 7Dormant
Serveur MCP comportemental servant de juge pour renforcer les assistants IA de codage par évaluations LLM explicites.
Reformulée en françaismcpprogression mesuréeVoir la source ↗
Installer
claude mcp add mcp-as-a-judge -- uvx mcp-as-a-judge17étoiles GitHubstable - 8Actif
anchor
SkillModèle AGENTS.md prêt pour la production avec 51 sections de règles éprouvées pour les agents IA de codage.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/peva3/anchor ~/.claude/skills/anchor8étoiles GitHubstable - 91étoiles GitHubstable
- 10Actif
skill-eval-harness
SkillHarnais d'évaluation de compétence d'agent pour variantes appariées, artefacts de trace et adaptateurs d'exécution.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/adewale/skill-eval-harness ~/.claude/skills/skill-eval-harness73étoiles GitHubstable - 110étoiles GitHubstable
- 12Dormant
eval-layer
AutreCompétence Claude Code qui ajoute une couche d'évaluation basée sur une grille à tout projet d'agent, générant une grille, des cas de test, un prompt d'évaluateur et un score pondéré.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
13étoiles GitHubstable - 13Dormant
Compagnon multi-agents en santé mentale centré sur la sécurité avec suivi de la détresse en temps réel et garde-fous pour les développeurs et utilisateurs.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
1étoiles GitHubstable - 14Actif
AgentX-Python
AutreUn SDK Python pour construire une main-d'œuvre multi-agents IA avec évaluation, traçage et observabilité complète.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
68étoiles GitHubstable - 155étoiles GitHubstable
- 161étoiles GitHubstable
- 17Actif
seo-skill-bench
Skillgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/aleclindz/seo-skill-bench ~/.claude/skills/seo-skill-bench51étoiles GitHubstable - 18Actif
green-agent
AgentOrchestrateur d'agents A2A pour évaluer des agents sur le benchmark AppWorld, construit sur le SDK AgentBeats.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
0étoiles GitHubstable - 191étoiles GitHubstable
- 20Actif
nora
MCPPlan de contrôle open-source auto-hébergé pour les flottes d'agents OpenClaw et Hermes sur Docker/Kubernetes.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
50étoiles GitHubstable - 21Dormant
adaptive-harness
SkillRouteur auto-améliorant pour Claude Code.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add SeongwoongCho/adaptive-harness8étoiles GitHubstable - 22Dormant
agentops
AgentPlateforme de remédiation d'infrastructure multi-agent utilisant le protocole A2A avec coordination d'agents, approbation HITL et restauration automatique.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
0étoiles GitHubstable - 231étoiles GitHubstable
- 24Actif
agent-mmm
SkillPlugin d'agent expert en Marketing Mix Modeling pour Claude Code utilisant pymc-marketing.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add Yakoub-ai/agent-mmm4étoiles GitHubstable - 25Actif
shokunin-review
AutreSystème de validation terminal pour examiner des documents PRD, RFC, stratégies et plans d'expérience.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
1étoiles GitHubstable