Observabilité LLM : outils pour développeurs
Supervision, traces, évaluation et suivi de la qualité des applications LLM. Une entrée peut apparaître dans plusieurs usages lorsque ses topics ou sa description fournissent plusieurs signaux explicites.
Usage
Activité
Trier par
123 entrées dans cette vue.
Classement des outils
Classement par progressions mesurées, normalisées entre sources. Les valeurs brutes gardent leur fenêtre propre, indiquée sous chaque outil ; une variation exige au moins deux relevés sur les 7 derniers jours.
- 1Actif
SkillCorpus
Skillgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/EverMind-AI/SkillCorpus ~/.claude/skills/SkillCorpus360étoiles GitHub+168 (+87.5 %) - 2Actif
SkillEvaluator
Skillgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/NVIDIA/SkillEvaluator ~/.claude/skills/SkillEvaluator363étoiles GitHub+58 (+19.0 %) - 3Actif
craft-skills
Skillgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/ZSeven-W/craft-skills ~/.claude/skills/craft-skills138étoiles GitHub+21 (+17.9 %) - 4Actif
agent-kernel
AgentUn système d'exploitation pour orchestrer et déployer des agents IA d'entreprise à l'échelle, sans dépendance à un framework, avec support natif de MCP et A2A.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
146étoiles GitHub+13 (+9.8 %) - 5Actif
skill-eval-harness
SkillHarnais d'évaluation de compétence d'agent pour variantes appariées, artefacts de trace et adaptateurs d'exécution.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/adewale/skill-eval-harness ~/.claude/skills/skill-eval-harness72étoiles GitHub+4 (+5.9 %) - 6Actif
dynatrace-for-ai
SkillCompétences, invites et instructions pour construire des agents IA exploitant le contexte de production Dynatrace.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/Dynatrace/dynatrace-for-ai ~/.claude/skills/dynatrace-for-ai131étoiles GitHub+5 (+4.0 %) - 7Actif
databuff
AgentAPM orienté IA utilisant OpenTelemetry pour analyser les traces, métriques et topologies de services afin d'identifier les causes racines.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
627étoiles GitHub+22 (+3.6 %) - 8Actif
Compétences OpenTelemetry neutres vis-à-vis des fournisseurs pour les agents de codage IA, ancrées dans les sources en amont.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/ollygarden/opentelemetry-agent-skills ~/.claude/skills/opentelemetry-agent-skills96étoiles GitHub+3 (+3.2 %) - 9Actif
yao-meta-skill
SkillSystème d'ingénierie, d'évaluation, de gouvernance et de portabilité pour les compétences d'agents IA réutilisables.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/yaojingang/yao-meta-skill ~/.claude/skills/yao-meta-skill2 565étoiles GitHub+58 (+2.3 %) - 10Actif
agent-skills-eval
SkillTest runner pour les skills d'agents IA au style agentskills.io.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/darkrishabh/agent-skills-eval ~/.claude/skills/agent-skills-eval713étoiles GitHub+12 (+1.7 %) - 11Actif
skill-kit
SkillUn outil d'analyse locale pour les compétences d'agent IA.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/crafter-station/skill-kit ~/.claude/skills/skill-kit77étoiles GitHub+1 (+1.3 %) - 12Actif
Serveur MCP pour l'observabilité LLM Langfuse, analysant traces et observations.
Reformulée en françaismcpprogression mesuréeVoir la source ↗
Installer
claude mcp add langfuse -- npx langfuse-observability-mcp-server78étoiles GitHub+1 (+1.3 %) - 13Actif
Framework Go pour construire des systèmes d'agents de production avec workflows graphiques, outils, mémoire, A2A, MCP et observabilité.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
1 752étoiles GitHub+22 (+1.3 %) - 14Actif
agent-skill-creator
Skillgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/FrancyJGLisboa/agent-skill-creator ~/.claude/skills/agent-skill-creator2 358étoiles GitHub+29 (+1.2 %) - 15Actif
fable-method
SkillEnsemble de compétences distillant le workflow Fable 5 de Claude, exécutables par n'importe quel modèle, avec évaluation intégrée.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/Sahir619/fable-method ~/.claude/skills/fable-method2 269étoiles GitHub+22 (+0.98 %) - 16Actif
altk-evolve
MCPFramework pour agents qui s'améliorent par itération successive, avec gestion de mémoire et contexte.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
105étoiles GitHub+1 (+0.96 %) - 17Actif
OpenJudge
SkillFramework d'évaluation unifié pour les agents IA et les modèles de récompense.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/agentscope-ai/OpenJudge ~/.claude/skills/OpenJudge807étoiles GitHub+7 (+0.88 %) - 18Actif
langfuse-docs
SkillPlateforme open source d'ingénierie LLM offrant observabilité, évaluations, gestion de prompts et métriques pour déboguer et améliorer les applications LLM.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/langfuse/langfuse-docs ~/.claude/skills/langfuse-docs237étoiles GitHub+2 (+0.85 %) - 19Actif
aura
MCPUne plateforme d'agent SRE prête pour la production qui gère les garde-fous, APIs, gestion d'état et gestion des défaillances pour déployer l'IA de manière sûre sur l'infrastructure de production.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
258étoiles GitHub+2 (+0.78 %) - 20Actif
claude-code-karma
SkillTableau de bord pour surveiller et visualiser les sessions Claude Code avec observabilité des hooks, skills et MCP.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add JayantDevkar/claude-code-karma321étoiles GitHub+2 (+0.63 %) - 21Actif
SkillForge
SkillCréateur de compétences fondé sur des tests de régression pour Claude Code et Codex, avec validation et évaluation des compétences.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/tripleyak/SkillForge ~/.claude/skills/SkillForge884étoiles GitHub+5 (+0.57 %) - 22Actif
promptfoo
AutreOutil de test de prompts, d'agents et de RAG permettant d'évaluer les vulnérabilités et les performances de différents modèles de langage via des configurations déclaratives.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
24 710étoiles GitHub+137 (+0.56 %) - 23Actif
openobserve
AutrePlateforme open-source d'observabilité pour les logs, métriques, traces et monitoring LLM avec une alternative économe en stockage à Datadog et Splunk.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
21 594étoiles GitHub+119 (+0.55 %) - 24Actif
garak
AutreScanner de vulnérabilités spécialisé dans l'évaluation de la sécurité des modèles de langage.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
9 079étoiles GitHub+46 (+0.51 %)
Ressources pédagogiques et de référence
Classement par progressions mesurées, normalisées entre sources. Ces ressources restent accessibles séparément et ne participent pas au classement principal des outils.
- 1ActifVoir la source ↗
Répertoire organisé et évalué de serveurs MCP et agents pour DevOps, Cloud, SRE et Platform Engineering, classés selon l'accès en production, les contrôles d'approbation et les preuves d'audit.
Reformulée en françaisgithubRessourceprogression mesurée77étoiles GitHub+1 (+1.3 %)