Observabilité LLM : outils pour développeurs

Supervision, traces, évaluation et suivi de la qualité des applications LLM. Une entrée peut apparaître dans plusieurs usages lorsque ses topics ou sa description fournissent plusieurs signaux explicites.

Usage

Activité

Trier par

123 entrées dans cette vue.

Classement des outils

Classement par progressions mesurées, normalisées entre sources. Les valeurs brutes gardent leur fenêtre propre, indiquée sous chaque outil ; une variation exige au moins deux relevés sur les 7 derniers jours.

  1. 1

    Skill
    Actif

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/EverMind-AI/SkillCorpus ~/.claude/skills/SkillCorpus

    360étoiles GitHub+168 (+87.5 %)
  2. 2
    Actif

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/NVIDIA/SkillEvaluator ~/.claude/skills/SkillEvaluator

    363étoiles GitHub+58 (+19.0 %)
  3. 3

    Skill
    Actif

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/ZSeven-W/craft-skills ~/.claude/skills/craft-skills

    138étoiles GitHub+21 (+17.9 %)
  4. 4

    Agent
    Actif

    Un système d'exploitation pour orchestrer et déployer des agents IA d'entreprise à l'échelle, sans dépendance à un framework, avec support natif de MCP et A2A.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    146étoiles GitHub+13 (+9.8 %)
  5. 5
    Actif

    Harnais d'évaluation de compétence d'agent pour variantes appariées, artefacts de trace et adaptateurs d'exécution.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/adewale/skill-eval-harness ~/.claude/skills/skill-eval-harness

    72étoiles GitHub+4 (+5.9 %)
  6. 6
    Actif

    Compétences, invites et instructions pour construire des agents IA exploitant le contexte de production Dynatrace.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/Dynatrace/dynatrace-for-ai ~/.claude/skills/dynatrace-for-ai

    131étoiles GitHub+5 (+4.0 %)
  7. 7

    Agent
    Actif

    APM orienté IA utilisant OpenTelemetry pour analyser les traces, métriques et topologies de services afin d'identifier les causes racines.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    627étoiles GitHub+22 (+3.6 %)
  8. 8
    Actif

    Compétences OpenTelemetry neutres vis-à-vis des fournisseurs pour les agents de codage IA, ancrées dans les sources en amont.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/ollygarden/opentelemetry-agent-skills ~/.claude/skills/opentelemetry-agent-skills

    96étoiles GitHub+3 (+3.2 %)
  9. 9
    Actif

    Système d'ingénierie, d'évaluation, de gouvernance et de portabilité pour les compétences d'agents IA réutilisables.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/yaojingang/yao-meta-skill ~/.claude/skills/yao-meta-skill

    2 565étoiles GitHub+58 (+2.3 %)
  10. 10
    Actif

    Test runner pour les skills d'agents IA au style agentskills.io.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/darkrishabh/agent-skills-eval ~/.claude/skills/agent-skills-eval

    713étoiles GitHub+12 (+1.7 %)
  11. 11

    Skill
    Actif

    Un outil d'analyse locale pour les compétences d'agent IA.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/crafter-station/skill-kit ~/.claude/skills/skill-kit

    77étoiles GitHub+1 (+1.3 %)
  12. 12
    Actif

    Serveur MCP pour l'observabilité LLM Langfuse, analysant traces et observations.

    Reformulée en français

    mcpprogression mesuréeVoir la source ↗

    Installer claude mcp add langfuse -- npx langfuse-observability-mcp-server

    78étoiles GitHub+1 (+1.3 %)
  13. 13
    Actif

    Framework Go pour construire des systèmes d'agents de production avec workflows graphiques, outils, mémoire, A2A, MCP et observabilité.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    1 752étoiles GitHub+22 (+1.3 %)
  14. 14
    Actif

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/FrancyJGLisboa/agent-skill-creator ~/.claude/skills/agent-skill-creator

    2 358étoiles GitHub+29 (+1.2 %)
  15. 15

    Skill
    Actif

    Ensemble de compétences distillant le workflow Fable 5 de Claude, exécutables par n'importe quel modèle, avec évaluation intégrée.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/Sahir619/fable-method ~/.claude/skills/fable-method

    2 269étoiles GitHub+22 (+0.98 %)
  16. 16
    Actif

    Framework pour agents qui s'améliorent par itération successive, avec gestion de mémoire et contexte.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    105étoiles GitHub+1 (+0.96 %)
  17. 17

    Skill
    Actif

    Framework d'évaluation unifié pour les agents IA et les modèles de récompense.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/agentscope-ai/OpenJudge ~/.claude/skills/OpenJudge

    807étoiles GitHub+7 (+0.88 %)
  18. 18
    Actif

    Plateforme open source d'ingénierie LLM offrant observabilité, évaluations, gestion de prompts et métriques pour déboguer et améliorer les applications LLM.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/langfuse/langfuse-docs ~/.claude/skills/langfuse-docs

    237étoiles GitHub+2 (+0.85 %)
  19. 19

    MCP
    Actif

    Une plateforme d'agent SRE prête pour la production qui gère les garde-fous, APIs, gestion d'état et gestion des défaillances pour déployer l'IA de manière sûre sur l'infrastructure de production.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    258étoiles GitHub+2 (+0.78 %)
  20. 20
    Actif

    Tableau de bord pour surveiller et visualiser les sessions Claude Code avec observabilité des hooks, skills et MCP.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add JayantDevkar/claude-code-karma

    321étoiles GitHub+2 (+0.63 %)
  21. 21

    Skill
    Actif

    Créateur de compétences fondé sur des tests de régression pour Claude Code et Codex, avec validation et évaluation des compétences.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/tripleyak/SkillForge ~/.claude/skills/SkillForge

    884étoiles GitHub+5 (+0.57 %)
  22. 22

    Autre
    Actif

    Outil de test de prompts, d'agents et de RAG permettant d'évaluer les vulnérabilités et les performances de différents modèles de langage via des configurations déclaratives.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    24 710étoiles GitHub+137 (+0.56 %)
  23. 23

    Autre
    Actif

    Plateforme open-source d'observabilité pour les logs, métriques, traces et monitoring LLM avec une alternative économe en stockage à Datadog et Splunk.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    21 594étoiles GitHub+119 (+0.55 %)
  24. 24

    Autre
    Actif

    Scanner de vulnérabilités spécialisé dans l'évaluation de la sécurité des modèles de langage.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    9 079étoiles GitHub+46 (+0.51 %)

Ressources pédagogiques et de référence

Classement par progressions mesurées, normalisées entre sources. Ces ressources restent accessibles séparément et ne participent pas au classement principal des outils.

  1. 1
    ActifVoir la source ↗

    Répertoire organisé et évalué de serveurs MCP et agents pour DevOps, Cloud, SRE et Platform Engineering, classés selon l'accès en production, les contrôles d'approbation et les preuves d'audit.

    Reformulée en françaisgithubRessourceprogression mesurée
    77étoiles GitHub+1 (+1.3 %)