Observabilité LLM : outils pour développeurs

Supervision, traces, évaluation et suivi de la qualité des applications LLM. Une entrée peut apparaître dans plusieurs usages lorsque ses topics ou sa description fournissent plusieurs signaux explicites.

Usage

Activité

Trier par

121 entrées dans cette vue.

Classement des outils

Classement par nombre d’étoiles GitHub connu, du plus élevé au plus faible ; les dépôts archivés viennent après les dépôts maintenus. Les valeurs brutes gardent leur fenêtre propre, indiquée sous chaque outil ; une variation exige au moins deux relevés sur les 7 derniers jours.

  1. 1

    Skill
    Actif

    Tableau de bord de traçage en temps réel et d'intelligence des coûts pour Claude Code.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add DeibyGS/claudestat

    34étoiles GitHubstable
  2. 2
    Dormant

    Compétence d'observabilité IA pour Claude Code permettant de déboguer les agents LangChain/LangGraph en récupérant les traces d'exécution depuis LangSmith Studio.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/OthmanAdi/langsmith-fetch-skill ~/.claude/skills/langsmith-fetch-skill

    27étoiles GitHubstable
  3. 3

    Agent
    Dormant

    githubprogression mesuréeVoir la source ↗

    26étoiles GitHubstable
  4. 4
    Actif

    Une skill de suivi comportemental système pour Claude, basée sur Sentry.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/tortastudios/sentry-instrumentation ~/.claude/skills/sentry-instrumentation

    24étoiles GitHubstable
  5. 5
    Actif

    Plugin Claude Code qui enregistre les sessions vers Opik, plateforme open-source d'observabilité et d'évaluation pour LLM.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    22étoiles GitHub+1 (+4.8 %)
  6. 6
    Actif

    githubprogression mesuréeVoir la source ↗

    22étoiles GitHubstable
  7. 7

    Skill
    Actif

    Outil mesurant les améliorations de prompts et de compétences via comparaison A/B en aveugle.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add shinpr/rashomon

    18étoiles GitHubstable
  8. 8

    Autre
    Actif

    Humaniseur IA open-source gratuit qui réécrit itérativement le texte IA contre les scores de détecteurs en direct tout en préservant le sens, citations et faits.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    18étoiles GitHub-1 (-5.3 %)
  9. 9
    Dormant

    Deux compétences Claude Code pour relecture de code contradictoire (PAR mono-modèle et MMAR multi-modèles) avec suite d'évaluation basée sur des fixtures.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add prime-radiant-inc/parallel-adversarial-review

    17étoiles GitHubstable
  10. 10
    Dormant

    Serveur MCP comportemental servant de juge pour renforcer les assistants IA de codage par évaluations LLM explicites.

    Reformulée en français

    mcpprogression mesuréeVoir la source ↗

    Installer claude mcp add mcp-as-a-judge -- uvx mcp-as-a-judge

    17étoiles GitHubstable
  11. 11
    Actif

    Outil pour faire écrire Claude clairement et de manière accessible.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add stefanobaghino/simple-output-styles

    16étoiles GitHubstable
  12. 12

    Autre
    Actif

    Outil en ligne de commande pour créer et gérer des agents IA prêts pour l'entreprise utilisant le protocole A2A.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    14étoiles GitHub+1 (+7.7 %)
  13. 13
    Actif

    Serveur MCP permettant de consulter l'observabilité LLM de Spanlens depuis Cursor, Claude Desktop ou Continue.

    Reformulée en français

    mcpprogression mesuréeVoir la source ↗

    Installer claude mcp add mcp-server -- npx @spanlens/mcp-server

    13étoiles GitHub+1 (+8.3 %)
  14. 14
    Actif

    Place de marché de greffons Claude Code avec ingénierie agentique et audit de dépôts pour préparer l'open source.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add GiustoPiedimonte/agentic-engineering-marketplace

    13étoiles GitHubstable
  15. 15

    Autre
    Dormant

    Compétence Claude Code qui ajoute une couche d'évaluation basée sur une grille à tout projet d'agent, générant une grille, des cas de test, un prompt d'évaluateur et un score pondéré.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    13étoiles GitHubstable
  16. 16

    Autre
    Actif

    githubprogression mesuréeVoir la source ↗

    10étoiles GitHubstable
  17. 17

    Skill
    Actif

    Compétence Claude Code qui génère plusieurs solutions, crée automatiquement des critères d'évaluation, les juge indépendamment et retourne la meilleure.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add CoriChui/bakeoff

    10étoiles GitHubstable
  18. 18
    Actif

    Outil d'audit qui identifie les compétences Claude Code réellement utilisées et détecte les installations mortes dans vos journaux de session.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add sfrangulov/skill-graveyard

    10étoiles GitHubstable
  19. 19

    Skill
    Actif

    Fournit des règles de codage IA prêtes pour la production pour Cursor et Claude Code, avec templates et compétences à intégrer dans n'importe quel projet.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/aiagentwithdhruv/ai-dev-stack ~/.claude/skills/ai-dev-stack

    10étoiles GitHubstable
  20. 20
    Dormant

    Outil local open-source pour déboguer, sécuriser et évaluer les agents LLM via analyse statique, vérifications dynamiques et monitoring en temps réel.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add cylestio/agent-inspector

    9étoiles GitHubstable
  21. 21

    Skill
    Actif

    Modèle AGENTS.md prêt pour la production avec 51 sections de règles éprouvées pour les agents IA de codage.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/peva3/anchor ~/.claude/skills/anchor

    8étoiles GitHubstable
  22. 22
    Dormant

    Routeur auto-améliorant pour Claude Code.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add SeongwoongCho/adaptive-harness

    8étoiles GitHubstable

Ressources pédagogiques et de référence

Classement par nombre d’étoiles GitHub connu, du plus élevé au plus faible ; les dépôts archivés viennent après les dépôts maintenus. Ces ressources restent accessibles séparément et ne participent pas au classement principal des outils.

  1. 1
    ActifVoir la source ↗

    Ensemble de plus de 50 outils de traçabilité LLM et 26 compétences pour construire, évaluer, déboguer, sécuriser et surveiller des applications LLM fiables.

    Reformulée en françaisgithub

    Installer git clone https://github.com/ContextJet-ai/awesome-llm-observability ~/.claude/skills/awesome-llm-observability

    Ressourceprogression mesurée
    33étoiles GitHub+2 (+6.5 %)
  2. 2
    ActifVoir la source ↗githubRessourceprogression mesurée
    18étoiles GitHubstable
  3. 3
    ActifVoir la source ↗

    Outil de télémétrie pour Claude Code qui analyse la documentation en local et génère des cartes thermiques.

    Reformulée en françaisgithub

    Installer /plugin marketplace add Hedde/trigger_tree

    Ressourceprogression mesurée
    14étoiles GitHubstable