Observabilité LLM : outils pour développeurs

Supervision, traces, évaluation et suivi de la qualité des applications LLM. Une entrée peut apparaître dans plusieurs usages lorsque ses topics ou sa description fournissent plusieurs signaux explicites.

Usage

Activité

Trier par

121 entrées dans cette vue.

Classement des outils

Classement par progressions mesurées, normalisées entre sources. Les valeurs brutes gardent leur fenêtre propre, indiquée sous chaque outil ; une variation exige au moins deux relevés sur les 7 derniers jours.

  1. 1

    Skill
    Dormant

    Couche d'audit de réclamations LLM rendant chaque affirmation factuelle vérifiable, avec gradients de vérité T1-T7.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/lc198707/anti-lie ~/.claude/skills/anti-lie

    89étoiles GitHubstable
  2. 2

    Skill
    Actif

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/ssheleg/agent-stack ~/.claude/skills/agent-stack

    2étoiles GitHub+1 (+100.0 %)
  3. 3

    Autre
    Actif

    Humaniseur IA open-source gratuit qui réécrit itérativement le texte IA contre les scores de détecteurs en direct tout en préservant le sens, citations et faits.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    18étoiles GitHubstable
  4. 4
    Actif

    Plugin Claude Code qui enregistre les sessions vers Opik, plateforme open-source d'observabilité et d'évaluation pour LLM.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    22étoiles GitHub+1 (+4.8 %)
  5. 5
    Actif

    githubprogression mesuréeVoir la source ↗

    22étoiles GitHub+2 (+10.0 %)
  6. 6

    Skill
    Actif

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/MrZoyo/deslop-GPT ~/.claude/skills/deslop-GPT

    87étoiles GitHub+59 (+210.7 %)
  7. 7

    Agent
    Dormant

    Proxy de débogage en temps réel pour les systèmes multi-agents Agent2Agent (A2A).

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    3étoiles GitHubstable
  8. 8

    Agent
    Dormant

    githubprogression mesuréeVoir la source ↗

    0étoiles GitHubstable
  9. 9
    Actif

    Une skill de suivi comportemental système pour Claude, basée sur Sentry.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/tortastudios/sentry-instrumentation ~/.claude/skills/sentry-instrumentation

    24étoiles GitHubstable
  10. 10
    Dormant

    Routeur auto-améliorant pour Claude Code.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add SeongwoongCho/adaptive-harness

    8étoiles GitHubstable
  11. 11
    Actif

    Serveur MCP pour l'observabilité LLM Langfuse, analysant traces et observations.

    Reformulée en français

    mcpprogression mesuréeVoir la source ↗

    Installer claude mcp add langfuse -- npx langfuse-observability-mcp-server

    80étoiles GitHub+2 (+2.6 %)
  12. 12

    Skill
    Actif

    Une marketplace organisée de plugins pour Claude Code.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/netopsengineer/axiom ~/.claude/skills/axiom

    5étoiles GitHubstable
  13. 13

    Agent
    Dormant

    githubprogression mesuréeVoir la source ↗

    26étoiles GitHubstable
  14. 14
    Actif

    Framework Go pour construire des systèmes d'agents de production avec workflows graphiques, outils, mémoire, A2A, MCP et observabilité.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    1 763étoiles GitHub+15 (+0.86 %)
  15. 15

    Agent
    Actif

    githubprogression mesuréeVoir la source ↗

    0étoiles GitHubstable
  16. 16
    Dormant

    Compagnon multi-agents en santé mentale centré sur la sécurité avec suivi de la détresse en temps réel et garde-fous pour les développeurs et utilisateurs.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    1étoiles GitHubstable
  17. 17

    Skill
    Actif

    Framework d'évaluation unifié pour les agents IA et les modèles de récompense.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/agentscope-ai/OpenJudge ~/.claude/skills/OpenJudge

    816étoiles GitHub+11 (+1.4 %)
  18. 18

    Autre
    Dormant

    githubprogression mesuréeVoir la source ↗

    1étoiles GitHubstable
  19. 19
    Dormant

    Compétence d'observabilité IA pour Claude Code permettant de déboguer les agents LangChain/LangGraph en récupérant les traces d'exécution depuis LangSmith Studio.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/OthmanAdi/langsmith-fetch-skill ~/.claude/skills/langsmith-fetch-skill

    27étoiles GitHubstable
  20. 20

    Skill
    Actif

    Un outil d'analyse locale pour les compétences d'agent IA.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/crafter-station/skill-kit ~/.claude/skills/skill-kit

    77étoiles GitHub+1 (+1.3 %)
  21. 21
    Actif

    Suite de 8 produits MCP autonomes pour PME couvrant governances, finops, observabilité et routage d'agents IA.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    1étoiles GitHubstable
  22. 22

    Agent
    Dormant

    Plateforme de remédiation d'infrastructure multi-agent utilisant le protocole A2A avec coordination d'agents, approbation HITL et restauration automatique.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    0étoiles GitHubstable
  23. 23

    MCP
    Actif

    Une plateforme d'agent SRE prête pour la production qui gère les garde-fous, APIs, gestion d'état et gestion des défaillances pour déployer l'IA de manière sûre sur l'infrastructure de production.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    339étoiles GitHub+81 (+31.4 %)
  24. 24
    Actif

    Harnais d'évaluation de compétence d'agent pour variantes appariées, artefacts de trace et adaptateurs d'exécution.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/adewale/skill-eval-harness ~/.claude/skills/skill-eval-harness

    73étoiles GitHub+2 (+2.8 %)
  25. 25
    Dormant

    Outil local open-source pour déboguer, sécuriser et évaluer les agents LLM via analyse statique, vérifications dynamiques et monitoring en temps réel.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add cylestio/agent-inspector

    9étoiles GitHubstable