Observabilité LLM : outils pour développeurs

Supervision, traces, évaluation et suivi de la qualité des applications LLM. Une entrée peut apparaître dans plusieurs usages lorsque ses topics ou sa description fournissent plusieurs signaux explicites.

Usage

Activité

Trier par

122 entrées dans cette vue.

Classement des outils

Classement mixte : les progressions mesurées priment ; les entrées sans deux relevés sont estimées. Les valeurs brutes gardent leur fenêtre propre, indiquée sous chaque outil ; une variation exige au moins deux relevés sur les 7 derniers jours.

  1. 1
    Actif

    Skills pour Claude Code qui incluent des benchmarks d'exactitude validés par rapport à des références.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/sjh9714/skill-receipts ~/.claude/skills/skill-receipts

    2étoiles GitHubstable
  2. 2
    Actif

    Une skill de suivi comportemental système pour Claude, basée sur Sentry.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/tortastudios/sentry-instrumentation ~/.claude/skills/sentry-instrumentation

    24étoiles GitHubstable
  3. 3

    Autre
    Dormant

    Système multi-agents de support client utilisant Google ADK et Gemini 2.5 Flash Lite.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    2étoiles GitHubstable
  4. 4
    Actif

    githubprogression mesuréeVoir la source ↗

    22étoiles GitHub+2 (+10.0 %)
  5. 5

    MCP
    Actif

    githubprogression mesuréeVoir la source ↗

    2étoiles GitHubstable
  6. 6
    Actif

    Plugin Claude Code qui enregistre les sessions vers Opik, plateforme open-source d'observabilité et d'évaluation pour LLM.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    22étoiles GitHub+1 (+4.8 %)
  7. 7

    Autre
    Actif

    Humaniseur IA open-source gratuit qui réécrit itérativement le texte IA contre les scores de détecteurs en direct tout en préservant le sens, citations et faits.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    18étoiles GitHubstable
  8. 8
    Dormant

    Des conventions sémantiques et de l'instrumentation OpenTelemetry pour la provenance des agents, la traçabilité des dérivations et l'évaluation des critères d'acceptation.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    0étoiles GitHubstable
  9. 9

    Agent
    Dormant

    Framework d'évaluation de systèmes multi-agents utilisant PydanticAI pour générer et évaluer des critiques d'articles scientifiques.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    2étoiles GitHubstable
  10. 10
    Actif

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/ma-nucho-pro/supervisor-skill-claude ~/.claude/skills/supervisor-skill-claude

    2étoiles GitHubstable
  11. 11

    Skill
    Actif

    Outil mesurant les améliorations de prompts et de compétences via comparaison A/B en aveugle.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add shinpr/rashomon

    18étoiles GitHubstable
  12. 12

    Skill
    Actif

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/ssheleg/agent-stack ~/.claude/skills/agent-stack

    2étoiles GitHub+1 (+100.0 %)
  13. 13
    Dormant

    Serveur MCP comportemental servant de juge pour renforcer les assistants IA de codage par évaluations LLM explicites.

    Reformulée en français

    mcpprogression mesuréeVoir la source ↗

    Installer claude mcp add mcp-as-a-judge -- uvx mcp-as-a-judge

    17étoiles GitHubstable
  14. 14

    Agent
    Actif

    Système multi-agents SRE d'investigation sur appel qui classe automatiquement les alertes d'infrastructure Slack/Discord via AWS Bedrock AgentCore en les distribuant à des agents spécialisés pour investigation parallèle.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    3étoiles GitHubstable
  15. 15

    Skill
    Actif

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/MrZoyo/deslop-GPT ~/.claude/skills/deslop-GPT

    76étoiles GitHub+48 (+171.4 %)
  16. 16
    Actif

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/NocodeMrLi/mini-program-engineering-skill-suite ~/.claude/skills/mini-program-engineering-skill-suite

    43étoiles GitHub+4 (+10.3 %)
  17. 17
    Actif

    githubmomentum estiméVoir la source ↗

    Installer git clone https://github.com/FrancyJGLisboa/agent-skills-platform ~/.claude/skills/agent-skills-platform

    2 376étoiles GitHub

Ressources pédagogiques et de référence

Classement par progressions mesurées, normalisées entre sources. Ces ressources restent accessibles séparément et ne participent pas au classement principal des outils.

  1. 1
    ActifVoir la source ↗

    Outil de télémétrie pour Claude Code qui analyse la documentation en local et génère des cartes thermiques.

    Reformulée en françaisgithub

    Installer /plugin marketplace add Hedde/trigger_tree

    Ressourceprogression mesurée
    14étoiles GitHub+1 (+7.7 %)
  2. 2
    ActifVoir la source ↗githubRessourceprogression mesurée
    1étoiles GitHubstable
  3. 3
    ActifVoir la source ↗

    Ensemble de plus de 50 outils de traçabilité LLM et 26 compétences pour construire, évaluer, déboguer, sécuriser et surveiller des applications LLM fiables.

    Reformulée en françaisgithub

    Installer git clone https://github.com/ContextJet-ai/awesome-llm-observability ~/.claude/skills/awesome-llm-observability

    Ressourceprogression mesurée
    33étoiles GitHub+3 (+10.0 %)
  4. 4
    ActifVoir la source ↗githubRessourceprogression mesurée
    18étoiles GitHubstable
  5. 5

    tunelab

    Skill
    ActifVoir la source ↗

    Plugin Claude Code pour l'ajustement fin, la distillation et l'évaluation de modèles de langage.

    Reformulée en françaisgithub

    Installer /plugin marketplace add rchaz/tunelab

    Ressourceprogression mesurée
    6étoiles GitHubstable