Observabilité LLM : outils pour développeurs

Supervision, traces, évaluation et suivi de la qualité des applications LLM. Une entrée peut apparaître dans plusieurs usages lorsque ses topics ou sa description fournissent plusieurs signaux explicites.

Usage

Activité

Trier par

117 entrées dans cette vue.

Classement des outils

Classement par progressions mesurées, normalisées entre sources. Les valeurs brutes gardent leur fenêtre propre, indiquée sous chaque outil ; une variation exige au moins deux relevés sur les 7 derniers jours.

  1. 1

    MCP
    Actif

    Une plateforme d'agent SRE prête pour la production qui gère les garde-fous, APIs, gestion d'état et gestion des défaillances pour déployer l'IA de manière sûre sur l'infrastructure de production.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    254étoiles GitHub-3 (-1.2 %)
  2. 2
    Actif

    Un runtime open-source qui déploie les agents LangGraph ou Google ADK en service FastAPI prêt pour la production, avec interface utilisateur, guardrails, MCP et observabilité.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/Idun-Group/idun-agent-platform ~/.claude/skills/idun-agent-platform

    198étoiles GitHub-1 (-0.50 %)
  3. 3
    Actif

    SRE IA auto-hébergé pour Kubernetes avec observabilité eBPF sans instrumentation et un copilote qui corrige les incidents.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    131étoiles GitHub-4 (-3.0 %)
  4. 4
    Actif

    Collection de 71 compétences open-source pour Claude Code et Codex couvrant l'orchestration, la revue de code, les évaluations et le shipping d'applications.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    129étoiles GitHub-4 (-3.0 %)
  5. 5
    Actif

    Serveur Model Context Protocol pour agents IA permettant d'interroger les données de traçage Langfuse.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    105étoiles GitHubstable
  6. 6

    Skill
    Dormant

    Couche d'audit de réclamations LLM rendant chaque affirmation factuelle vérifiable, avec gradients de vérité T1-T7.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/lc198707/anti-lie ~/.claude/skills/anti-lie

    89étoiles GitHubstable
  7. 7
    Actif

    Serveur MCP pour l'observabilité LLM Langfuse, analysant traces et observations.

    Reformulée en français

    mcpprogression mesuréeVoir la source ↗

    Installer claude mcp add langfuse -- npx langfuse-observability-mcp-server

    78étoiles GitHubstable
  8. 8
    Actif

    Un SDK Python pour construire une main-d'œuvre multi-agents IA avec évaluation, traçage et observabilité complète.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    68étoiles GitHubstable
  9. 9
    Actif

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/aleclindz/seo-skill-bench ~/.claude/skills/seo-skill-bench

    51étoiles GitHub-5 (-8.9 %)
  10. 10

    Skill
    Actif

    Compétences d'agent pour gérer des ensembles de données, des expériences et des traces dans Arize via la CLI ax.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/Arize-ai/arize-skills ~/.claude/skills/arize-skills

    47étoiles GitHubstable
  11. 11
    Actif

    Plugin Claude Code qui fait se comporter Claude Opus 4.8 comme Claude Fable 5 avec hooks de détection de dérive et boucle d'évaluation.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add rennf93/opus-fable-playbook

    33étoiles GitHubstable
  12. 12
    Dormant

    Compétence d'observabilité IA pour Claude Code permettant de déboguer les agents LangChain/LangGraph en récupérant les traces d'exécution depuis LangSmith Studio.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/OthmanAdi/langsmith-fetch-skill ~/.claude/skills/langsmith-fetch-skill

    27étoiles GitHubstable
  13. 13

    Agent
    Dormant

    githubprogression mesuréeVoir la source ↗

    26étoiles GitHubstable
  14. 14
    Actif

    Une skill de suivi comportemental système pour Claude, basée sur Sentry.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/tortastudios/sentry-instrumentation ~/.claude/skills/sentry-instrumentation

    24étoiles GitHubstable
  15. 15

    Autre
    Actif

    Humaniseur IA open-source gratuit qui réécrit itérativement le texte IA contre les scores de détecteurs en direct tout en préservant le sens, citations et faits.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    18étoiles GitHubstable
  16. 16

    Skill
    Actif

    Outil mesurant les améliorations de prompts et de compétences via comparaison A/B en aveugle.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add shinpr/rashomon

    18étoiles GitHubstable
  17. 17
    Actif

    Deux compétences Claude Code pour relecture de code contradictoire (PAR mono-modèle et MMAR multi-modèles) avec suite d'évaluation basée sur des fixtures.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add prime-radiant-inc/parallel-adversarial-review

    17étoiles GitHubstable
  18. 18
    Actif

    Outil pour faire écrire Claude clairement et de manière accessible.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add stefanobaghino/simple-output-styles

    16étoiles GitHubstable
  19. 19
    Actif

    Place de marché de greffons Claude Code avec ingénierie agentique et audit de dépôts pour préparer l'open source.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add GiustoPiedimonte/agentic-engineering-marketplace

    13étoiles GitHubstable
  20. 20

    Autre
    Dormant

    Compétence Claude Code qui ajoute une couche d'évaluation basée sur une grille à tout projet d'agent, générant une grille, des cas de test, un prompt d'évaluateur et un score pondéré.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    13étoiles GitHubstable
  21. 21
    Actif

    Serveur MCP permettant de consulter l'observabilité LLM de Spanlens depuis Cursor, Claude Desktop ou Continue.

    Reformulée en français

    mcpprogression mesuréeVoir la source ↗

    Installer claude mcp add mcp-server -- npx @spanlens/mcp-server

    12étoiles GitHubstable
  22. 22

    Skill
    Actif

    Compétence Claude Code qui génère plusieurs solutions, crée automatiquement des critères d'évaluation, les juge indépendamment et retourne la meilleure.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add CoriChui/bakeoff

    10étoiles GitHubstable
  23. 23

    Autre
    Actif

    githubprogression mesuréeVoir la source ↗

    10étoiles GitHubstable

Ressources pédagogiques et de référence

Classement par progressions mesurées, normalisées entre sources. Ces ressources restent accessibles séparément et ne participent pas au classement principal des outils.

  1. 1
    ActifVoir la source ↗

    Répertoire organisé et évalué de serveurs MCP et agents pour DevOps, Cloud, SRE et Platform Engineering, classés selon l'accès en production, les contrôles d'approbation et les preuves d'audit.

    Reformulée en françaisgithubRessourceprogression mesurée
    77étoiles GitHubstable
  2. 2
    ActifVoir la source ↗githubRessourceprogression mesurée
    18étoiles GitHubstable