Observabilité LLM : outils pour développeurs

Supervision, traces, évaluation et suivi de la qualité des applications LLM. Une entrée peut apparaître dans plusieurs usages lorsque ses topics ou sa description fournissent plusieurs signaux explicites.

Usage

Activité

Trier par

123 entrées dans cette vue.

Classement des outils

Classement par progressions mesurées, normalisées entre sources. Les valeurs brutes gardent leur fenêtre propre, indiquée sous chaque outil ; une variation exige au moins deux relevés sur les 7 derniers jours.

  1. 1
    Actif

    Serveur MCP pour l'observabilité LLM Langfuse, analysant traces et observations.

    Reformulée en français

    mcpprogression mesuréeVoir la source ↗

    Installer claude mcp add langfuse -- npx langfuse-observability-mcp-server

    78étoiles GitHub+1 (+1.3 %)
  2. 2
    Actif

    Framework pour agents qui s'améliorent par itération successive, avec gestion de mémoire et contexte.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    105étoiles GitHub+1 (+0.96 %)
  3. 3

    Autre
    Actif

    Plateforme d'AgenticOps IA pour Kubernetes et l'infrastructure cloud.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    782étoiles GitHub+1 (+0.13 %)
  4. 4
    Actif

    Un runtime open-source qui déploie les agents LangGraph ou Google ADK en service FastAPI prêt pour la production, avec interface utilisateur, guardrails, MCP et observabilité.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/Idun-Group/idun-agent-platform ~/.claude/skills/idun-agent-platform

    198étoiles GitHubstable
  5. 5
    Actif

    Compétences d'agent pour automatiser le cycle de vie du développement logiciel au sein d'équipes d'ingénierie.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/tikalk/adlc-team-skills ~/.claude/skills/adlc-team-skills

    131étoiles GitHubstable
  6. 6
    Actif

    SRE IA auto-hébergé pour Kubernetes avec observabilité eBPF sans instrumentation et un copilote qui corrige les incidents.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    130étoiles GitHub-11 (-7.8 %)
  7. 7
    Actif

    Collection de 71 compétences open-source pour Claude Code et Codex couvrant l'orchestration, la revue de code, les évaluations et le shipping d'applications.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    129étoiles GitHub-10 (-7.2 %)
  8. 8
    Actif

    Serveur Model Context Protocol pour agents IA permettant d'interroger les données de traçage Langfuse.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    105étoiles GitHubstable
  9. 9

    Skill
    Dormant

    Couche d'audit de réclamations LLM rendant chaque affirmation factuelle vérifiable, avec gradients de vérité T1-T7.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/lc198707/anti-lie ~/.claude/skills/anti-lie

    89étoiles GitHubstable
  10. 10
    Actif

    Un SDK Python pour construire une main-d'œuvre multi-agents IA avec évaluation, traçage et observabilité complète.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    68étoiles GitHubstable
  11. 11
    Actif

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/aleclindz/seo-skill-bench ~/.claude/skills/seo-skill-bench

    50étoiles GitHub-6 (-10.7 %)
  12. 12

    Skill
    Actif

    Compétences d'agent pour gérer des ensembles de données, des expériences et des traces dans Arize via la CLI ax.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/Arize-ai/arize-skills ~/.claude/skills/arize-skills

    47étoiles GitHubstable
  13. 13
    Dormant

    Compétence pour valider les affirmations de recherche par des plans de preuve, vérifications adversariales et registres de justification.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/tonyblu331/research-proof ~/.claude/skills/research-proof

    45étoiles GitHubstable
  14. 14
    Dormant

    Compétence d'observabilité IA pour Claude Code permettant de déboguer les agents LangChain/LangGraph en récupérant les traces d'exécution depuis LangSmith Studio.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/OthmanAdi/langsmith-fetch-skill ~/.claude/skills/langsmith-fetch-skill

    27étoiles GitHubstable
  15. 15

    Agent
    Dormant

    githubprogression mesuréeVoir la source ↗

    26étoiles GitHubstable
  16. 16
    Actif

    Une skill de suivi comportemental système pour Claude, basée sur Sentry.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/tortastudios/sentry-instrumentation ~/.claude/skills/sentry-instrumentation

    24étoiles GitHubstable
  17. 17
    Actif

    Plugin Claude Code qui enregistre les sessions vers Opik, plateforme open-source d'observabilité et d'évaluation pour LLM.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    21étoiles GitHubstable
  18. 18

    Skill
    Actif

    Outil mesurant les améliorations de prompts et de compétences via comparaison A/B en aveugle.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add shinpr/rashomon

    18étoiles GitHubstable
  19. 19
    Dormant

    Serveur MCP comportemental servant de juge pour renforcer les assistants IA de codage par évaluations LLM explicites.

    Reformulée en français

    mcpprogression mesuréeVoir la source ↗

    Installer claude mcp add mcp-as-a-judge -- uvx mcp-as-a-judge

    17étoiles GitHubstable
  20. 20
    Actif

    Deux compétences Claude Code pour relecture de code contradictoire (PAR mono-modèle et MMAR multi-modèles) avec suite d'évaluation basée sur des fixtures.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add prime-radiant-inc/parallel-adversarial-review

    17étoiles GitHubstable
  21. 21
    Actif

    Outil pour faire écrire Claude clairement et de manière accessible.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add stefanobaghino/simple-output-styles

    16étoiles GitHubstable
  22. 22
    Actif

    Place de marché de greffons Claude Code avec ingénierie agentique et audit de dépôts pour préparer l'open source.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add GiustoPiedimonte/agentic-engineering-marketplace

    13étoiles GitHubstable
  23. 23

    Autre
    Actif

    Outil en ligne de commande pour créer et gérer des agents IA prêts pour l'entreprise utilisant le protocole A2A.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    13étoiles GitHubstable

Ressources pédagogiques et de référence

Classement par progressions mesurées, normalisées entre sources. Ces ressources restent accessibles séparément et ne participent pas au classement principal des outils.

  1. 1
    ActifVoir la source ↗

    Répertoire organisé et évalué de serveurs MCP et agents pour DevOps, Cloud, SRE et Platform Engineering, classés selon l'accès en production, les contrôles d'approbation et les preuves d'audit.

    Reformulée en françaisgithubRessourceprogression mesurée
    77étoiles GitHub+1 (+1.3 %)
  2. 2
    ActifVoir la source ↗githubRessourceprogression mesurée
    18étoiles GitHubstable