Observabilité LLM : outils pour développeurs

Supervision, traces, évaluation et suivi de la qualité des applications LLM. Une entrée peut apparaître dans plusieurs usages lorsque ses topics ou sa description fournissent plusieurs signaux explicites.

Usage

Activité

Trier par

121 entrées dans cette vue.

Classement des outils

Classement par progressions mesurées, normalisées entre sources. Les valeurs brutes gardent leur fenêtre propre, indiquée sous chaque outil ; une variation exige au moins deux relevés sur les 7 derniers jours.

  1. 1
    Actif

    Compétence Claude Code qui mesure le respect des règles établies d'un agent en analysant son historique de sessions.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add jleonceo/skill-adherencia-reglas

    1étoiles GitHubstable
  2. 2

    Agent
    Actif

    Système multi-agents SRE d'investigation sur appel qui classe automatiquement les alertes d'infrastructure Slack/Discord via AWS Bedrock AgentCore en les distribuant à des agents spécialisés pour investigation parallèle.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    3étoiles GitHubstable
  3. 3
    Actif

    Outil qui évalue le respect des règles par un agent IA en analysant l'historique local de Claude Code et en retournant un pourcentage de conformité par règle, sans installation ni dépendance réseau.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/jleonceo/adherencia-reglas ~/.claude/skills/adherencia-reglas

    1étoiles GitHubstable
  4. 4

    Autre
    Actif

    Framework multi-agent auto-hébergé et open-source avec streaming d'événements, mémoire causale et observabilité.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    0étoiles GitHubstable
  5. 5
    Actif

    githubprogression mesuréeVoir la source ↗

    0étoiles GitHubstable
  6. 6

    Agent
    Actif

    githubprogression mesuréeVoir la source ↗

    1étoiles GitHubstable
  7. 7
    Dormant

    Serveur MCP comportemental servant de juge pour renforcer les assistants IA de codage par évaluations LLM explicites.

    Reformulée en français

    mcpprogression mesuréeVoir la source ↗

    Installer claude mcp add mcp-as-a-judge -- uvx mcp-as-a-judge

    17étoiles GitHubstable
  8. 8

    Skill
    Actif

    Modèle AGENTS.md prêt pour la production avec 51 sections de règles éprouvées pour les agents IA de codage.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/peva3/anchor ~/.claude/skills/anchor

    8étoiles GitHubstable
  9. 9

    Agent
    Actif

    githubprogression mesuréeVoir la source ↗

    1étoiles GitHubstable
  10. 10
    Actif

    Harnais d'évaluation de compétence d'agent pour variantes appariées, artefacts de trace et adaptateurs d'exécution.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/adewale/skill-eval-harness ~/.claude/skills/skill-eval-harness

    73étoiles GitHubstable
  11. 11

    Agent
    Actif

    githubprogression mesuréeVoir la source ↗

    0étoiles GitHubstable
  12. 12

    Autre
    Dormant

    Compétence Claude Code qui ajoute une couche d'évaluation basée sur une grille à tout projet d'agent, générant une grille, des cas de test, un prompt d'évaluateur et un score pondéré.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    13étoiles GitHubstable
  13. 13
    Dormant

    Compagnon multi-agents en santé mentale centré sur la sécurité avec suivi de la détresse en temps réel et garde-fous pour les développeurs et utilisateurs.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    1étoiles GitHubstable
  14. 14
    Actif

    Un SDK Python pour construire une main-d'œuvre multi-agents IA avec évaluation, traçage et observabilité complète.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    68étoiles GitHubstable
  15. 15

    MCP
    Dormant

    githubprogression mesuréeVoir la source ↗

    5étoiles GitHubstable
  16. 16

    Autre
    Dormant

    githubprogression mesuréeVoir la source ↗

    1étoiles GitHubstable
  17. 17
    Actif

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/aleclindz/seo-skill-bench ~/.claude/skills/seo-skill-bench

    51étoiles GitHubstable
  18. 18

    Agent
    Actif

    Orchestrateur d'agents A2A pour évaluer des agents sur le benchmark AppWorld, construit sur le SDK AgentBeats.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    0étoiles GitHubstable
  19. 19
    Actif

    githubprogression mesuréeVoir la source ↗

    1étoiles GitHubstable
  20. 20

    MCP
    Actif

    Plan de contrôle open-source auto-hébergé pour les flottes d'agents OpenClaw et Hermes sur Docker/Kubernetes.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    50étoiles GitHubstable
  21. 21
    Dormant

    Routeur auto-améliorant pour Claude Code.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add SeongwoongCho/adaptive-harness

    8étoiles GitHubstable
  22. 22

    Agent
    Dormant

    Plateforme de remédiation d'infrastructure multi-agent utilisant le protocole A2A avec coordination d'agents, approbation HITL et restauration automatique.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    0étoiles GitHubstable
  23. 23

    Agent
    Dormant

    githubprogression mesuréeVoir la source ↗

    1étoiles GitHubstable
  24. 24

    Skill
    Actif

    Plugin d'agent expert en Marketing Mix Modeling pour Claude Code utilisant pymc-marketing.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add Yakoub-ai/agent-mmm

    4étoiles GitHubstable
  25. 25
    Actif

    Système de validation terminal pour examiner des documents PRD, RFC, stratégies et plans d'expérience.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    1étoiles GitHubstable