Observabilité LLM : outils pour développeurs

Supervision, traces, évaluation et suivi de la qualité des applications LLM. Une entrée peut apparaître dans plusieurs usages lorsque ses topics ou sa description fournissent plusieurs signaux explicites.

Usage

Activité

Trier par

122 entrées dans cette vue.

Classement des outils

Classement par progressions mesurées, normalisées entre sources. Les valeurs brutes gardent leur fenêtre propre, indiquée sous chaque outil ; une variation exige au moins deux relevés sur les 7 derniers jours.

  1. 1
    Actif

    Plugin Claude Code qui enregistre les sessions vers Opik, plateforme open-source d'observabilité et d'évaluation pour LLM.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    22étoiles GitHub+1 (+4.8 %)
  2. 2
    Actif

    Outil de surveillance et gouvernance pour modèles de langage locaux Ollama avec vérification des requêtes.

    Reformulée en français

    mcpprogression mesuréeVoir la source ↗

    Installer claude mcp add ai-guardian -- uvx ai-guardian-aiops

    0étoiles GitHubstable
  3. 3

    Autre
    Actif

    Humaniseur IA open-source gratuit qui réécrit itérativement le texte IA contre les scores de détecteurs en direct tout en préservant le sens, citations et faits.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    18étoiles GitHubstable
  4. 4

    Skill
    Actif

    Outil mesurant les améliorations de prompts et de compétences via comparaison A/B en aveugle.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add shinpr/rashomon

    18étoiles GitHubstable
  5. 5

    Skill
    Actif

    Framework d'évaluation unifié pour les agents IA et les modèles de récompense.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/agentscope-ai/OpenJudge ~/.claude/skills/OpenJudge

    809étoiles GitHub+6 (+0.75 %)
  6. 6
    Dormant

    githubprogression mesuréeVoir la source ↗

    0étoiles GitHubstable
  7. 7
    Actif

    Deux compétences Claude Code pour relecture de code contradictoire (PAR mono-modèle et MMAR multi-modèles) avec suite d'évaluation basée sur des fixtures.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add prime-radiant-inc/parallel-adversarial-review

    17étoiles GitHubstable
  8. 8
    Dormant

    Serveur MCP comportemental servant de juge pour renforcer les assistants IA de codage par évaluations LLM explicites.

    Reformulée en français

    mcpprogression mesuréeVoir la source ↗

    Installer claude mcp add mcp-as-a-judge -- uvx mcp-as-a-judge

    17étoiles GitHubstable
  9. 9
    Actif

    Outil pour faire écrire Claude clairement et de manière accessible.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add stefanobaghino/simple-output-styles

    16étoiles GitHubstable
  10. 10

    Agent
    Dormant

    Plateforme de remédiation d'infrastructure multi-agent utilisant le protocole A2A avec coordination d'agents, approbation HITL et restauration automatique.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    0étoiles GitHubstable
  11. 11

    Autre
    Actif

    Outil en ligne de commande pour créer et gérer des agents IA prêts pour l'entreprise utilisant le protocole A2A.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    14étoiles GitHub+1 (+7.7 %)
  12. 12
    Actif

    Test runner pour les skills d'agents IA au style agentskills.io.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/darkrishabh/agent-skills-eval ~/.claude/skills/agent-skills-eval

    719étoiles GitHub+13 (+1.8 %)
  13. 13
    Actif

    Place de marché de greffons Claude Code avec ingénierie agentique et audit de dépôts pour préparer l'open source.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add GiustoPiedimonte/agentic-engineering-marketplace

    13étoiles GitHubstable
  14. 14

    Skill
    Actif

    Indicateur de statut pour Claude Code et Codex en terminal avec états visuels et gestion d'utilisation Anthropic sur macOS.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/wasulajr/headsup ~/.claude/skills/headsup

    1étoiles GitHubstable
  15. 15

    Autre
    Dormant

    Compétence Claude Code qui ajoute une couche d'évaluation basée sur une grille à tout projet d'agent, générant une grille, des cas de test, un prompt d'évaluateur et un score pondéré.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    13étoiles GitHubstable
  16. 16

    Agent
    Actif

    githubprogression mesuréeVoir la source ↗

    0étoiles GitHubstable
  17. 17

    Skill
    Actif

    Fournit des règles de codage IA prêtes pour la production pour Cursor et Claude Code, avec templates et compétences à intégrer dans n'importe quel projet.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/aiagentwithdhruv/ai-dev-stack ~/.claude/skills/ai-dev-stack

    10étoiles GitHub+1 (+11.1 %)
  18. 18

    Skill
    Actif

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/EverMind-AI/SkillCorpus ~/.claude/skills/SkillCorpus

    424étoiles GitHub+170 (+66.9 %)
  19. 19
    Actif

    Système de validation terminal pour examiner des documents PRD, RFC, stratégies et plans d'expérience.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    1étoiles GitHubstable
  20. 20
    Actif

    Outil d'audit qui identifie les compétences Claude Code réellement utilisées et détecte les installations mortes dans vos journaux de session.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add sfrangulov/skill-graveyard

    10étoiles GitHub+1 (+11.1 %)
  21. 21

    Skill
    Actif

    Compétence Claude Code qui génère plusieurs solutions, crée automatiquement des critères d'évaluation, les juge indépendamment et retourne la meilleure.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add CoriChui/bakeoff

    10étoiles GitHubstable
  22. 22

    Autre
    Actif

    githubprogression mesuréeVoir la source ↗

    10étoiles GitHubstable
  23. 23

    Autre
    Dormant

    githubprogression mesuréeVoir la source ↗

    1étoiles GitHubstable
  24. 24
    Dormant

    Outil local open-source pour déboguer, sécuriser et évaluer les agents LLM via analyse statique, vérifications dynamiques et monitoring en temps réel.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer /plugin marketplace add cylestio/agent-inspector

    9étoiles GitHubstable
  25. 25

    Skill
    Actif

    Modèle AGENTS.md prêt pour la production avec 51 sections de règles éprouvées pour les agents IA de codage.

    Reformulée en français

    githubprogression mesuréeVoir la source ↗

    Installer git clone https://github.com/peva3/anchor ~/.claude/skills/anchor

    8étoiles GitHubstable