Observabilité LLM : outils pour développeurs
Supervision, traces, évaluation et suivi de la qualité des applications LLM. Une entrée peut apparaître dans plusieurs usages lorsque ses topics ou sa description fournissent plusieurs signaux explicites.
Usage
Activité
Trier par
121 entrées dans cette vue.
Classement des outils
Classement par nombre d’étoiles GitHub connu, du plus élevé au plus faible ; les dépôts archivés viennent après les dépôts maintenus. Les valeurs brutes gardent leur fenêtre propre, indiquée sous chaque outil ; une variation exige au moins deux relevés sur les 7 derniers jours.
- 1Actif
claudestat
SkillTableau de bord de traçage en temps réel et d'intelligence des coûts pour Claude Code.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add DeibyGS/claudestat34étoiles GitHubstable - 2Dormant
Compétence d'observabilité IA pour Claude Code permettant de déboguer les agents LangChain/LangGraph en récupérant les traces d'exécution depuis LangSmith Studio.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/OthmanAdi/langsmith-fetch-skill ~/.claude/skills/langsmith-fetch-skill27étoiles GitHubstable - 326étoiles GitHubstable
- 4Actif
Une skill de suivi comportemental système pour Claude, basée sur Sentry.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/tortastudios/sentry-instrumentation ~/.claude/skills/sentry-instrumentation24étoiles GitHubstable - 5Actif
Plugin Claude Code qui enregistre les sessions vers Opik, plateforme open-source d'observabilité et d'évaluation pour LLM.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
22étoiles GitHubstable - 622étoiles GitHubstable
- 7Actif
untell
AutreHumaniseur IA open-source gratuit qui réécrit itérativement le texte IA contre les scores de détecteurs en direct tout en préservant le sens, citations et faits.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
20étoiles GitHub+2 (+11.1 %) - 8Actif
rashomon
SkillOutil mesurant les améliorations de prompts et de compétences via comparaison A/B en aveugle.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add shinpr/rashomon18étoiles GitHubstable - 9Dormant
Serveur MCP comportemental servant de juge pour renforcer les assistants IA de codage par évaluations LLM explicites.
Reformulée en françaismcpprogression mesuréeVoir la source ↗
Installer
claude mcp add mcp-as-a-judge -- uvx mcp-as-a-judge17étoiles GitHubstable - 10Dormant
Deux compétences Claude Code pour relecture de code contradictoire (PAR mono-modèle et MMAR multi-modèles) avec suite d'évaluation basée sur des fixtures.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add prime-radiant-inc/parallel-adversarial-review17étoiles GitHubstable - 11Actif
simple-output-styles
SkillOutil pour faire écrire Claude clairement et de manière accessible.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add stefanobaghino/simple-output-styles16étoiles GitHubstable - 12Actif
adl-cli
AutreOutil en ligne de commande pour créer et gérer des agents IA prêts pour l'entreprise utilisant le protocole A2A.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
14étoiles GitHubstable - 13Actif
Serveur MCP permettant de consulter l'observabilité LLM de Spanlens depuis Cursor, Claude Desktop ou Continue.
Reformulée en françaismcpprogression mesuréeVoir la source ↗
Installer
claude mcp add mcp-server -- npx @spanlens/mcp-server13étoiles GitHub+1 (+8.3 %) - 14Actif
Place de marché de greffons Claude Code avec ingénierie agentique et audit de dépôts pour préparer l'open source.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add GiustoPiedimonte/agentic-engineering-marketplace13étoiles GitHubstable - 15Dormant
eval-layer
AutreCompétence Claude Code qui ajoute une couche d'évaluation basée sur une grille à tout projet d'agent, générant une grille, des cas de test, un prompt d'évaluateur et un score pondéré.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
13étoiles GitHubstable - 1610étoiles GitHubstable
- 17Actif
ai-dev-stack
SkillFournit des règles de codage IA prêtes pour la production pour Cursor et Claude Code, avec templates et compétences à intégrer dans n'importe quel projet.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/aiagentwithdhruv/ai-dev-stack ~/.claude/skills/ai-dev-stack10étoiles GitHubstable - 18Actif
bakeoff
SkillCompétence Claude Code qui génère plusieurs solutions, crée automatiquement des critères d'évaluation, les juge indépendamment et retourne la meilleure.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add CoriChui/bakeoff10étoiles GitHubstable - 19Actif
skill-graveyard
SkillOutil d'audit qui identifie les compétences Claude Code réellement utilisées et détecte les installations mortes dans vos journaux de session.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add sfrangulov/skill-graveyard10étoiles GitHubstable - 20Dormant
agent-inspector
SkillOutil local open-source pour déboguer, sécuriser et évaluer les agents LLM via analyse statique, vérifications dynamiques et monitoring en temps réel.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add cylestio/agent-inspector9étoiles GitHubstable - 21Dormant
adaptive-harness
SkillRouteur auto-améliorant pour Claude Code.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add SeongwoongCho/adaptive-harness8étoiles GitHubstable - 22Actif
anchor
SkillModèle AGENTS.md prêt pour la production avec 51 sections de règles éprouvées pour les agents IA de codage.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/peva3/anchor ~/.claude/skills/anchor8étoiles GitHubstable
Ressources pédagogiques et de référence
Classement par nombre d’étoiles GitHub connu, du plus élevé au plus faible ; les dépôts archivés viennent après les dépôts maintenus. Ces ressources restent accessibles séparément et ne participent pas au classement principal des outils.
- 1ActifVoir la source ↗
Ensemble de plus de 50 outils de traçabilité LLM et 26 compétences pour construire, évaluer, déboguer, sécuriser et surveiller des applications LLM fiables.
Reformulée en françaisgithubInstaller
Ressourceprogression mesuréegit clone https://github.com/ContextJet-ai/awesome-llm-observability ~/.claude/skills/awesome-llm-observability33étoiles GitHub+1 (+3.1 %) - 218étoiles GitHubstable
- 3ActifVoir la source ↗
trigger_tree
SkillOutil de télémétrie pour Claude Code qui analyse la documentation en local et génère des cartes thermiques.
Reformulée en françaisgithubInstaller
Ressourceprogression mesurée/plugin marketplace add Hedde/trigger_tree14étoiles GitHubstable