Observabilité LLM : outils pour développeurs
Supervision, traces, évaluation et suivi de la qualité des applications LLM. Une entrée peut apparaître dans plusieurs usages lorsque ses topics ou sa description fournissent plusieurs signaux explicites.
Usage
Activité
Trier par
117 entrées dans cette vue.
Classement des outils
Classement par progressions mesurées, normalisées entre sources. Les valeurs brutes gardent leur fenêtre propre, indiquée sous chaque outil ; une variation exige au moins deux relevés sur les 7 derniers jours.
- 1Actif
aura
MCPUne plateforme d'agent SRE prête pour la production qui gère les garde-fous, APIs, gestion d'état et gestion des défaillances pour déployer l'IA de manière sûre sur l'infrastructure de production.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
254étoiles GitHub-3 (-1.2 %) - 2Actif
idun-agent-platform
SkillUn runtime open-source qui déploie les agents LangGraph ou Google ADK en service FastAPI prêt pour la production, avec interface utilisateur, guardrails, MCP et observabilité.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/Idun-Group/idun-agent-platform ~/.claude/skills/idun-agent-platform198étoiles GitHub-1 (-0.50 %) - 3Actif
rocketplaneIO
AutreSRE IA auto-hébergé pour Kubernetes avec observabilité eBPF sans instrumentation et un copilote qui corrige les incidents.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
131étoiles GitHub-4 (-3.0 %) - 4Actif
Collection de 71 compétences open-source pour Claude Code et Codex couvrant l'orchestration, la revue de code, les évaluations et le shipping d'applications.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
129étoiles GitHub-4 (-3.0 %) - 5Actif
langfuse-mcp
MCPServeur Model Context Protocol pour agents IA permettant d'interroger les données de traçage Langfuse.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
105étoiles GitHubstable - 6Dormant
anti-lie
SkillCouche d'audit de réclamations LLM rendant chaque affirmation factuelle vérifiable, avec gradients de vérité T1-T7.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/lc198707/anti-lie ~/.claude/skills/anti-lie89étoiles GitHubstable - 7Actif
Serveur MCP pour l'observabilité LLM Langfuse, analysant traces et observations.
Reformulée en françaismcpprogression mesuréeVoir la source ↗
Installer
claude mcp add langfuse -- npx langfuse-observability-mcp-server78étoiles GitHubstable - 8Actif
AgentX-Python
AutreUn SDK Python pour construire une main-d'œuvre multi-agents IA avec évaluation, traçage et observabilité complète.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
68étoiles GitHubstable - 9Actif
seo-skill-bench
Skillgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/aleclindz/seo-skill-bench ~/.claude/skills/seo-skill-bench51étoiles GitHub-5 (-8.9 %) - 10Actif
arize-skills
SkillCompétences d'agent pour gérer des ensembles de données, des expériences et des traces dans Arize via la CLI ax.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/Arize-ai/arize-skills ~/.claude/skills/arize-skills47étoiles GitHubstable - 11Actif
opus-fable-playbook
SkillPlugin Claude Code qui fait se comporter Claude Opus 4.8 comme Claude Fable 5 avec hooks de détection de dérive et boucle d'évaluation.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add rennf93/opus-fable-playbook33étoiles GitHubstable - 12Dormant
Compétence d'observabilité IA pour Claude Code permettant de déboguer les agents LangChain/LangGraph en récupérant les traces d'exécution depuis LangSmith Studio.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/OthmanAdi/langsmith-fetch-skill ~/.claude/skills/langsmith-fetch-skill27étoiles GitHubstable - 1326étoiles GitHubstable
- 14Actif
Une skill de suivi comportemental système pour Claude, basée sur Sentry.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/tortastudios/sentry-instrumentation ~/.claude/skills/sentry-instrumentation24étoiles GitHubstable - 15Actif
untell
AutreHumaniseur IA open-source gratuit qui réécrit itérativement le texte IA contre les scores de détecteurs en direct tout en préservant le sens, citations et faits.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
18étoiles GitHubstable - 16Actif
rashomon
SkillOutil mesurant les améliorations de prompts et de compétences via comparaison A/B en aveugle.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add shinpr/rashomon18étoiles GitHubstable - 17Actif
Deux compétences Claude Code pour relecture de code contradictoire (PAR mono-modèle et MMAR multi-modèles) avec suite d'évaluation basée sur des fixtures.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add prime-radiant-inc/parallel-adversarial-review17étoiles GitHubstable - 18Actif
simple-output-styles
SkillOutil pour faire écrire Claude clairement et de manière accessible.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add stefanobaghino/simple-output-styles16étoiles GitHubstable - 19Actif
Place de marché de greffons Claude Code avec ingénierie agentique et audit de dépôts pour préparer l'open source.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add GiustoPiedimonte/agentic-engineering-marketplace13étoiles GitHubstable - 20Dormant
eval-layer
AutreCompétence Claude Code qui ajoute une couche d'évaluation basée sur une grille à tout projet d'agent, générant une grille, des cas de test, un prompt d'évaluateur et un score pondéré.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
13étoiles GitHubstable - 21Actif
Serveur MCP permettant de consulter l'observabilité LLM de Spanlens depuis Cursor, Claude Desktop ou Continue.
Reformulée en françaismcpprogression mesuréeVoir la source ↗
Installer
claude mcp add mcp-server -- npx @spanlens/mcp-server12étoiles GitHubstable - 22Actif
bakeoff
SkillCompétence Claude Code qui génère plusieurs solutions, crée automatiquement des critères d'évaluation, les juge indépendamment et retourne la meilleure.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add CoriChui/bakeoff10étoiles GitHubstable - 2310étoiles GitHubstable
Ressources pédagogiques et de référence
Classement par progressions mesurées, normalisées entre sources. Ces ressources restent accessibles séparément et ne participent pas au classement principal des outils.
- 1ActifVoir la source ↗
Répertoire organisé et évalué de serveurs MCP et agents pour DevOps, Cloud, SRE et Platform Engineering, classés selon l'accès en production, les contrôles d'approbation et les preuves d'audit.
Reformulée en françaisgithubRessourceprogression mesurée77étoiles GitHubstable - 218étoiles GitHubstable