Observabilité LLM : outils pour développeurs
Supervision, traces, évaluation et suivi de la qualité des applications LLM. Une entrée peut apparaître dans plusieurs usages lorsque ses topics ou sa description fournissent plusieurs signaux explicites.
Usage
Activité
Trier par
123 entrées dans cette vue.
Classement des outils
Classement par date de création, des plus récentes aux plus anciennes ; les entrées sans date viennent en dernier. Les valeurs brutes gardent leur fenêtre propre, indiquée sous chaque outil ; une variation exige au moins deux relevés sur les 7 derniers jours.
- 1Actif
Scaffolding Python d'architecture d'un bureau de crédit multi-agent auditable utilisant A2A, MCP, des politiques de crédit déterministes et l'observabilité.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
0étoiles GitHubstable - 2Actif
AI Guardian
MCPOutil de surveillance et gouvernance pour modèles de langage locaux Ollama avec vérification des requêtes.
Reformulée en françaismcpprogression mesuréeVoir la source ↗
Installer
claude mcp add ai-guardian -- uvx ai-guardian-aiops0étoiles GitHubstable - 3Actif
Flawless
AutrePlateforme d'AgenticOps IA pour Kubernetes et l'infrastructure cloud.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
782étoiles GitHub+1 (+0.13 %) - 4Actif
homestream
AutreFramework multi-agent auto-hébergé et open-source avec streaming d'événements, mémoire causale et observabilité.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
0étoiles GitHubstable - 5Actif
bakeoff
SkillCompétence Claude Code qui génère plusieurs solutions, crée automatiquement des critères d'évaluation, les juge indépendamment et retourne la meilleure.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add CoriChui/bakeoff10étoiles GitHubstable - 6Actif
fable-method
SkillEnsemble de compétences distillant le workflow Fable 5 de Claude, exécutables par n'importe quel modèle, avec évaluation intégrée.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/Sahir619/fable-method ~/.claude/skills/fable-method2 273étoiles GitHub+11 (+0.49 %) - 7Actif
rocketplaneIO
AutreSRE IA auto-hébergé pour Kubernetes avec observabilité eBPF sans instrumentation et un copilote qui corrige les incidents.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
131étoiles GitHub-4 (-3.0 %) - 8Actif
seo-skill-bench
Skillgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/aleclindz/seo-skill-bench ~/.claude/skills/seo-skill-bench51étoiles GitHub-5 (-8.9 %) - 9Actif
opus-fable-playbook
SkillPlugin Claude Code qui fait se comporter Claude Opus 4.8 comme Claude Fable 5 avec hooks de détection de dérive et boucle d'évaluation.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add rennf93/opus-fable-playbook34étoiles GitHub+1 (+3.0 %) - 10Actif
Place de marché de greffons Claude Code avec ingénierie agentique et audit de dépôts pour préparer l'open source.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add GiustoPiedimonte/agentic-engineering-marketplace13étoiles GitHubstable - 11Actif
untell
AutreHumaniseur IA open-source gratuit qui réécrit itérativement le texte IA contre les scores de détecteurs en direct tout en préservant le sens, citations et faits.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
18étoiles GitHubstable - 12Actif
SkillEvaluator
Skillgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/NVIDIA/SkillEvaluator ~/.claude/skills/SkillEvaluator399étoiles GitHub+51 (+14.7 %) - 131étoiles GitHubstable
- 14Actif
databuff
AgentAPM orienté IA utilisant OpenTelemetry pour analyser les traces, métriques et topologies de services afin d'identifier les causes racines.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
649étoiles GitHub+39 (+6.4 %) - 151étoiles GitHubstable
- 16Actif
shokunin-review
AutreSystème de validation terminal pour examiner des documents PRD, RFC, stratégies et plans d'expérience.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
1étoiles GitHubstable - 17Actif
cap-evolve
MCPOptimise les compétences, outils/MCP et invites d'un agent IA en fonction d'évaluations personnalisées.
Reformulée en françaisgithubmomentum estiméVoir la source ↗
47étoiles GitHub— - 181étoiles GitHubstable
- 19Actif
skill-eval-harness
SkillHarnais d'évaluation de compétence d'agent pour variantes appariées, artefacts de trace et adaptateurs d'exécution.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/adewale/skill-eval-harness ~/.claude/skills/skill-eval-harness73étoiles GitHub+4 (+5.8 %) - 201étoiles GitHubstable
- 21Actif
axiom
SkillUne marketplace organisée de plugins pour Claude Code.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/netopsengineer/axiom ~/.claude/skills/axiom5étoiles GitHubstable - 221étoiles GitHubstable
Ressources pédagogiques et de référence
Classement par date de création, des plus récentes aux plus anciennes ; les entrées sans date viennent en dernier. Ces ressources restent accessibles séparément et ne participent pas au classement principal des outils.
- 1ActifVoir la source ↗
Ensemble de plus de 50 outils de traçabilité LLM et 26 compétences pour construire, évaluer, déboguer, sécuriser et surveiller des applications LLM fiables.
Reformulée en françaisgithubInstaller
Ressourceprogression mesuréegit clone https://github.com/ContextJet-ai/awesome-llm-observability ~/.claude/skills/awesome-llm-observability33étoiles GitHub+3 (+10.0 %) - 2ActifVoir la source ↗
Répertoire organisé et évalué de serveurs MCP et agents pour DevOps, Cloud, SRE et Platform Engineering, classés selon l'accès en production, les contrôles d'approbation et les preuves d'audit.
Reformulée en françaisgithubRessourceprogression mesurée77étoiles GitHubstable - 3ActifVoir la source ↗
tunelab
SkillPlugin Claude Code pour l'ajustement fin, la distillation et l'évaluation de modèles de langage.
Reformulée en françaisgithubInstaller
Ressourceprogression mesurée/plugin marketplace add rchaz/tunelab6étoiles GitHubstable