Observabilité LLM : outils pour développeurs
Supervision, traces, évaluation et suivi de la qualité des applications LLM. Une entrée peut apparaître dans plusieurs usages lorsque ses topics ou sa description fournissent plusieurs signaux explicites.
Usage
Activité
Trier par
123 entrées dans cette vue.
Classement des outils
Classement par progressions mesurées, normalisées entre sources. Les valeurs brutes gardent leur fenêtre propre, indiquée sous chaque outil ; une variation exige au moins deux relevés sur les 7 derniers jours.
- 11étoiles GitHubstable
- 2Actif
adl-cli
AutreOutil en ligne de commande pour créer et gérer des agents IA prêts pour l'entreprise utilisant le protocole A2A.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
14étoiles GitHub+1 (+7.7 %) - 3Actif
Compétence Claude Code qui mesure le respect des règles établies d'un agent en analysant son historique de sessions.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add jleonceo/skill-adherencia-reglas1étoiles GitHubstable - 4Actif
ai-dev-stack
SkillFournit des règles de codage IA prêtes pour la production pour Cursor et Claude Code, avec templates et compétences à intégrer dans n'importe quel projet.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/aiagentwithdhruv/ai-dev-stack ~/.claude/skills/ai-dev-stack10étoiles GitHub+1 (+11.1 %) - 5Actif
Plugin Claude Code qui enregistre les sessions vers Opik, plateforme open-source d'observabilité et d'évaluation pour LLM.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
22étoiles GitHub+1 (+4.8 %) - 6Dormant
agentops
AgentPlateforme de remédiation d'infrastructure multi-agent utilisant le protocole A2A avec coordination d'agents, approbation HITL et restauration automatique.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
0étoiles GitHubstable - 71étoiles GitHubstable
- 80étoiles GitHubstable
- 91étoiles GitHubstable
- 10Dormant
Compagnon multi-agents en santé mentale centré sur la sécurité avec suivi de la détresse en temps réel et garde-fous pour les développeurs et utilisateurs.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
1étoiles GitHubstable - 110étoiles GitHubstable
- 120étoiles GitHubstable
- 13Actif
a2a-otel-kit
MCPTracing OpenTelemetry vendor-neutral pour agents A2A et services MCP avec propagation W3C et télémétrie respectueuse de la vie privée.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
1étoiles GitHubstable - 14Actif
Serveur MCP permettant de consulter l'observabilité LLM de Spanlens depuis Cursor, Claude Desktop ou Continue.
Reformulée en françaismcpprogression mesuréeVoir la source ↗
Installer
claude mcp add mcp-server -- npx @spanlens/mcp-server12étoiles GitHubstable - 15Actif
headsup
SkillIndicateur de statut pour Claude Code et Codex en terminal avec états visuels et gestion d'utilisation Anthropic sur macOS.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/wasulajr/headsup ~/.claude/skills/headsup1étoiles GitHubstable - 16Actif
skill-receipts
SkillSkills pour Claude Code qui incluent des benchmarks d'exactitude validés par rapport à des références.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/sjh9714/skill-receipts ~/.claude/skills/skill-receipts2étoiles GitHubstable - 17Actif
agent-stack
Skillgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/ssheleg/agent-stack ~/.claude/skills/agent-stack2étoiles GitHub+1 (+100.0 %) - 18Actif
simple-output-styles
SkillOutil pour faire écrire Claude clairement et de manière accessible.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add stefanobaghino/simple-output-styles16étoiles GitHubstable - 19Actif
CustoFlow
AutreSystème multi-agents de support client utilisant Google ADK et Gemini 2.5 Flash Lite.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
2étoiles GitHubstable - 20Actif
shokunin-review
AutreSystème de validation terminal pour examiner des documents PRD, RFC, stratégies et plans d'expérience.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
1étoiles GitHubstable - 21Dormant
eval-layer
AutreCompétence Claude Code qui ajoute une couche d'évaluation basée sur une grille à tout projet d'agent, générant une grille, des cas de test, un prompt d'évaluateur et un score pondéré.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
13étoiles GitHubstable - 22Dormant
Agents-eval
AgentFramework d'évaluation de systèmes multi-agents utilisant PydanticAI pour générer et évaluer des critiques d'articles scientifiques.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
2étoiles GitHubstable - 23Actif
Deux compétences Claude Code pour relecture de code contradictoire (PAR mono-modèle et MMAR multi-modèles) avec suite d'évaluation basée sur des fixtures.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add prime-radiant-inc/parallel-adversarial-review17étoiles GitHubstable - 24Actif
githubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/ma-nucho-pro/supervisor-skill-claude ~/.claude/skills/supervisor-skill-claude2étoiles GitHubstable - 25Actif
untell
AutreHumaniseur IA open-source gratuit qui réécrit itérativement le texte IA contre les scores de détecteurs en direct tout en préservant le sens, citations et faits.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
18étoiles GitHub+1 (+5.9 %)