Observabilité LLM : outils pour développeurs
Supervision, traces, évaluation et suivi de la qualité des applications LLM. Une entrée peut apparaître dans plusieurs usages lorsque ses topics ou sa description fournissent plusieurs signaux explicites.
Usage
Activité
Trier par
122 entrées dans cette vue.
Classement des outils
Classement mixte : les progressions mesurées priment ; les entrées sans deux relevés sont estimées. Les valeurs brutes gardent leur fenêtre propre, indiquée sous chaque outil ; une variation exige au moins deux relevés sur les 7 derniers jours.
- 1Actif
skill-receipts
SkillSkills pour Claude Code qui incluent des benchmarks d'exactitude validés par rapport à des références.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/sjh9714/skill-receipts ~/.claude/skills/skill-receipts2étoiles GitHubstable - 2Actif
Une skill de suivi comportemental système pour Claude, basée sur Sentry.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/tortastudios/sentry-instrumentation ~/.claude/skills/sentry-instrumentation24étoiles GitHubstable - 3Dormant
CustoFlow
AutreSystème multi-agents de support client utilisant Google ADK et Gemini 2.5 Flash Lite.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
2étoiles GitHubstable - 422étoiles GitHub+2 (+10.0 %)
- 52étoiles GitHubstable
- 6Actif
Plugin Claude Code qui enregistre les sessions vers Opik, plateforme open-source d'observabilité et d'évaluation pour LLM.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
22étoiles GitHub+1 (+4.8 %) - 7Actif
untell
AutreHumaniseur IA open-source gratuit qui réécrit itérativement le texte IA contre les scores de détecteurs en direct tout en préservant le sens, citations et faits.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
18étoiles GitHubstable - 8Dormant
Des conventions sémantiques et de l'instrumentation OpenTelemetry pour la provenance des agents, la traçabilité des dérivations et l'évaluation des critères d'acceptation.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
0étoiles GitHubstable - 9Dormant
Agents-eval
AgentFramework d'évaluation de systèmes multi-agents utilisant PydanticAI pour générer et évaluer des critiques d'articles scientifiques.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
2étoiles GitHubstable - 10Actif
githubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/ma-nucho-pro/supervisor-skill-claude ~/.claude/skills/supervisor-skill-claude2étoiles GitHubstable - 11Actif
rashomon
SkillOutil mesurant les améliorations de prompts et de compétences via comparaison A/B en aveugle.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
Installer
/plugin marketplace add shinpr/rashomon18étoiles GitHubstable - 12Actif
agent-stack
Skillgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/ssheleg/agent-stack ~/.claude/skills/agent-stack2étoiles GitHub+1 (+100.0 %) - 13Dormant
Serveur MCP comportemental servant de juge pour renforcer les assistants IA de codage par évaluations LLM explicites.
Reformulée en françaismcpprogression mesuréeVoir la source ↗
Installer
claude mcp add mcp-as-a-judge -- uvx mcp-as-a-judge17étoiles GitHubstable - 14Actif
sre-on-call
AgentSystème multi-agents SRE d'investigation sur appel qui classe automatiquement les alertes d'infrastructure Slack/Discord via AWS Bedrock AgentCore en les distribuant à des agents spécialisés pour investigation parallèle.
Reformulée en françaisgithubprogression mesuréeVoir la source ↗
3étoiles GitHubstable - 15Actif
deslop-GPT
Skillgithubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/MrZoyo/deslop-GPT ~/.claude/skills/deslop-GPT76étoiles GitHub+48 (+171.4 %) - 16Actif
githubprogression mesuréeVoir la source ↗
Installer
git clone https://github.com/NocodeMrLi/mini-program-engineering-skill-suite ~/.claude/skills/mini-program-engineering-skill-suite43étoiles GitHub+4 (+10.3 %) - 17Actif
githubmomentum estiméVoir la source ↗
Installer
git clone https://github.com/FrancyJGLisboa/agent-skills-platform ~/.claude/skills/agent-skills-platform2 376étoiles GitHub—
Ressources pédagogiques et de référence
Classement par progressions mesurées, normalisées entre sources. Ces ressources restent accessibles séparément et ne participent pas au classement principal des outils.
- 1ActifVoir la source ↗
trigger_tree
SkillOutil de télémétrie pour Claude Code qui analyse la documentation en local et génère des cartes thermiques.
Reformulée en françaisgithubInstaller
Ressourceprogression mesurée/plugin marketplace add Hedde/trigger_tree14étoiles GitHub+1 (+7.7 %) - 21étoiles GitHubstable
- 3ActifVoir la source ↗
Ensemble de plus de 50 outils de traçabilité LLM et 26 compétences pour construire, évaluer, déboguer, sécuriser et surveiller des applications LLM fiables.
Reformulée en françaisgithubInstaller
Ressourceprogression mesuréegit clone https://github.com/ContextJet-ai/awesome-llm-observability ~/.claude/skills/awesome-llm-observability33étoiles GitHub+3 (+10.0 %) - 418étoiles GitHubstable
- 5ActifVoir la source ↗
tunelab
SkillPlugin Claude Code pour l'ajustement fin, la distillation et l'évaluation de modèles de langage.
Reformulée en françaisgithubInstaller
Ressourceprogression mesurée/plugin marketplace add rchaz/tunelab6étoiles GitHubstable