Die Werkzeugbeschreibungen sind auf Englisch.

LLM-Beobachtbarkeit

Monitoring, Traces, Bewertung und Qualität von LLM-Anwendungen.

Anwendungsfall

Aktivität

Sortieren nach

112

Werkzeug-Rangliste

Nach gemessenem Wachstum und quellenübergreifend normalisiert sortiert. Rohwerte behalten ihr eigenes Zeitfenster; eine Änderung erfordert mindestens zwei Messungen in 7 Tagen.

  1. 1

    Skill
    Aktiv

    Open-source infrastructure that turns scattered SKILL.md files into curated, retrieval-ready agent-skill corpora—with retrieval and evaluation tooling included.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/EverMind-AI/SkillCorpus ~/.claude/skills/SkillCorpus

    424GitHub-Sterne+204 (+92.7 %)
  2. 2
    Aktiv

    Multi-tier framework for evaluating AI agent skills with quality gates, semantic overlap detection, synthetic evaluation dataset generation, and live agent evaluation that measures how skills affect agent behavior.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/NVIDIA/SkillEvaluator ~/.claude/skills/SkillEvaluator

    389GitHub-Sterne+63 (+19.3 %)
  3. 3

    Skill
    Aktiv

    Research-backed, eval-driven skills for AI agents

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/ZSeven-W/craft-skills ~/.claude/skills/craft-skills

    142GitHub-Sterne+21 (+17.4 %)
  4. 4

    Agent
    Aktiv

    The Operating System for Scalable Enterprise AI Agents - Run, orchestrate, and deploy Compliant Enterprise AI Agents at scale across frameworks, without lock-in, rewrites or fragile glue code. Native support for MCP, A2A. Interface with all…

    githubgemessenes WachstumQuelle öffnen ↗

    156GitHub-Sterne+22 (+16.4 %)
  5. 5
    Aktiv

    Agent Skill evaluation harness for paired variants, trace artifacts, and runner adapters

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/adewale/skill-eval-harness ~/.claude/skills/skill-eval-harness

    73GitHub-Sterne+4 (+5.8 %)
  6. 6
    Aktiv

    Skills, prompts, and instructions for building AI agents on top of Dynatrace production context

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/Dynatrace/dynatrace-for-ai ~/.claude/skills/dynatrace-for-ai

    132GitHub-Sterne+6 (+4.8 %)
  7. 7
    Aktiv

    Vendor-neutral OpenTelemetry skills for AI coding agents, grounded in upstream sources

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/ollygarden/opentelemetry-agent-skills ~/.claude/skills/opentelemetry-agent-skills

    97GitHub-Sterne+4 (+4.3 %)
  8. 8

    Agent
    Aktiv

    DataBuff is an AI-native APM built on Opentelemetry,with multi-agent troubleshooting out of the box.

    githubgemessenes WachstumQuelle öffnen ↗

    634GitHub-Sterne+26 (+4.3 %)
  9. 9
    Aktiv

    YAO = Yielding AI Outcomes. A rigorous engineering, evaluation, governance, and portability system for reusable agent skills.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/yaojingang/yao-meta-skill ~/.claude/skills/yao-meta-skill

    2 577GitHub-Sterne+54 (+2.1 %)
  10. 10
    Aktiv

    A test runner for agentskills.io-style AI agent skills

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/darkrishabh/agent-skills-eval ~/.claude/skills/agent-skills-eval

    719GitHub-Sterne+15 (+2.1 %)
  11. 11
    Aktiv

    A Go framework for building production agent systems with graph workflows, tools, memory, A2A, AG-UI, MCP, evaluation, and observability.

    githubgemessenes WachstumQuelle öffnen ↗

    1 759GitHub-Sterne+24 (+1.4 %)
  12. 12

    Skill
    Aktiv

    local-first analytics for AI agent skills

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/crafter-station/skill-kit ~/.claude/skills/skill-kit

    77GitHub-Sterne+1 (+1.3 %)
  13. 13
    Aktiv

    Build tested agent skills and govern their lifecycle through a user-defined marketplace: evidence, discovery, updates, rollback, quarantine, and 17-platform distribution.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/FrancyJGLisboa/agent-skill-creator ~/.claude/skills/agent-skill-creator

    2 367GitHub-Sterne+30 (+1.3 %)
  14. 14
    Aktiv

    🪢 Langfuse documentation -- Langfuse is the open source LLM Engineering Platform. Observability, evals, prompt management, playground and metrics to debug and improve LLM apps

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/langfuse/langfuse-docs ~/.claude/skills/langfuse-docs

    239GitHub-Sterne+3 (+1.3 %)
  15. 15

    Skill
    Aktiv

    OpenJudge: A Unified Framework for Holistic Evaluation and Quality Rewards

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/agentscope-ai/OpenJudge ~/.claude/skills/OpenJudge

    809GitHub-Sterne+10 (+1.3 %)
  16. 16
    Aktiv

    Self improving agents through iterations

    githubgemessenes WachstumQuelle öffnen ↗

    105GitHub-Sterne+1 (+0.96 %)
  17. 17
    Aktiv

    Dashboard for monitoring claude code sessions.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren /plugin marketplace add JayantDevkar/claude-code-karma

    323GitHub-Sterne+3 (+0.94 %)
  18. 18

    Skill
    Aktiv

    The Fable Workflow: how Claude Fable 5 worked, distilled into skills any model can run, with the eval that keeps it honest. Think / act / prove.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/Sahir619/fable-method ~/.claude/skills/fable-method

    2 272GitHub-Sterne+19 (+0.84 %)
  19. 19
    Aktiv

    🐙 ADLC Team Skills — Agentic SDLC for Engineering Teams

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/tikalk/adlc-team-skills ~/.claude/skills/adlc-team-skills

    132GitHub-Sterne+1 (+0.76 %)
  20. 20

    Sonstige
    Aktiv

    Mastra is the modern TypeScript framework for AI-powered applications and agents.

    githubgemessenes WachstumQuelle öffnen ↗

    27 624GitHub-Sterne+121 (+0.44 %)
  21. 21

    Skill
    Aktiv

    A skill creator that proves its skills work. Evidence-driven skill creation for Claude Code and Codex: baseline-tested generation, per-skill regression evals, ecosystem doctor, cross-runtime compile, and an opt-in proactive advisor.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/tripleyak/SkillForge ~/.claude/skills/SkillForge

    884GitHub-Sterne+3 (+0.34 %)
  22. 22
    Aktiv

    🫖 Status page with uptime monitoring & API monitoring as code 🫖

    githubgemessenes WachstumQuelle öffnen ↗

    9 052GitHub-Sterne+28 (+0.31 %)
  23. 23

    Sonstige
    Aktiv

    SigNoz is an open-source, OpenTelemetry-native observability platform for your team and their AI agents. Get logs, metrics, and traces in one tool with features like APM, distributed tracing, log management, infra monitoring, etc. Combined…

    githubgemessenes WachstumQuelle öffnen ↗

    31 992GitHub-Sterne+62 (+0.19 %)
  24. 24

    Sonstige
    Aktiv

    Open-source observability tool that uses AI agents to self-heal your software

    githubgemessenes WachstumQuelle öffnen ↗

    1 404GitHub-Sterne+2 (+0.14 %)
  25. 25

    Sonstige
    Aktiv

    AI SRE AgenticOps for Kubernetes and cloud infrastructure.

    githubgemessenes WachstumQuelle öffnen ↗

    782GitHub-Sterne+1 (+0.13 %)