Die Werkzeugbeschreibungen sind auf Englisch.

LLM-Beobachtbarkeit

Monitoring, Traces, Bewertung und Qualität von LLM-Anwendungen.

Anwendungsfall

Aktivität

Sortieren nach

122

Werkzeug-Rangliste

Nach gemessenem Wachstum und quellenübergreifend normalisiert sortiert. Rohwerte behalten ihr eigenes Zeitfenster; eine Änderung erfordert mindestens zwei Messungen in 7 Tagen.

  1. 1

    Skill
    Aktiv

    OpenJudge: A Unified Framework for Holistic Evaluation and Quality Rewards

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/agentscope-ai/OpenJudge ~/.claude/skills/OpenJudge

    812GitHub-Sterne+7 (+0.87 %)
  2. 2
    Aktiv

    Skills, prompts, and instructions for building AI agents on top of Dynatrace production context

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/Dynatrace/dynatrace-for-ai ~/.claude/skills/dynatrace-for-ai

    135GitHub-Sterne+4 (+3.1 %)
  3. 3
    Aktiv

    Agent Skill evaluation harness for paired variants, trace artifacts, and runner adapters

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/adewale/skill-eval-harness ~/.claude/skills/skill-eval-harness

    73GitHub-Sterne+4 (+5.8 %)
  4. 4
    Aktiv

    Mini Program Engineering Skill Suite is an Agent Skill suite for evidence‑first mini‑program development. It helps agents bring WeChat or other mini‑program projects from vague intent to reliable engineering work: project intake, product…

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/NocodeMrLi/mini-program-engineering-skill-suite ~/.claude/skills/mini-program-engineering-skill-suite

    43GitHub-Sterne+4 (+10.3 %)
  5. 5
    Aktiv

    🪢 Langfuse documentation -- Langfuse is the open source LLM Engineering Platform. Observability, evals, prompt management, playground and metrics to debug and improve LLM apps

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/langfuse/langfuse-docs ~/.claude/skills/langfuse-docs

    239GitHub-Sterne+3 (+1.3 %)
  6. 6

    Skill
    Aktiv

    The container platform tailored for Kubernetes multi-cloud, datacenter, and edge management ⎈ 🖥 ☁️

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/kubesphere/kubesphere ~/.claude/skills/kubesphere

    17 035GitHub-Sterne+2 (+0.01 %)
  7. 7
    Aktiv

    Amazon Bedrock AgentCore enterprise platform accelerator with AWS CDK, Terraform organization guardrails, MCP/A2A agents, security, memory, and observability.

    githubgemessenes WachstumQuelle öffnen ↗

    6GitHub-Sterne+2 (+50.0 %)
  8. 8
    Aktiv

    Dashboard for monitoring claude code sessions.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren /plugin marketplace add JayantDevkar/claude-code-karma

    323GitHub-Sterne+2 (+0.62 %)
  9. 9
    Aktiv

    MCP server for Langfuse LLM observability — trace and observation analysis.

    mcpgemessenes WachstumQuelle öffnen ↗

    Installieren claude mcp add langfuse -- npx langfuse-observability-mcp-server

    80GitHub-Sterne+2 (+2.6 %)
  10. 10

    MCP
    Aktiv

    Open-source, self-hosted control plane for OpenClaw and Hermes AI-agent fleets on Docker/Kubernetes — REST, CLI, and MCP.

    githubgemessenes WachstumQuelle öffnen ↗

    50GitHub-Sterne+2 (+4.2 %)
  11. 11
    Aktiv

    Deterministic, local-only audit reports for Claude Code AI agent sessions. Rust + SQLite. Zero network calls. MCP server for agents.

    githubgemessenes WachstumQuelle öffnen ↗

    22GitHub-Sterne+2 (+10.0 %)
  12. 12

    Sonstige
    Aktiv

    AI SRE AgenticOps for Kubernetes and cloud infrastructure.

    githubgemessenes WachstumQuelle öffnen ↗

    782GitHub-Sterne+1 (+0.13 %)
  13. 13

    Sonstige
    Aktiv

    A command-line tool to scaffold and manage enterprise-ready AI Agents powered by the A2A (Agent-to-Agent) protocol

    githubgemessenes WachstumQuelle öffnen ↗

    14GitHub-Sterne+1 (+7.7 %)
  14. 14

    Skill
    Aktiv

    Production-grade AI coding rules for Cursor and Claude Code. 15 rules + 9 doc templates + skills + agents + MCP setup. Drop into any project.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/aiagentwithdhruv/ai-dev-stack ~/.claude/skills/ai-dev-stack

    10GitHub-Sterne+1 (+11.1 %)
  15. 15
    Aktiv

    Audit which Claude Code skills you actually use — surface dead installs and hallucinated invocations from your session logs.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren /plugin marketplace add sfrangulov/skill-graveyard

    10GitHub-Sterne+1 (+11.1 %)
  16. 16
    Aktiv

    🐙 ADLC Team Skills — Agentic SDLC for Engineering Teams

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/tikalk/adlc-team-skills ~/.claude/skills/adlc-team-skills

    132GitHub-Sterne+1 (+0.76 %)
  17. 17
    Aktiv

    Self improving agents through iterations

    githubgemessenes WachstumQuelle öffnen ↗

    105GitHub-Sterne+1 (+0.96 %)
  18. 18
    Aktiv

    Vendor-neutral OpenTelemetry skills for AI coding agents, grounded in upstream sources

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/ollygarden/opentelemetry-agent-skills ~/.claude/skills/opentelemetry-agent-skills

    97GitHub-Sterne+1 (+1.0 %)
  19. 19

    Skill
    Aktiv

    local-first analytics for AI agent skills

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/crafter-station/skill-kit ~/.claude/skills/skill-kit

    77GitHub-Sterne+1 (+1.3 %)
  20. 20
    Aktiv

    Make Claude Opus 4.8 behave like Claude Fable 5 — doctrine output style, drift-catching hooks, and an eval loop against golden Fable transcripts. Claude Code plugin.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren /plugin marketplace add rennf93/opus-fable-playbook

    34GitHub-Sterne+1 (+3.0 %)
  21. 21
    Aktiv

    Log Claude Code sessions to Opik, the open-source LLM observability and evaluation platform, built by Comet. Tracing, evaluation, and skills for observable AI applications.

    githubgemessenes WachstumQuelle öffnen ↗

    22GitHub-Sterne+1 (+4.8 %)
  22. 22

    Skill
    Aktiv

    Production patterns for agent orchestrators, harnesses, evals, MCP/A2A interoperability, memory, provider routing, and LLM usage metering.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/ssheleg/agent-stack ~/.claude/skills/agent-stack

    2GitHub-Sterne+1 (+100.0 %)
  23. 23

    Sonstige
    Aktiv

    Open-source observability tool that uses AI agents to self-heal your software

    githubgemessenes WachstumQuelle öffnen ↗

    1 404GitHub-Sterne+1 (+0.07 %)

Lern- und Referenzressourcen

Nach gemessenem Wachstum und quellenübergreifend normalisiert sortiert. Diese Ressourcen bleiben getrennt zugänglich und fließen nicht in die Hauptwertung ein.

  1. 1
    AktivQuelle öffnen ↗

    50+ curated LLM observability tools PLUS 26 Agent Skills (several with runnable, unit-tested scripts) to build, evaluate, debug, secure & monitor reliable LLM apps. Tracing, evals, guardrails, LLMOps.

    github

    Installieren git clone https://github.com/ContextJet-ai/awesome-llm-observability ~/.claude/skills/awesome-llm-observability

    Ressourcegemessenes Wachstum
    33GitHub-Sterne+3 (+10.0 %)
  2. 2
    AktivQuelle öffnen ↗

    Documentation-discovery telemetry for Claude Code — heat/cold maps, health grade, evidence-backed router fixes. 100% local, zero tokens. /tt

    github

    Installieren /plugin marketplace add Hedde/trigger_tree

    Ressourcegemessenes Wachstum
    14GitHub-Sterne+1 (+7.7 %)