Die Werkzeugbeschreibungen sind auf Englisch.
LLM-Beobachtbarkeit
Monitoring, Traces, Bewertung und Qualität von LLM-Anwendungen.
Anwendungsfall
Aktivität
Sortieren nach
123
Werkzeug-Rangliste
Nach gemessenem Wachstum und quellenübergreifend normalisiert sortiert. Rohwerte behalten ihr eigenes Zeitfenster; eine Änderung erfordert mindestens zwei Messungen in 7 Tagen.
- 1Aktiv
agent-skills-eval
SkillA test runner for agentskills.io-style AI agent skills
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/darkrishabh/agent-skills-eval ~/.claude/skills/agent-skills-eval713GitHub-Sterne+12 (+1.7 %) - 2Aktiv
cilium
SonstigeeBPF-based Networking, Security, and Observability
githubgemessenes WachstumQuelle öffnen ↗
25 035GitHub-Sterne+26 (+0.10 %) - 3Aktiv
untell
SonstigeAI-detector auditing toolkit: measures how often a detector flags genuine human writing, how stable its verdict is across seeds, and whether that verdict survives meaning-preserving edits. Detector-in-the-loop measurement harness. Claude…
githubgemessenes WachstumQuelle öffnen ↗
19GitHub-Sterne+2 (+11.8 %) - 4Aktiv
skill-eval-harness
SkillAgent Skill evaluation harness for paired variants, trace artifacts, and runner adapters
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/adewale/skill-eval-harness ~/.claude/skills/skill-eval-harness72GitHub-Sterne+4 (+5.9 %) - 5Aktiv
Deterministic, local-only audit reports for Claude Code AI agent sessions. Rust + SQLite. Zero network calls. MCP server for agents.
githubgemessenes WachstumQuelle öffnen ↗
22GitHub-Sterne+2 (+10.0 %) - 6Aktiv
dynatrace-for-ai
SkillSkills, prompts, and instructions for building AI agents on top of Dynatrace production context
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/Dynatrace/dynatrace-for-ai ~/.claude/skills/dynatrace-for-ai131GitHub-Sterne+5 (+4.0 %) - 7Aktiv
ai-dev-stack
SkillProduction-grade AI coding rules for Cursor and Claude Code. 15 rules + 9 doc templates + skills + agents + MCP setup. Drop into any project.
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/aiagentwithdhruv/ai-dev-stack ~/.claude/skills/ai-dev-stack10GitHub-Sterne+1 (+11.1 %) - 8Aktiv
skill-graveyard
SkillAudit which Claude Code skills you actually use — surface dead installs and hallucinated invocations from your session logs.
githubgemessenes WachstumQuelle öffnen ↗
Installieren
/plugin marketplace add sfrangulov/skill-graveyard10GitHub-Sterne+1 (+11.1 %) - 9Ruhend
eval-layer
SonstigeA Claude Code skill that adds a rubric-based eval layer to any agent project. Framework-agnostic — generates rubric, test cases, judge prompt, and harness. Returns a weighted score plus a judge-leniency signal.
githubgemessenes WachstumQuelle öffnen ↗
13GitHub-Sterne+1 (+8.3 %) - 10Aktiv
Vendor-neutral OpenTelemetry skills for AI coding agents, grounded in upstream sources
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/ollygarden/opentelemetry-agent-skills ~/.claude/skills/opentelemetry-agent-skills96GitHub-Sterne+3 (+3.2 %) - 11Aktiv
OpenJudge
SkillOpenJudge: A Unified Framework for Holistic Evaluation and Quality Rewards
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/agentscope-ai/OpenJudge ~/.claude/skills/OpenJudge807GitHub-Sterne+7 (+0.88 %) - 12Aktiv
nora
MCPOpen-source, self-hosted control plane for OpenClaw and Hermes AI-agent fleets on Docker/Kubernetes — REST, CLI, and MCP.
githubgemessenes WachstumQuelle öffnen ↗
49GitHub-Sterne+2 (+4.3 %) - 13Aktiv
superlog
SonstigeOpen-source observability tool that uses AI agents to self-heal your software
githubgemessenes WachstumQuelle öffnen ↗
1 404GitHub-Sterne+7 (+0.50 %) - 14Aktiv
SkillForge
SkillA skill creator that proves its skills work. Evidence-driven skill creation for Claude Code and Codex: baseline-tested generation, per-skill regression evals, ecosystem doctor, cross-runtime compile, and an opt-in proactive advisor.
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/tripleyak/SkillForge ~/.claude/skills/SkillForge884GitHub-Sterne+5 (+0.57 %) - 15Aktiv
kubeshark
AgenteBPF-powered network observability for Kubernetes. Indexes L4/L7 traffic with full K8s context, decrypts TLS without keys. Queryable by AI agents via MCP and humans via dashboard.
githubgemessenes WachstumQuelle öffnen ↗
12 065GitHub-Sterne+7 (+0.06 %) - 16Aktiv
kubesphere
SkillThe container platform tailored for Kubernetes multi-cloud, datacenter, and edge management ⎈ 🖥 ☁️
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/kubesphere/kubesphere ~/.claude/skills/kubesphere17 035GitHub-Sterne+6 (+0.04 %) - 17Aktiv
opus-fable-playbook
SkillMake Claude Opus 4.8 behave like Claude Fable 5 — doctrine output style, drift-catching hooks, and an eval loop against golden Fable transcripts. Claude Code plugin.
githubgemessenes WachstumQuelle öffnen ↗
Installieren
/plugin marketplace add rennf93/opus-fable-playbook33GitHub-Sterne+1 (+3.1 %) - 18Aktiv
claudestat
SkillReal-time execution trace and cost intelligence for Claude Code
githubgemessenes WachstumQuelle öffnen ↗
Installieren
/plugin marketplace add DeibyGS/claudestat34GitHub-Sterne+1 (+3.0 %) - 19Aktiv
cap-evolve
MCPOptimize any AI agent’s skills, tools/MCP, and prompts against your own evals.
githubgemessenes WachstumQuelle öffnen ↗
47GitHub-Sterne+1 (+2.2 %) - 20Aktiv
langfuse-docs
Skill🪢 Langfuse documentation -- Langfuse is the open source LLM Engineering Platform. Observability, evals, prompt management, playground and metrics to debug and improve LLM apps
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/langfuse/langfuse-docs ~/.claude/skills/langfuse-docs237GitHub-Sterne+2 (+0.85 %) - 21Aktiv
aura
MCPAURA is a production-tested SRE agent platform you can deploy in minutes. AURA handles the guardrails, APIs, state management, streaming, and failure handling required to put AI to work safely on production infrastructure.
githubgemessenes WachstumQuelle öffnen ↗
258GitHub-Sterne+2 (+0.78 %) - 22Aktiv
claude-code-karma
SkillDashboard for monitoring claude code sessions.
githubgemessenes WachstumQuelle öffnen ↗
Installieren
/plugin marketplace add JayantDevkar/claude-code-karma321GitHub-Sterne+2 (+0.63 %) - 23Aktiv
skill-kit
Skilllocal-first analytics for AI agent skills
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/crafter-station/skill-kit ~/.claude/skills/skill-kit77GitHub-Sterne+1 (+1.3 %)
Lern- und Referenzressourcen
Nach gemessenem Wachstum und quellenübergreifend normalisiert sortiert. Diese Ressourcen bleiben getrennt zugänglich und fließen nicht in die Hauptwertung ein.
- 1AktivQuelle öffnen ↗
trigger_tree
SkillDocumentation-discovery telemetry for Claude Code — heat/cold maps, health grade, evidence-backed router fixes. 100% local, zero tokens. /tt
githubInstallieren
Ressourcegemessenes Wachstum/plugin marketplace add Hedde/trigger_tree14GitHub-Sterne+1 (+7.7 %) - 2AktivQuelle öffnen ↗
50+ curated LLM observability tools PLUS 26 Agent Skills (several with runnable, unit-tested scripts) to build, evaluate, debug, secure & monitor reliable LLM apps. Tracing, evals, guardrails, LLMOps.
githubInstallieren
Ressourcegemessenes Wachstumgit clone https://github.com/ContextJet-ai/awesome-llm-observability ~/.claude/skills/awesome-llm-observability31GitHub-Sterne+1 (+3.3 %)