Die Werkzeugbeschreibungen sind auf Englisch.
LLM-Beobachtbarkeit
Monitoring, Traces, Bewertung und Qualität von LLM-Anwendungen.
Anwendungsfall
Aktivität
Sortieren nach
122
Werkzeug-Rangliste
Nach gemessenem Wachstum und quellenübergreifend normalisiert sortiert. Rohwerte behalten ihr eigenes Zeitfenster; eine Änderung erfordert mindestens zwei Messungen in 7 Tagen.
- 1Aktiv
OpenJudge
SkillOpenJudge: A Unified Framework for Holistic Evaluation and Quality Rewards
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/agentscope-ai/OpenJudge ~/.claude/skills/OpenJudge812GitHub-Sterne+7 (+0.87 %) - 2Aktiv
dynatrace-for-ai
SkillSkills, prompts, and instructions for building AI agents on top of Dynatrace production context
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/Dynatrace/dynatrace-for-ai ~/.claude/skills/dynatrace-for-ai135GitHub-Sterne+4 (+3.1 %) - 3Aktiv
skill-eval-harness
SkillAgent Skill evaluation harness for paired variants, trace artifacts, and runner adapters
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/adewale/skill-eval-harness ~/.claude/skills/skill-eval-harness73GitHub-Sterne+4 (+5.8 %) - 4Aktiv
Mini Program Engineering Skill Suite is an Agent Skill suite for evidence‑first mini‑program development. It helps agents bring WeChat or other mini‑program projects from vague intent to reliable engineering work: project intake, product…
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/NocodeMrLi/mini-program-engineering-skill-suite ~/.claude/skills/mini-program-engineering-skill-suite43GitHub-Sterne+4 (+10.3 %) - 5Aktiv
langfuse-docs
Skill🪢 Langfuse documentation -- Langfuse is the open source LLM Engineering Platform. Observability, evals, prompt management, playground and metrics to debug and improve LLM apps
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/langfuse/langfuse-docs ~/.claude/skills/langfuse-docs239GitHub-Sterne+3 (+1.3 %) - 6Aktiv
kubesphere
SkillThe container platform tailored for Kubernetes multi-cloud, datacenter, and edge management ⎈ 🖥 ☁️
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/kubesphere/kubesphere ~/.claude/skills/kubesphere17 035GitHub-Sterne+2 (+0.01 %) - 7Aktiv
Amazon Bedrock AgentCore enterprise platform accelerator with AWS CDK, Terraform organization guardrails, MCP/A2A agents, security, memory, and observability.
githubgemessenes WachstumQuelle öffnen ↗
6GitHub-Sterne+2 (+50.0 %) - 8Aktiv
claude-code-karma
SkillDashboard for monitoring claude code sessions.
githubgemessenes WachstumQuelle öffnen ↗
Installieren
/plugin marketplace add JayantDevkar/claude-code-karma323GitHub-Sterne+2 (+0.62 %) - 9Aktiv
MCP server for Langfuse LLM observability — trace and observation analysis.
mcpgemessenes WachstumQuelle öffnen ↗
Installieren
claude mcp add langfuse -- npx langfuse-observability-mcp-server80GitHub-Sterne+2 (+2.6 %) - 10Aktiv
nora
MCPOpen-source, self-hosted control plane for OpenClaw and Hermes AI-agent fleets on Docker/Kubernetes — REST, CLI, and MCP.
githubgemessenes WachstumQuelle öffnen ↗
50GitHub-Sterne+2 (+4.2 %) - 11Aktiv
Deterministic, local-only audit reports for Claude Code AI agent sessions. Rust + SQLite. Zero network calls. MCP server for agents.
githubgemessenes WachstumQuelle öffnen ↗
22GitHub-Sterne+2 (+10.0 %) - 12Aktiv
Flawless
SonstigeAI SRE AgenticOps for Kubernetes and cloud infrastructure.
githubgemessenes WachstumQuelle öffnen ↗
782GitHub-Sterne+1 (+0.13 %) - 13Aktiv
adl-cli
SonstigeA command-line tool to scaffold and manage enterprise-ready AI Agents powered by the A2A (Agent-to-Agent) protocol
githubgemessenes WachstumQuelle öffnen ↗
14GitHub-Sterne+1 (+7.7 %) - 14Aktiv
ai-dev-stack
SkillProduction-grade AI coding rules for Cursor and Claude Code. 15 rules + 9 doc templates + skills + agents + MCP setup. Drop into any project.
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/aiagentwithdhruv/ai-dev-stack ~/.claude/skills/ai-dev-stack10GitHub-Sterne+1 (+11.1 %) - 15Aktiv
skill-graveyard
SkillAudit which Claude Code skills you actually use — surface dead installs and hallucinated invocations from your session logs.
githubgemessenes WachstumQuelle öffnen ↗
Installieren
/plugin marketplace add sfrangulov/skill-graveyard10GitHub-Sterne+1 (+11.1 %) - 16Aktiv
adlc-team-skills
Skill🐙 ADLC Team Skills — Agentic SDLC for Engineering Teams
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/tikalk/adlc-team-skills ~/.claude/skills/adlc-team-skills132GitHub-Sterne+1 (+0.76 %) - 17105GitHub-Sterne+1 (+0.96 %)
- 18Aktiv
Vendor-neutral OpenTelemetry skills for AI coding agents, grounded in upstream sources
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/ollygarden/opentelemetry-agent-skills ~/.claude/skills/opentelemetry-agent-skills97GitHub-Sterne+1 (+1.0 %) - 19Aktiv
skill-kit
Skilllocal-first analytics for AI agent skills
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/crafter-station/skill-kit ~/.claude/skills/skill-kit77GitHub-Sterne+1 (+1.3 %) - 20Aktiv
opus-fable-playbook
SkillMake Claude Opus 4.8 behave like Claude Fable 5 — doctrine output style, drift-catching hooks, and an eval loop against golden Fable transcripts. Claude Code plugin.
githubgemessenes WachstumQuelle öffnen ↗
Installieren
/plugin marketplace add rennf93/opus-fable-playbook34GitHub-Sterne+1 (+3.0 %) - 21Aktiv
Log Claude Code sessions to Opik, the open-source LLM observability and evaluation platform, built by Comet. Tracing, evaluation, and skills for observable AI applications.
githubgemessenes WachstumQuelle öffnen ↗
22GitHub-Sterne+1 (+4.8 %) - 22Aktiv
agent-stack
SkillProduction patterns for agent orchestrators, harnesses, evals, MCP/A2A interoperability, memory, provider routing, and LLM usage metering.
githubgemessenes WachstumQuelle öffnen ↗
Installieren
git clone https://github.com/ssheleg/agent-stack ~/.claude/skills/agent-stack2GitHub-Sterne+1 (+100.0 %) - 23Aktiv
superlog
SonstigeOpen-source observability tool that uses AI agents to self-heal your software
githubgemessenes WachstumQuelle öffnen ↗
1 404GitHub-Sterne+1 (+0.07 %)
Lern- und Referenzressourcen
Nach gemessenem Wachstum und quellenübergreifend normalisiert sortiert. Diese Ressourcen bleiben getrennt zugänglich und fließen nicht in die Hauptwertung ein.
- 1AktivQuelle öffnen ↗
50+ curated LLM observability tools PLUS 26 Agent Skills (several with runnable, unit-tested scripts) to build, evaluate, debug, secure & monitor reliable LLM apps. Tracing, evals, guardrails, LLMOps.
githubInstallieren
Ressourcegemessenes Wachstumgit clone https://github.com/ContextJet-ai/awesome-llm-observability ~/.claude/skills/awesome-llm-observability33GitHub-Sterne+3 (+10.0 %) - 2AktivQuelle öffnen ↗
trigger_tree
SkillDocumentation-discovery telemetry for Claude Code — heat/cold maps, health grade, evidence-backed router fixes. 100% local, zero tokens. /tt
githubInstallieren
Ressourcegemessenes Wachstum/plugin marketplace add Hedde/trigger_tree14GitHub-Sterne+1 (+7.7 %)