Die Werkzeugbeschreibungen sind auf Englisch.

LLM-Beobachtbarkeit

Monitoring, Traces, Bewertung und Qualität von LLM-Anwendungen.

Anwendungsfall

Aktivität

Sortieren nach

123

Werkzeug-Rangliste

Ranked by creation date, newest first; undated entries come last. Rohwerte behalten ihr eigenes Zeitfenster; eine Änderung erfordert mindestens zwei Messungen in 7 Tagen.

  1. 1

    Agent
    Aktiv

    面向长程研发任务的 Java Agent Harness,支持 A2A 跨语言协作、可恢复执行、上下文工程与 Eval 驱动开发。

    githubgemessenes WachstumQuelle öffnen ↗

    0GitHub-Sternestabil
  2. 2

    Skill
    Aktiv

    Deletion-first Agent Skill for removing test bloat, verification theater, and speculative fallbacks while preserving behavior.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/MrZoyo/deslop-GPT ~/.claude/skills/deslop-GPT

    55GitHub-Sterne+27 (+96.4 %)
  3. 3

    Agent
    Aktiv

    Generic DeepSeek Harness (dsh) plugins: A2A protocol server, session storage mirror, and Langfuse observability.

    githubgemessenes WachstumQuelle öffnen ↗

    1GitHub-Sternestabil
  4. 4
    Aktiv

    Production reliability, benchmarking, and evaluation layer for MCP agent runtimes — protocol negotiation, A2A interop, circuit breakers, connection pooling, adaptive streaming, and autoscaling, with measured throughput/latency and a…

    githubgemessenes WachstumQuelle öffnen ↗

    3GitHub-Sternestabil
  5. 5
    Aktiv

    Multi-agent quality gate skill for Claude Code that researches, reviews, tests and challenges AI-generated work before the final answer.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/ma-nucho-pro/supervisor-skill-claude ~/.claude/skills/supervisor-skill-claude

    2GitHub-Sternestabil
  6. 6
    Aktiv

    Mini Program Engineering Skill Suite is an Agent Skill suite for evidence‑first mini‑program development. It helps agents bring WeChat or other mini‑program projects from vague intent to reliable engineering work: project intake, product…

    githubgeschätztes MomentumQuelle öffnen ↗

    Installieren git clone https://github.com/NocodeMrLi/mini-program-engineering-skill-suite ~/.claude/skills/mini-program-engineering-skill-suite

    39GitHub-Sterne
  7. 7
    Aktiv

    Deterministic, local-only audit reports for Claude Code AI agent sessions. Rust + SQLite. Zero network calls. MCP server for agents.

    githubgemessenes WachstumQuelle öffnen ↗

    22GitHub-Sterne+2 (+10.0 %)
  8. 8
    Aktiv

    Amazon Bedrock AgentCore enterprise platform accelerator with AWS CDK, Terraform organization guardrails, MCP/A2A agents, security, memory, and observability.

    githubgemessenes WachstumQuelle öffnen ↗

    5GitHub-Sterne+1 (+25.0 %)
  9. 9

    Skill
    Aktiv

    Open-source infrastructure that turns scattered SKILL.md files into curated, retrieval-ready agent-skill corpora—with retrieval and evaluation tooling included.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/EverMind-AI/SkillCorpus ~/.claude/skills/SkillCorpus

    424GitHub-Sterne+170 (+66.9 %)
  10. 10

    Agent
    Aktiv

    Local-first control plane for durable, governed agent teams: DAG orchestration, approvals, memory, signed skills, trace contracts, and realtime.

    githubgemessenes WachstumQuelle öffnen ↗

    0GitHub-Sternestabil
  11. 11

    Skill
    Aktiv

    Production patterns for agent orchestrators, harnesses, evals, MCP/A2A interoperability, memory, provider routing, and LLM usage metering.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/ssheleg/agent-stack ~/.claude/skills/agent-stack

    2GitHub-Sterne+1 (+100.0 %)
  12. 12

    Skill
    Aktiv

    Research-backed, eval-driven skills for AI agents

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/ZSeven-W/craft-skills ~/.claude/skills/craft-skills

    142GitHub-Sterne+18 (+14.5 %)
  13. 13
    Aktiv

    Make Claude write clearly, for everyone.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren /plugin marketplace add stefanobaghino/simple-output-styles

    16GitHub-Sternestabil
  14. 14
    Aktiv

    Skill instalable para Claude Code que mide si tu agente cumple las reglas establecidas. Lee el historial de sesiones de tu disco y devuelve un porcentaje por regla de cumplimiento. Sin instalar nada, sin red, biblioteca estándar.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren /plugin marketplace add jleonceo/skill-adherencia-reglas

    1GitHub-Sternestabil
  15. 15
    Aktiv

    Mide si tu agente de IA cumple las reglas que le escribiste. Lee el historial local de Claude Code y devuelve un porcentaje por regla. Sin instalar nada, sin red, biblioteca estándar.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/jleonceo/adherencia-reglas ~/.claude/skills/adherencia-reglas

    1GitHub-Sternestabil
  16. 16
    Aktiv

    Agent Skill that asks: should there be an agentic system at all? Then designs, builds, audits, verifies, and ports systems—from workflows to governed teams.

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/ingcontartese-netizen/multi-agent-system-architect-v2 ~/.claude/skills/multi-agent-system-architect-v2

    1GitHub-Sternestabil
  17. 17

    Sonstige
    Aktiv

    Evidence-first infrastructure for reproducible, isolated executable evaluation and online rewards.

    githubgemessenes WachstumQuelle öffnen ↗

    140GitHub-Sterne+24 (+20.7 %)
  18. 18
    Aktiv

    Claude Code skills where every entry ships receipts — accuracy-gated benchmarks against baseline and placebo, rejects published

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/sjh9714/skill-receipts ~/.claude/skills/skill-receipts

    2GitHub-Sternestabil
  19. 19
    Aktiv

    Deterministic crash tests for agent control planes: paired worlds, hard stops, budgets, scopes, approvals, and hash-linked receipts.

    githubgemessenes WachstumQuelle öffnen ↗

    1GitHub-Sternestabil
  20. 20
    Aktiv

    🐙 ADLC Team Skills — Agentic SDLC for Engineering Teams

    githubgemessenes WachstumQuelle öffnen ↗

    Installieren git clone https://github.com/tikalk/adlc-team-skills ~/.claude/skills/adlc-team-skills

    132GitHub-Sterne+1 (+0.76 %)
  21. 21

    MCP
    Aktiv

    A typed, replayable, budget-aware programming language for LLM agents. Compiles to Python & TypeScript.

    githubgemessenes WachstumQuelle öffnen ↗

    2GitHub-Sternestabil
  22. 22
    Aktiv

    Vendor-neutral OpenTelemetry tracing for A2A agents and MCP services, with W3C context propagation and privacy-safe telemetry.

    githubgemessenes WachstumQuelle öffnen ↗

    1GitHub-Sternestabil
  23. 23
    Aktiv

    Architecture-first Python scaffold for an auditable multi-agent corporate credit desk using A2A, MCP, deterministic credit policies, model routing, and OpenTelemetry.

    githubgemessenes WachstumQuelle öffnen ↗

    0GitHub-Sternestabil

Lern- und Referenzressourcen

Ranked by creation date, newest first; undated entries come last. Diese Ressourcen bleiben getrennt zugänglich und fließen nicht in die Hauptwertung ein.

  1. 1
    AktivQuelle öffnen ↗

    My complete journey to becoming an Agentic AI Engineer through structured learning, projects, experiments, and production-ready implementations of modern AI systems.

    githubRessourcegemessenes Wachstum
    18GitHub-Sternestabil
  2. 2
    AktivQuelle öffnen ↗

    Documentation-discovery telemetry for Claude Code — heat/cold maps, health grade, evidence-backed router fixes. 100% local, zero tokens. /tt

    github

    Installieren /plugin marketplace add Hedde/trigger_tree

    Ressourcegemessenes Wachstum
    14GitHub-Sterne+1 (+7.7 %)