Die Werkzeugbeschreibungen sind auf Englisch.

Agents-eval — Werkzeugprofil und Verlauf

A Multi-Agent System (MAS) evaluation framework using PydanticAI that generates and evaluates scientific paper reviews through a three-tiered assessment approach: traditional metrics, LLM-as-a-Judge, and graph-based complexity analysis.

Ruhend

Kanonische Quelle ↗

Sprache
Python
Lizenz
Apache-2.0
Erstellt
Letzte Aktivität
Themen
  • a2a-protocol
  • agent-evaluation
  • agentbeats
  • ai-agents
  • benchmarks
  • llm-evaluation
  • multi-agent-evaluation
  • peerread

Aktuelle Messung

2GitHub-Sternestabil
gemessenes Wachstum

Momentum uses available readings from the last 7 days: measured with at least two comparable readings, estimated otherwise.

Messverlauf

90 Tage · 90 Messungen maximal
DatumWertMetrik
2GitHub-Sterne
2GitHub-Sterne
2GitHub-Sterne
2GitHub-Sterne
2GitHub-Sterne
2GitHub-Sterne
2GitHub-Sterne
2GitHub-Sterne
2GitHub-Sterne
2GitHub-Sterne
2GitHub-Sterne
2GitHub-Sterne
2GitHub-Sterne
2GitHub-Sterne
2GitHub-Sterne
2GitHub-Sterne
2GitHub-Sterne
2GitHub-Sterne

Klassifikationen

Bereiche
Typ
Agenten
Anwendungsfälle

Diese Einträge führen dieselben Themen. Es wird keine Ähnlichkeit abgeleitet: genannt werden nur die gemeinsamen Themen.