aaabench — fiche et historique

Banc de test pour évaluer les agents de codage en leur confiant un moteur de jeu réel et le défi de construire un jeu en monde ouvert.

Actif

Reformulée en français

Source canonique ↗

Langage
Shell
Licence
MIT
Création
Dernière activité
Topics
  • ai-agents
  • benchmark
  • game-development
  • llm-evaluation
  • mcp
  • unreal-engine

Mesure actuelle

297étoiles GitHub
momentum estimé

Le momentum utilise les relevés disponibles des 7 derniers jours : mesuré avec au moins deux relevés comparables, estimé sinon.

Historique des relevés

90 jours · 90 relevés maximum
DateValeurMétrique
297étoiles GitHub

Classements

Domaines
Type
Agents
Usages

Ces entrées déclarent les mêmes sujets. Aucune similarité n’est déduite : seuls les sujets communs sont indiqués.