Le descrizioni degli strumenti sono in inglese.

agent-vision-toolkit — scheda e storico dello strumento

为纯文本模型"看图“设计更好的视觉工具箱和技能,支持多图理解,图片问答,前端UI还原、GUI 自动化等,并可选无缝接入多个主流agent,直接识别粘贴图片| A vision toolkit and skill designed for text-only llms — image Q&A, long-screenshot OCR, frontend UI restoration, and GUI automation, with optional seamless integration for Codex, Claude Code, Pi, Oh My Pi, and OpenCode

Attivo

Fonte canonica ↗

Linguaggio
Python
Licenza
MIT
Creazione
Ultima attività
Argomenti
  • agent
  • agent-skills
  • claude-code
  • codex
  • computer-use
  • deepseek
  • dsh-plugin
  • glm
  • harness-engineering
  • multimodal
  • opencode
  • text-only-llm
  • vision
  • vision-language-model

Installa git clone https://github.com/Anionex/agent-vision-toolkit ~/.claude/skills/agent-vision-toolkit

Misurazione attuale

1 125stelle GitHub+23 (+2.1 %)
crescita misurata

Momentum uses available readings from the last 7 days: measured with at least two comparable readings, estimated otherwise.

Storico delle rilevazioni

90 giorni · 90 rilevazioni massime
DataValoreMetrica
1 125stelle GitHub
1 119stelle GitHub
1 118stelle GitHub
1 114stelle GitHub
1 110stelle GitHub
1 107stelle GitHub
1 102stelle GitHub
1 098stelle GitHub
1 095stelle GitHub
1 095stelle GitHub
1 084stelle GitHub
1 072stelle GitHub
1 049stelle GitHub
1 005stelle GitHub
989stelle GitHub
911stelle GitHub
845stelle GitHub
830stelle GitHub
409stelle GitHub
397stelle GitHub
392stelle GitHub
384stelle GitHub

Classificazioni

Ambiti
Tipo
Skill per agenti
Utilizzi

Queste voci dichiarano gli stessi argomenti. Nessuna somiglianza viene dedotta: sono indicati solo gli argomenti in comune.