Adsh-vision-toolkit
anionex/dsh-vision-toolkit
Vision für reine Textmodelle: Fügen Sie ein Bild ein und das Modell wechselt zur Vision-Toolkit-Variante für Bild-Q&A, Mehrbildvergleich, Lang-Screenshot-OCR, Screenshot-zu-UI-Reproduktion, Element-Grounding und Pixel-Diff. Standardmäßig kein API-Key erforderlich — Bilder werden vom kostenlosen, vom Autor gehosteten Dienst verarbeitet, 100 pro Maschine pro Tag; konfigurierbar auf Ihren eigenen Anbieter.
887vorgesternVision, Sprache & MultimodalMIT