Adsh-vision-toolkit
anionex/dsh-vision-toolkit
Visión para modelos solo de texto: al pegar una imagen, el modelo cambia a la variante Vision Toolkit para preguntas y respuestas sobre imágenes, comparación de múltiples imágenes, OCR de capturas largas, reproducción de UI a partir de capturas, localización de elementos y diferencias de píxeles. Sin clave de API por defecto — las imágenes se procesan mediante el servicio gratuito alojado por el autor, 100 por máquina al día; configurable a tu propio proveedor.
887anteayerVisión, voz y multimodalMIT