Saltar al contenido principal

Plugins

Explora, filtra e instala plugins de DeepSeek-Harness.

47 plugins encontrados

Y

dsh-vision-router

ysr666/dsh-vision-router

Visión gratuita para agentes de solo texto: cadena de visión integrada sin clave más herramientas de píxeles (preguntas y respuestas, grounding, recorte, diff de píxeles, colores, OCR, trazado SVG, recorte de figuras, capturas de pantalla); pega una imagen para usarla.

1.1kayerVisión, voz y multimodalMIT
A

dsh-vision-toolkit

anionex/dsh-vision-toolkit

Visión para modelos solo de texto: al pegar una imagen, el modelo cambia a la variante Vision Toolkit para preguntas y respuestas sobre imágenes, comparación de múltiples imágenes, OCR de capturas largas, reproducción de UI a partir de capturas, localización de elementos y diferencias de píxeles. Sin clave de API por defecto — las imágenes se procesan mediante el servicio gratuito alojado por el autor, 100 por máquina al día; configurable a tu propio proveedor.

887anteayerVisión, voz y multimodalMIT
O

dsh-vision

oil-oil/dsh-vision

Comprensión de imágenes casi nativa para DeepSeek Harness

24hace 2 mesesVisión, voz y multimodalMIT
F

dsh-vision-proxy

flyvhidbwo/dsh-vision-proxy

Cerebro DeepSeek + transcripción automática de imágenes: adjunta imágenes en la GUI y cada una se transcribe mediante el modelo oficial deepseek-v4-flash-vision-exp por defecto (un cerebro V4-Pro puramente textual puede ver imágenes), con cualquier VLM compatible con OpenAI u Ollama local como alternativas.

15el mes pasadoVisión, voz y multimodalMIT
P

dsh-vision-opencode

poiuyjie/dsh-vision-opencode

Añade un modelo de visión configurable a los modelos principales solo de texto: una herramienta vision_read_image, un selector de modelo de visión en la barra del compositor, y conversión automática de imagen a texto para rutas solo de texto.

13hace 23 díasVisión, voz y multimodalMIT
L

dsh-vision

linenxi-ctrl/dsh-vision

Plugin de visión externo para DeepSeek Harness: panel de configuración con botón de ballena, reconocimiento de imágenes con respuesta automática, y herramientas de captura y reconocimiento para el agente.

9hace 2 mesesVisión, voz y multimodalMIT
5

dsh-vision

54xkeee/dsh-vision

Visión para DeepSeek de solo texto mediante Doubao Web de forma predeterminada (sin costo, sin clave de API: controla tu Chrome con sesión iniciada a través de un puente CDP de Windows), con cuota de Antigravity IDE (flash/pro) o alternativa a Gemini; escalado automático de detalle, memoria de evidencia visual con rehidratación tras compactación, caché por hash de contenido y un panel de cliente bilingüe.

7hace 2 mesesVisión, voz y multimodalMIT
L

dsh-drop-to-path

loudmore/dsh-drop-to-path

Plugin de DSH que entrega imágenes y archivos a modelos de solo texto como rutas del espacio de trabajo: las imágenes conservan la experiencia de adjuntos nativa, otros archivos se muestran como chips cuadrados en la barra, y las rutas se añaden al enviar; combina bien con dsh-vision-toolkit.

6hace 2 mesesMejoras de UIMIT
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

Visión bajo demanda para sesiones DSH solo de texto: las imágenes se convierten en marcadores, y una herramienta vision_describe envía solo la imagen y la pregunta a un modelo de visión compatible con OpenAI

5hace 2 mesesVisión, voz y multimodalMIT
X

dsh-vision-hub (tool-vision)

xing666173/dsh-vision-hub

Caja de herramientas de visión mejorada: 14 herramientas de visión a nivel de píxel (describe, ground, detect, crop, pixel-diff, OCR, OCR de captura larga, vectorize, colors, cutout, screenshot, present, materialize, html-screenshot) impulsadas por un endpoint compatible con OpenAI, con marcadores de puente limpios [图片: path], clasificación de seguridad de contenido y auto-retry por límite de tasa.

4el mes pasadoVisión, voz y multimodal
X

dsh-vision-hub (file-drop)

xing666173/dsh-vision-hub

Subida de archivos drag-and-drop para PDF, Word, Excel e imágenes: los archivos soltados se guardan en un directorio local y se referencian por ruta, sin bloat de base64 en el chat.

4el mes pasadoHerramientas y funciones
X

dsh-vision-hub (bridge-preview)

xing666173/dsh-vision-hub

Previsualización inline para marcadores de puente de imagen [图片: path]: tras renderizarse el marcador, la imagen se muestra en el chat automáticamente, manteniendo instrucciones largas fuera de la conversación.

4el mes pasadoSesiones y mensajes
1

dsh-vision-sidecar

121103qwq/dsh-vision-sidecar

Sidecar de visión gratuito y alojado para DeepSeek Harness, con evidencia de sesión duradera

4hace 2 mesesVisión, voz y multimodalMIT
G

dsh-vision-bridge

gxx182/dsh-vision-bridge

Conecta las imágenes de la sesión a proveedores de visión configurables y devuelve análisis de solo texto a las rutas de modelos elegibles de DeepSeek Harness.

4hace 2 mesesVisión, voz y multimodalMIT
P

dsh-agent-router

peterwangze/dsh-agent-router

Complemento de enrutamiento multimodelo para DeepSeek Harness: deje las tareas especializadas en manos de agentes especializados: personalice agentes profesionales (visión/traducción/voz/subagente, etc.) y asócielos a modelos independientes; inicio de sesión con un clic para cuentas multimodales, enrutamiento de estado del pool de cuentas y estadísticas de uso en tiempo real.

3hace 2 mesesModelos y proveedoresMIT
T

dsh-plugins (dsh-vision)

tzhr-invest/dsh-plugins

Herramienta de visión invocable por agentes que describe imágenes locales mediante cualquier endpoint de visión compatible con OpenAI que configures, con verificación cruzada opcional de varios modelos y sin claves integradas.

3hace 5 díasVisión, voz y multimodalMIT
M

dsh-vision-tools

moon09300731/dsh-vision-tools

Paquete completo de capacidades de visión para DeepSeek Harness: una herramienta vision_understand (APIs de visión compatibles con OpenAI, Zhipu GLM-4V-Flash gratuito por defecto) además de puntos de entrada de pegar/arrastrar y soltar/botón para reconocimiento de imágenes.

3hace 2 mesesVisión, voz y multimodalMIT
H

dsh-vision-mix

haiziyao/dsh-vision-mix

Combina APIs de texto, visión y generación de imágenes en un único modelo Mix con enrutamiento automático: las solicitudes de solo texto van al modelo de chat, las imágenes del usuario y las capturas del agente van al modelo de visión, los seguimientos siguen usando la misma imagen de sesión, y los agentes pueden generar o editar imágenes con un historial de llamadas con alcance de sesión.

3hace 25 díasVisión, voz y multimodalMIT
N

dsh-vision-plugin

nexsjournal/dsh-vision-plugin

Instala una casilla de entrada de imagen en el catálogo Models para que un modelo personalizado pueda declarar entrada de imagen y recibir imágenes directamente; incluye un relé de visión BYO opcional.

3hace 2 mesesMejoras de UIMIT
B

dsh-vision-plugin

bug-huntter/dsh-vision-plugin

Reconocimiento de imágenes configurable para modelos DSH solo de texto: los mensajes de imagen se transcriben primero mediante un modelo de visión compatible con OpenAI (URL base, ID de modelo y clave API configurados en una sección de Ajustes) y luego se pasan al modelo principal como texto, mientras se anuncia la compatibilidad con entrada de imágenes. El esquema de autenticación de la clave API es seleccionable (cabeceras de petición estilo OpenAI, Anthropic, Gemini o Azure) y se notifica la falta de una clave antes de enviar cualquier petición.

2hace 5 díasVisión, voz y multimodalMIT
G

dsh-vision-bridge

goodandready/dsh-vision-bridge

Enruta imágenes a un modelo de visión de tu elección — reescritura automática, herramientas explícitas o híbrido — para que un modelo de chat solo texto no falle un turno que contiene una imagen.

2hace 6 díasVisión, voz y multimodalMIT
X

dsh-vision

xiaoshihou514/dsh-vision

Extensión nativa de capacidad de visión, que utiliza Zhipu (gratis) o Qwen-VL (local).

2el mes pasadoVisión, voz y multimodalMIT
K

dsh-vision-recognizer

kaixinbaba/dsh-vision-recognizer

Ruta de proveedor de visión que transcribe imágenes adjuntas a texto mediante un modelo configurable (más de 15 proveedores compatibles con OpenAI y Anthropic) mientras DeepSeek sigue respondiendo.

2el mes pasadoVisión, voz y multimodalMIT
3

dsh-vision (vision-tool)

314857493/dsh-vision

Herramienta `vision` invocable por el modelo para DeepSeek Harness: describe y aplica OCR a archivos de imagen llamando directamente a la API de visión gratuita Zhipu GLM (cadena de respaldo glm-4v-flash), sin necesidad de CLI externo.

2hace 28 díasVisión, voz y multimodalMIT