Saltar al contenido principal

Plugins

Explora, filtra e instala plugins de DeepSeek-Harness.

86 plugins encontrados

G

deepseek-vision

gou-gee/deepseek-vision

Bundle de visión nativo de DeepSeek Harness: pega o arrastra imágenes, invoca modelos de visión compatibles con OpenAI mediante el deepseek-vision-mcp alojado.

4el mes pasadoMCP y conectoresMIT
S

dsh-digipet

swaylq/dsh-digipet

Juego de cría estilo Digimon: incuba un huevo que se alimenta de trabajo real (turnos, llamadas a herramientas, errores) y evoluciona por cuatro líneas ramificadas según cómo trabajas; cero tokens, invisible para el modelo.

4el mes pasadoSolo por diversiónMIT
G

deepseek-vision (dsh-plugin-deepseek-vision)

gou-gee/deepseek-vision

Bundle MCP de visión y DSH para DeepSeek solo de texto: herramientas analyze_image, analyze_clipboard, compare_images y vision_status, una página de configuración visual, GLM-4.6V-Flash gratuito por defecto, almacenamiento en caché de resultados y tolerancia al límite de tasa; las claves no aparecen en los registros.

4hace 14 díasVisión, voz y multimodalMIT
F

dsh-plugin-deepeye

favio8/dsh-plugin-deepeye

Plugin de visión DeepEye para DeepSeek Harness (DSH): descripción de imágenes, OCR, VQA, diseño de UI y análisis del portapapeles.

4el mes pasadoVisión, voz y multimodal
H

dsh-her-eyes

huashenglian/dsh-her-eyes

Un plugin de dsh que permite a la IA invocar automáticamente VLM (modelos multimodales) para el análisis visual.

4el mes pasadoVisión, voz y multimodalMIT
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

Estación de trabajo omnimodal para DSH: analyze_image sobre una cadena ordenada de conmutación por error VLM de varias tarjetas, un conjunto de seis herramientas de visión (zoom, muestreo de color, diferencia de píxeles, OCR, detección de elementos y visualización en línea) que comparten el mismo resolutor de imágenes, generate_image mediante los protocolos OpenAI/DashScope/ComfyUI, generate_video asíncrono con varias tarjetas y un constructor /build-video-tool, y speak/clone_voice TTS en siete proveedores, todo gobernado por una única página de ajustes con autoguardado.

3anteayerVisión, voz y multimodalMIT
M

dsh-iris

mokuyoaxis/dsh-iris

Espacio de trabajo de medios y visión para DeepSeek Harness: generación de imágenes, vídeo y voz, preguntas y respuestas sobre imágenes y localización de elementos, OCR de imágenes largas, diferencia de píxeles, verificación mediante capturas de pantalla de HTML y resumen de vídeo, con proveedores DashScope y compatibles con OpenAI, grupos de modelos y un cliente de banco de trabajo.

3hace 14 horasHerramientas y funcionesMIT
W

dsh-model-capabilities

wjz-p/dsh-model-capabilities

Añade un selector de modalidad de entrada a la configuración de modelos personalizados en la interfaz web de DeepSeek Harness.

3el mes pasadoModelos y proveedoresMIT
W

visual-review

wang-bool/visual-review

Renderiza en línea las imágenes pegadas o subidas dentro del chat de DSH Web y da visión a los modelos solo de texto: la herramienta visual_review, invocable por el modelo, llama primero a cualquier API multimodal compatible con OpenAI y, si falla, recurre a un worker local de Qwen3-VL.

3el mes pasadoVisión, voz y multimodalMIT
S

dsh-plugin-multimodal

shinjiyu/dsh-plugin-multimodal

Anuncia el pegado de imágenes en rutas de DeepSeek solo de texto, describe los archivos adjuntos con un sidecar de visión y deja intactos los modelos de visión nativos.

3el mes pasadoVisión, voz y multimodalMIT
H

dsh-vision-mix

haiziyao/dsh-vision-mix

Combina APIs de texto, visión y generación de imágenes en un único modelo Mix con enrutamiento automático: las solicitudes de solo texto van al modelo de chat, las imágenes del usuario y las capturas del agente van al modelo de visión, los seguimientos siguen usando la misma imagen de sesión, y los agentes pueden generar o editar imágenes con un historial de llamadas con alcance de sesión.

3hace 13 díasVisión, voz y multimodalMIT
L

dsh-visibridge

lhbsaa/dsh-visibridge

Evidencia visual estructurada (OCR/distribución/semántica) además de una herramienta de captura con cámara USB para un bucle de depuración «disparar-mirar-ajustar»; backends: Ollama, DeepSeek, Xiaomi.

2hace 28 díasVisión, voz y multimodalMIT
S

dsh-llm-qwen-local

starefinger/dsh-llm-qwen-local

Plugin adaptador de LLM para modelos Qwen desplegados localmente detrás de un punto de conexión vLLM compatible con OpenAI, con conmutador multimodal por modelo, esfuerzos de razonamiento totalmente configurables y una página de ajustes web para editar el despliegue desde el frontend.

2hace 6 díasModelos y proveedoresMIT
A

dsh-multi-model-provider

alexkaiqi/dsh-multi-model-provider

Para DeepSeek Harness: registra modelos, ayuda con los retratos y selecciona el modelo de Agent desde un catálogo sin secretos.

2hace 28 díasModelos y proveedoresMIT
S

dsh-collaboration

socialist-sister/dsh-collaboration

Suite de colaboración multiagente: roster de especialistas configurado por el usuario, despacho persistente bajo demanda (team_call/team_message/team_status/team_close), instancias clonadas, relé de topología en estrella, comparación de modelos y un puente de visión multimodal.

2el mes pasadoFlujos y automatizaciónMIT
I

dsh-tool-visual-primitives

inkshadewoods/dsh-tool-visual-primitives

Analiza imágenes de conversación mediante prompts específicos por modo (caption, UI, documento, grounding, topología, etc.) e inyecta evidencia estructurada con primitivas de coordenadas (cajas, puntos, referencias) como texto, con caché a nivel de sesión para reutilización entre replay y compaction.

2hace 10 díasVisión, voz y multimodalMIT
H

dsh-open-eyes

hyp6666/dsh-open-eyes

Puente de visión para rutas de DeepSeek solo de texto que analiza imágenes adjuntas y locales mediante endpoints configurables de OpenAI Responses, Chat Completions o Anthropic Messages, mientras deja nativas las rutas con capacidad de imagen.

2hace 15 díasVisión, voz y multimodalMIT
5

dsh-youreyes

54xkeee/dsh-youreyes

Kit de visión para DeepSeek solo de texto: herramienta `vision` invocable por el modelo, adaptadores contenedores para deepseek/opencode-go (v4 flash/pro), cuota de Antigravity IDE (default, flash/pro) / cualquier VLM compatible con OpenAI / Gemini / canales locales de Ollama, memoria de evidencias con rehidratación por compactación, caché de hash de contenido y un panel de cliente bilingüe.

2el mes pasadoVisión, voz y multimodalMIT
W

dsh-file-attachment

wszhoho/dsh-file-attachment

Drag-and-drop / paste / upload files and images; on non-multimodal models images are auto-described by a configured VLM.

1hace 3 díasMejoras de UIMIT
M

dsh-bilibili

moxingovo/dsh-bilibili

DeepSeek Harness plugin: Bilibili keyword video search, video metadata, subtitle transcripts, direct play URLs, and multimodal frame viewing (bilibili_search / bilibili_video / bilibili_subtitles / bilibili_playurl / bilibili_frames). Anonymous by default

1hace 27 díasVisión, voz y multimodalMIT
J

dsh-mmroute

jmxsxwyzjdwl/dsh-mmroute

Transparent multimodal routing for text-only models: every image in every model call is fully transcribed (verbatim OCR, data, uncertainty zones, injection-hardened) by your own multimodal understander, with focused re-look via vision_relook and automatic retry on image-related failures. No bundled endpoints, no borrowed logins.

1hace 14 díasVisión, voz y multimodalMIT
H

dsh-vision-analysis

harvey-will/dsh-vision-analysis

DeepSeek Harness vision plugin: 8 analysis modes (describe, OCR, chart data, UI review, object detection, compare, code-gen, debug), any OpenAI- or Anthropic-compatible vision API, with a built-in free vision model and automatic rate-limit failover.

1hace 11 díasVisión, voz y multimodalMIT
E

dsh-sight

ericfetch/dsh-sight

DeepSeek Harness plugin: direct multimodal image transfer declarations + per-session image clearing (surface replace), with a settings page and composer controls.

1el mes pasadoVisión, voz y multimodalMIT
Y

dsh-multimodal

yauntyour/dsh-multimodal

Per-file-type multimodal chains: preset processing models per wildcard convert image/video/audio files into prompt tokens before they reach the text-only session model, with per-preset fallback chains and a Multimodal settings page.

1el mes pasadoVisión, voz y multimodalMIT