Saltar al contenido principal

Plugins

Explora, filtra e instala plugins de DeepSeek-Harness.

82 plugins encontrados

L

modlens

liustack/modlens

Puente de visión para modelos de solo texto: pega una imagen y obtén evidencia JSON estructurada (OCR, diseño, semántica).

4.1khace 5 díasVisión, voz y multimodalMIT
Y

dsh-vision-router

ysr666/dsh-vision-router

Visión gratuita para agentes de solo texto: cadena de visión integrada sin clave más herramientas de píxeles (preguntas y respuestas, grounding, recorte, diff de píxeles, colores, OCR, trazado SVG, recorte de figuras, capturas de pantalla); pega una imagen para usarla.

1.1kayerVisión, voz y multimodalMIT
T

tongflow (dsh-tongflow)

tong-io/tongflow

Estudio de equipo de rodaje TongFlow para producción de imagen, voz, música y vídeo: el agente escribe archivos de flujo de trabajo TongFlow por recurso (.tongflow.json) que se ejecutan mediante complementos de TongFlow, con un lienzo de flujo integrado, una estructura de proyecto por plano/personaje/toma y una plantilla de manga-drama; las sesiones que comienzan con @tongflow abren la vista de estudio.

1khace 7 horasFlujos y automatizaciónAGPL-3.0
T

tongflow

tong-io/tongflow

Complemento de estudio TongFlow para DeepSeek Harness (dsh): modelo de proyecto al estilo de un equipo de rodaje, flujos de trabajo TongFlow creados por el agente, generación multimedia determinista, lienzo integrado.

870el mes pasadoVisión, voz y multimodalAGPL-3.0
O

watch-skill

oxbshw/watch-skill

Las capacidades de DeepWatch, instalables en un perfil de DeepSeek Harness existente.

378hace 18 díasVisión, voz y multimodalMIT
Z

dsh-crew

zseven-w/dsh-crew

Despacha trabajo a agentes DSH desde Claude Code o Codex: progreso nativo de subagentes, sesiones de trabajador en el host con ajustes predefinidos por nivel y un puente multimodal para visión y generación de imágenes.

153hace 8 díasIntegraciones y acceso remotoMIT
V

ark-cli (ark-managed-agents)

volcengine/ark-cli

Añade una pestaña de ajustes de Managed Agents y herramientas MCP para enviar tareas de agente de larga duración a Ark cloud Managed Agents.

139hace 3 díasHerramientas y funcionesApache-2.0
V

ark-cli (ark-plan-api)

volcengine/ark-cli

Registra Ark Agent Plan, Coding Plan y rutas de modelos de pospago en el selector nativo de modelos de DSH.

139hace 3 díasModelos y proveedoresApache-2.0
V

ark-cli

volcengine/ark-cli

Complemento de proveedor de Volcengine Ark para DeepSeek Harness (DSH): registra las rutas Agent Plan, Coding Plan y de pago posterior en el adaptador nativo pi-ai para que los modelos de Ark aparezcan en el selector de modelos.

112el mes pasadoModelos y proveedoresApache-2.0
S

dsh-AuthInOne

stormycry-cryp/dsh-authinone

Añade inicio de sesión de cuenta, configuración de API y Provider personalizado, cambio de modelo, fallback de imagen para modelos solo de texto y atribución de tokens/costos a DeepSeek Harness 47f.

105hace 2 mesesModelos y proveedoresMIT
S

dsh-design-qa

sunxin-ai/dsh-design-qa

QA de fidelidad de diseño para modelos solo de texto: una herramienta `deepseek_vision` toma prestado un ojo de cualquier ruta de visión compatible con OpenAI, de modo que el modelo pueda juzgar si una implementación coincide con su maqueta — se entrega con el benchmark detrás de ese juicio (cuatro fixtures, 23 defectos inyectados, transcripciones en bruto) y la disciplina de cuestionamiento de la que depende.

44hace 26 díasVisión, voz y multimodalMIT
J

picturereader

jing-hy/picturereader

"Lectura" de imágenes para modelos de solo texto: reduce la escala + reduce la profundidad de color + convierte huellas de estructura/color en cuadrículas de texto que se devuelven a la conversación, permitiendo que el modelo haga zoom, muestreo y OCR de forma autónoma como un modelo multimodal; totalmente local y sin dependencia de modelos externos, incluye una skill de metodología de lectura de imágenes y PaddleOCR opcional.

37anteayerVisión, voz y multimodalMIT
O

dsh-vision

oil-oil/dsh-vision

Comprensión de imágenes casi nativa para DeepSeek Harness

24hace 2 mesesVisión, voz y multimodalMIT
S

dsh-ros2

stvli/dsh-ros2

Conjunto de herramientas de depuración ROS2 y análisis de visión del estado del robot para DeepSeek Harness: enumeración de node/topic/service/action/interface/TF, JSON de topología completa del grafo, comprobaciones rosdep, builds con aprobación y andamiaje de mensajes personalizados, capturas de pantalla de GUI y observación de visión multimodal, más renderizado offscreen sin cabeza de RViz2 (mallas low-poly, lectura directa de píxeles, paso de GPU: renderizado de movimiento a 30 Hz) con análisis paralelo de VLM en tiempo real.

22anteayerHerramientas y funcionesMIT
J

dsh-visual-plugin

jyh20030112/dsh-visual-plugin

Da visión a los modelos solo de texto: reenvía las imágenes del usuario a un modelo de visión compatible con OpenAI y muestra las descripciones en un panel derecho de la interfaz web.

16hace 3 díasVisión, voz y multimodalMIT
F

dsh-vision-proxy

flyvhidbwo/dsh-vision-proxy

Cerebro DeepSeek + transcripción automática de imágenes: adjunta imágenes en la GUI y cada una se transcribe mediante el modelo oficial deepseek-v4-flash-vision-exp por defecto (un cerebro V4-Pro puramente textual puede ver imágenes), con cualquier VLM compatible con OpenAI u Ollama local como alternativas.

15el mes pasadoVisión, voz y multimodalMIT
M

dsh-provider-qoder

mo-n/dsh-provider-qoder

Conecta las suscripciones de Qoder a DeepSeek Harness, con soporte para las regiones Global y China, entrada multimodal y llamadas a herramientas.

13ayerModelos y proveedoresMIT
W

dsh-mmx-bridge

welsione/dsh-mmx-bridge

Puente multimodal MiniMax: una única herramienta `mmx_bridge` cubre comprensión/generación de imágenes, vídeo, TTS, música, portadas, búsqueda web y cuota; sustitución opcional de `web_search`/`read_image`; reproductores en línea/vistas previas de imágenes directamente en la GUI web (npm: `dsh-mmx-bridge`).

10hace 15 díasHerramientas y funcionesMIT
S

dsh-deepseek-vision

siegfly/dsh-deepseek-vision

Una ruta de proveedor de puerta de enlace de visión-lenguaje: las imágenes pegadas son descritas por un modelo VL configurable (Qwen-VL de forma predeterminada) antes de enviarse a DeepSeek.

9hace 21 díasVisión, voz y multimodalMIT
M

dsh-iris

mokuyoaxis/dsh-iris

Espacio de trabajo de medios y visión para DeepSeek Harness: generación de imágenes, vídeo y voz, preguntas y respuestas sobre imágenes y localización de elementos, OCR de imágenes largas, diferencia de píxeles, verificación mediante capturas de pantalla de HTML y resumen de vídeo, con proveedores DashScope y compatibles con OpenAI, grupos de modelos y un cliente de banco de trabajo.

7ayerHerramientas y funcionesMIT
5

dsh-vision

54xkeee/dsh-vision

Visión para DeepSeek de solo texto mediante Doubao Web de forma predeterminada (sin costo, sin clave de API: controla tu Chrome con sesión iniciada a través de un puente CDP de Windows), con cuota de Antigravity IDE (flash/pro) o alternativa a Gemini; escalado automático de detalle, memoria de evidencia visual con rehidratación tras compactación, caché por hash de contenido y un panel de cliente bilingüe.

7hace 2 mesesVisión, voz y multimodalMIT
Y

deepseek-harness-plugins (vision-bridge)

yinxe/deepseek-harness-plugins

Deja que los modelos de solo texto vean imágenes: cuando llega una imagen con un marcador como \[image omitted because this model accepts text only], el modelo llama a la herramienta vision_describe y el plugin reenvía la referencia de la imagen junto con la pregunta a un modelo multimodal, reintentando con un modelo de reserva si falla. Se configura en la página de ajustes y se conserva mediante la API oficial de ajustes.

6ayerVisión, voz y multimodalMIT
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

Visión bajo demanda para sesiones DSH solo de texto: las imágenes se convierten en marcadores, y una herramienta vision_describe envía solo la imagen y la pregunta a un modelo de visión compatible con OpenAI

5hace 2 mesesVisión, voz y multimodalMIT
A

dsh-guide-dog

atropinoltt/dsh-guide-dog

Plugin multimodal impulsado por MiniMax: modo de llamada de voz en tiempo real (conversación en streaming, interfaz de dock flotante), modo de voz y entrada de voz por micrófono, además de herramientas de generación de imagen/video/música/voz y de inspección visual.

5hace 2 mesesVisión, voz y multimodalMIT