Saltar al contenido principal

Plugins

Explora, filtra e instala plugins de DeepSeek-Harness.

86 plugins encontrados

L

modlens

liustack/modlens

Puente de visión para modelos de solo texto: pega una imagen y obtén evidencia JSON estructurada (OCR, diseño, semántica).

4khace 3 díasVisión, voz y multimodalMIT
Y

dsh-vision-router

ysr666/dsh-vision-router

Visión gratuita para agentes de solo texto: cadena de visión integrada sin clave más herramientas de píxeles (preguntas y respuestas, grounding, recorte, diff de píxeles, colores, OCR, trazado SVG, recorte de figuras, capturas de pantalla); pega una imagen para usarla.

1.1kayerVisión, voz y multimodalMIT
T

tongflow (dsh-tongflow)

tong-io/tongflow

Estudio de equipo de rodaje TongFlow para producción de imagen, voz, música y vídeo: el agente escribe archivos de flujo de trabajo TongFlow por recurso (.tongflow.json) que se ejecutan mediante complementos de TongFlow, con un lienzo de flujo integrado, una estructura de proyecto por plano/personaje/toma y una plantilla de manga-drama; las sesiones que comienzan con @tongflow abren la vista de estudio.

1khace 14 horasFlujos y automatizaciónAGPL-3.0
T

tongflow

tong-io/tongflow

Complemento de estudio TongFlow para DeepSeek Harness (dsh): modelo de proyecto al estilo de un equipo de rodaje, flujos de trabajo TongFlow creados por el agente, generación multimedia determinista, lienzo integrado.

870el mes pasadoVisión, voz y multimodalAGPL-3.0
O

watch-skill

oxbshw/watch-skill

Las capacidades de DeepWatch, instalables en un perfil de DeepSeek Harness existente.

378hace 6 díasVisión, voz y multimodalMIT
Z

dsh-crew

zseven-w/dsh-crew

Despacha trabajo a agentes DSH desde Claude Code o Codex: progreso nativo de subagentes, sesiones de trabajador en el host con ajustes predefinidos por nivel y un puente multimodal para visión y generación de imágenes.

149hace 7 díasIntegraciones y acceso remotoMIT
V

ark-cli (ark-managed-agents)

volcengine/ark-cli

Añade una pestaña de ajustes de Managed Agents y herramientas MCP para enviar tareas de agente de larga duración a Ark cloud Managed Agents.

133hace 3 díasHerramientas y funcionesApache-2.0
V

ark-cli (ark-plan-api)

volcengine/ark-cli

Registra Ark Agent Plan, Coding Plan y rutas de modelos de pospago en el selector nativo de modelos de DSH.

133hace 3 díasModelos y proveedoresApache-2.0
V

ark-cli

volcengine/ark-cli

Complemento de proveedor de Volcengine Ark para DeepSeek Harness (DSH): registra las rutas Agent Plan, Coding Plan y de pago posterior en el adaptador nativo pi-ai para que los modelos de Ark aparezcan en el selector de modelos.

112hace 25 díasModelos y proveedoresApache-2.0
S

dsh-AuthInOne

stormycry-cryp/dsh-authinone

Añade inicio de sesión de cuenta, configuración de API y Provider personalizado, cambio de modelo, fallback de imagen para modelos solo de texto y atribución de tokens/costos a DeepSeek Harness 47f.

104el mes pasadoModelos y proveedoresMIT
S

dsh-design-qa

sunxin-ai/dsh-design-qa

QA de fidelidad de diseño para modelos solo de texto: una herramienta `deepseek_vision` toma prestado un ojo de cualquier ruta de visión compatible con OpenAI, de modo que el modelo pueda juzgar si una implementación coincide con su maqueta — se entrega con el benchmark detrás de ese juicio (cuatro fixtures, 23 defectos inyectados, transcripciones en bruto) y la disciplina de cuestionamiento de la que depende.

44hace 14 díasVisión, voz y multimodalMIT
J

picturereader

jing-hy/picturereader

"Lectura" de imágenes para modelos de solo texto: reduce la escala + reduce la profundidad de color + convierte huellas de estructura/color en cuadrículas de texto que se devuelven a la conversación, permitiendo que el modelo haga zoom, muestreo y OCR de forma autónoma como un modelo multimodal; totalmente local y sin dependencia de modelos externos, incluye una skill de metodología de lectura de imágenes y PaddleOCR opcional.

36anteayerVisión, voz y multimodalMIT
O

dsh-vision

oil-oil/dsh-vision

Comprensión de imágenes casi nativa para DeepSeek Harness

24el mes pasadoVisión, voz y multimodalMIT
S

dsh-ros2

stvli/dsh-ros2

Conjunto de herramientas de depuración ROS2 y análisis de visión del estado del robot para DeepSeek Harness: enumeración de node/topic/service/action/interface/TF, JSON de topología completa del grafo, comprobaciones rosdep, builds con aprobación y andamiaje de mensajes personalizados, capturas de pantalla de GUI y observación de visión multimodal, más renderizado offscreen sin cabeza de RViz2 (mallas low-poly, lectura directa de píxeles, paso de GPU: renderizado de movimiento a 30 Hz) con análisis paralelo de VLM en tiempo real.

21hace 5 díasHerramientas y funcionesMIT
J

dsh-visual-plugin

jyh20030112/dsh-visual-plugin

Da visión a los modelos solo de texto: reenvía las imágenes del usuario a un modelo de visión compatible con OpenAI y muestra las descripciones en un panel derecho de la interfaz web.

16hace 19 díasVisión, voz y multimodalMIT
F

dsh-vision-proxy

flyvhidbwo/dsh-vision-proxy

Cerebro DeepSeek + transcripción automática de imágenes: adjunta imágenes en la GUI y cada una se transcribe mediante el modelo oficial deepseek-v4-flash-vision-exp por defecto (un cerebro V4-Pro puramente textual puede ver imágenes), con cualquier VLM compatible con OpenAI u Ollama local como alternativas.

14hace 26 díasVisión, voz y multimodalMIT
W

dsh-mmx-bridge

welsione/dsh-mmx-bridge

Puente multimodal MiniMax: una única herramienta `mmx_bridge` cubre comprensión/generación de imágenes, vídeo, TTS, música, portadas, búsqueda web y cuota; sustitución opcional de `web_search`/`read_image`; reproductores en línea/vistas previas de imágenes directamente en la GUI web (npm: `dsh-mmx-bridge`).

10hace 3 díasHerramientas y funcionesMIT
S

dsh-deepseek-vision

siegfly/dsh-deepseek-vision

Una ruta de proveedor de puerta de enlace de visión-lenguaje: las imágenes pegadas son descritas por un modelo VL configurable (Qwen-VL de forma predeterminada) antes de enviarse a DeepSeek.

9hace 10 díasVisión, voz y multimodalMIT
P

dsh-plugin-xiaomi-mimo-tts

ppy-web/dsh-plugin-xiaomi-mimo-tts

Añade controles de texto a voz Xiaomi MiMo para los mensajes finalizados del asistente, con voces predefinidas y diseño de voz personalizada.

7ayerVisión, voz y multimodalMIT
5

dsh-vision

54xkeee/dsh-vision

Visión para DeepSeek de solo texto mediante Doubao Web de forma predeterminada (sin costo, sin clave de API: controla tu Chrome con sesión iniciada a través de un puente CDP de Windows), con cuota de Antigravity IDE (flash/pro) o alternativa a Gemini; escalado automático de detalle, memoria de evidencia visual con rehidratación tras compactación, caché por hash de contenido y un panel de cliente bilingüe.

7el mes pasadoVisión, voz y multimodalMIT
Y

deepseek-harness-plugins (vision-bridge)

yinxe/deepseek-harness-plugins

Deja que los modelos de solo texto vean imágenes: cuando llega una imagen con un marcador como \[image omitted because this model accepts text only], el modelo llama a la herramienta vision_describe y el plugin reenvía la referencia de la imagen junto con la pregunta a un modelo multimodal, reintentando con un modelo de reserva si falla. Se configura en la página de ajustes y se conserva mediante la API oficial de ajustes.

5hace 22 horasVisión, voz y multimodalMIT
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

Visión bajo demanda para sesiones DSH solo de texto: las imágenes se convierten en marcadores, y una herramienta vision_describe envía solo la imagen y la pregunta a un modelo de visión compatible con OpenAI

5el mes pasadoVisión, voz y multimodalMIT
A

dsh-guide-dog

atropinoltt/dsh-guide-dog

Plugin multimodal impulsado por MiniMax: modo de llamada de voz en tiempo real (conversación en streaming, interfaz de dock flotante), modo de voz y entrada de voz por micrófono, además de herramientas de generación de imagen/video/música/voz y de inspección visual.

5el mes pasadoVisión, voz y multimodalMIT
Y

dsh-opencode-free-models (dsh-opencode-free-models)

yu-wenchao/dsh-opencode-free-models

Plugin de proveedor de modelos gratuitos para DSH con más de 20 modelos, incluidos Gemini, MiMo, GLM, etc.

4hace 18 díasModelos y proveedores