Saltar al contenido principal

Plugins

Explora, filtra e instala plugins de DeepSeek-Harness.

86 plugins encontrados

N

vision-exp-tile

nicholas023/vision-exp-tile

Reconocimiento de imágenes grandes para modelos vision-exp: reconocimiento por mosaicos 800×800 sin pérdida (smart/pipeline/full), OCR local con preprocesamiento y enrutamiento de escritura a mano, GPU multivendor opcional (DirectML/CUDA/OpenVINO) con fallback automático a CPU.

5el mes pasadoVisión, voz y multimodalMIT
B

dsh-ocr-local

balcoz/dsh-ocr-local

OCR local para DeepSeek Harness: pegue o adjunte una imagen, obtenga su texto mediante PP-OCRv5 + ONNX Runtime, totalmente sin conexión. TUI (cc-tui) y Web.

5hace 2 mesesVisión, voz y multimodal
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

Visión bajo demanda para sesiones DSH solo de texto: las imágenes se convierten en marcadores, y una herramienta vision_describe envía solo la imagen y la pregunta a un modelo de visión compatible con OpenAI

5hace 2 mesesVisión, voz y multimodalMIT
E

canvas-workbench

elangan1997-cmyk/canvas-workbench

Taller local de generación de imágenes, sin suscripciones: usa tu propia API para generar imágenes (cualquier interfaz compatible con OpenAI, suscripción cero), maquetación en lienzo + retoque/borrado/quitar fondo/OCR/vectorización, entrega PSD/AI editable, puente bidireccional a nivel de capa con Photoshop/Illustrator

4hace 3 díasVisión, voz y multimodalMIT
L

dsh-attachment-formats

linkingoscar/dsh-attachment-formats

Plugin web DeepSeek Harness — capa de texto PDF y OCR de PDF escaneado, Office docx/xlsx/pptx a Markdown, tarjetas de índice TIFF/epub y de documentos largos.

4hace 3 díasHerramientas y funcionesApache-2.0
X

dsh-vision-hub (tool-vision)

xing666173/dsh-vision-hub

Caja de herramientas de visión mejorada: 14 herramientas de visión a nivel de píxel (describe, ground, detect, crop, pixel-diff, OCR, OCR de captura larga, vectorize, colors, cutout, screenshot, present, materialize, html-screenshot) impulsadas por un endpoint compatible con OpenAI, con marcadores de puente limpios [图片: path], clasificación de seguridad de contenido y auto-retry por límite de tasa.

4el mes pasadoVisión, voz y multimodal
X

dsh-vision-hub (file-drop)

xing666173/dsh-vision-hub

Subida de archivos drag-and-drop para PDF, Word, Excel e imágenes: los archivos soltados se guardan en un directorio local y se referencian por ruta, sin bloat de base64 en el chat.

4el mes pasadoHerramientas y funciones
X

dsh-vision-hub (bridge-preview)

xing666173/dsh-vision-hub

Previsualización inline para marcadores de puente de imagen [图片: path]: tras renderizarse el marcador, la imagen se muestra en el chat automáticamente, manteniendo instrucciones largas fuera de la conversación.

4el mes pasadoSesiones y mensajes
M

dsh-nuphus-mcp

mrpulor-gh/dsh-nuphus-mcp

Complemento DSH oficial para nuphus-mcp (por los mantenedores de nuphus-mcp): automatización de escritorio y navegador (38 herramientas) con percepción de elementos PaddleOCR y navegación Chrome CDP, mediante un proceso hijo stdio MCP persistente.

4el mes pasadoHerramientas y funcionesMIT
G

deepseek-vision

gou-gee/deepseek-vision

Bundle de visión nativo de DeepSeek Harness: pega o arrastra imágenes, invoca modelos de visión compatibles con OpenAI mediante el deepseek-vision-mcp alojado.

4hace 2 mesesMCP y conectoresMIT
N

free-vision-skill

niyongsheng/free-vision-skill

Comprensión de imágenes y OCR completamente locales mediante el Vision Framework de macOS: `ocr_image` (texto, diseño de tabla + coordenadas) y `view_image` (escena, caras, QR): pega varias imágenes en el cuadro de entrada web o pasa ruta/URL/base64; las imágenes nunca salen de tu Mac.

4el mes pasadoVisión, voz y multimodalMIT
G

deepseek-vision (dsh-plugin-deepseek-vision)

gou-gee/deepseek-vision

Bundle MCP de visión y DSH para DeepSeek solo de texto: herramientas analyze_image, analyze_clipboard, compare_images y vision_status, una página de configuración visual, GLM-4.6V-Flash gratuito por defecto, almacenamiento en caché de resultados y tolerancia al límite de tasa; las claves no aparecen en los registros.

4hace 26 díasVisión, voz y multimodalMIT
C

dsh-learning-mode

chplus0/dsh-learning-mode

Preset de agente Learning Mode: un agente de codificación que enseña mientras codifica — explicaciones concretas basadas en escenarios, guía socrática y espacios de práctica TODO(你), modelado en el estilo de salida Learning de Claude Code; instalable vía dsh plugin add (dsh-learning-mode en npm).

4hace 2 mesesHerramientas y funciones
F

dsh-plugin-deepeye

favio8/dsh-plugin-deepeye

Plugin de visión DeepEye para DeepSeek Harness (DSH): descripción de imágenes, OCR, VQA, diseño de UI y análisis del portapapeles.

4hace 2 mesesVisión, voz y multimodal
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

Estación de trabajo omnimodal para DSH: analyze_image sobre una cadena ordenada de conmutación por error VLM de varias tarjetas, un conjunto de seis herramientas de visión (zoom, muestreo de color, diferencia de píxeles, OCR, detección de elementos y visualización en línea) que comparten el mismo resolutor de imágenes, generate_image mediante los protocolos OpenAI/DashScope/ComfyUI, generate_video asíncrono con varias tarjetas y un constructor /build-video-tool, y speak/clone_voice TTS en siete proveedores, todo gobernado por una única página de ajustes con autoguardado.

3hace 14 díasVisión, voz y multimodalMIT
X

dsh-image-vision

xiaoyuink/dsh-image-vision

Comprensión de imágenes para cualquier modelo de DSH: herramientas de visión, OCR, grounding y recorte con presets de dominio para histopatología, biología celular, anatomía, imágenes clínicas y figuras científicas.

3hace 29 díasVisión, voz y multimodal
Y

dsh-ui-spec

yumimanji/dsh-ui-spec

Complemento de DeepSeek Harness que convierte capturas de pantalla de UI en especificaciones web de grado de implementación usando OCR, geometría determinista, grafos de escena, recursos y comparación de renderizado.

3hace 2 mesesVisión, voz y multimodalMIT
F

dsh-wechat-mp-studio

funcwei/dsh-wechat-mp-studio

Estudio de contenido para cuentas oficiales de WeChat: escritura rotativa para evitar la homogeneización, manual de remediación para baja creatividad, línea base visual de imágenes de bendición, canalización gpt-image con aceptación por OCR y la API web de borradores xiaolvshu medida en la práctica.

3hace 2 mesesHabilidadesMIT
O

dsh-paddle-ocr

omdsh-dev/dsh-paddle-ocr

3hace 2 mesesVisión, voz y multimodalBSD-3-Clause
Y

dsh-md-convert

yakoylp/dsh-md-convert

Convierte documentos Office y PDF (incluidos los escaneados) a Markdown con formato estructural mediante un pipeline OCR con enrutamiento con prioridad de CPU (RapidOCR/SLANet/FormulaNet).

2hace 22 díasFlujos y automatizaciónMIT
L

dsh-visibridge

lhbsaa/dsh-visibridge

Evidencia visual estructurada (OCR/distribución/semántica) además de una herramienta de captura con cámara USB para un bucle de depuración «disparar-mirar-ajustar»; backends: Ollama, DeepSeek, Xiaomi.

2el mes pasadoVisión, voz y multimodalMIT
F

auto-mouse

fish121380/auto-mouse

Selector de contexto de UI de escritorio de Windows para Codex, DeepSeek Harness y clientes MCP: selecciona ventanas, elementos de UI o regiones de pantalla con resaltado al pasar el ratón, UI Automation, capturas de pantalla y OCR local, y luego revisa y aprueba el contexto Markdown/JSON antes de la salida.

2el mes pasadoHerramientas y funcionesMIT
G

dsh-vision-bridge

goodandready/dsh-vision-bridge

Enruta imágenes a un modelo de visión de tu elección — reescritura automática, herramientas explícitas o híbrido — para que un modelo de chat solo texto no falle un turno que contiene una imagen.

2hace 6 díasVisión, voz y multimodalMIT
3

dsh-vision (vision-tool)

314857493/dsh-vision

Herramienta `vision` invocable por el modelo para DeepSeek Harness: describe y aplica OCR a archivos de imagen llamando directamente a la API de visión gratuita Zhipu GLM (cadena de respaldo glm-4v-flash), sin necesidad de CLI externo.

2hace 28 díasVisión, voz y multimodalMIT