Pular para o conteúdo principal

Plugins

Navegue, filtre e instale plugins do DeepSeek-Harness.

86 plugins encontrados

N

vision-exp-tile

nicholas023/vision-exp-tile

Reconhecimento de imagens grandes para modelos vision-exp: reconhecimento por mosaicos 800×800 sem perda (smart/pipeline/full), OCR local com pré-processamento e encaminhamento de caligrafia, GPU multivendor opcional (DirectML/CUDA/OpenVINO) com fallback automático para CPU.

5mês passadoVisão, voz e multimodalMIT
B

dsh-ocr-local

balcoz/dsh-ocr-local

OCR local para DeepSeek Harness: cole ou anexe uma imagem, obtenha seu texto via PP-OCRv5 + ONNX Runtime, totalmente offline. TUI (cc-tui) e Web.

5há 2 mesesVisão, voz e multimodal
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

Visão sob demanda para sessões DSH somente texto: imagens se tornam marcadores, e uma ferramenta vision_describe envia apenas a imagem e a pergunta para um modelo de visão compatível com OpenAI

5há 2 mesesVisão, voz e multimodalMIT
E

canvas-workbench

elangan1997-cmyk/canvas-workbench

Bancada local de geração de imagens, assinatura zero: gere imagens com sua própria API (qualquer interface compatível com OpenAI, assinatura zero), layout de tela + edição/remoção de fundo/remoção de fundo/OCR/conversão para vetor, entrega em PSD/AI editável, ponte bidirecional em nível de camada com Photoshop/Illustrator

4há 3 diasVisão, voz e multimodalMIT
L

dsh-attachment-formats

linkingoscar/dsh-attachment-formats

Plugin Web do DeepSeek Harness — camada de texto de PDF e OCR de PDF escaneado, Office docx/xlsx/pptx para Markdown, cartões de índice TIFF/epub e documentos longos.

4há 3 diasFerramentas e funçõesApache-2.0
X

dsh-vision-hub (tool-vision)

xing666173/dsh-vision-hub

Toolbox de visão aprimorada: 14 ferramentas de visão em nível de pixel (describe, ground, detect, crop, pixel-diff, OCR, OCR de long-screenshot, vectorize, colors, cutout, screenshot, present, materialize, html-screenshot) acionadas por um endpoint compatível com OpenAI, com marcadores de bridge [图片: path] limpos, classificação de segurança de conteúdo e retry automático de rate-limit.

4mês passadoVisão, voz e multimodal
X

dsh-vision-hub (file-drop)

xing666173/dsh-vision-hub

Upload de arquivos por arrastar e soltar para PDF, Word, Excel e imagens: arquivos soltos são salvos em um diretório local e referenciados por caminho, sem inchaço de base64 no chat.

4mês passadoFerramentas e funções
X

dsh-vision-hub (bridge-preview)

xing666173/dsh-vision-hub

Pré-visualização inline para marcadores de bridge de imagem [图片: path]: após o marcador renderizar, a imagem aparece no chat automaticamente, mantendo instruções longas fora da conversa.

4mês passadoSessões e mensagens
M

dsh-nuphus-mcp

mrpulor-gh/dsh-nuphus-mcp

Plugin DSH oficial para nuphus-mcp (pelos mantenedores do nuphus-mcp): automação de desktop e navegador (38 ferramentas) com percepção de elementos PaddleOCR e navegação Chrome CDP, via um processo filho stdio MCP persistente.

4mês passadoFerramentas e funçõesMIT
G

deepseek-vision

gou-gee/deepseek-vision

Bundle de visão nativo do DeepSeek Harness: cole ou arraste imagens e chame modelos de visão compatíveis com OpenAI via o deepseek-vision-mcp gerenciado.

4há 2 mesesMCP e conectoresMIT
N

free-vision-skill

niyongsheng/free-vision-skill

Compreensão de imagens e OCR totalmente locais via Vision Framework do macOS: `ocr_image` (texto, layout de tabela + coordenadas) e `view_image` (cena, rostos, QR) — cole várias imagens na caixa de entrada da web ou passe caminho/URL/base64; as imagens nunca saem do seu Mac.

4mês passadoVisão, voz e multimodalMIT
G

deepseek-vision (dsh-plugin-deepseek-vision)

gou-gee/deepseek-vision

Pacote Vision MCP e DSH para DeepSeek somente texto: ferramentas analyze_image, analyze_clipboard, compare_images e vision_status, uma página de configurações visual, GLM-4.6V-Flash gratuito por padrão, cache de resultados e tolerância a rate limit; keys ficam fora dos logs.

4há 26 diasVisão, voz e multimodalMIT
C

dsh-learning-mode

chplus0/dsh-learning-mode

Preset de agente Learning Mode: um agente de codificação que ensina enquanto codifica — explicações concretas baseadas em cenários, orientação socrática e lacunas de prática TODO(你), modelado no estilo de saída Learning do Claude Code; instalável via dsh plugin add (dsh-learning-mode no npm).

4há 2 mesesFerramentas e funções
F

dsh-plugin-deepeye

favio8/dsh-plugin-deepeye

Plugin de visão DeepEye para o DeepSeek Harness (DSH): descrição de imagens, OCR, VQA, layout de UI e análise da área de transferência.

4há 2 mesesVisão, voz e multimodal
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

Estação de trabalho omni-modal para o DSH: analyze_image sobre uma cadeia ordenada de vários cartões VLM com comutação de recurso, um conjunto de seis ferramentas de visão (zoom, amostragem de cor, diff de píxeis, OCR, deteção de elementos, apresentação inline) que partilham o mesmo resolvedor de imagens, generate_image sobre protocolos OpenAI/DashScope/ComfyUI, generate_video assíncrono com vários cartões e um construtor /build-video-tool, e TTS speak/clone_voice sobre sete fornecedores, tudo controlado por uma única página de definições com gravação automática.

3há 14 diasVisão, voz e multimodalMIT
X

dsh-image-vision

xiaoyuink/dsh-image-vision

Compreensão de imagens para qualquer modelo do DSH: ferramentas de visão, OCR, grounding e recorte com presets de domínio para histopatologia, biologia celular, anatomia, imagens clínicas e figuras científicas.

3há 29 diasVisão, voz e multimodal
Y

dsh-ui-spec

yumimanji/dsh-ui-spec

Plugin do DeepSeek Harness que transforma capturas de tela de UI em especificações web de nível de implementação usando OCR, geometria determinística, grafos de cena, assets e comparação de renderização.

3há 2 mesesVisão, voz e multimodalMIT
F

dsh-wechat-mp-studio

funcwei/dsh-wechat-mp-studio

Estúdio de conteúdo para Conta Oficial do WeChat: escrita em rotação para evitar homogeneização, playbook de remediação para baixa criatividade, baseline visual de imagens de bênção, pipeline gpt-image com aceitação por OCR e a API web de rascunho xiaolvshu medida na prática.

3há 2 mesesHabilidadesMIT
O

dsh-paddle-ocr

omdsh-dev/dsh-paddle-ocr

3há 2 mesesVisão, voz e multimodalBSD-3-Clause
Y

dsh-md-convert

yakoylp/dsh-md-convert

Converte documentos Office e PDFs (incluindo os digitalizados) em Markdown estruturalmente formatado por meio de um pipeline OCR com roteamento priorizando CPU (RapidOCR/SLANet/FormulaNet).

2há 22 diasFluxos e automaçãoMIT
L

dsh-visibridge

lhbsaa/dsh-visibridge

Evidência visual estruturada (OCR/layout/semântica) além de uma ferramenta de captura por câmera USB para um loop de depuração "atirar-olhar-ajustar"; backends: Ollama, DeepSeek, Xiaomi.

2mês passadoVisão, voz e multimodalMIT
F

auto-mouse

fish121380/auto-mouse

Seletor de contexto de UI do desktop Windows para Codex, DeepSeek Harness e clientes MCP: seleciona janelas, elementos de UI ou regiões da tela com destaque ao passar o mouse, UI Automation, capturas de tela e OCR local, e depois revisa e aprova o contexto Markdown/JSON antes da saída.

2mês passadoFerramentas e funçõesMIT
G

dsh-vision-bridge

goodandready/dsh-vision-bridge

Encaminha imagens para um modelo de visão à sua escolha — reescrita automática, ferramentas explícitas ou híbrido — para que um modelo de chat apenas de texto não falhe em um turno que contenha uma imagem.

2há 6 diasVisão, voz e multimodalMIT
3

dsh-vision (vision-tool)

314857493/dsh-vision

Ferramenta `vision` invocável pelo modelo para o DeepSeek Harness: descreve e faz OCR de arquivos de imagem chamando diretamente a API de visão Zhipu GLM gratuita (cadeia de fallback glm-4v-flash), sem precisar de CLI externo.

2há 28 diasVisão, voz e multimodalMIT