Pular para o conteúdo principal

Plugins

Navegue, filtre e instale plugins do DeepSeek-Harness.

47 plugins encontrados

Y

dsh-vision-router

ysr666/dsh-vision-router

Visão gratuita para agentes somente-texto: cadeia de visão integrada sem chave, além de ferramentas de pixel (perguntas e respostas, grounding, recorte, diff de pixels, cores, OCR, rastreamento SVG, recorte de objetos, capturas de tela); cole uma imagem para usar.

1.1kontemVisão, voz e multimodalMIT
A

dsh-vision-toolkit

anionex/dsh-vision-toolkit

Visão para modelos apenas de texto: cole uma imagem e o modelo muda para a variante Vision Toolkit para perguntas e respostas sobre imagens, comparação de múltiplas imagens, OCR de capturas longas, reprodução de UI a partir de capturas, localização de elementos e diferença de pixels. Sem chave de API por padrão — as imagens são processadas pelo serviço gratuito hospedado pelo autor, 100 por máquina por dia; configurável para seu próprio provedor.

887anteontemVisão, voz e multimodalMIT
O

dsh-vision

oil-oil/dsh-vision

Compreensão de imagens quase nativa para o DeepSeek Harness

24há 2 mesesVisão, voz e multimodalMIT
F

dsh-vision-proxy

flyvhidbwo/dsh-vision-proxy

Cérebro DeepSeek + transcrição automática de imagens: anexe imagens na GUI e cada uma é transcrita pelo deepseek-v4-flash-vision-exp oficial por padrão (um cérebro V4-Pro puramente textual pode ver imagens), com qualquer VLM compatível com OpenAI ou Ollama local como alternativas.

15mês passadoVisão, voz e multimodalMIT
P

dsh-vision-opencode

poiuyjie/dsh-vision-opencode

Adiciona um modelo de visão configurável a modelos principais somente de texto: uma ferramenta vision_read_image, um seletor de modelo de visão na barra do compositor e conversão automática de imagem para texto em rotas somente de texto.

13há 23 diasVisão, voz e multimodalMIT
L

dsh-vision

linenxi-ctrl/dsh-vision

Plugin de visão externa para o DeepSeek Harness: painel de configuração via botão da baleia, reconhecimento de imagens com resposta automática e ferramentas de captura de tela/reconhecimento para o agente.

9há 2 mesesVisão, voz e multimodalMIT
5

dsh-vision

54xkeee/dsh-vision

Visão para o DeepSeek somente-texto via Doubao Web por padrão (sem custo, sem chave de API — controla seu Chrome logado por meio de uma ponte CDP do Windows), com cota do Antigravity IDE (flash/pro) ou fallback para o Gemini; escalonamento automático de detalhe, memória de evidências visuais com reidratação após compactação, cache por hash de conteúdo e um painel de cliente bilíngue.

7há 2 mesesVisão, voz e multimodalMIT
L

dsh-drop-to-path

loudmore/dsh-drop-to-path

Plugin DSH: leva imagens e arquivos diretamente a modelos somente-texto — as imagens mantêm a experiência nativa de anexo, enquanto PDF/Office/compactados/vídeo/áudio aparecem como blocos na barra de anexos; ao enviar, são convertidos automaticamente em caminhos do workspace; combinado com o dsh-vision-toolkit, basta colar para ver a imagem. Um plugin DSH que entrega imagens E arquivos a modelos somente-texto como caminhos de workspace: as imagens mantêm a UI nativa de anexo, os demais arquivos aparecem como chips quadrados na barra, e os caminhos são anexados ao enviar — combina com o dsh-vision-toolkit.

6há 2 mesesMelhorias de UIMIT
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

Visão sob demanda para sessões DSH somente texto: imagens se tornam marcadores, e uma ferramenta vision_describe envia apenas a imagem e a pergunta para um modelo de visão compatível com OpenAI

5há 2 mesesVisão, voz e multimodalMIT
X

dsh-vision-hub (tool-vision)

xing666173/dsh-vision-hub

Toolbox de visão aprimorada: 14 ferramentas de visão em nível de pixel (describe, ground, detect, crop, pixel-diff, OCR, OCR de long-screenshot, vectorize, colors, cutout, screenshot, present, materialize, html-screenshot) acionadas por um endpoint compatível com OpenAI, com marcadores de bridge [图片: path] limpos, classificação de segurança de conteúdo e retry automático de rate-limit.

4mês passadoVisão, voz e multimodal
X

dsh-vision-hub (file-drop)

xing666173/dsh-vision-hub

Upload de arquivos por arrastar e soltar para PDF, Word, Excel e imagens: arquivos soltos são salvos em um diretório local e referenciados por caminho, sem inchaço de base64 no chat.

4mês passadoFerramentas e funções
X

dsh-vision-hub (bridge-preview)

xing666173/dsh-vision-hub

Pré-visualização inline para marcadores de bridge de imagem [图片: path]: após o marcador renderizar, a imagem aparece no chat automaticamente, mantendo instruções longas fora da conversa.

4mês passadoSessões e mensagens
1

dsh-vision-sidecar

121103qwq/dsh-vision-sidecar

Sidecar de visão gratuito e hospedado para o DeepSeek Harness, com evidências duráveis por sessão

4há 2 mesesVisão, voz e multimodalMIT
G

dsh-vision-bridge

gxx182/dsh-vision-bridge

Conecta imagens da sessão a provedores de visão configuráveis e retorna análise somente texto para rotas de modelos elegíveis do DeepSeek Harness.

4há 2 mesesVisão, voz e multimodalMIT
P

dsh-agent-router

peterwangze/dsh-agent-router

Plugin de roteamento multimodelo para DeepSeek Harness: deixe as tarefas especializadas para agentes especializados — personalize agentes profissionais (visão/tradução/voz/subagente, etc.) e vincule-os a modelos independentes; login com um clique para contas multimodais, roteamento de integridade do pool de contas e estatísticas de uso em tempo real.

3há 2 mesesModelos e provedoresMIT
T

dsh-plugins (dsh-vision)

tzhr-invest/dsh-plugins

Ferramenta de visão invocável pelo agente que descreve imagens locais por meio de qualquer endpoint de visão compatível com OpenAI que você configurar, com verificação cruzada opcional de vários modelos e sem chaves embutidas.

3há 5 diasVisão, voz e multimodalMIT
M

dsh-vision-tools

moon09300731/dsh-vision-tools

Pacote completo de capacidades de visão para DeepSeek Harness: uma ferramenta vision_understand (APIs de visão compatíveis com OpenAI, Zhipu GLM-4V-Flash gratuito por padrão) além de pontos de entrada de colar/arrastar e soltar/botão para reconhecimento de imagens.

3há 2 mesesVisão, voz e multimodalMIT
H

dsh-vision-mix

haiziyao/dsh-vision-mix

Combine APIs de texto, visão e geração de imagens em um modelo Mix único com roteamento automático: solicitações só de texto vão para o modelo de chat, imagens do usuário e capturas do agente vão para o modelo de visão, acompanhamentos continuam usando a mesma imagem de sessão, e agentes podem gerar ou editar imagens com histórico de chamadas no escopo da sessão.

3há 25 diasVisão, voz e multimodalMIT
N

dsh-vision-plugin

nexsjournal/dsh-vision-plugin

Instala uma caixa de seleção de entrada de imagem no catálogo Models para que um modelo personalizado possa declarar entrada de imagem e receber imagens diretamente; inclui um relé de visão BYO opcional.

3há 2 mesesMelhorias de UIMIT
B

dsh-vision-plugin

bug-huntter/dsh-vision-plugin

Reconhecimento de imagens configurável para modelos DSH somente de texto: as mensagens de imagem são primeiro transcritas por um modelo de visão compatível com OpenAI (URL base, ID do modelo e chave API definidos numa secção de Definições) e depois passadas ao modelo principal como texto, enquanto o suporte a entrada de imagem é anunciado. O esquema de autenticação por chave API é selecionável (cabeçalhos de pedido estilo OpenAI, Anthropic, Gemini ou Azure) e a falta de uma chave é comunicada antes de qualquer pedido ser enviado.

2há 5 diasVisão, voz e multimodalMIT
G

dsh-vision-bridge

goodandready/dsh-vision-bridge

Encaminha imagens para um modelo de visão à sua escolha — reescrita automática, ferramentas explícitas ou híbrido — para que um modelo de chat apenas de texto não falhe em um turno que contenha uma imagem.

2há 6 diasVisão, voz e multimodalMIT
X

dsh-vision

xiaoshihou514/dsh-vision

Extensão nativa de capacidade de visão, usando Zhipu (grátis) ou Qwen-VL (local).

2mês passadoVisão, voz e multimodalMIT
K

dsh-vision-recognizer

kaixinbaba/dsh-vision-recognizer

Rota de provedor de visão que transcreve imagens anexadas em texto por meio de um modelo configurável (mais de 15 fornecedores compatíveis com OpenAI e Anthropic) enquanto o DeepSeek continua respondendo.

2mês passadoVisão, voz e multimodalMIT
3

dsh-vision (vision-tool)

314857493/dsh-vision

Ferramenta `vision` invocável pelo modelo para o DeepSeek Harness: descreve e faz OCR de arquivos de imagem chamando diretamente a API de visão Zhipu GLM gratuita (cadeia de fallback glm-4v-flash), sem precisar de CLI externo.

2há 28 diasVisão, voz e multimodalMIT