Pular para o conteúdo principal

Plugins

Navegue, filtre e instale plugins do DeepSeek-Harness.

86 plugins encontrados

L

modlens

liustack/modlens

Ponte de visão para modelos somente-texto: cole uma imagem e receba evidências estruturadas em JSON (OCR, layout, semântica).

4khá 3 diasVisão, voz e multimodalMIT
Y

dsh-vision-router

ysr666/dsh-vision-router

Visão gratuita para agentes somente-texto: cadeia de visão integrada sem chave, além de ferramentas de pixel (perguntas e respostas, grounding, recorte, diff de pixels, cores, OCR, rastreamento SVG, recorte de objetos, capturas de tela); cole uma imagem para usar.

1.1kontemVisão, voz e multimodalMIT
T

tongflow (dsh-tongflow)

tong-io/tongflow

Estúdio de equipe de filmagem TongFlow para produção de imagem, voz, música e vídeo: o agente escreve arquivos de fluxo de trabalho TongFlow por recurso (.tongflow.json) que são executados por plugins do TongFlow, com uma tela de fluxo incorporada, layout de projeto por plano/personagem/tomada e um modelo de mangá-drama; sessões iniciadas com @tongflow abrem a visualização de Estúdio.

1khá 14 horasFluxos e automaçãoAGPL-3.0
T

tongflow

tong-io/tongflow

Plugin de estúdio TongFlow para DeepSeek Harness (dsh): modelo de projeto no estilo de equipe de filmagem, fluxos de trabalho TongFlow criados pelo agente, geração de mídia determinística, tela incorporada.

870mês passadoVisão, voz e multimodalAGPL-3.0
O

watch-skill

oxbshw/watch-skill

Os recursos do DeepWatch, instaláveis em um perfil existente do DeepSeek Harness

378há 6 diasVisão, voz e multimodalMIT
Z

dsh-crew

zseven-w/dsh-crew

Despache trabalho para agentes DSH a partir do Claude Code ou Codex: progresso nativo de subagentes, sessões de worker no host com predefinições por nível e uma ponte multimodal para visão e geração de imagens.

149há 7 diasIntegrações e acesso remotoMIT
V

ark-cli (ark-managed-agents)

volcengine/ark-cli

Adiciona uma aba de configurações Managed Agents e ferramentas MCP para despachar tarefas de agente de longa duração para o Ark cloud Managed Agents.

133há 3 diasFerramentas e funçõesApache-2.0
V

ark-cli (ark-plan-api)

volcengine/ark-cli

Registra as rotas Ark Agent Plan, Coding Plan e de modelos pós-pagos no seletor nativo de modelos do DSH.

133há 3 diasModelos e provedoresApache-2.0
V

ark-cli

volcengine/ark-cli

Plugin de provedor Volcengine Ark para o DeepSeek Harness (DSH): registra as rotas Agent Plan, Coding Plan e pós-pagas no adaptador nativo pi-ai para que os modelos Ark apareçam no seletor de modelos.

112há 25 diasModelos e provedoresApache-2.0
S

dsh-AuthInOne

stormycry-cryp/dsh-authinone

Adiciona login de conta, configuração de API e Provider personalizado, troca de modelo, fallback de imagem para modelos somente de texto e atribuição de token/custo ao DeepSeek Harness 47f.

104mês passadoModelos e provedoresMIT
S

dsh-design-qa

sunxin-ai/dsh-design-qa

QA de fidelidade de design para modelos somente texto: uma ferramenta `deepseek_vision` empresta um olho de qualquer rota de visão compatível com OpenAI, para que o modelo possa julgar se uma implementação corresponde ao seu mock — fornecida com o benchmark por trás desse julgamento (quatro fixtures, 23 defeitos injetados, transcrições brutas) e a disciplina de questionamento da qual ele depende.

44há 14 diasVisão, voz e multimodalMIT
J

picturereader

jing-hy/picturereader

"Leitura" de imagens para modelos somente de texto: reduz a escala + reduz a profundidade de cor + converte impressões digitais de estrutura/cor em grades de texto devolvidas à conversa, permitindo que o modelo faça zoom, amostragem e OCR de forma autônoma como um modelo multimodal; totalmente local, sem dependência de modelo externo, inclui uma skill de metodologia de leitura de imagem e PaddleOCR opcional.

36anteontemVisão, voz e multimodalMIT
O

dsh-vision

oil-oil/dsh-vision

Compreensão de imagens quase nativa para o DeepSeek Harness

24mês passadoVisão, voz e multimodalMIT
S

dsh-ros2

stvli/dsh-ros2

Conjunto de ferramentas de depuração ROS2 e análise de visão do estado do robô para DeepSeek Harness: enumeração de node/topic/service/action/interface/TF, JSON de topologia do grafo inteiro, verificações rosdep, builds com gate de aprovação e scaffolding de mensagens customizadas, capturas de tela da GUI e observação de visão multimodal, além de renderização offscreen RViz2 headless (malhas low-poly, leitura direta de pixel, passthrough GPU - renderização de movimento a 30Hz) com análise VLM paralela em tempo real.

21há 5 diasFerramentas e funçõesMIT
J

dsh-visual-plugin

jyh20030112/dsh-visual-plugin

Dá visão a modelos somente de texto: encaminha as imagens do usuário para um modelo de visão compatível com OpenAI e exibe as descrições em um painel direito da interface web.

16há 19 diasVisão, voz e multimodalMIT
F

dsh-vision-proxy

flyvhidbwo/dsh-vision-proxy

Cérebro DeepSeek + transcrição automática de imagens: anexe imagens na GUI e cada uma é transcrita pelo deepseek-v4-flash-vision-exp oficial por padrão (um cérebro V4-Pro puramente textual pode ver imagens), com qualquer VLM compatível com OpenAI ou Ollama local como alternativas.

14há 26 diasVisão, voz e multimodalMIT
W

dsh-mmx-bridge

welsione/dsh-mmx-bridge

Ponte multimodal MiniMax: uma única ferramenta `mmx_bridge` cobre compreensão/geração de imagens, vídeo, TTS, música, capas, busca na web e cota; substituição opcional de `web_search`/`read_image`; players e pré-visualizações de imagem embutidos diretamente na GUI web (npm: `dsh-mmx-bridge`).

10há 3 diasFerramentas e funçõesMIT
S

dsh-deepseek-vision

siegfly/dsh-deepseek-vision

Uma rota de provedor de gateway de visão-linguagem: as imagens coladas são descritas por um modelo VL configurável (Qwen-VL por padrão) antes de serem enviadas ao DeepSeek.

9há 10 diasVisão, voz e multimodalMIT
P

dsh-plugin-xiaomi-mimo-tts

ppy-web/dsh-plugin-xiaomi-mimo-tts

Adiciona controles de texto para fala Xiaomi MiMo para mensagens finalizadas do assistente, com vozes predefinidas e design de voz personalizada.

7ontemVisão, voz e multimodalMIT
5

dsh-vision

54xkeee/dsh-vision

Visão para o DeepSeek somente-texto via Doubao Web por padrão (sem custo, sem chave de API — controla seu Chrome logado por meio de uma ponte CDP do Windows), com cota do Antigravity IDE (flash/pro) ou fallback para o Gemini; escalonamento automático de detalhe, memória de evidências visuais com reidratação após compactação, cache por hash de conteúdo e um painel de cliente bilíngue.

7mês passadoVisão, voz e multimodalMIT
Y

deepseek-harness-plugins (vision-bridge)

yinxe/deepseek-harness-plugins

Deixe os modelos apenas de texto ver imagens: quando chega uma imagem com um marcador como \[image omitted because this model accepts text only], o modelo chama a ferramenta vision_describe e o plugin encaminha a referência da imagem mais a pergunta para um modelo multimodal, repetindo com um modelo de recurso em caso de falha. Configurado na página de definições e persistido através da API oficial de definições.

5há 22 horasVisão, voz e multimodalMIT
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

Visão sob demanda para sessões DSH somente texto: imagens se tornam marcadores, e uma ferramenta vision_describe envia apenas a imagem e a pergunta para um modelo de visão compatível com OpenAI

5mês passadoVisão, voz e multimodalMIT
A

dsh-guide-dog

atropinoltt/dsh-guide-dog

Plugin multimodal alimentado por MiniMax: modo de chamada de voz em tempo real (conversa em streaming, interface de dock flutuante), modo de voz e entrada de voz pelo microfone, além de ferramentas de geração de imagem/vídeo/música/fala e de inspeção visual.

5mês passadoVisão, voz e multimodalMIT
Y

dsh-opencode-free-models (dsh-opencode-free-models)

yu-wenchao/dsh-opencode-free-models

Plugin de provedor de modelos gratuitos para o DSH com mais de 20 modelos, incluindo Gemini, MiMo, GLM, etc.

4há 18 diasModelos e provedores