Pular para o conteúdo principal

Plugins

Navegue, filtre e instale plugins do DeepSeek-Harness.

7 plugins encontrados

S

dsh-design-qa

sunxin-ai/dsh-design-qa

QA de fidelidade de design para modelos somente texto: uma ferramenta `deepseek_vision` empresta um olho de qualquer rota de visão compatível com OpenAI, para que o modelo possa julgar se uma implementação corresponde ao seu mock — fornecida com o benchmark por trás desse julgamento (quatro fixtures, 23 defeitos injetados, transcrições brutas) e a disciplina de questionamento da qual ele depende.

44há 26 diasVisão, voz e multimodalMIT
S

dsh-deepseek-vision

siegfly/dsh-deepseek-vision

Uma rota de provedor de gateway de visão-linguagem: as imagens coladas são descritas por um modelo VL configurável (Qwen-VL por padrão) antes de serem enviadas ao DeepSeek.

9há 21 diasVisão, voz e multimodalMIT
W

visual-review

wang-bool/visual-review

Renderiza imagens coladas ou enviadas diretamente no chat do DSH Web e dá visão a modelos apenas de texto: a ferramenta visual_review, invocável pelo modelo, chama primeiro qualquer API multimodal compatível com OpenAI e, se falhar, recorre a um worker local do Qwen3-VL.

3há 2 mesesVisão, voz e multimodalMIT
X

dsh-vision

xiaoshihou514/dsh-vision

Extensão nativa de capacidade de visão, usando Zhipu (grátis) ou Qwen-VL (local).

2mês passadoVisão, voz e multimodalMIT
Z

dsh-plugins

zjcdkj/dsh-plugins

Plugin out-of-tree para DeepSeek Harness: dá olhos a um modelo de codificação somente texto roteando imagens para uma rota Qwen-VL (DashScope) via ctx.llm e retornando texto.

1mês passadoVisão, voz e multimodalMIT
S

multimodal-bridge

spirit4471/multimodal-bridge

Pacote de plugins do DeepSeek Harness: ferramentas qwen_vision (compreensão de imagens via Qwen-VL) e qwen_generate (texto para imagem via Qwen-Image) para modelos somente de texto

1há 2 mesesVisão, voz e multimodalMIT
L

dsh-mingmu

lab-sku/dsh-mingmu

明眸 VisionBridge - Ponte visual própria: quando um modelo cego recebe imagens, chama automaticamente um modelo visual para reconhecê-las e devolve o texto reconhecido ao modelo principal; transparente, configurável e sem perdas ao atualizar.

0há 2 mesesVisão, voz e multimodalMIT