Pular para o conteúdo principal

Plugins

Navegue, filtre e instale plugins do DeepSeek-Harness.

76 plugins encontrados

O

watch-skill

oxbshw/watch-skill

Os recursos do DeepWatch, instaláveis em um perfil existente do DeepSeek Harness

378há 18 diasVisão, voz e multimodalMIT
P

dsh-omi-voice

polinnizhong/dsh-omi-voice

Leitura em voz alta no chat para o DeepSeek Harness: toque para ler, pausar e retomar as respostas da IA com vozes naturais do Doubao TTS (BYOK); lê apenas a resposta final, com código, tabelas e diagramas filtrados; motor local, o plugin não guarda nenhuma chave de API.

74mês passadoVisão, voz e multimodalMIT
P

dsh-voice-scribe

pensivefei/dsh-voice-scribe

Entrada de voz para a interface web: toque em Alt (ou Alt+Space) para iniciar/parar o ditado, Web Speech do navegador (sem configuração) ou ASR em nuvem compatível com OpenAI, polimento opcional por meio do LLM configurado no DSH, interface de configurações.

34há 3 diasVisão, voz e multimodalMIT
C

dsh-live2d-pets

cyanfish-x/dsh-live2d-pets

Overlay de mascote de mesa Live2D para a Web UI do DSH: espelha o estado do agente (pensando, ocioso, erro, concluído, aguardando aprovação) com movimentos e balões de fala, reações ao toque por parte, arrastar para encaixar, personas alternáveis e modelos personalizados via URL ou caminho local.

27há 9 diasSó por diversão
W

dsh-ears

wiziscool/dsh-ears

Plugin de entrada de voz para DeepSeek Harness (dsh): um botão de microfone no compositor converte fala em rascunho transcrito, com escolha de backends de reconhecimento de voz, refinamento opcional pelas próprias rotas LLM do dsh e uma página de configurações nativa.

21ontemVisão, voz e multimodalMIT
1

dsh-plugin-tts

1624318455/dsh-plugin-tts

Lê em voz alta as respostas do assistente via Edge TTS gratuito ou seus próprios modelos de voz RVC: botões de leitura em voz alta + leitura automática, reprodução progressiva em blocos adaptativos (leituras longas sem interrupções), instalação de pacotes de voz com um clique a partir de um registro e um runtime RVC portátil.

21há 6 diasVisão, voz e multimodalMIT
A

dsh-whale-girl-live2d

andersen216/dsh-whale-girl-live2d

Uma companheira Live2D de garota-baleia para a UI web do DeepSeek Harness: o modelo fica na tela e reage ao que o agente está realmente fazendo (pensando, chamadas de ferramenta, texto em streaming, erros, fim do turno); clique nela para enviar uma mensagem ao agente e ver a resposta surgir em um balão; clique com o botão direito para um menu de expressões, itens de vestir, cenários de mesa e animações de disparo único, cada ação mapeada a partir da folha de atalhos do autor do modelo original, de modo que nada se sobrepõe e tudo termina sozinho. Assets do modelo não comerciais (CC BY-NC-SA 4.0), código MIT, por Andersen216 (https://github.com/Andersen216).

20ontemSó por diversãoMIT
P

dsh-talk

perrylink/dsh-talk

I/O por voz para DeepSeek Harness — speech-to-text e text-to-speech pelo microfone e pela saída de áudio.

16há 8 diasVisão, voz e multimodalApache-2.0
Q

dsh-voice-mode (dsh-voice-mode)

qishuilalala/dsh-voice-mode

Modo de voz full-duplex para a Web UI do DeepSeek Harness: alternar (envio automático com pausa de 2s) ou ditação por pressionar e segurar em um rascunho editável com ASR streaming zipformer2, wake word opcional; leitura em voz alta sentença por sentença via Edge TTS com legendas ao vivo, e a fala interrompe a reprodução e o turno em execução (barge-in verdadeiro). ASR no dispositivo, sem chave de API.

15há 10 horasVisão, voz e multimodalMIT
P

dsh-plugin-xiaomi-mimo-tts

ppy-web/dsh-plugin-xiaomi-mimo-tts

Adiciona o texto-para-fala Xiaomi MiMo ao DSH Web, com leitura em voz alta das mensagens do assistente, streaming PCM, design de voz predefinido e personalizado, fallback de fala do navegador, controles de reprodução e sons de UI opcionais.

11há 3 diasVisão, voz e multimodalMIT
3

dsh-voice

3274375092/dsh-voice

Entrada de voz para DeepSeek Harness: fale ao microfone e o texto reconhecido é enviado como uma mensagem de chat normal, via reconhecimento de fala local ou do navegador.

8anteontemVisão, voz e multimodalMIT
A

dsh-web-whale-maid

acidgr/dsh-web-whale-maid

Pet de desktop de uma baleia empregada de anime para a interface web do DeepSeek Harness (dsh): diálogos com LLM em tempo real, 8 animações de humor, sistema de reserva de saciedade, balão de fala persistente e interface de armário adaptada para celular.

7há 22 diasSó por diversãoMIT
M

dsh-iris

mokuyoaxis/dsh-iris

Espaço de trabalho de mídia e visão para o DeepSeek Harness: geração de imagem, vídeo e fala, perguntas e respostas sobre imagens e localização de elementos, OCR de imagens longas, diff de pixels, verificação por captura de tela de HTML e sumarização de vídeo, com provedores DashScope e compatíveis com a OpenAI, pools de modelos e um cliente de bancada.

7anteontemFerramentas e funçõesMIT
M

dsh-alert-sound

machine-126/dsh-alert-sound

Alertas de áudio e voz para a Web GUI do dsh: tons diferenciados e fala opcional para aprovações, perguntas, conclusões e erros.

7há 10 diasIntegrações e acesso remotoMIT
Z

adhdgofly-dsh-ext

zuoguyoupan2023/adhdgofly-dsh-ext

Destaca classes gramaticais (substantivos em verde, verbos em vermelho, adjetivos/advérbios em roxo) no Markdown web DSH renderizado, com paletas clara/escura, alternâncias e atualizações com reconhecimento de fluxo.

6há 27 diasMelhorias de UIMIT
F

liang-desktop-pet (liang-harness-plugin)

flycat43/liang-desktop-pet

Companheiro de personagem arrastável para o perfil Web do DeepSeek Harness, com seis níveis visuais e de expressão, quatro modos de tarefa, chat da sessão atual, resumos públicos do raciocínio e síntese de voz do navegador.

5mês passadoSó por diversãoMIT
C

dsh-qq-onebot-bridge

cheesehaqi/dsh-qq-onebot-bridge

Ponte QQ bidirecional sobre OneBot v11 (WebSocket reverso): sessões por grupo e por chat privado, voz speech-to-text citada por @, visualização privada de imagens/figurinhas animadas, ferramentas de rosto e figurinha.

5há 19 diasIntegrações e acesso remotoMIT
0

dsh-voice-input

0nt-one/dsh-voice-input

Botão de microfone na linha de ferramentas do composer: speech-to-text Web Speech API (Chrome/Edge), troca de idioma, e auto-send opcional, zero dependências.

5há 2 mesesVisão, voz e multimodalMIT
A

dsh-guide-dog

atropinoltt/dsh-guide-dog

Plugin multimodal alimentado por MiniMax: modo de chamada de voz em tempo real (conversa em streaming, interface de dock flutuante), modo de voz e entrada de voz pelo microfone, além de ferramentas de geração de imagem/vídeo/música/fala e de inspeção visual.

5há 2 mesesVisão, voz e multimodalMIT
Y

Herta-dsh

yunmengyuan/herta-dsh

Instala a Herta como agente do DeepSeek Harness: um preset que traz seções de prompt de persona e memória dela, seis ferramentas de memória e voz, uma camada narrativa que separa o que ela pensa do que ela diz, 80 clipes de voz incluídos, síntese de fala offline e MiniMax, e duas visões de conversa que renderizam a sessão com os componentes dela.

4há 9 horasIntegrações e acesso remotoMIT
Y

dsh-tts-bridge

yuuyuko-uu/dsh-tts-bridge

Lê as conversas do DSH em voz alta usando a leitura em voz alta integrada da página web do DeepSeek, controlada por uma pequena extensão de navegador.

4há 3 diasVisão, voz e multimodal
S

dsh-voice

stardustlc666/dsh-voice

Ferramentas de voz: síntese de voz neural gratuita com edge-tts, transcrição ASR compatível com OpenAI, lista de vozes, pré-visualização de vozes em lote e autodiagnóstico de estado.

4há 10 horasVisão, voz e multimodalMIT
F

dsh-chatvoice

fuzzysoul/dsh-chatvoice

Loop de voz gratuito para a interface web: entrada de microfone via SpeechRecognition do navegador com resultados parciais em tempo real, além de botões de alto-falante para leitura em voz alta e leitura automática das respostas do assistente, sem configuração e sem chave de API.

4há 2 mesesVisão, voz e multimodalMIT
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

Estação de trabalho omni-modal para o DSH: analyze_image sobre uma cadeia ordenada de vários cartões VLM com comutação de recurso, um conjunto de seis ferramentas de visão (zoom, amostragem de cor, diff de píxeis, OCR, deteção de elementos, apresentação inline) que partilham o mesmo resolvedor de imagens, generate_image sobre protocolos OpenAI/DashScope/ComfyUI, generate_video assíncrono com vários cartões e um construtor /build-video-tool, e TTS speak/clone_voice sobre sete fornecedores, tudo controlado por uma única página de definições com gravação automática.

3há 14 diasVisão, voz e multimodalMIT