Pular para o conteúdo principal

Plugins

Navegue, filtre e instale plugins do DeepSeek-Harness.

125 plugins encontrados

W

dsh-appshots

wongyuye/dsh-appshots

Captura de janela ao estilo Codex para o DSH Desktop no macOS e Windows: pressione ambas as teclas Command (macOS) ou ambas as teclas Ctrl (Windows), ou o botão de câmera, para capturar a janela frontal, anexá-la ao chat atual e injetar uma árvore de acessibilidade estilo VoiceOver como contexto oculto.

7há 15 diasVisão, voz e multimodalMIT
M

dsh-alert-sound

machine-126/dsh-alert-sound

Alertas de áudio e voz para a Web GUI do dsh: tons diferenciados e fala opcional para aprovações, perguntas, conclusões e erros.

7há 10 diasIntegrações e acesso remotoMIT
R

dsh-plugin-call-me

radres/dsh-plugin-call-me

Faz seu telefone tocar via CallKit: ferramentas `call_me` e `text_me`, além de ligações opcionais de fim de turno e de aprovação, cuja resposta falada é transcrita de volta para a sessão.

7mês passadoIntegrações e acesso remotoMIT
Y

dsh-duet

yums/dsh-duet

Interação por voz em chinês full-duplex para DSH Web: dite e edite tarefas, envie solicitações, gerencie sessões, responda perguntas do DSH e ouça anúncios concisos de conclusão de tarefas.

6há 3 diasVisão, voz e multimodalApache-2.0
Z

dsh-voice-input-plugin

zhangbo-cn/dsh-voice-input-plugin

Microfone do compositor para a interface web: toque para monitorar a transcrição ao vivo e segure para falar, com leitura da resposta por Edge TTS do host transmitida enquanto o modelo gera, pausa de eco durante a leitura e toque para parar.

6mês passadoVisão, voz e multimodalMIT
C

dsh-qq-onebot-bridge

cheesehaqi/dsh-qq-onebot-bridge

Ponte QQ bidirecional sobre OneBot v11 (WebSocket reverso): sessões por grupo e por chat privado, voz speech-to-text citada por @, visualização privada de imagens/figurinhas animadas, ferramentas de rosto e figurinha.

5há 19 diasIntegrações e acesso remotoMIT
L

dsh-wechat-bridge

lanbaolu/dsh-wechat-bridge

Bridge WeChat bidirecional para DeepSeek Harness via protocolo iLink: vincule seu WeChat pessoal com um escaneamento de QR e converse com um agente DSH local a partir da caixa de chat (texto, imagens, voz para texto, arquivos); um painel de configurações web lida com vinculação/início/parada/status, vinculação de sessão de projeto continua a conversa no desktop, notificações proativas wechat_notify incluem throttling, e o daemon puramente em Node roda em Windows/macOS/Linux.

5há 4 diasIntegrações e acesso remotoMIT
0

dsh-voice-input

0nt-one/dsh-voice-input

Botão de microfone na linha de ferramentas do composer: speech-to-text Web Speech API (Chrome/Edge), troca de idioma, e auto-send opcional, zero dependências.

5há 2 mesesVisão, voz e multimodalMIT
A

dsh-guide-dog

atropinoltt/dsh-guide-dog

Plugin multimodal alimentado por MiniMax: modo de chamada de voz em tempo real (conversa em streaming, interface de dock flutuante), modo de voz e entrada de voz pelo microfone, além de ferramentas de geração de imagem/vídeo/música/fala e de inspeção visual.

5há 2 mesesVisão, voz e multimodalMIT
Y

Herta-dsh

yunmengyuan/herta-dsh

Instala a Herta como agente do DeepSeek Harness: um preset que traz seções de prompt de persona e memória dela, seis ferramentas de memória e voz, uma camada narrativa que separa o que ela pensa do que ela diz, 80 clipes de voz incluídos, síntese de fala offline e MiniMax, e duas visões de conversa que renderizam a sessão com os componentes dela.

4há 8 horasIntegrações e acesso remotoMIT
L

dsh-plugin-memory

littleblacktong/dsh-plugin-memory

Memória de longo prazo em markdown entre sessões, com estrutura LLM-Wiki e persona SOUL.md, injetada no início da sessão (por padrão só após a primeira mensagem do usuário e só na sessão ativa), com fluxos remember/recall/consolidate/forget, skill de memória embutida, ferramentas de migração pack/unpack e um lembrete de recall em primeira pessoa ocioso. Traz observabilidade e manutenção: orçamento de bloco de boot por arquivo, carimbo automático de last_access, painel somente leitura de saúde da memória, compilador declarativo de índice, grafo de memória interativo, consultas estruturadas (tag/tipo/saliência) e sugestões de links cruzados. O payload de boot caiu ~23%.

4há 4 diasMemóriaMIT
S

dsh-voice

stardustlc666/dsh-voice

Ferramentas de voz: síntese de voz neural gratuita com edge-tts, transcrição ASR compatível com OpenAI, lista de vozes, pré-visualização de vozes em lote e autodiagnóstico de estado.

4há 9 horasVisão, voz e multimodalMIT
H

dsh-voice

haoku123/dsh-voice

Modo de voz full-duplex para a interface web: ditado por toque para alternar ou manter pressionado (tecla de envio ou `Ctrl`) com legendas ao vivo, ASR SenseVoice do lado do host via sherpa-onnx, respostas faladas frase por frase, e falar interrompe a reprodução e o turno em execução (verdadeira interrupção). Sem chave de API.

4mês passadoVisão, voz e multimodalMIT
F

dsh-chatvoice

fuzzysoul/dsh-chatvoice

Loop de voz gratuito para a interface web: entrada de microfone via SpeechRecognition do navegador com resultados parciais em tempo real, além de botões de alto-falante para leitura em voz alta e leitura automática das respostas do assistente, sem configuração e sem chave de API.

4há 2 mesesVisão, voz e multimodalMIT
Z

dsh-window (kit)

zichenggurrr/dsh-window

Pacote tudo em um para o DSH: janela de desktop nativa do Windows (WebView2), visão DeepEye (GLM-4V-Flash) e entrada de voz (botão de microfone) em uma única instalação.

4há 2 mesesMelhorias de UIMIT
L

dsh-plugin-notify-sound

ldchaowin/dsh-plugin-notify-sound

Toques de conclusão por workspace, além de sons de atenção para eventos de aprovação, pergunta, revisão de plano, objetivo bloqueado e falha de tarefa, com sintetizador embutido, voz (TTS) e áudio personalizado

4há 2 mesesIntegrações e acesso remotoMIT
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

Estação de trabalho omni-modal para o DSH: analyze_image sobre uma cadeia ordenada de vários cartões VLM com comutação de recurso, um conjunto de seis ferramentas de visão (zoom, amostragem de cor, diff de píxeis, OCR, deteção de elementos, apresentação inline) que partilham o mesmo resolvedor de imagens, generate_image sobre protocolos OpenAI/DashScope/ComfyUI, generate_video assíncrono com vários cartões e um construtor /build-video-tool, e TTS speak/clone_voice sobre sete fornecedores, tudo controlado por uma única página de definições com gravação automática.

3há 14 diasVisão, voz e multimodalMIT
W

dsh-hold-to-talk

wangzhanchao883/dsh-hold-to-talk

Entrada com uma só mão e sem teclado para o compositor: prima e mantenha o rato na caixa de entrada, fale, largue — o texto fica no rascunho, e deslizar para cima cancela sem deixar uma meia frase para trás. Não há botão de microfone para acertar nem atalho para memorizar; a mão nunca precisa de sair da área de entrada, o que é essencial quando a outra mão está ocupada. O reconhecimento corre totalmente offline (SenseVoice via sherpa-onnx, sem chave de API, o áudio nunca sai da máquina).

3há 22 horasVisão, voz e multimodalMIT
Z

dsh-approval-voice

ziye1208/dsh-approval-voice

Reproduz um toque e um alerta de voz em chinês quando aparece um popup de aprovação, pergunta ou revisão de plano na interface web do DSH, para você nunca perder uma solicitação.

3anteontemIntegrações e acesso remotoMIT
S

dsh-voice-assistant

supersyh-sss/dsh-voice-assistant

Assistente de voz para o dsh web: diga a frase de ativação (por exemplo, «小鲸») para ativar o ditado mãos-livres — o que diz é transcrito e escrito automaticamente na caixa de conversa. Suporta comandos de edição falados (enviar, limpar, nova linha, parar de ler) e lê em voz alta as respostas do assistente em chinês. O reconhecimento de fala corre localmente no navegador via sherpa-onnx WASM, pelo que funciona offline sem chave de API.

3mês passadoVisão, voz e multimodalMIT
D

dsh-whale-pet

dleaf6211-hash/dsh-whale-pet

Mascote de mesa garota-baleia para DeepSeek Harness: mascote flutuante do navegador mais mascote de mesa do Windows compartilhando um único backend de dados, com painel de saldo em tempo real, avisos de tarefas, interação de carinho na cabeça, 19 linhas de voz pré-sintetizadas com emoção por linha e fala ociosa com detecção de presença.

3há 17 diasSó por diversãoMIT
S

dsh-audiogen

shimingming520/dsh-audiogen

Geração de áudio por IA para a GUI web do DeepSeek Harness — TTS multiforncedor, música, efeitos sonoros e design de voz com painel lateral, comparação de modelos, biblioteca de recursos e ferramentas Agent.

3há 24 diasVisão, voz e multimodalApache-2.0
L

dsh-voco

lgquan/dsh-voco

Conversas de voz contínuas para DSH com escuta mãos-livres, push-to-talk, reconhecimento de fala, respostas TTS e delegação de Agent em segundo plano.

3mês passadoVisão, voz e multimodalMIT
T

dsh-gsv

taoruiliu19/dsh-gsv

TTS local em tempo real para DeepSeek Harness: predefinições de voz, leitura automática, assistente de configuração do motor, botão de leitura em voz alta e um painel de configurações para o motor GSV-TTS-Lite.

3mês passadoVisão, voz e multimodalMIT