Pular para o conteúdo principal

Plugins

Navegue, filtre e instale plugins do DeepSeek-Harness.

76 plugins encontrados

W

dsh-opencode-go-usage

wawo77/dsh-opencode-go-usage

Mascote de uso do plano para a GUI web do DSH: um personagem flutuante com animação de esqueleto informa a cota em um balão de fala, combinando automaticamente com o provedor configurado (OpenCode Go, Command Code, DeepSeek) para mostrar uma porcentagem do plano ou um saldo de conta, e recorre a estatísticas locais de tokens quando a API do provedor não está disponível; arrastável, redimensionável pela roda do mouse (90-260px), sons de clique sintetizados, rotas somente loopback.

3há 16 diasUso e cobrançaMIT
W

dsh-hold-to-talk

wangzhanchao883/dsh-hold-to-talk

Entrada com uma só mão e sem teclado para o compositor: prima e mantenha o rato na caixa de entrada, fale, largue — o texto fica no rascunho, e deslizar para cima cancela sem deixar uma meia frase para trás. Não há botão de microfone para acertar nem atalho para memorizar; a mão nunca precisa de sair da área de entrada, o que é essencial quando a outra mão está ocupada. O reconhecimento corre totalmente offline (SenseVoice via sherpa-onnx, sem chave de API, o áudio nunca sai da máquina).

3ontemVisão, voz e multimodalMIT
N

dsh-plugin-speech

nakamuraia/dsh-plugin-speech

Lê em voz alta as respostas do assistente no DeepSeek Harness: provedores de texto para fala com reprodução em streaming.

3há 18 diasVisão, voz e multimodalMIT
S

dsh-voice-assistant

supersyh-sss/dsh-voice-assistant

Assistente de voz para o dsh web: diga a frase de ativação (por exemplo, «小鲸») para ativar o ditado mãos-livres — o que diz é transcrito e escrito automaticamente na caixa de conversa. Suporta comandos de edição falados (enviar, limpar, nova linha, parar de ler) e lê em voz alta as respostas do assistente em chinês. O reconhecimento de fala corre localmente no navegador via sherpa-onnx WASM, pelo que funciona offline sem chave de API.

3mês passadoVisão, voz e multimodalMIT
D

dsh-whale-pet

dleaf6211-hash/dsh-whale-pet

Mascote de mesa garota-baleia para DeepSeek Harness: mascote flutuante do navegador mais mascote de mesa do Windows compartilhando um único backend de dados, com painel de saldo em tempo real, avisos de tarefas, interação de carinho na cabeça, 19 linhas de voz pré-sintetizadas com emoção por linha e fala ociosa com detecção de presença.

3há 17 diasSó por diversãoMIT
L

dsh-voco

lgquan/dsh-voco

Conversas de voz contínuas para DSH com escuta mãos-livres, push-to-talk, reconhecimento de fala, respostas TTS e delegação de Agent em segundo plano.

3mês passadoVisão, voz e multimodalMIT
T

dsh-gsv

taoruiliu19/dsh-gsv

TTS local em tempo real para DeepSeek Harness: predefinições de voz, leitura automática, assistente de configuração do motor, botão de leitura em voz alta e um painel de configurações para o motor GSV-TTS-Lite.

3mês passadoVisão, voz e multimodalMIT
L

Deepseek-Continuity

linxuhao/deepseek-continuity

Geração local de imagem, voz, música e SFX, além de transcrição, com identidade fixada: personagens, animais, objetos e vozes de atores são definidos uma vez e reutilizados em cada chamada posterior; a saída degenerada (imagem quase plana, áudio silencioso) é rejeitada em vez de retornada como sucesso, e uma linha gerada pode ser lida de volta como texto, para que um clone que engoliu seu final se torne visível. Os motores descarregam quando ociosos, e a geração de imagens e a transcrição podem cada uma apontar para uma API no formato OpenAI em vez do backend local Vulkan.

3há 12 diasVisão, voz e multimodalMIT
N

voco-input-sh

nothree-code/voco-input-sh

Entrada por voz para a Web UI: um botão de microfone que aciona o reconhecimento de fala offline local VocoType e insere automaticamente o texto reconhecido no compositor (implantação automática, deduplicação, ditado contínuo).

3há 20 diasVisão, voz e multimodalMIT
B

dsh-stt-input

baisama-cloud/dsh-stt-input

Entrada de voz speech-to-text para a Web UI: um botão de microfone no compositor transcreve a fala para o rascunho via Web Speech API do navegador (sem configuração) ou uma API Whisper compatível com OpenAI (OpenAI / Groq), com modelo e idioma selecionáveis em Configurações.

3mês passadoVisão, voz e multimodalMIT
J

dsh-voice

jesse-njx/dsh-voice

Notas de voz na entrada, respostas faladas na saída: dite áudio que se torna mensagens de usuário (transcrever), faça o agente ler as respostas em voz alta (falar), local-first em ~/.dsh/voice

3há 2 mesesVisão, voz e multimodalMIT
Q

dsh-mic-input

qt-chen/dsh-mic-input

Entrada de voz por microfone para o compositor: transcrição ao vivo via Web Speech API do navegador, deduplicação/continuação automática, pontuação inteligente, e configurações de idioma e envio automático

3há 2 mesesVisão, voz e multimodalMIT
B

dsh-voice-call

biliye/dsh-voice-call

Assistente de chamada de voz para a GUI web do DSH: uma bola de chamada flutuante e arrastável, VAD no navegador que envia cada fala após uma pausa, reconhecimento de fala FunASR HTTP ou em streaming, respostas TTS da MiniMax ou compatíveis com OpenAI, um modo opcional de palavra de ativação com suspensão automática e despacho de tarefas para sessões de subagente separadas com progresso, parada e relatórios falados de conclusão.

2há 5 diasVisão, voz e multimodalMIT
M

dsh-voice-chat

maoyuching/dsh-voice-chat

Chat de voz estilo Doubao para DSH: segurar o microfone do compositor converte a fala em texto e envia automaticamente, e as respostas da IA são lidas em voz alta. Condensação opcional por LLM (respostas longas resumidas em falas curtas, seguindo o modelo da conversa atual), limpeza de texto amigável ao TTS, vozes Edge TTS selecionáveis, parada automática por silêncio ajustável e configurações embutidas no diálogo de configurações do DSH.

2há 8 diasVisão, voz e multimodalMIT
G

dsh-tts

goodandready/dsh-tts

Fala as respostas do agente na interface web do DeepSeek Harness por meio de uma cadeia de fallback de provedores (OpenAI, ElevenLabs, Google, Azure, Groq, Deepgram, OpenRouter, Edge, Piper, eSpeak), para que um provedor com falha ou com limite de taxa passe para o próximo em vez de ficar em silêncio.

2há 6 diasVisão, voz e multimodalMIT
T

dsh-deepseek-pet

txlznbzsdj-collab/dsh-deepseek-pet

Animal de estimação animado de baleia azul DeepSeek que flutua na página DSH Web: arrastável, com balões de fala e poses de humor, uma ferramenta pet_say para o modelo o fazer falar, e estados de pensamento e celebração no início/fim de cada turno.

2há 2 mesesSó por diversãoMIT
P

dsh-voice-call

pandapolo/dsh-voice-call

Chamadas de voz iniciadas pelo agente: `offer_call` faz o humano tocar (接听/拒接/稍后再说); as chamadas aceitas são sintetizadas e reproduzidas localmente com CrispASR + Qwen3-TTS (9 vozes, 2 dialetos chineses), e as rejeitadas devolvem a decisão ao agente.

2há 3 diasVisão, voz e multimodalMIT
M

dsh-fish-tts

mari23333/dsh-fish-tts

Lê em voz alta as respostas do assistente apenas via a API Fish Audio (traga sua própria chave): leitura por mensagem, alternância de leitura automática e uma página de configurações para modelo, reference_id da voz, chave de API criptografada e proxy.

2anteontemVisão, voz e multimodalMIT
W

dsh-multi-tts

wyr-233/dsh-multi-tts

Per-reply read-aloud with a multi-provider settings page — MiniMax or any OpenAI-compatible /audio/speech endpoint, with voice, emotion, speed and model selection plus an auto-read toggle.

1há 21 diasVisão, voz e multimodal
V

dsh-live-voice

victorwads/dsh-live-voice

Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.

1há 18 diasVisão, voz e multimodalGPL-3.0
N

dsh-dictate

navneetset/dsh-dictate

Live speech-to-text dictation into the dsh web composer via OpenRouter STT

1há 27 diasVisão, voz e multimodalMIT
M

dsh-minimax-asr

moluyao/dsh-minimax-asr

MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选

1há 19 diasVisão, voz e multimodalMIT
D

dsh-voice-talk

duoduoqian708/dsh-voice-talk

Voice conversation mode for the DSH Web GUI: tap the mic to start a full-screen call, talk hands-free, and hear each reply read aloud as it streams. Bilingual (Chinese/English) UI, light and dark themes, adjustable speech rate, and switchable voices.

1há 20 diasVisão, voz e multimodalMIT
J

dsh-live-voice

jstn-1g/dsh-live-voice

Consent-bound one-turn voice preview for DSH Web with a credential-free local synthetic demo, optional Qwen Audio, exact Session isolation, and explicit transcript-to-draft handoff without automatic submission.

1há 27 diasVisão, voz e multimodalMIT