Pular para o conteúdo principal

Plugins

Navegue, filtre e instale plugins do DeepSeek-Harness.

45 plugins encontrados

F

dsh-memory

furongjun-1999/dsh-memory

Exploração de arquitetura AGI de caixa branca: metacognição (loop de autocognição), aprendizagem contínua (volante de conhecimento), modelo de mundo (espaço de condições, grafo de memória espaço-temporal), autoaperfeiçoamento (disciplina bootstrap), pipeline de caixa branca zero-LLM e guardrails de confiança auditáveis.

308há 15 horasMemóriaMIT
B

DSH-Plugins-Marketplace

bradegithub/dsh-plugins-marketplace

Marketplace de plugins e skills orientado por tópicos do GitHub: uma página de configurações que percorre o registro coletado automaticamente (todo o tópico dsh-plugin mais o índice de skills, atualizado por CI a cada 2 horas) com instalação em um clique, detecção de tipo, confirmações de segurança para scripts de instalação e dependências ocultas do host, gerenciamento de chaves de ambiente e a especificação de reconhecimento STANDARD.md.

169há 4 horasDesenvolvimento e ferramentas de pluginsMIT
F

dsh-prompt-enhancer

fishsb/dsh-prompt-enhancer

Aprimoramento de prompt com um clique (5 modos, cadeia de memória, fallback multimodelo) mais reconhecimento de voz (Qwen3-ASR na nuvem / SenseVoice offline, parada automática no silêncio) para o compositor, com reinicialização do serviço DSH com um clique.

82há 5 diasFerramentas e funções
P

dsh-voice-scribe

pensivefei/dsh-voice-scribe

Entrada de voz para a interface web: toque em Alt (ou Alt+Space) para iniciar/parar o ditado, Web Speech do navegador (sem configuração) ou ASR em nuvem compatível com OpenAI, polimento opcional por meio do LLM configurado no DSH, interface de configurações.

34há 3 diasVisão, voz e multimodalMIT
W

dsh-ears

wiziscool/dsh-ears

Plugin de entrada de voz para DeepSeek Harness (dsh): um botão de microfone no compositor converte fala em rascunho transcrito, com escolha de backends de reconhecimento de voz, refinamento opcional pelas próprias rotas LLM do dsh e uma página de configurações nativa.

21há 23 horasVisão, voz e multimodalMIT
Q

dsh-voice-mode (dsh-voice-mode)

qishuilalala/dsh-voice-mode

Modo de voz full-duplex para a Web UI do DeepSeek Harness: alternar (envio automático com pausa de 2s) ou ditação por pressionar e segurar em um rascunho editável com ASR streaming zipformer2, wake word opcional; leitura em voz alta sentença por sentença via Edge TTS com legendas ao vivo, e a fala interrompe a reprodução e o turno em execução (barge-in verdadeiro). ASR no dispositivo, sem chave de API.

15há 8 horasVisão, voz e multimodalMIT
L

dsh-vision

linenxi-ctrl/dsh-vision

Plugin de visão externa para o DeepSeek Harness: painel de configuração via botão da baleia, reconhecimento de imagens com resposta automática e ferramentas de captura de tela/reconhecimento para o agente.

9há 2 mesesVisão, voz e multimodalMIT
A

dsh-highres-vision

azwosile/dsh-highres-vision

Para o modelo de visão nativo do DeepSeek Harness deepseek-v4-flash-vision-exp, eleva os limites de admissão de imagens para 32 MiB / 8192 px / 600 imagens e adiciona uma ferramenta highres_read que divide imagens grandes em blocos e depois retorna a imagem inteira mais blocos de 800x800 por meio da ferramenta read_image do host.

8há 22 diasVisão, voz e multimodalMIT
3

dsh-voice

3274375092/dsh-voice

Entrada de voz para DeepSeek Harness: fale ao microfone e o texto reconhecido é enviado como uma mensagem de chat normal, via reconhecimento de fala local ou do navegador.

8anteontemVisão, voz e multimodalMIT
5

dsh-vision

54xkeee/dsh-vision

Visão para o DeepSeek somente-texto via Doubao Web por padrão (sem custo, sem chave de API — controla seu Chrome logado por meio de uma ponte CDP do Windows), com cota do Antigravity IDE (flash/pro) ou fallback para o Gemini; escalonamento automático de detalhe, memória de evidências visuais com reidratação após compactação, cache por hash de conteúdo e um painel de cliente bilíngue.

7há 2 mesesVisão, voz e multimodalMIT
G

dsh-tool-see-image

gugu123a/dsh-tool-see-image

Fornece a ferramenta see_image para o DSH: envia um arquivo de imagem para um modelo de visão compatível com OpenAI configurável e repassa sua descrição de volta a um modelo somente de texto.

5mês passadoFerramentas e funçõesMIT
N

vision-exp-tile

nicholas023/vision-exp-tile

Reconhecimento de imagens grandes para modelos vision-exp: reconhecimento por mosaicos 800×800 sem perda (smart/pipeline/full), OCR local com pré-processamento e encaminhamento de caligrafia, GPU multivendor opcional (DirectML/CUDA/OpenVINO) com fallback automático para CPU.

5mês passadoVisão, voz e multimodalMIT
F

dsh-chatvoice

fuzzysoul/dsh-chatvoice

Loop de voz gratuito para a interface web: entrada de microfone via SpeechRecognition do navegador com resultados parciais em tempo real, além de botões de alto-falante para leitura em voz alta e leitura automática das respostas do assistente, sem configuração e sem chave de API.

4há 2 mesesVisão, voz e multimodalMIT
S

dsh-linghun

syyr1987/dsh-linghun

Um núcleo de julgamento para o DeepSeek Harness: um laço cognitivo que dá origem e atribuição a cada decisão e leva o planejamento até o fim, memória hipocampal que condensa a experiência em conhecimento reutilizável e um cartão de persona personalizável (nome, personalidade, estilo de comunicação). Requer DSH ^0.1.0-rc.7.

3há 14 horasMemória
A

dsh-j-space

anonyjcy/dsh-j-space

Preset de agente nativo J-Space Cognition Suite SV1 e plugin Cordis autônomo: 13 módulos, controlador persistente e workspace desacoplado.

3há 3 diasMemóriaMIT
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

Estação de trabalho omni-modal para o DSH: analyze_image sobre uma cadeia ordenada de vários cartões VLM com comutação de recurso, um conjunto de seis ferramentas de visão (zoom, amostragem de cor, diff de píxeis, OCR, deteção de elementos, apresentação inline) que partilham o mesmo resolvedor de imagens, generate_image sobre protocolos OpenAI/DashScope/ComfyUI, generate_video assíncrono com vários cartões e um construtor /build-video-tool, e TTS speak/clone_voice sobre sete fornecedores, tudo controlado por uma única página de definições com gravação automática.

3há 14 diasVisão, voz e multimodalMIT
W

dsh-hold-to-talk

wangzhanchao883/dsh-hold-to-talk

Entrada com uma só mão e sem teclado para o compositor: prima e mantenha o rato na caixa de entrada, fale, largue — o texto fica no rascunho, e deslizar para cima cancela sem deixar uma meia frase para trás. Não há botão de microfone para acertar nem atalho para memorizar; a mão nunca precisa de sair da área de entrada, o que é essencial quando a outra mão está ocupada. O reconhecimento corre totalmente offline (SenseVoice via sherpa-onnx, sem chave de API, o áudio nunca sai da máquina).

3há 22 horasVisão, voz e multimodalMIT
S

dsh-voice-assistant

supersyh-sss/dsh-voice-assistant

Assistente de voz para o dsh web: diga a frase de ativação (por exemplo, «小鲸») para ativar o ditado mãos-livres — o que diz é transcrito e escrito automaticamente na caixa de conversa. Suporta comandos de edição falados (enviar, limpar, nova linha, parar de ler) e lê em voz alta as respostas do assistente em chinês. O reconhecimento de fala corre localmente no navegador via sherpa-onnx WASM, pelo que funciona offline sem chave de API.

3mês passadoVisão, voz e multimodalMIT
L

dsh-voco

lgquan/dsh-voco

Conversas de voz contínuas para DSH com escuta mãos-livres, push-to-talk, reconhecimento de fala, respostas TTS e delegação de Agent em segundo plano.

3mês passadoVisão, voz e multimodalMIT
X

dsh-image-vision

xiaoyuink/dsh-image-vision

Compreensão de imagens para qualquer modelo do DSH: ferramentas de visão, OCR, grounding e recorte com presets de domínio para histopatologia, biologia celular, anatomia, imagens clínicas e figuras científicas.

3há 29 diasVisão, voz e multimodal
N

voco-input-sh

nothree-code/voco-input-sh

Entrada por voz para a Web UI: um botão de microfone que aciona o reconhecimento de fala offline local VocoType e insere automaticamente o texto reconhecido no compositor (implantação automática, deduplicação, ditado contínuo).

3há 19 diasVisão, voz e multimodalMIT
W

visual-review

wang-bool/visual-review

Renderiza imagens coladas ou enviadas diretamente no chat do DSH Web e dá visão a modelos apenas de texto: a ferramenta visual_review, invocável pelo modelo, chama primeiro qualquer API multimodal compatível com OpenAI e, se falhar, recorre a um worker local do Qwen3-VL.

3há 2 mesesVisão, voz e multimodalMIT
M

dsh-vision-tools

moon09300731/dsh-vision-tools

Pacote completo de capacidades de visão para DeepSeek Harness: uma ferramenta vision_understand (APIs de visão compatíveis com OpenAI, Zhipu GLM-4V-Flash gratuito por padrão) além de pontos de entrada de colar/arrastar e soltar/botão para reconhecimento de imagens.

3há 2 mesesVisão, voz e multimodalMIT
B

dsh-voice-call

biliye/dsh-voice-call

Assistente de chamada de voz para a GUI web do DSH: uma bola de chamada flutuante e arrastável, VAD no navegador que envia cada fala após uma pausa, reconhecimento de fala FunASR HTTP ou em streaming, respostas TTS da MiniMax ou compatíveis com OpenAI, um modo opcional de palavra de ativação com suspensão automática e despacho de tarefas para sessões de subagente separadas com progresso, parada e relatórios falados de conclusão.

2há 5 diasVisão, voz e multimodalMIT