Vai al contenuto principale

Plugin

Sfoglia, filtra e installa i plugin di DeepSeek-Harness.

125 plugin trovati

L

Deepseek-Continuity

linxuhao/deepseek-continuity

Generazione locale di immagini, voce, musica ed effetti sonori, più trascrizione, con identità fissata: personaggi, animali, oggetti e voci degli attori vengono definiti una volta e riutilizzati in ogni chiamata successiva; l'output degenerato (immagine quasi piatta, audio silenzioso) viene rifiutato invece di essere restituito come successo, e una riga generata può essere riletta come testo, così che un clone che ha inghiottito la propria fine diventi visibile. I motori si scaricano quando inattivi, e la generazione di immagini e la trascrizione possono ciascuna puntare a un'API di forma OpenAI invece del backend Vulkan locale.

312 giorni faVisione, voce e multimodaleMIT
N

voco-input-sh

nothree-code/voco-input-sh

Input vocale per la Web UI: un pulsante microfono che usa il riconoscimento vocale offline locale di VocoType e inserisce automaticamente il testo riconosciuto nel compositore (auto-deploy, dedupe, dettatura continua).

320 giorni faVisione, voce e multimodaleMIT
B

dsh-stt-input

baisama-cloud/dsh-stt-input

Input vocale speech-to-text per la web UI: un pulsante microfono nel composer trascrive il parlato nella bozza tramite la Web Speech API del browser (zero-config) o un'API Whisper compatibile OpenAI (OpenAI / Groq), con modello e lingua selezionabili nelle Impostazioni.

3mese scorsoVisione, voce e multimodaleMIT
H

dsh-plugin-notify

huguangyu666/dsh-plugin-notify

Casella di notifiche in uscita: l'agente notifica proattivamente tramite toast / voce TTS in cinese / effetti sonori (esplosione, vittoria, allarme), con una finestra di conferma di 60 secondi che ti richiama a voce, aumento del volume e pannello impostazioni.

318 giorni faIntegrazioni e accesso remotoMIT
J

dsh-voice

jesse-njx/dsh-voice

Note vocali in ingresso, risposte parlate in uscita: detta audio che diventa messaggi utente (trascrizione), fai leggere ad alta voce le risposte dall'agente (sintesi vocale), local-first sotto ~/.dsh/voice

32 mesi faVisione, voce e multimodaleMIT
Q

dsh-mic-input

qt-chen/dsh-mic-input

Input vocale da microfono per il composer: trascrizione live tramite Web Speech API del browser, deduplicazione/auto-continuazione, punteggiatura intelligente, impostazioni di lingua e invio automatico

32 mesi faVisione, voce e multimodaleMIT
B

dsh-voice-call

biliye/dsh-voice-call

Assistente di chiamata vocale per la GUI web di DSH: una pallina di chiamata fluttuante e trascinabile, VAD lato browser che invia ogni frase dopo una pausa, riconoscimento vocale FunASR HTTP o in streaming, risposte TTS di MiniMax o compatibili OpenAI, una modalità opzionale con wake word e auto-sospensione, e invio di attività a sessioni subagente separate con progresso, stop e resoconti vocali di completamento.

25 giorni faVisione, voce e multimodaleMIT
Y

dsh-tool-lipsync

yu-wenchao/dsh-tool-lipsync

Plugin DSH gratuito per generare video lip-sync con oltre 3000 voci e oltre 500 lingue.

228 giorni faVisione, voce e multimodaleMIT
G

dsh-messenger-gateway

goodandready/dsh-messenger-gateway

Bridge Telegram per DeepSeek Harness: sessioni bidirezionali, steering della conversazione, instradamento verso il canale home e note vocali TTS inviate come messaggi audio Telegram.

23 giorni faIntegrazioni e accesso remotoMIT
W

dsh-voice-agent (voice-app)

wayneyu430/dsh-voice-agent

Un Agent vocale conversazionale come frontend per dsh: parla naturalmente tramite ByteDance Duplex, delega le richieste a task in background e senti i loro risultati asincroni riportati a voce.

2mese scorsoVisione, voce e multimodale
M

dsh-voice-chat

maoyuching/dsh-voice-chat

Chat vocale in stile Doubao per DSH: tenere premuto il microfono del compositore converte la voce in testo e invia automaticamente, e le risposte dell'IA vengono lette a voce alta. Condensazione opzionale tramite LLM (le risposte lunghe vengono riassunte in brevi frasi parlate, seguendo il modello della conversazione corrente), pulizia del testo adatta al TTS, voci Edge TTS selezionabili, arresto automatico al silenzio regolabile e impostazioni incorporate nella finestra di dialogo delle impostazioni di DSH.

28 giorni faVisione, voce e multimodaleMIT
G

dsh-tts

goodandready/dsh-tts

Pronuncia le risposte dell'agente nell'interfaccia web di DeepSeek Harness tramite una catena di fallback dei fornitori (OpenAI, ElevenLabs, Google, Azure, Groq, Deepgram, OpenRouter, Edge, Piper, eSpeak), così un fornitore in errore o con limite di velocità passa al successivo invece di restare in silenzio.

26 giorni faVisione, voce e multimodaleMIT
P

muxiva-dsh-voice

piyotahu/muxiva-dsh-voice

Voce full-duplex local-first per DeepSeek Harness, orchestrata da Muxiva

22 mesi faVisione, voce e multimodaleApache-2.0
P

dsh-voice-call

pandapolo/dsh-voice-call

Chiamate vocali avviate dall’agente: `offer_call` fa squillare l’umano (接听/拒接/稍后再说); le chiamate accettate vengono sintetizzate e riprodotte in locale con CrispASR + Qwen3-TTS (9 voci, 2 dialetti cinesi), mentre quelle rifiutate restituiscono la decisione all’agente.

23 giorni faVisione, voce e multimodaleMIT
M

dsh-fish-tts

mari23333/dsh-fish-tts

Legge ad alta voce le risposte dell’assistente solo tramite Fish Audio API (porta la tua chiave): lettura per messaggio, interruttore di lettura automatica e una pagina impostazioni per modello, reference_id della voce, chiave API cifrata e proxy.

2l’altro ieriVisione, voce e multimodaleMIT
J

dsh-live2d-voice

john-walks-slow/dsh-live2d-voice

Live2D session view with realtime voice: continuous voice input, streaming TTS, subtitle translation, multi-model catalog, standalone entry / Live2D 实时语音会话视图:连续语音输入、流式 TTS、字幕翻译、多模型目录、独立入口

14 giorni faVisione, voce e multimodaleMIT
M

dsh-onebot

mario841859784/dsh-onebot

QQ channel for dsh via OneBot 11 (NapCat and friends): reverse or forward WebSocket, DM and group chats, image and voice transcription, t2i text-image cards, merged forwards, and a settings page.

18 giorni faIntegrazioni e accesso remotoBSD-3-Clause
Y

dsh-claude-slider

yicun0316/dsh-claude-slider

Replaces the reasoning-effort dropdown with a draggable snapping slider, and draws 13 canvas effects across five style families (thrust, fluid, fantasy, tech, texture) with three tiers that unlock as the effort level rises. Custom mode combines 10 particle forms with 8 flow trajectories; 9 accent presets and a hex picker recolor every effect, and optional key sounds cover two voice clips, a synthesized duck squeak, a mechanical click and a local audio file.

19 giorni faMiglioramenti UIMIT
Z

dsh-wx-bridge

zhy5/dsh-wx-bridge

Drive your local DSH from WeChat: a self-hosted iLink bridge over a persistent ACP session (context lives in DSH and is resumable), phone conversations grouped into the desktop workspace, with image recognition, file messages (Excel/Word/PDF, parsed by the agent itself) and voice transcripts. Access defaults to strict (only registered devices are served); the phone channel's permission preset is wide by design - see the README security section before sharing the bot.

16 giorni faIntegrazioni e accesso remotoMIT
W

dsh-multi-tts

wyr-233/dsh-multi-tts

Per-reply read-aloud with a multi-provider settings page — MiniMax or any OpenAI-compatible /audio/speech endpoint, with voice, emotion, speed and model selection plus an auto-read toggle.

122 giorni faVisione, voce e multimodale
X

dshgo

xiazhi88/dshgo

Proxies the loopback-only dsh web onto a LAN port so phones and other machines can reach it, with an optional access password that browsers type in and the bundled Android client unlocks with biometrics. Adds a LAN-access settings page with QR codes, inlines dsh-web-mobile (MIT, attribution kept) for the mobile layout, and the Android client in the same repository adds finish/approval notifications, voice input and a home-screen widget.

114 giorni faIntegrazioni e accesso remotoMIT
V

dsh-live-voice

victorwads/dsh-live-voice

Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.

118 giorni faVisione, voce e multimodaleGPL-3.0
M

dsh-minimax-asr

moluyao/dsh-minimax-asr

MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选

119 giorni faVisione, voce e multimodaleMIT
D

dsh-voice-talk

duoduoqian708/dsh-voice-talk

Voice conversation mode for the DSH Web GUI: tap the mic to start a full-screen call, talk hands-free, and hear each reply read aloud as it streams. Bilingual (Chinese/English) UI, light and dark themes, adjustable speech rate, and switchable voices.

120 giorni faVisione, voce e multimodaleMIT