Plugin
Sfoglia, filtra e installa i plugin di DeepSeek-Harness.
125 plugin trovati
Deepseek-Continuity
linxuhao/deepseek-continuity
Generazione locale di immagini, voce, musica ed effetti sonori, più trascrizione, con identità fissata: personaggi, animali, oggetti e voci degli attori vengono definiti una volta e riutilizzati in ogni chiamata successiva; l'output degenerato (immagine quasi piatta, audio silenzioso) viene rifiutato invece di essere restituito come successo, e una riga generata può essere riletta come testo, così che un clone che ha inghiottito la propria fine diventi visibile. I motori si scaricano quando inattivi, e la generazione di immagini e la trascrizione possono ciascuna puntare a un'API di forma OpenAI invece del backend Vulkan locale.
voco-input-sh
nothree-code/voco-input-sh
Input vocale per la Web UI: un pulsante microfono che usa il riconoscimento vocale offline locale di VocoType e inserisce automaticamente il testo riconosciuto nel compositore (auto-deploy, dedupe, dettatura continua).
dsh-stt-input
baisama-cloud/dsh-stt-input
Input vocale speech-to-text per la web UI: un pulsante microfono nel composer trascrive il parlato nella bozza tramite la Web Speech API del browser (zero-config) o un'API Whisper compatibile OpenAI (OpenAI / Groq), con modello e lingua selezionabili nelle Impostazioni.
dsh-plugin-notify
huguangyu666/dsh-plugin-notify
Casella di notifiche in uscita: l'agente notifica proattivamente tramite toast / voce TTS in cinese / effetti sonori (esplosione, vittoria, allarme), con una finestra di conferma di 60 secondi che ti richiama a voce, aumento del volume e pannello impostazioni.
dsh-voice
jesse-njx/dsh-voice
Note vocali in ingresso, risposte parlate in uscita: detta audio che diventa messaggi utente (trascrizione), fai leggere ad alta voce le risposte dall'agente (sintesi vocale), local-first sotto ~/.dsh/voice
dsh-mic-input
qt-chen/dsh-mic-input
Input vocale da microfono per il composer: trascrizione live tramite Web Speech API del browser, deduplicazione/auto-continuazione, punteggiatura intelligente, impostazioni di lingua e invio automatico
dsh-voice-call
biliye/dsh-voice-call
Assistente di chiamata vocale per la GUI web di DSH: una pallina di chiamata fluttuante e trascinabile, VAD lato browser che invia ogni frase dopo una pausa, riconoscimento vocale FunASR HTTP o in streaming, risposte TTS di MiniMax o compatibili OpenAI, una modalità opzionale con wake word e auto-sospensione, e invio di attività a sessioni subagente separate con progresso, stop e resoconti vocali di completamento.
dsh-tool-lipsync
yu-wenchao/dsh-tool-lipsync
Plugin DSH gratuito per generare video lip-sync con oltre 3000 voci e oltre 500 lingue.
dsh-messenger-gateway
goodandready/dsh-messenger-gateway
Bridge Telegram per DeepSeek Harness: sessioni bidirezionali, steering della conversazione, instradamento verso il canale home e note vocali TTS inviate come messaggi audio Telegram.
dsh-voice-agent (voice-app)
wayneyu430/dsh-voice-agent
Un Agent vocale conversazionale come frontend per dsh: parla naturalmente tramite ByteDance Duplex, delega le richieste a task in background e senti i loro risultati asincroni riportati a voce.
dsh-voice-chat
maoyuching/dsh-voice-chat
Chat vocale in stile Doubao per DSH: tenere premuto il microfono del compositore converte la voce in testo e invia automaticamente, e le risposte dell'IA vengono lette a voce alta. Condensazione opzionale tramite LLM (le risposte lunghe vengono riassunte in brevi frasi parlate, seguendo il modello della conversazione corrente), pulizia del testo adatta al TTS, voci Edge TTS selezionabili, arresto automatico al silenzio regolabile e impostazioni incorporate nella finestra di dialogo delle impostazioni di DSH.
dsh-tts
goodandready/dsh-tts
Pronuncia le risposte dell'agente nell'interfaccia web di DeepSeek Harness tramite una catena di fallback dei fornitori (OpenAI, ElevenLabs, Google, Azure, Groq, Deepgram, OpenRouter, Edge, Piper, eSpeak), così un fornitore in errore o con limite di velocità passa al successivo invece di restare in silenzio.
muxiva-dsh-voice
piyotahu/muxiva-dsh-voice
Voce full-duplex local-first per DeepSeek Harness, orchestrata da Muxiva
dsh-voice-call
pandapolo/dsh-voice-call
Chiamate vocali avviate dall’agente: `offer_call` fa squillare l’umano (接听/拒接/稍后再说); le chiamate accettate vengono sintetizzate e riprodotte in locale con CrispASR + Qwen3-TTS (9 voci, 2 dialetti cinesi), mentre quelle rifiutate restituiscono la decisione all’agente.
dsh-fish-tts
mari23333/dsh-fish-tts
Legge ad alta voce le risposte dell’assistente solo tramite Fish Audio API (porta la tua chiave): lettura per messaggio, interruttore di lettura automatica e una pagina impostazioni per modello, reference_id della voce, chiave API cifrata e proxy.
dsh-live2d-voice
john-walks-slow/dsh-live2d-voice
Live2D session view with realtime voice: continuous voice input, streaming TTS, subtitle translation, multi-model catalog, standalone entry / Live2D 实时语音会话视图:连续语音输入、流式 TTS、字幕翻译、多模型目录、独立入口
dsh-onebot
mario841859784/dsh-onebot
QQ channel for dsh via OneBot 11 (NapCat and friends): reverse or forward WebSocket, DM and group chats, image and voice transcription, t2i text-image cards, merged forwards, and a settings page.
dsh-claude-slider
yicun0316/dsh-claude-slider
Replaces the reasoning-effort dropdown with a draggable snapping slider, and draws 13 canvas effects across five style families (thrust, fluid, fantasy, tech, texture) with three tiers that unlock as the effort level rises. Custom mode combines 10 particle forms with 8 flow trajectories; 9 accent presets and a hex picker recolor every effect, and optional key sounds cover two voice clips, a synthesized duck squeak, a mechanical click and a local audio file.
dsh-wx-bridge
zhy5/dsh-wx-bridge
Drive your local DSH from WeChat: a self-hosted iLink bridge over a persistent ACP session (context lives in DSH and is resumable), phone conversations grouped into the desktop workspace, with image recognition, file messages (Excel/Word/PDF, parsed by the agent itself) and voice transcripts. Access defaults to strict (only registered devices are served); the phone channel's permission preset is wide by design - see the README security section before sharing the bot.
dsh-multi-tts
wyr-233/dsh-multi-tts
Per-reply read-aloud with a multi-provider settings page — MiniMax or any OpenAI-compatible /audio/speech endpoint, with voice, emotion, speed and model selection plus an auto-read toggle.
dshgo
xiazhi88/dshgo
Proxies the loopback-only dsh web onto a LAN port so phones and other machines can reach it, with an optional access password that browsers type in and the bundled Android client unlocks with biometrics. Adds a LAN-access settings page with QR codes, inlines dsh-web-mobile (MIT, attribution kept) for the mobile layout, and the Android client in the same repository adds finish/approval notifications, voice input and a home-screen widget.
dsh-live-voice
victorwads/dsh-live-voice
Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.
dsh-minimax-asr
moluyao/dsh-minimax-asr
MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选
dsh-voice-talk
duoduoqian708/dsh-voice-talk
Voice conversation mode for the DSH Web GUI: tap the mic to start a full-screen call, talk hands-free, and hear each reply read aloud as it streams. Bilingual (Chinese/English) UI, light and dark themes, adjustable speech rate, and switchable voices.