Plugin
Sfoglia, filtra e installa i plugin di DeepSeek-Harness.
25 plugin trovati
dsh-omi-voice
polinnizhong/dsh-omi-voice
Lettura ad alta voce in chat per DeepSeek Harness: tocca per leggere, mettere in pausa e riprendere le risposte dell'IA con voci Doubao TTS naturali (BYOK); legge solo la risposta finale, con codice, tabelle e diagrammi filtrati; motore locale, il plugin non conserva alcuna chiave API.
dsh-plugin-tts
1624318455/dsh-plugin-tts
Legge ad alta voce le risposte dell'assistente tramite Edge TTS gratuito o i tuoi modelli vocali RVC: pulsanti di lettura ad alta voce + lettura automatica, riproduzione progressiva a blocchi adattivi (letture lunghe senza interruzioni), installazione con un clic di pacchetti vocali da un registro e un runtime RVC portatile.
dsh-talk
perrylink/dsh-talk
I/O vocale per DeepSeek Harness — speech-to-text e text-to-speech tramite microfono e uscita audio.
dsh-voice-mode (dsh-voice-mode)
qishuilalala/dsh-voice-mode
Modalità vocale full-duplex per la Web UI di DeepSeek Harness: toggle (invio automatico dopo pausa di 2s) o dettatura hold-to-talk in una bozza editabile con ASR streaming zipformer2, wake word opzionale; lettura ad alta voce Edge TTS frase per frase con sottotitoli live, e il parlato interrompe la riproduzione e il turno in corso (vero barge-in). ASR on-device, nessuna chiave API.
dsh-plugin-xiaomi-mimo-tts
ppy-web/dsh-plugin-xiaomi-mimo-tts
Aggiunge la sintesi vocale Xiaomi MiMo a DSH Web con lettura ad alta voce dei messaggi dell'assistente, streaming PCM, voci predefinite e personalizzate, fallback alla sintesi vocale del browser, controlli di riproduzione e suoni dell'interfaccia opzionali.
dsh-tts-bridge
yuuyuko-uu/dsh-tts-bridge
Legge ad alta voce le conversazioni DSH usando la lettura ad alta voce integrata della pagina web DeepSeek, gestita da una piccola estensione del browser.
dsh-omni-workstation
huashenglian/dsh-omni-workstation
Workstation omni-modale per DSH: analyze_image su una catena ordinata multi-scheda di failover VLM, un toolkit di visione con sei strumenti (zoom, campionamento colori, pixel diff, OCR, rilevamento elementi, visualizzazione inline) che condivide lo stesso resolver di immagini, generate_image sui protocolli OpenAI/DashScope/ComfyUI, generate_video asincrono multi-scheda con un builder /build-video-tool, più TTS speak/clone_voice su sette provider, tutto governato da un'unica pagina di impostazioni con salvataggio automatico.
dsh-plugin-speech
nakamuraia/dsh-plugin-speech
Legge ad alta voce le risposte dell'assistente in DeepSeek Harness: fornitori di sintesi vocale con riproduzione in streaming.
dsh-voco
lgquan/dsh-voco
Conversazioni vocali continue per DSH con ascolto a mani libere, push-to-talk, riconoscimento vocale, risposte TTS e delega di Agent in background.
dsh-gsv
taoruiliu19/dsh-gsv
TTS locale in tempo reale per DeepSeek Harness: preset vocali, lettura automatica, assistente di configurazione del motore, pulsante di lettura ad alta voce e un pannello delle impostazioni per il motore GSV-TTS-Lite.
Deepseek-Continuity
linxuhao/deepseek-continuity
Generazione locale di immagini, voce, musica ed effetti sonori, più trascrizione, con identità fissata: personaggi, animali, oggetti e voci degli attori vengono definiti una volta e riutilizzati in ogni chiamata successiva; l'output degenerato (immagine quasi piatta, audio silenzioso) viene rifiutato invece di essere restituito come successo, e una riga generata può essere riletta come testo, così che un clone che ha inghiottito la propria fine diventi visibile. I motori si scaricano quando inattivi, e la generazione di immagini e la trascrizione possono ciascuna puntare a un'API di forma OpenAI invece del backend Vulkan locale.
dsh-voice
jesse-njx/dsh-voice
Note vocali in ingresso, risposte parlate in uscita: detta audio che diventa messaggi utente (trascrizione), fai leggere ad alta voce le risposte dall'agente (sintesi vocale), local-first sotto ~/.dsh/voice
dsh-voice-call
biliye/dsh-voice-call
Assistente di chiamata vocale per la GUI web di DSH: una pallina di chiamata fluttuante e trascinabile, VAD lato browser che invia ogni frase dopo una pausa, riconoscimento vocale FunASR HTTP o in streaming, risposte TTS di MiniMax o compatibili OpenAI, una modalità opzionale con wake word e auto-sospensione, e invio di attività a sessioni subagente separate con progresso, stop e resoconti vocali di completamento.
dsh-voice-call
pandapolo/dsh-voice-call
Chiamate vocali avviate dall’agente: `offer_call` fa squillare l’umano (接听/拒接/稍后再说); le chiamate accettate vengono sintetizzate e riprodotte in locale con CrispASR + Qwen3-TTS (9 voci, 2 dialetti cinesi), mentre quelle rifiutate restituiscono la decisione all’agente.
dsh-fish-tts
mari23333/dsh-fish-tts
Legge ad alta voce le risposte dell’assistente solo tramite Fish Audio API (porta la tua chiave): lettura per messaggio, interruttore di lettura automatica e una pagina impostazioni per modello, reference_id della voce, chiave API cifrata e proxy.
dsh-multi-tts
wyr-233/dsh-multi-tts
Per-reply read-aloud with a multi-provider settings page — MiniMax or any OpenAI-compatible /audio/speech endpoint, with voice, emotion, speed and model selection plus an auto-read toggle.
dsh-live-voice
victorwads/dsh-live-voice
Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.
dsh-minimax-asr
moluyao/dsh-minimax-asr
MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选
dsh-voice
zhuiyueya/dsh-voice
Voce per DeepSeek Harness (dsh) — input speech-to-text + lettura ad alta voce TTS per DeepSeek solo testo, senza chiave API
dsh-say
fangqian616/dsh-say
Speaks your agent's reports in a voice you choose, compressing long reports before speaking. Character voices need no training - a 3-10 second reference clip clones one, and community-trained models work too - and no 6.4 GB GPT-SoVITS install: the plugin installs its own runtime and voice. An existing GPT-SoVITS can be used instead, and it is the same voice model.
dsh-voice-alert
loyalchiiina/dsh-voice-alert
Speaks or plays a sound at the end of every turn and plays a failure cue when a tool call or a turn errors. Ships 20 built-in effects (10 alert chimes + 10 nature sounds) and defaults to effect mode, so it needs no API key and no audio files; an optional Volcengine voice-clone route generates the three announcement clips in one click. Plays through winmm/waveOut as-is, never changing the system volume or mute state. Windows only.
dsh-voice-mimo
ch1bug/dsh-voice-mimo
Xiaomi MiMo-powered voice for DeepSeek Harness: browser 🎤/🧠/🔊 UI, voice_transcribe/voice_understand/voice_speak tools, configurable voice map (preset/voicedesign/voiceclone). Fork of zhuiyueya/dsh-voice (MIT), Settings pattern from Anionex/dsh-vision-toolkit (MIT).
dsh-kitt-voice
kittcat-lab/dsh-kitt-voice
Voice for the DeepSeek Harness: speak to the agent, hear it back, and see what it is doing from a floating window that stays on top of whatever you are running.
dsh-plugins
genesis-agents/dsh-plugins
A source library for DeepSeek Harness: 72 feeds on an hourly timer, a reader with transcripts and translation, and a publisher that turns what it collects into a podcast, a digest, or a report