Vai al contenuto principale

Plugin

Sfoglia, filtra e installa i plugin di DeepSeek-Harness.

29 plugin trovati

O

watch-skill

oxbshw/watch-skill

Le capacità di DeepWatch, installabili in un profilo DeepSeek Harness esistente

37818 giorni faVisione, voce e multimodaleMIT
P

dsh-voice-scribe

pensivefei/dsh-voice-scribe

Input vocale per l'interfaccia web: premi Alt (o Alt+Space) per avviare/arrestare la dettatura, Web Speech del browser (zero-config) o ASR cloud compatibile con OpenAI, rifinitura opzionale tramite LLM configurato in DSH, interfaccia impostazioni.

343 giorni faVisione, voce e multimodaleMIT
W

dsh-ears

wiziscool/dsh-ears

Plugin di input vocale per DeepSeek Harness (dsh): un pulsante microfono nel compositore converte il parlato in una bozza trascritta, con scelta di backend di riconoscimento vocale, rifinitura opzionale tramite i percorsi LLM propri di dsh e una pagina delle impostazioni nativa.

2121 ore faVisione, voce e multimodaleMIT
P

dsh-talk

perrylink/dsh-talk

I/O vocale per DeepSeek Harness — speech-to-text e text-to-speech tramite microfono e uscita audio.

168 giorni faVisione, voce e multimodaleApache-2.0
Q

dsh-voice-mode (dsh-voice-mode)

qishuilalala/dsh-voice-mode

Modalità vocale full-duplex per la Web UI di DeepSeek Harness: toggle (invio automatico dopo pausa di 2s) o dettatura hold-to-talk in una bozza editabile con ASR streaming zipformer2, wake word opzionale; lettura ad alta voce Edge TTS frase per frase con sottotitoli live, e il parlato interrompe la riproduzione e il turno in corso (vero barge-in). ASR on-device, nessuna chiave API.

156 ore faVisione, voce e multimodaleMIT
C

dsh-qq-onebot-bridge

cheesehaqi/dsh-qq-onebot-bridge

Bridge QQ bidirezionale su OneBot v11 (WebSocket inverso): sessioni per gruppo e per chat privata, sintesi vocale speech-to-text quotata con @, visualizzazione privata di immagini/sticker animati, strumenti per volti e sticker.

519 giorni faIntegrazioni e accesso remotoMIT
0

dsh-voice-input

0nt-one/dsh-voice-input

Pulsante microfono nella riga degli strumenti del composer: speech-to-text con Web Speech API (Chrome/Edge), cambio lingua e auto-invio opzionale, zero dipendenze.

52 mesi faVisione, voce e multimodaleMIT
W

dsh-hold-to-talk

wangzhanchao883/dsh-hold-to-talk

Input a una mano e senza tastiera per il composer: tieni premuto il mouse sulla casella di input, parla, rilascia — il testo finisce nella bozza, e scorrendo verso l'alto annulli senza lasciare una frase a metà. Nessun pulsante microfono da centrare e nessuna scorciatoia da ricordare; la mano non deve mai lasciare l'area di input, che è il punto quando l'altra mano è occupata. Il riconoscimento gira completamente offline (SenseVoice via sherpa-onnx, nessuna chiave API, l'audio non lascia mai la macchina).

320 ore faVisione, voce e multimodaleMIT
N

voco-input-sh

nothree-code/voco-input-sh

Input vocale per la Web UI: un pulsante microfono che usa il riconoscimento vocale offline locale di VocoType e inserisce automaticamente il testo riconosciuto nel compositore (auto-deploy, dedupe, dettatura continua).

319 giorni faVisione, voce e multimodaleMIT
B

dsh-stt-input

baisama-cloud/dsh-stt-input

Input vocale speech-to-text per la web UI: un pulsante microfono nel composer trascrive il parlato nella bozza tramite la Web Speech API del browser (zero-config) o un'API Whisper compatibile OpenAI (OpenAI / Groq), con modello e lingua selezionabili nelle Impostazioni.

3mese scorsoVisione, voce e multimodaleMIT
J

dsh-voice

jesse-njx/dsh-voice

Note vocali in ingresso, risposte parlate in uscita: detta audio che diventa messaggi utente (trascrizione), fai leggere ad alta voce le risposte dall'agente (sintesi vocale), local-first sotto ~/.dsh/voice

32 mesi faVisione, voce e multimodaleMIT
P

dsh-voice-call

pandapolo/dsh-voice-call

Chiamate vocali avviate dall’agente: `offer_call` fa squillare l’umano (接听/拒接/稍后再说); le chiamate accettate vengono sintetizzate e riprodotte in locale con CrispASR + Qwen3-TTS (9 voci, 2 dialetti cinesi), mentre quelle rifiutate restituiscono la decisione all’agente.

23 giorni faVisione, voce e multimodaleMIT
V

dsh-live-voice

victorwads/dsh-live-voice

Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.

117 giorni faVisione, voce e multimodaleGPL-3.0
N

dsh-dictate

navneetset/dsh-dictate

Live speech-to-text dictation into the dsh web composer via OpenRouter STT

127 giorni faVisione, voce e multimodaleMIT
M

dsh-minimax-asr

moluyao/dsh-minimax-asr

MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选

119 giorni faVisione, voce e multimodaleMIT
J

dsh-live-voice

jstn-1g/dsh-live-voice

Consent-bound one-turn voice preview for DSH Web with a credential-free local synthetic demo, optional Qwen Audio, exact Session isolation, and explicit transcript-to-draft handoff without automatic submission.

127 giorni faVisione, voce e multimodaleMIT
Z

dsh-voice

zhuiyueya/dsh-voice

Voce per DeepSeek Harness (dsh) — input speech-to-text + lettura ad alta voce TTS per DeepSeek solo testo, senza chiave API

12 mesi faVisione, voce e multimodaleMIT
W

dsh-voice-danmaku

weizhida/dsh-voice-danmaku

这是dsh的插件,语音发送弹幕。在玩游戏时通过语音输入在b站发弹幕,不切出游戏可以正常操作

03 giorni faVisione, voce e multimodaleMIT
Z

dsh-stt-plugin

zemanzhang809/dsh-stt-plugin

A speech-to-text (voice input) plugin for DeepSeek Harness.

015 giorni faVisione, voce e multimodaleMIT
B

dsh-asr-voice

bittersmilezzz/dsh-asr-voice

开口即成文 · Speak-to-prompt for DeepSeek Harness:云端 ASR 语音识别 + 提示词优化 + 填入草稿/自动发送,跨平台 macOS / Windows。

017 giorni faVisione, voce e multimodaleMIT
C

dsh-voice-mimo

ch1bug/dsh-voice-mimo

Xiaomi MiMo-powered voice for DeepSeek Harness: browser 🎤/🧠/🔊 UI, voice_transcribe/voice_understand/voice_speak tools, configurable voice map (preset/voicedesign/voiceclone). Fork of zhuiyueya/dsh-voice (MIT), Settings pattern from Anionex/dsh-vision-toolkit (MIT).

019 giorni faVisione, voce e multimodaleMIT
M

dsh-voice-input-en

mohith-das/dsh-voice-input-en

Minimal English-only voice input for the DeepSeek Harness Web UI: a mic button in the composer that transcribes speech into the draft via the browser's native SpeechRecognition API. No dependencies, no subprocess, no network calls beyond whatever the brow

0mese scorsoVisione, voce e multimodaleMIT
K

dsh-kitt-voice

kittcat-lab/dsh-kitt-voice

Voice for the DeepSeek Harness: speak to the agent, hear it back, and see what it is doing from a floating window that stays on top of whatever you are running.

028 giorni faVisione, voce e multimodaleMIT
S

dsh-voice-control

sucriss/dsh-voice-control

Voice control for the DSH web composer: push-to-talk speech-to-text into the input box (with optional auto-send), spoken playback of assistant replies via the Web Speech API, right-click settings popover, and a global Ctrl+M hotkey.

0mese scorsoVisione, voce e multimodaleMIT