Plugin
Sfoglia, filtra e installa i plugin di DeepSeek-Harness.
18 plugin trovati
dsh-vision-proxy
flyvhidbwo/dsh-vision-proxy
Cervello DeepSeek + trascrizione automatica delle immagini: allega immagini nella GUI e ognuna viene trascritta tramite il deepseek-v4-flash-vision-exp ufficiale per impostazione predefinita (un cervello V4-Pro puramente testuale può vedere le immagini), con qualsiasi VLM compatibile con OpenAI o Ollama locale come alternative.
dsh-plugin-call-me
radres/dsh-plugin-call-me
Fa squillare il tuo telefono tramite CallKit: strumenti `call_me` e `text_me`, più chiamate opzionali a fine turno e per l'approvazione, la cui risposta vocale viene trascritta di nuovo nella sessione.
dsh-voice-assistant
supersyh-sss/dsh-voice-assistant
Assistente vocale per il web dsh: pronuncia la frase di attivazione (ad es. "小鲸") per attivare la dettatura a mani libere — ciò che dici viene trascritto e digitato automaticamente nella casella della chat. Supporta comandi di modifica vocali (invia, cancella, nuova riga, interrompi lettura) e legge ad alta voce in cinese le risposte dell'assistente. Il riconoscimento vocale gira localmente nel browser via sherpa-onnx WASM, quindi funziona offline senza chiave API.
dsh-stt-input
baisama-cloud/dsh-stt-input
Input vocale speech-to-text per la web UI: un pulsante microfono nel composer trascrive il parlato nella bozza tramite la Web Speech API del browser (zero-config) o un'API Whisper compatibile OpenAI (OpenAI / Groq), con modello e lingua selezionabili nelle Impostazioni.
dsh-voice
jesse-njx/dsh-voice
Note vocali in ingresso, risposte parlate in uscita: detta audio che diventa messaggi utente (trascrizione), fai leggere ad alta voce le risposte dall'agente (sintesi vocale), local-first sotto ~/.dsh/voice
dsh-vision-plugin
bug-huntter/dsh-vision-plugin
Riconoscimento immagini configurabile per modelli DSH solo testo: i messaggi immagine vengono prima trascritti da un modello vision compatibile con OpenAI (URL di base, ID modello e chiave API impostati in una sezione Impostazioni) e poi passati al modello principale come testo, mentre viene dichiarato il supporto all'input immagine. Lo schema di autenticazione della chiave API è selezionabile (intestazioni di richiesta in stile OpenAI, Anthropic, Gemini o Azure) e la mancanza di una chiave viene segnalata prima dell'invio di qualsiasi richiesta.
dsh-vision-recognizer
kaixinbaba/dsh-vision-recognizer
Rotta del provider di visione che trascrive le immagini allegate in testo tramite un modello configurabile (oltre 15 fornitori compatibili con OpenAI e Anthropic) mentre DeepSeek continua a rispondere.
dsh-vision (vision-route)
314857493/dsh-vision
Registra una route provider `deepseek-vision`: la GUI web accetta immagini incollate e le trascrive in testo tramite la free Zhipu GLM vision API prima di delegare all’adattatore DeepSeek.
dsh-vision-bridge
ximengxiaolan/dsh-vision-bridge
Le immagini allegate nel composer vengono trascritte in testo da un modello di visione compatibile con OpenAI prima di raggiungere i modelli DeepSeek solo testo
dsh-mmroute
jmxsxwyzjdwl/dsh-mmroute
Routing multimodale trasparente per modelli solo testuali: ogni immagine in ogni chiamata al modello viene trascritta completamente (OCR letterale, dati, zone di incertezza, protetta dalle iniezioni) dal tuo stesso comprenditore multimodale, con riosservazione mirata tramite vision_relook e nuovo tentativo automatico in caso di errori legati alle immagini. Nessun endpoint incluso, nessun login preso in prestito.
dsh-audio-copilot
ai-yucheng/dsh-audio-copilot
Audio Copilot per DeepSeek Harness: trascrivi audio (ASR) e sintetizza voce (TTS) — dà orecchie e voce agli agenti solo testo. TTS SAPI locale Windows pronto all'uso; endpoint ASR/TTS compatibili OpenAI configurabili. Include un input vocale nel composer
dsh-vision
314857493/dsh-vision
Plugin DeepSeek Harness: una rotta `deepseek-vision` che dichiara l'input di immagini e trascrive le immagini incollate tramite i modelli di visione gratuiti Zhipu GLM prima di delegare all'adattatore DeepSeek.
dsh-voice-mimo
ch1bug/dsh-voice-mimo
Xiaomi MiMo-powered voice for DeepSeek Harness: browser 🎤/🧠/🔊 UI, voice_transcribe/voice_understand/voice_speak tools, configurable voice map (preset/voicedesign/voiceclone). Fork of zhuiyueya/dsh-voice (MIT), Settings pattern from Anionex/dsh-vision-toolkit (MIT).
dsh-voice-input-en
mohith-das/dsh-voice-input-en
Minimal English-only voice input for the DeepSeek Harness Web UI: a mic button in the composer that transcribes speech into the draft via the browser's native SpeechRecognition API. No dependencies, no subprocess, no network calls beyond whatever the brow
dsh-vision-pro-bridge
shainedemo/dsh-vision-pro-bridge
Vision bridge for text-only DeepSeek models: transcribes attached images with deepseek-v4-flash-vision-exp before they reach deepseek-v4-pro, with no third-party dependencies.
dsh-autovision
junkrat9527/dsh-autovision
Vision for text-only dsh models: paste an image and a configured multimodal model transcribes it to text automatically — transparent twin routing, an agent-callable read-image tool, no built-in keys or relay.
dsh-voice-input
newdanew/dsh-voice-input
Voice input for the web UI: a mic button in the composer that transcribes speech into the draft via the Web Speech API, with an optional auto-send toggle.
dsh-plugin-image-input
elohia/dsh-plugin-image-input
Image-to-text input for the Web UI: paste or drag an image and it is transcribed into structured text and sent, giving text-only LLMs image-input takeover (OpenAI-compatible vision API).