Vai al contenuto principale

Plugin

Sfoglia, filtra e installa i plugin di DeepSeek-Harness.

18 plugin trovati

F

dsh-vision-proxy

flyvhidbwo/dsh-vision-proxy

Cervello DeepSeek + trascrizione automatica delle immagini: allega immagini nella GUI e ognuna viene trascritta tramite il deepseek-v4-flash-vision-exp ufficiale per impostazione predefinita (un cervello V4-Pro puramente testuale può vedere le immagini), con qualsiasi VLM compatibile con OpenAI o Ollama locale come alternative.

16mese scorsoVisione, voce e multimodaleMIT
R

dsh-plugin-call-me

radres/dsh-plugin-call-me

Fa squillare il tuo telefono tramite CallKit: strumenti `call_me` e `text_me`, più chiamate opzionali a fine turno e per l'approvazione, la cui risposta vocale viene trascritta di nuovo nella sessione.

7l’altro ieriIntegrazioni e accesso remotoMIT
S

dsh-voice-assistant

supersyh-sss/dsh-voice-assistant

Assistente vocale per il web dsh: pronuncia la frase di attivazione (ad es. "小鲸") per attivare la dettatura a mani libere — ciò che dici viene trascritto e digitato automaticamente nella casella della chat. Supporta comandi di modifica vocali (invia, cancella, nuova riga, interrompi lettura) e legge ad alta voce in cinese le risposte dell'assistente. Il riconoscimento vocale gira localmente nel browser via sherpa-onnx WASM, quindi funziona offline senza chiave API.

3mese scorsoVisione, voce e multimodaleMIT
B

dsh-stt-input

baisama-cloud/dsh-stt-input

Input vocale speech-to-text per la web UI: un pulsante microfono nel composer trascrive il parlato nella bozza tramite la Web Speech API del browser (zero-config) o un'API Whisper compatibile OpenAI (OpenAI / Groq), con modello e lingua selezionabili nelle Impostazioni.

3mese scorsoVisione, voce e multimodaleMIT
J

dsh-voice

jesse-njx/dsh-voice

Note vocali in ingresso, risposte parlate in uscita: detta audio che diventa messaggi utente (trascrizione), fai leggere ad alta voce le risposte dall'agente (sintesi vocale), local-first sotto ~/.dsh/voice

32 mesi faVisione, voce e multimodaleMIT
B

dsh-vision-plugin

bug-huntter/dsh-vision-plugin

Riconoscimento immagini configurabile per modelli DSH solo testo: i messaggi immagine vengono prima trascritti da un modello vision compatibile con OpenAI (URL di base, ID modello e chiave API impostati in una sezione Impostazioni) e poi passati al modello principale come testo, mentre viene dichiarato il supporto all'input immagine. Lo schema di autenticazione della chiave API è selezionabile (intestazioni di richiesta in stile OpenAI, Anthropic, Gemini o Azure) e la mancanza di una chiave viene segnalata prima dell'invio di qualsiasi richiesta.

27 giorni faVisione, voce e multimodaleMIT
K

dsh-vision-recognizer

kaixinbaba/dsh-vision-recognizer

Rotta del provider di visione che trascrive le immagini allegate in testo tramite un modello configurabile (oltre 15 fornitori compatibili con OpenAI e Anthropic) mentre DeepSeek continua a rispondere.

22 mesi faVisione, voce e multimodaleMIT
3

dsh-vision (vision-route)

314857493/dsh-vision

Registra una route provider `deepseek-vision`: la GUI web accetta immagini incollate e le trascrive in testo tramite la free Zhipu GLM vision API prima di delegare all’adattatore DeepSeek.

2mese scorsoVisione, voce e multimodaleMIT
X

dsh-vision-bridge

ximengxiaolan/dsh-vision-bridge

Le immagini allegate nel composer vengono trascritte in testo da un modello di visione compatibile con OpenAI prima di raggiungere i modelli DeepSeek solo testo

22 mesi faVisione, voce e multimodaleMIT
J

dsh-mmroute

jmxsxwyzjdwl/dsh-mmroute

Routing multimodale trasparente per modelli solo testuali: ogni immagine in ogni chiamata al modello viene trascritta completamente (OCR letterale, dati, zone di incertezza, protetta dalle iniezioni) dal tuo stesso comprenditore multimodale, con riosservazione mirata tramite vision_relook e nuovo tentativo automatico in caso di errori legati alle immagini. Nessun endpoint incluso, nessun login preso in prestito.

128 giorni faVisione, voce e multimodaleMIT
A

dsh-audio-copilot

ai-yucheng/dsh-audio-copilot

Audio Copilot per DeepSeek Harness: trascrivi audio (ASR) e sintetizza voce (TTS) — dà orecchie e voce agli agenti solo testo. TTS SAPI locale Windows pronto all'uso; endpoint ASR/TTS compatibili OpenAI configurabili. Include un input vocale nel composer

12 mesi faVisione, voce e multimodaleMIT
3

dsh-vision

314857493/dsh-vision

Plugin DeepSeek Harness: una rotta `deepseek-vision` che dichiara l'input di immagini e trascrive le immagini incollate tramite i modelli di visione gratuiti Zhipu GLM prima di delegare all'adattatore DeepSeek.

12 mesi faVisione, voce e multimodaleMIT
C

dsh-voice-mimo

ch1bug/dsh-voice-mimo

Xiaomi MiMo-powered voice for DeepSeek Harness: browser 🎤/🧠/🔊 UI, voice_transcribe/voice_understand/voice_speak tools, configurable voice map (preset/voicedesign/voiceclone). Fork of zhuiyueya/dsh-voice (MIT), Settings pattern from Anionex/dsh-vision-toolkit (MIT).

021 giorni faVisione, voce e multimodaleMIT
M

dsh-voice-input-en

mohith-das/dsh-voice-input-en

Minimal English-only voice input for the DeepSeek Harness Web UI: a mic button in the composer that transcribes speech into the draft via the browser's native SpeechRecognition API. No dependencies, no subprocess, no network calls beyond whatever the brow

0mese scorsoVisione, voce e multimodaleMIT
S

dsh-vision-pro-bridge

shainedemo/dsh-vision-pro-bridge

Vision bridge for text-only DeepSeek models: transcribes attached images with deepseek-v4-flash-vision-exp before they reach deepseek-v4-pro, with no third-party dependencies.

0mese scorsoVisione, voce e multimodaleMIT
J

dsh-autovision

junkrat9527/dsh-autovision

Vision for text-only dsh models: paste an image and a configured multimodal model transcribes it to text automatically — transparent twin routing, an agent-callable read-image tool, no built-in keys or relay.

02 mesi faVisione, voce e multimodaleMIT
N

dsh-voice-input

newdanew/dsh-voice-input

Voice input for the web UI: a mic button in the composer that transcribes speech into the draft via the Web Speech API, with an optional auto-send toggle.

02 mesi faVisione, voce e multimodaleMIT
E

dsh-plugin-image-input

elohia/dsh-plugin-image-input

Image-to-text input for the Web UI: paste or drag an image and it is transcribed into structured text and sent, giving text-only LLMs image-input takeover (OpenAI-compatible vision API).

02 mesi faVisione, voce e multimodaleMIT