Plugin
Sfoglia, filtra e installa i plugin di DeepSeek-Harness.
45 plugin trovati
dsh-memory
furongjun-1999/dsh-memory
Esplorazione dell'architettura AGI white-box: metacognizione (ciclo di auto-cognizione), apprendimento continuo (volano della conoscenza), modello del mondo (spazio delle condizioni, grafo di memoria spazio-temporale), auto-miglioramento (disciplina bootstrap), pipeline white-box zero-LLM e guardrail di fiducia verificabili.
DSH-Plugins-Marketplace
bradegithub/dsh-plugins-marketplace
Marketplace di plugin e skill basato sui topic di GitHub: una pagina delle impostazioni che sfoglia il registro raccolto automaticamente (l'intero topic dsh-plugin più l'indice delle skill, aggiornato dalla CI ogni 2 ore) con installazione con un clic, rilevamento del tipo, conferme di sicurezza per gli script di installazione e le dipendenze nascoste dell'host, gestione delle chiavi di ambiente e la specifica di riconoscimento STANDARD.md.
dsh-prompt-enhancer
fishsb/dsh-prompt-enhancer
Miglioramento dei prompt con un clic (5 modalità, catena di memoria, fallback multi-modello) più riconoscimento vocale (Qwen3-ASR cloud / SenseVoice offline, arresto automatico al silenzio) per il composer, con riavvio del servizio DSH con un clic.
dsh-voice-scribe
pensivefei/dsh-voice-scribe
Input vocale per l'interfaccia web: premi Alt (o Alt+Space) per avviare/arrestare la dettatura, Web Speech del browser (zero-config) o ASR cloud compatibile con OpenAI, rifinitura opzionale tramite LLM configurato in DSH, interfaccia impostazioni.
dsh-ears
wiziscool/dsh-ears
Plugin di input vocale per DeepSeek Harness (dsh): un pulsante microfono nel compositore converte il parlato in una bozza trascritta, con scelta di backend di riconoscimento vocale, rifinitura opzionale tramite i percorsi LLM propri di dsh e una pagina delle impostazioni nativa.
dsh-voice-mode (dsh-voice-mode)
qishuilalala/dsh-voice-mode
Modalità vocale full-duplex per la Web UI di DeepSeek Harness: toggle (invio automatico dopo pausa di 2s) o dettatura hold-to-talk in una bozza editabile con ASR streaming zipformer2, wake word opzionale; lettura ad alta voce Edge TTS frase per frase con sottotitoli live, e il parlato interrompe la riproduzione e il turno in corso (vero barge-in). ASR on-device, nessuna chiave API.
dsh-vision
linenxi-ctrl/dsh-vision
Plugin di vision esterno per DeepSeek Harness: pannello di configurazione con pulsante balena, riconoscimento immagini con risposta automatica e strumenti agente per screenshot/riconoscimento.
dsh-highres-vision
azwosile/dsh-highres-vision
Per il modello di visione nativo di DeepSeek Harness deepseek-v4-flash-vision-exp, innalza i limiti di ammissione delle immagini a 32 MiB / 8192 px / 600 immagini e aggiunge uno strumento highres_read che suddivide le immagini grandi in riquadri, per poi restituire l'immagine intera più riquadri di 800x800 tramite lo strumento read_image dell'host.
dsh-voice
3274375092/dsh-voice
Input vocale per DeepSeek Harness: parla nel microfono e il testo riconosciuto viene inviato come un normale messaggio di chat, tramite riconoscimento vocale locale o del browser.
dsh-vision
54xkeee/dsh-vision
Visione per DeepSeek solo testo tramite Doubao Web per impostazione predefinita (gratuito, senza chiave API: guida il tuo Chrome connesso tramite un bridge CDP Windows), con quota Antigravity IDE (flash/pro) o fallback su Gemini; escalation automatica del livello di dettaglio, memoria delle evidenze visive con reidratazione dopo la compattazione, cache basata su hash dei contenuti e un pannello client bilingue.
dsh-tool-see-image
gugu123a/dsh-tool-see-image
Fornisce lo strumento see_image per DSH: invia un file immagine a un modello di visione compatibile con OpenAI configurabile e riporta la sua descrizione a un modello di solo testo.
vision-exp-tile
nicholas023/vision-exp-tile
Riconoscimento di immagini grandi per modelli vision-exp: riconoscimento a tile 800×800 senza perdita (smart/pipeline/full), OCR locale con pre-elaborazione e instradamento della grafia, GPU multi-vendor opzionale (DirectML/CUDA/OpenVINO) con fallback automatico a CPU.
dsh-chatvoice
fuzzysoul/dsh-chatvoice
Circuito vocale gratuito per la Web UI: input microfonico con SpeechRecognition del browser con risultati provvisori in tempo reale, più pulsanti altoparlante per la lettura ad alta voce e lettura automatica delle risposte dell'assistente, zero configurazione e nessuna chiave API.
dsh-linghun
syyr1987/dsh-linghun
Un nucleo di giudizio per DeepSeek Harness: un ciclo cognitivo che dà a ogni decisione fonte e attribuzione e porta la pianificazione fino alla chiusura, una memoria ippocampale che condensa l'esperienza in conoscenza riutilizzabile e una scheda persona personalizzabile (nome, personalità, stile di comunicazione). Richiede DSH ^0.1.0-rc.7.
dsh-j-space
anonyjcy/dsh-j-space
Preset agente nativo J-Space Cognition Suite SV1 e plugin Cordis autonomo: 13 moduli, controller persistente e workspace disaccoppiato.
dsh-omni-workstation
huashenglian/dsh-omni-workstation
Workstation omni-modale per DSH: analyze_image su una catena ordinata multi-scheda di failover VLM, un toolkit di visione con sei strumenti (zoom, campionamento colori, pixel diff, OCR, rilevamento elementi, visualizzazione inline) che condivide lo stesso resolver di immagini, generate_image sui protocolli OpenAI/DashScope/ComfyUI, generate_video asincrono multi-scheda con un builder /build-video-tool, più TTS speak/clone_voice su sette provider, tutto governato da un'unica pagina di impostazioni con salvataggio automatico.
dsh-hold-to-talk
wangzhanchao883/dsh-hold-to-talk
Input a una mano e senza tastiera per il composer: tieni premuto il mouse sulla casella di input, parla, rilascia — il testo finisce nella bozza, e scorrendo verso l'alto annulli senza lasciare una frase a metà. Nessun pulsante microfono da centrare e nessuna scorciatoia da ricordare; la mano non deve mai lasciare l'area di input, che è il punto quando l'altra mano è occupata. Il riconoscimento gira completamente offline (SenseVoice via sherpa-onnx, nessuna chiave API, l'audio non lascia mai la macchina).
dsh-voice-assistant
supersyh-sss/dsh-voice-assistant
Assistente vocale per il web dsh: pronuncia la frase di attivazione (ad es. "小鲸") per attivare la dettatura a mani libere — ciò che dici viene trascritto e digitato automaticamente nella casella della chat. Supporta comandi di modifica vocali (invia, cancella, nuova riga, interrompi lettura) e legge ad alta voce in cinese le risposte dell'assistente. Il riconoscimento vocale gira localmente nel browser via sherpa-onnx WASM, quindi funziona offline senza chiave API.
dsh-voco
lgquan/dsh-voco
Conversazioni vocali continue per DSH con ascolto a mani libere, push-to-talk, riconoscimento vocale, risposte TTS e delega di Agent in background.
dsh-image-vision
xiaoyuink/dsh-image-vision
Comprensione delle immagini per qualsiasi modello DSH: strumenti di visione, OCR, grounding e ritaglio con preset di dominio per istopatologia, biologia cellulare, anatomia, immagini cliniche e figure scientifiche.
voco-input-sh
nothree-code/voco-input-sh
Input vocale per la Web UI: un pulsante microfono che usa il riconoscimento vocale offline locale di VocoType e inserisce automaticamente il testo riconosciuto nel compositore (auto-deploy, dedupe, dettatura continua).
visual-review
wang-bool/visual-review
Visualizza inline nel chat di DSH Web le immagini incollate o caricate e dà la vista ai modelli solo testuali: lo strumento visual_review, richiamabile dal modello, usa prima una qualsiasi API multimodale compatibile con OpenAI e, se fallisce, passa a un worker locale Qwen3-VL.
dsh-vision-tools
moon09300731/dsh-vision-tools
Bundle completo di capacità di visione per DeepSeek Harness: uno strumento vision_understand (API di visione compatibili con OpenAI, Zhipu GLM-4V-Flash gratuito per impostazione predefinita) oltre a punti di ingresso incolla/trascina e rilascia/pulsante per il riconoscimento delle immagini.
dsh-voice-call
biliye/dsh-voice-call
Assistente di chiamata vocale per la GUI web di DSH: una pallina di chiamata fluttuante e trascinabile, VAD lato browser che invia ogni frase dopo una pausa, riconoscimento vocale FunASR HTTP o in streaming, risposte TTS di MiniMax o compatibili OpenAI, una modalità opzionale con wake word e auto-sospensione, e invio di attività a sessioni subagente separate con progresso, stop e resoconti vocali di completamento.