Vai al contenuto principale

Plugin

Sfoglia, filtra e installa i plugin di DeepSeek-Harness.

86 plugin trovati

N

vision-exp-tile

nicholas023/vision-exp-tile

Riconoscimento di immagini grandi per modelli vision-exp: riconoscimento a tile 800×800 senza perdita (smart/pipeline/full), OCR locale con pre-elaborazione e instradamento della grafia, GPU multi-vendor opzionale (DirectML/CUDA/OpenVINO) con fallback automatico a CPU.

5mese scorsoVisione, voce e multimodaleMIT
B

dsh-ocr-local

balcoz/dsh-ocr-local

OCR locale per DeepSeek Harness: incolla o allega un'immagine, ottieni il suo testo tramite PP-OCRv5 + ONNX Runtime, completamente offline. TUI (cc-tui) e Web.

52 mesi faVisione, voce e multimodale
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

Visione su richiesta per sessioni DSH solo testo: le immagini diventano marcatori e uno strumento vision_describe invia solo l'immagine e la domanda a un modello di visione compatibile con OpenAI

52 mesi faVisione, voce e multimodaleMIT
E

canvas-workbench

elangan1997-cmyk/canvas-workbench

Workbench locale di generazione immagini, zero canoni di abbonamento: usa la tua API per generare immagini (qualsiasi interfaccia compatibile con OpenAI, zero abbonamenti), layout su telaio e ritocco/cancellatura/rimozione sfondo/OCR/vettorializzazione, consegna PSD/AI modificabili, bridge bidirezionale a livello di oggetti Photoshop/Illustrator.

43 giorni faVisione, voce e multimodaleMIT
L

dsh-attachment-formats

linkingoscar/dsh-attachment-formats

Plugin web DeepSeek Harness — strato di testo PDF e OCR PDF scansionati, Office docx/xlsx/pptx in Markdown, schede indice TIFF/epub e documenti lunghi.

43 giorni faStrumenti e capacitàApache-2.0
X

dsh-vision-hub (tool-vision)

xing666173/dsh-vision-hub

Toolbox visione migliorato: 14 strumenti visione a livello di pixel (describe, ground, detect, crop, pixel-diff, OCR, long-screenshot OCR, vectorize, colors, cutout, screenshot, present, materialize, html-screenshot) guidati da un endpoint OpenAI-compatible, con marcatori bridge puliti [图片: path], classificazione content-safety e auto-retry del rate-limit.

4mese scorsoVisione, voce e multimodale
X

dsh-vision-hub (file-drop)

xing666173/dsh-vision-hub

Upload file drag-and-drop per PDF, Word, Excel e immagini: i file rilasciati sono salvati in una directory locale e referenziati per percorso, nessun bloat base64 in chat.

4mese scorsoStrumenti e capacità
X

dsh-vision-hub (bridge-preview)

xing666173/dsh-vision-hub

Anteprima inline per i marcatori bridge immagine [图片: path]: dopo che il marcatore si renderizza, l'immagine appare in chat automaticamente, mantenendo istruzioni lunghe fuori dalla conversazione.

4mese scorsoSessioni e messaggi
M

dsh-nuphus-mcp

mrpulor-gh/dsh-nuphus-mcp

Plugin DSH ufficiale per nuphus-mcp (dai manutentori di nuphus-mcp): automazione desktop e browser (38 strumenti) con percezione degli elementi PaddleOCR e navigazione Chrome CDP, tramite un processo figlio stdio MCP persistente.

4mese scorsoStrumenti e capacitàMIT
G

deepseek-vision

gou-gee/deepseek-vision

Bundle visivo nativo per DeepSeek Harness: incolla o trascina immagini, richiama modelli visivi compatibili OpenAI tramite deepseek-vision-mcp ospitato.

42 mesi faMCP e connettoriMIT
N

free-vision-skill

niyongsheng/free-vision-skill

Comprensione delle immagini e OCR completamente locali tramite il Vision Framework di macOS: `ocr_image` (testo, layout tabella + coordinate) e `view_image` (scena, volti, QR) — incolla più immagini nella casella di input web o passa percorso/URL/base64; le immagini non lasciano mai il tuo Mac.

4mese scorsoVisione, voce e multimodaleMIT
G

deepseek-vision (dsh-plugin-deepseek-vision)

gou-gee/deepseek-vision

Bundle Vision MCP e DSH per DeepSeek solo testo: strumenti analyze_image, analyze_clipboard, compare_images e vision_status, una pagina impostazioni visuale, GLM-4.6V-Flash gratuito di default, caching dei risultati e tolleranza al rate-limit; le chiavi restano fuori dai log.

426 giorni faVisione, voce e multimodaleMIT
C

dsh-learning-mode

chplus0/dsh-learning-mode

Preset agente Learning Mode: un agente di coding che insegna mentre programma — spiegazioni concrete basate su scenari, guida socratica e spazi vuoti per esercitazioni TODO(你), modellato sullo stile di output Learning di Claude Code; installabile tramite dsh plugin add (dsh-learning-mode su npm).

42 mesi faStrumenti e capacità
F

dsh-plugin-deepeye

favio8/dsh-plugin-deepeye

Plugin di vision DeepEye per DeepSeek Harness (DSH): descrizione delle immagini, OCR, VQA, layout UI e analisi degli appunti.

42 mesi faVisione, voce e multimodale
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

Workstation omni-modale per DSH: analyze_image su una catena ordinata multi-scheda di failover VLM, un toolkit di visione con sei strumenti (zoom, campionamento colori, pixel diff, OCR, rilevamento elementi, visualizzazione inline) che condivide lo stesso resolver di immagini, generate_image sui protocolli OpenAI/DashScope/ComfyUI, generate_video asincrono multi-scheda con un builder /build-video-tool, più TTS speak/clone_voice su sette provider, tutto governato da un'unica pagina di impostazioni con salvataggio automatico.

314 giorni faVisione, voce e multimodaleMIT
X

dsh-image-vision

xiaoyuink/dsh-image-vision

Comprensione delle immagini per qualsiasi modello DSH: strumenti di visione, OCR, grounding e ritaglio con preset di dominio per istopatologia, biologia cellulare, anatomia, immagini cliniche e figure scientifiche.

329 giorni faVisione, voce e multimodale
Y

dsh-ui-spec

yumimanji/dsh-ui-spec

Plugin DeepSeek Harness che trasforma screenshot UI in specifiche web di grado implementativo utilizzando OCR, geometria deterministica, grafi di scena, asset e confronto di rendering.

32 mesi faVisione, voce e multimodaleMIT
F

dsh-wechat-mp-studio

funcwei/dsh-wechat-mp-studio

Studio di contenuti per gli account ufficiali WeChat: scrittura a rotazione anti-omologazione, playbook di rimedio per bassa creatività, baseline visiva per le immagini di benedizione, pipeline gpt-image con accettazione OCR e la web API dei draft xiaolvshu misurata sul campo.

32 mesi faCompetenzeMIT
O

dsh-paddle-ocr

omdsh-dev/dsh-paddle-ocr

32 mesi faVisione, voce e multimodaleBSD-3-Clause
Y

dsh-md-convert

yakoylp/dsh-md-convert

Converte documenti Office e PDF (inclusi quelli scansionati) in Markdown strutturalmente formattato tramite una pipeline OCR con instradamento a priorità CPU (RapidOCR/SLANet/FormulaNet).

222 giorni faFlussi e automazioneMIT
L

dsh-visibridge

lhbsaa/dsh-visibridge

Evidenza visiva strutturata (OCR/layout/semantica) più uno strumento di acquisizione da camera USB per un ciclo di debug «scatta-guarda-regola»; backend: Ollama, DeepSeek, Xiaomi.

2mese scorsoVisione, voce e multimodaleMIT
F

auto-mouse

fish121380/auto-mouse

Selettore di contesto UI del desktop Windows per Codex, DeepSeek Harness e client MCP: seleziona finestre, elementi UI o regioni dello schermo con evidenziazione al passaggio del mouse, UI Automation, screenshot e OCR locale, poi rivedi e approva il contesto Markdown/JSON prima dell'output.

2mese scorsoStrumenti e capacitàMIT
G

dsh-vision-bridge

goodandready/dsh-vision-bridge

Instrada le immagini verso il modello di visione che preferisci - riscrittura automatica, strumenti espliciti o ibrido - così un modello di chat solo testuale non fallisce un turno che contiene un'immagine.

26 giorni faVisione, voce e multimodaleMIT
3

dsh-vision (vision-tool)

314857493/dsh-vision

Strumento `vision` invocabile dal modello per DeepSeek Harness: descrive e fa OCR dei file immagine chiamando direttamente la free Zhipu GLM vision API (catena di fallback glm-4v-flash), senza CLI esterno.

228 giorni faVisione, voce e multimodaleMIT