Vai al contenuto principale

Plugin

Sfoglia, filtra e installa i plugin di DeepSeek-Harness.

82 plugin trovati

L

modlens

liustack/modlens

Ponte visivo per modelli solo testuali: incolla un'immagine e ottieni prove strutturate in JSON (OCR, layout, semantica).

4.1k5 giorni faVisione, voce e multimodaleMIT
Y

dsh-vision-router

ysr666/dsh-vision-router

Vision gratuita per agenti solo testuali: catena di vision integrata senza chiave, più strumenti pixel (Q&A, grounding, ritaglio, confronto pixel, colori, OCR, tracciamento SVG, ritaglio silhouette, screenshot); incolla un'immagine per usarla.

1.1kieriVisione, voce e multimodaleMIT
T

tongflow (dsh-tongflow)

tong-io/tongflow

Studio troupe cinematografica TongFlow per la produzione di immagini, voce, musica e video: l'agente scrive file di flusso di lavoro TongFlow per ogni risorsa (.tongflow.json) che vengono eseguiti tramite plugin TongFlow, con una tela di flusso incorporata, un layout di progetto per inquadratura/personaggio/presa e un modello manga-drama; le sessioni che iniziano con @tongflow aprono la vista Studio.

1k11 ore faFlussi e automazioneAGPL-3.0
T

tongflow

tong-io/tongflow

Plugin studio TongFlow per DeepSeek Harness (dsh): modello di progetto in stile troupe cinematografica, flussi di lavoro TongFlow creati dall'agente, generazione multimediale deterministica, tela incorporata.

870mese scorsoVisione, voce e multimodaleAGPL-3.0
O

watch-skill

oxbshw/watch-skill

Le capacità di DeepWatch, installabili in un profilo DeepSeek Harness esistente

37818 giorni faVisione, voce e multimodaleMIT
Z

dsh-crew

zseven-w/dsh-crew

Disperdi il lavoro agli agenti DSH da Claude Code o Codex: avanzamento nativo dei sotto-agenti, sessioni worker sull'host con preset per livello e un bridge multimodale per visione e generazione di immagini.

1538 giorni faIntegrazioni e accesso remotoMIT
V

ark-cli (ark-managed-agents)

volcengine/ark-cli

Aggiunge una scheda impostazioni Managed Agents e tool MCP per inviare task agente a lunga durata agli Ark cloud Managed Agents.

1393 giorni faStrumenti e capacitàApache-2.0
V

ark-cli (ark-plan-api)

volcengine/ark-cli

Registra i percorsi Ark Agent Plan, Coding Plan e i modelli postpagati nel selettore nativo dei modelli DSH.

1393 giorni faModelli e providerApache-2.0
V

ark-cli

volcengine/ark-cli

Plugin di provider Volcengine Ark per DeepSeek Harness (DSH): registra le route Agent Plan, Coding Plan e a pagamento differito sull'adattatore nativo pi-ai affinché i modelli Ark compaiano nel selettore dei modelli.

112mese scorsoModelli e providerApache-2.0
S

dsh-AuthInOne

stormycry-cryp/dsh-authinone

Aggiunge accesso all'account, configurazione di API e Provider personalizzato, cambio modello, fallback immagine per modelli solo testo e attribuzione di token/costi a DeepSeek Harness 47f.

1052 mesi faModelli e providerMIT
S

dsh-design-qa

sunxin-ai/dsh-design-qa

QA di fedeltà al design per modelli solo testuali: uno strumento `deepseek_vision` prende in prestito un occhio da qualsiasi percorso vision compatibile con OpenAI, così il modello può giudicare se un'implementazione corrisponde al mock — fornito con il benchmark alla base di quel giudizio (quattro fixture, 23 difetti iniettati, trascrizioni grezze) e la disciplina di interrogazione da cui dipende.

4426 giorni faVisione, voce e multimodaleMIT
J

picturereader

jing-hy/picturereader

«Lettura» delle immagini per modelli solo testo: riduzione della scala + riduzione della profondità colore + impronte di struttura/colore convertite in griglie di testo restituite alla conversazione, permettendo al modello di ingrandire, campionare ed eseguire OCR in autonomia come un modello multimodale; completamente locale, senza alcuna dipendenza da modelli esterni, include una skill di metodologia di lettura delle immagini e PaddleOCR opzionale.

373 giorni faVisione, voce e multimodaleMIT
O

dsh-vision

oil-oil/dsh-vision

Comprensione delle immagini quasi nativa per DeepSeek Harness.

242 mesi faVisione, voce e multimodaleMIT
S

dsh-ros2

stvli/dsh-ros2

Toolset di debug ROS2 e analisi visiva dello stato del robot per DeepSeek Harness: enumerazione di node/topic/service/action/interface/TF, JSON della topologia dell'intero grafo, controlli rosdep, build con approvazione e scaffolding di messaggi personalizzati, screenshot GUI e osservazione visiva multimodale, più rendering offscreen headless RViz2 (mesh low-poly, lettura diretta dei pixel, passthrough GPU - rendering del movimento a 30Hz) con analisi VLM parallela in tempo reale.

22l’altro ieriStrumenti e capacitàMIT
J

dsh-visual-plugin

jyh20030112/dsh-visual-plugin

Dona la vista ai modelli solo testuali: inoltra le immagini dell'utente a un modello di visione compatibile con OpenAI e mostra le descrizioni in un pannello destro dell'interfaccia web.

163 giorni faVisione, voce e multimodaleMIT
F

dsh-vision-proxy

flyvhidbwo/dsh-vision-proxy

Cervello DeepSeek + trascrizione automatica delle immagini: allega immagini nella GUI e ognuna viene trascritta tramite il deepseek-v4-flash-vision-exp ufficiale per impostazione predefinita (un cervello V4-Pro puramente testuale può vedere le immagini), con qualsiasi VLM compatibile con OpenAI o Ollama locale come alternative.

15mese scorsoVisione, voce e multimodaleMIT
M

dsh-provider-qoder

mo-n/dsh-provider-qoder

Collega gli abbonamenti Qoder a DeepSeek Harness, con supporto per le regioni Global e Cina, input multimodale e chiamate agli strumenti.

13ieriModelli e providerMIT
W

dsh-mmx-bridge

welsione/dsh-mmx-bridge

Ponte multimodale MiniMax: un unico strumento `mmx_bridge` copre comprensione/generazione di immagini, video, TTS, musica, copertine, ricerca web e quota; sostituzione opzionale di `web_search`/`read_image`; player e anteprime immagine incorporati direttamente nella GUI web (npm: `dsh-mmx-bridge`).

1015 giorni faStrumenti e capacitàMIT
S

dsh-deepseek-vision

siegfly/dsh-deepseek-vision

Un percorso del provider gateway visione-linguaggio: le immagini incollate vengono descritte da un modello VL configurabile (Qwen-VL per impostazione predefinita) prima di essere inviate a DeepSeek.

922 giorni faVisione, voce e multimodaleMIT
M

dsh-iris

mokuyoaxis/dsh-iris

Spazio di lavoro per media e visione per DeepSeek Harness: generazione di immagini, video e parlato, Q&A sulle immagini e localizzazione degli elementi, OCR di immagini lunghe, diff a livello di pixel, verifica tramite screenshot HTML e riassunto di video, con provider DashScope e compatibili OpenAI, pool di modelli e un client workbench.

7l’altro ieriStrumenti e capacitàMIT
5

dsh-vision

54xkeee/dsh-vision

Visione per DeepSeek solo testo tramite Doubao Web per impostazione predefinita (gratuito, senza chiave API: guida il tuo Chrome connesso tramite un bridge CDP Windows), con quota Antigravity IDE (flash/pro) o fallback su Gemini; escalation automatica del livello di dettaglio, memoria delle evidenze visive con reidratazione dopo la compattazione, cache basata su hash dei contenuti e un pannello client bilingue.

72 mesi faVisione, voce e multimodaleMIT
Y

deepseek-harness-plugins (vision-bridge)

yinxe/deepseek-harness-plugins

Permette ai modelli solo testo di vedere le immagini: quando arriva un'immagine con un segnaposto come \[image omitted because this model accepts text only], il modello chiama lo strumento vision_describe e il plugin inoltra il riferimento dell'immagine più la domanda a un modello multimodale, riprovando con un modello di fallback in caso di errore. Si configura nella pagina delle impostazioni ed è persistito tramite l'API ufficiale delle impostazioni.

6l’altro ieriVisione, voce e multimodaleMIT
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

Visione su richiesta per sessioni DSH solo testo: le immagini diventano marcatori e uno strumento vision_describe invia solo l'immagine e la domanda a un modello di visione compatibile con OpenAI

52 mesi faVisione, voce e multimodaleMIT
A

dsh-guide-dog

atropinoltt/dsh-guide-dog

Plugin multimodale alimentato da MiniMax: modalità chiamata vocale in tempo reale (conversazione in streaming, interfaccia dock flottante), modalità vocale e input vocale dal microfono, oltre a strumenti di generazione di immagini/video/musica/voce e di ispezione visiva.

52 mesi faVisione, voce e multimodaleMIT