Zum Hauptinhalt springen

Plugins

Durchsuche, filtere und installiere DeepSeek-Harness-Plugins.

82 Plugins gefunden

L

modlens

liustack/modlens

Vision-Brücke für reine Textmodelle: Bild einfügen, strukturierte JSON-Belege erhalten (OCR, Layout, Semantik).

4.1kvor 5 TagenVision, Sprache & MultimodalMIT
Y

dsh-vision-router

ysr666/dsh-vision-router

Kostenlose Vision für reine Textagenten: integrierte, schlüssellose Vision-Chain plus Pixel-Tools (Q&A, Grounding, Zuschneiden, Pixel-Diff, Farben, OCR, SVG-Trace, Freistellen, Screenshots); Bild einfügen zur Nutzung.

1.1kgesternVision, Sprache & MultimodalMIT
T

tongflow (dsh-tongflow)

tong-io/tongflow

TongFlow-Filmcrew-Studio für Bild-, Sprach-, Musik- und Videoproduktion: Der Agent erstellt assetbezogene TongFlow-Workflow-Dateien (.tongflow.json), die über TongFlow-Plugins ausgeführt werden, mit eingebetteter Workflow-Canvas, Shot-/Character-/Take-Projektlayout und Manga-Drama-Vorlage; Sitzungen, die mit @tongflow beginnen, öffnen die Studio-Ansicht.

1kvor 7 StundenWorkflow-AutomatisierungAGPL-3.0
T

tongflow

tong-io/tongflow

TongFlow-Studio-Plugin für DeepSeek Harness (dsh): Filmcrew-artiges Projektmodell, vom Agent erstellte TongFlow-Workflows, deterministische Medienerstellung, eingebettete Canvas.

870letzten MonatVision, Sprache & MultimodalAGPL-3.0
O

watch-skill

oxbshw/watch-skill

Die Funktionen von DeepWatch, installierbar in ein bestehendes DeepSeek Harness-Profil

378vor 18 TagenVision, Sprache & MultimodalMIT
Z

dsh-crew

zseven-w/dsh-crew

Verteilen Sie Aufgaben von Claude Code oder Codex an DSH-Agenten: nativer Subagent-Fortschritt, Host-interne Worker-Sessions mit stufenbasierten Voreinstellungen und eine multimodale Brücke für Vision und Bildgenerierung.

153vor 8 TagenIntegrationen & FernzugriffMIT
V

ark-cli (ark-managed-agents)

volcengine/ark-cli

Fügt einen Tab für Managed Agents in den Einstellungen hinzu sowie MCP-Tools, um langfristige Agentenaufgaben an Ark Cloud Managed Agents zu übergeben.

139vor 3 TagenTools & FunktionenApache-2.0
V

ark-cli (ark-plan-api)

volcengine/ark-cli

Registriert Ark Agent Plan-, Coding-Plan- und Postpaid-Model-Routen im nativen DSH-Modellauswahldialog.

139vor 3 TagenModelle & AnbieterApache-2.0
V

ark-cli

volcengine/ark-cli

Volcengine-Ark-Provider-Plugin für DeepSeek Harness (DSH): registriert Agent Plan, Coding Plan und Postpaid-Routen auf dem nativen pi-ai-Adapter, sodass Ark-Modelle in der Modellauswahl erscheinen.

112letzten MonatModelle & AnbieterApache-2.0
S

dsh-AuthInOne

stormycry-cryp/dsh-authinone

Fügt Konto-Login, API- und benutzerdefinierte Provider-Einrichtung, Modellwechsel, Bild-Fallback für reine Textmodelle sowie Token-/Kostenzuordnung zu DeepSeek Harness 47f hinzu.

105vor 2 MonatenModelle & AnbieterMIT
S

dsh-design-qa

sunxin-ai/dsh-design-qa

Design-Treue-QA für textbasierte Modelle: Ein `deepseek_vision`-Tool leiht sich ein Auge von jedem OpenAI-kompatiblen Vision-Pfad, damit das Modell beurteilen kann, ob eine Implementierung zu seinem Mock passt — ausgeliefert mit dem Benchmark hinter diesem Urteil (vier Fixtures, 23 injizierte Defekte, Rohtranskripte) und der Fragedisziplin, von der es abhängt.

44vor 26 TagenVision, Sprache & MultimodalMIT
J

picturereader

jing-hy/picturereader

Bild-„Lesen“ für reine Textmodelle: Herunterskalieren + Reduzierung der Farbtiefe + Struktur-/Farb-Fingerabdrücke werden in Textraster umgewandelt und in das Gespräch zurückgespeist, sodass das Modell wie ein multimodales Modell autonom zoomen, sampeln und OCR durchführen kann; vollständig lokal ohne Abhängigkeit von externen Modellen, enthält einen Skill zur Bild-Lese-Methodik sowie optional PaddleOCR.

37vorgesternVision, Sprache & MultimodalMIT
O

dsh-vision

oil-oil/dsh-vision

Nahezu native Bildverständnis-Funktionen für DeepSeek Harness.

24vor 2 MonatenVision, Sprache & MultimodalMIT
S

dsh-ros2

stvli/dsh-ros2

ROS2-Debug-Werkzeugkasten und Roboterzustands-Bildanalyse für DeepSeek Harness: Aufzählung von Node/Topic/Service/Action/Interface/TF, Topologie-JSON des gesamten Graphen, rosdep-Prüfungen, genehmigungsgesteuerte Builds und Custom-Message-Gerüstbau, GUI-Screenshots und multimodale Visionsbeobachtung sowie Headless-RViz2-Offscreen-Rendering (Low-Poly-Meshes, direkter Pixel-Read, GPU-Passthrough – Bewegungsdarstellung mit 30 Hz) mit paralleler VLM-Echtzeitanalyse.

22vorgesternTools & FunktionenMIT
J

dsh-visual-plugin

jyh20030112/dsh-visual-plugin

Verleiht reinen Textmodellen Sehvermögen: leitet Benutzerbilder an ein OpenAI-kompatibles Vision-Modell weiter und zeigt die Beschreibungen in einem rechten Panel der Web-UI an.

16vor 3 TagenVision, Sprache & MultimodalMIT
F

dsh-vision-proxy

flyvhidbwo/dsh-vision-proxy

DeepSeek-Gehirn + automatische Bildtranskription: Bilder in der GUI anhängen und jedes wird standardmäßig über das offizielle deepseek-v4-flash-vision-exp transkribiert (ein reines Text-V4-Pro-Gehirn kann Bilder sehen), mit jeder OpenAI-kompatiblen VLM oder lokalem Ollama als Alternative.

15letzten MonatVision, Sprache & MultimodalMIT
M

dsh-provider-qoder

mo-n/dsh-provider-qoder

Verbindet Qoder-Abonnements mit DeepSeek Harness, mit Unterstützung für die Regionen Global und China, multimodale Eingaben und Tool-Aufrufe.

13gesternModelle & AnbieterMIT
W

dsh-mmx-bridge

welsione/dsh-mmx-bridge

MiniMax-Multimodal-Bridge: Ein einziges Tool `mmx_bridge` deckt Bildverständnis/-generierung, Video, TTS, Musik, Cover, Websuche und Kontingent ab; optionale Übernahme von `web_search`/`read_image`; eingebettete Player/Bildvorschauen direkt in der Web-GUI (npm: `dsh-mmx-bridge`).

10vor 15 TagenTools & FunktionenMIT
S

dsh-deepseek-vision

siegfly/dsh-deepseek-vision

Eine Vision-Language-Gateway-Provider-Route: Eingefügte Bilder werden von einem konfigurierbaren VL-Modell (standardmäßig Qwen-VL) beschrieben, bevor sie an DeepSeek gesendet werden.

9vor 21 TagenVision, Sprache & MultimodalMIT
M

dsh-iris

mokuyoaxis/dsh-iris

Medien- und Vision-Workspace für DeepSeek Harness: Erzeugung von Bildern, Videos und Sprache, Fragen und Antworten zu Bildern sowie Lokalisierung von Elementen, OCR für lange Bilder, Pixel-Diff, Verifikation von HTML-Screenshots und Zusammenfassung von Videos, mit DashScope- und OpenAI-kompatiblen Anbietern, Modellpools und einem Workbench-Client.

7gesternTools & FunktionenMIT
5

dsh-vision

54xkeee/dsh-vision

Vision für das reine Text-DeepSeek standardmäßig über Doubao Web (kostenlos, kein API-Schlüssel nötig – steuert Ihr angemeldetes Chrome über eine Windows-CDP-Brücke), mit Antigravity-IDE-Kontingent (flash/pro) oder Gemini als Fallback; automatische Detail-Eskalation, Vision-Beleg-Speicher mit Rehydrierung nach Kompaktierung, Content-Hash-Cache und ein zweisprachiges Client-Panel.

7vor 2 MonatenVision, Sprache & MultimodalMIT
Y

deepseek-harness-plugins (vision-bridge)

yinxe/deepseek-harness-plugins

Lässt reine Textmodelle Bilder sehen: Trifft ein Bild mit einem Platzhalter wie \[image omitted because this model accepts text only] ein, ruft das Modell das Werkzeug vision_describe auf, und das Plugin leitet die Bildreferenz samt Frage an ein multimodales Modell weiter und wiederholt bei Fehlschlag mit einem Ausweichmodell. Konfiguriert wird auf der Einstellungsseite, gespeichert über die offizielle Settings-API.

6gesternVision, Sprache & MultimodalMIT
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

On-Demand-Vision für reine Text-DSH-Sitzungen: Bilder werden zu Markern, und ein vision_describe-Tool sendet nur das Bild und die Frage an ein OpenAI-kompatibles Vision-Modell

5vor 2 MonatenVision, Sprache & MultimodalMIT
A

dsh-guide-dog

atropinoltt/dsh-guide-dog

MiniMax-betriebenes multimodales Plugin: Echtzeit-Sprachanrufmodus (Streaming-Gespräch, schwebende Dock-UI), Sprachmodus und Mikrofon-Spracheingabe, sowie Bild-/Video-/Musik-/Sprachgenerierung und visuelle Inspektionstools.

5vor 2 MonatenVision, Sprache & MultimodalMIT