Zum Hauptinhalt springen

Plugins

Durchsuche, filtere und installiere DeepSeek-Harness-Plugins.

86 Plugins gefunden

L

modlens

liustack/modlens

Vision-Brücke für reine Textmodelle: Bild einfügen, strukturierte JSON-Belege erhalten (OCR, Layout, Semantik).

4kvorgesternVision, Sprache & MultimodalMIT
Y

dsh-vision-router

ysr666/dsh-vision-router

Kostenlose Vision für reine Textagenten: integrierte, schlüssellose Vision-Chain plus Pixel-Tools (Q&A, Grounding, Zuschneiden, Pixel-Diff, Farben, OCR, SVG-Trace, Freistellen, Screenshots); Bild einfügen zur Nutzung.

1.1kgesternVision, Sprache & MultimodalMIT
T

tongflow (dsh-tongflow)

tong-io/tongflow

TongFlow-Filmcrew-Studio für Bild-, Sprach-, Musik- und Videoproduktion: Der Agent erstellt assetbezogene TongFlow-Workflow-Dateien (.tongflow.json), die über TongFlow-Plugins ausgeführt werden, mit eingebetteter Workflow-Canvas, Shot-/Character-/Take-Projektlayout und Manga-Drama-Vorlage; Sitzungen, die mit @tongflow beginnen, öffnen die Studio-Ansicht.

1kvor 13 StundenWorkflow-AutomatisierungAGPL-3.0
T

tongflow

tong-io/tongflow

TongFlow-Studio-Plugin für DeepSeek Harness (dsh): Filmcrew-artiges Projektmodell, vom Agent erstellte TongFlow-Workflows, deterministische Medienerstellung, eingebettete Canvas.

870letzten MonatVision, Sprache & MultimodalAGPL-3.0
O

watch-skill

oxbshw/watch-skill

Die Funktionen von DeepWatch, installierbar in ein bestehendes DeepSeek Harness-Profil

378vor 6 TagenVision, Sprache & MultimodalMIT
Z

dsh-crew

zseven-w/dsh-crew

Verteilen Sie Aufgaben von Claude Code oder Codex an DSH-Agenten: nativer Subagent-Fortschritt, Host-interne Worker-Sessions mit stufenbasierten Voreinstellungen und eine multimodale Brücke für Vision und Bildgenerierung.

149vor 7 TagenIntegrationen & FernzugriffMIT
V

ark-cli (ark-managed-agents)

volcengine/ark-cli

Fügt einen Tab für Managed Agents in den Einstellungen hinzu sowie MCP-Tools, um langfristige Agentenaufgaben an Ark Cloud Managed Agents zu übergeben.

133vor 3 TagenTools & FunktionenApache-2.0
V

ark-cli (ark-plan-api)

volcengine/ark-cli

Registriert Ark Agent Plan-, Coding-Plan- und Postpaid-Model-Routen im nativen DSH-Modellauswahldialog.

133vor 3 TagenModelle & AnbieterApache-2.0
V

ark-cli

volcengine/ark-cli

Volcengine-Ark-Provider-Plugin für DeepSeek Harness (DSH): registriert Agent Plan, Coding Plan und Postpaid-Routen auf dem nativen pi-ai-Adapter, sodass Ark-Modelle in der Modellauswahl erscheinen.

112vor 25 TagenModelle & AnbieterApache-2.0
S

dsh-AuthInOne

stormycry-cryp/dsh-authinone

Fügt Konto-Login, API- und benutzerdefinierte Provider-Einrichtung, Modellwechsel, Bild-Fallback für reine Textmodelle sowie Token-/Kostenzuordnung zu DeepSeek Harness 47f hinzu.

104letzten MonatModelle & AnbieterMIT
S

dsh-design-qa

sunxin-ai/dsh-design-qa

Design-Treue-QA für textbasierte Modelle: Ein `deepseek_vision`-Tool leiht sich ein Auge von jedem OpenAI-kompatiblen Vision-Pfad, damit das Modell beurteilen kann, ob eine Implementierung zu seinem Mock passt — ausgeliefert mit dem Benchmark hinter diesem Urteil (vier Fixtures, 23 injizierte Defekte, Rohtranskripte) und der Fragedisziplin, von der es abhängt.

44vor 14 TagenVision, Sprache & MultimodalMIT
J

picturereader

jing-hy/picturereader

Bild-„Lesen“ für reine Textmodelle: Herunterskalieren + Reduzierung der Farbtiefe + Struktur-/Farb-Fingerabdrücke werden in Textraster umgewandelt und in das Gespräch zurückgespeist, sodass das Modell wie ein multimodales Modell autonom zoomen, sampeln und OCR durchführen kann; vollständig lokal ohne Abhängigkeit von externen Modellen, enthält einen Skill zur Bild-Lese-Methodik sowie optional PaddleOCR.

36vorgesternVision, Sprache & MultimodalMIT
O

dsh-vision

oil-oil/dsh-vision

Nahezu native Bildverständnis-Funktionen für DeepSeek Harness.

24letzten MonatVision, Sprache & MultimodalMIT
S

dsh-ros2

stvli/dsh-ros2

ROS2-Debug-Werkzeugkasten und Roboterzustands-Bildanalyse für DeepSeek Harness: Aufzählung von Node/Topic/Service/Action/Interface/TF, Topologie-JSON des gesamten Graphen, rosdep-Prüfungen, genehmigungsgesteuerte Builds und Custom-Message-Gerüstbau, GUI-Screenshots und multimodale Visionsbeobachtung sowie Headless-RViz2-Offscreen-Rendering (Low-Poly-Meshes, direkter Pixel-Read, GPU-Passthrough – Bewegungsdarstellung mit 30 Hz) mit paralleler VLM-Echtzeitanalyse.

21vor 5 TagenTools & FunktionenMIT
J

dsh-visual-plugin

jyh20030112/dsh-visual-plugin

Verleiht reinen Textmodellen Sehvermögen: leitet Benutzerbilder an ein OpenAI-kompatibles Vision-Modell weiter und zeigt die Beschreibungen in einem rechten Panel der Web-UI an.

16vor 19 TagenVision, Sprache & MultimodalMIT
F

dsh-vision-proxy

flyvhidbwo/dsh-vision-proxy

DeepSeek-Gehirn + automatische Bildtranskription: Bilder in der GUI anhängen und jedes wird standardmäßig über das offizielle deepseek-v4-flash-vision-exp transkribiert (ein reines Text-V4-Pro-Gehirn kann Bilder sehen), mit jeder OpenAI-kompatiblen VLM oder lokalem Ollama als Alternative.

14vor 26 TagenVision, Sprache & MultimodalMIT
W

dsh-mmx-bridge

welsione/dsh-mmx-bridge

MiniMax-Multimodal-Bridge: Ein einziges Tool `mmx_bridge` deckt Bildverständnis/-generierung, Video, TTS, Musik, Cover, Websuche und Kontingent ab; optionale Übernahme von `web_search`/`read_image`; eingebettete Player/Bildvorschauen direkt in der Web-GUI (npm: `dsh-mmx-bridge`).

10vor 3 TagenTools & FunktionenMIT
S

dsh-deepseek-vision

siegfly/dsh-deepseek-vision

Eine Vision-Language-Gateway-Provider-Route: Eingefügte Bilder werden von einem konfigurierbaren VL-Modell (standardmäßig Qwen-VL) beschrieben, bevor sie an DeepSeek gesendet werden.

9vor 10 TagenVision, Sprache & MultimodalMIT
P

dsh-plugin-xiaomi-mimo-tts

ppy-web/dsh-plugin-xiaomi-mimo-tts

Fügt Xiaomi-MiMo-Sprachausgabe-Steuerelemente für finalisierte Assistenten-Nachrichten hinzu, mit voreingestellten Stimmen und individuellem Stimmdesign.

7vor 23 StundenVision, Sprache & MultimodalMIT
5

dsh-vision

54xkeee/dsh-vision

Vision für das reine Text-DeepSeek standardmäßig über Doubao Web (kostenlos, kein API-Schlüssel nötig – steuert Ihr angemeldetes Chrome über eine Windows-CDP-Brücke), mit Antigravity-IDE-Kontingent (flash/pro) oder Gemini als Fallback; automatische Detail-Eskalation, Vision-Beleg-Speicher mit Rehydrierung nach Kompaktierung, Content-Hash-Cache und ein zweisprachiges Client-Panel.

7letzten MonatVision, Sprache & MultimodalMIT
Y

deepseek-harness-plugins (vision-bridge)

yinxe/deepseek-harness-plugins

Lässt reine Textmodelle Bilder sehen: Trifft ein Bild mit einem Platzhalter wie \[image omitted because this model accepts text only] ein, ruft das Modell das Werkzeug vision_describe auf, und das Plugin leitet die Bildreferenz samt Frage an ein multimodales Modell weiter und wiederholt bei Fehlschlag mit einem Ausweichmodell. Konfiguriert wird auf der Einstellungsseite, gespeichert über die offizielle Settings-API.

5vor 21 StundenVision, Sprache & MultimodalMIT
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

On-Demand-Vision für reine Text-DSH-Sitzungen: Bilder werden zu Markern, und ein vision_describe-Tool sendet nur das Bild und die Frage an ein OpenAI-kompatibles Vision-Modell

5letzten MonatVision, Sprache & MultimodalMIT
A

dsh-guide-dog

atropinoltt/dsh-guide-dog

MiniMax-betriebenes multimodales Plugin: Echtzeit-Sprachanrufmodus (Streaming-Gespräch, schwebende Dock-UI), Sprachmodus und Mikrofon-Spracheingabe, sowie Bild-/Video-/Musik-/Sprachgenerierung und visuelle Inspektionstools.

5letzten MonatVision, Sprache & MultimodalMIT
Y

dsh-opencode-free-models (dsh-opencode-free-models)

yu-wenchao/dsh-opencode-free-models

Plugin für kostenlose Modellanbieter für DSH mit über 20 Modellen, darunter Gemini, MiMo, GLM usw.

4vor 18 TagenModelle & Anbieter