Zum Hauptinhalt springen

Plugins

Durchsuche, filtere und installiere DeepSeek-Harness-Plugins.

7 Plugins gefunden

S

dsh-design-qa

sunxin-ai/dsh-design-qa

Design-Treue-QA für textbasierte Modelle: Ein `deepseek_vision`-Tool leiht sich ein Auge von jedem OpenAI-kompatiblen Vision-Pfad, damit das Modell beurteilen kann, ob eine Implementierung zu seinem Mock passt — ausgeliefert mit dem Benchmark hinter diesem Urteil (vier Fixtures, 23 injizierte Defekte, Rohtranskripte) und der Fragedisziplin, von der es abhängt.

44vor 26 TagenVision, Sprache & MultimodalMIT
S

dsh-deepseek-vision

siegfly/dsh-deepseek-vision

Eine Vision-Language-Gateway-Provider-Route: Eingefügte Bilder werden von einem konfigurierbaren VL-Modell (standardmäßig Qwen-VL) beschrieben, bevor sie an DeepSeek gesendet werden.

9vor 22 TagenVision, Sprache & MultimodalMIT
W

visual-review

wang-bool/visual-review

Zeigt eingefügte oder hochgeladene Bilder direkt im DSH-Web-Chat an und gibt reinen Textmodellen Sehkraft: Das vom Modell aufrufbare Tool visual_review nutzt zuerst eine OpenAI-kompatible multimodale API und fällt bei einem Fehler auf einen lokalen Qwen3-VL-Worker zurück.

3vor 2 MonatenVision, Sprache & MultimodalMIT
X

dsh-vision

xiaoshihou514/dsh-vision

Native Erweiterung der Bildfunktion, die entweder Zhipu (kostenlos) oder Qwen-VL (lokal) verwendet.

2letzten MonatVision, Sprache & MultimodalMIT
Z

dsh-plugins

zjcdkj/dsh-plugins

DeepSeek Harness Out-of-Tree-Plugin: gibt einem Text-only-Coding-Modell Augen, indem es Bilder über ctx.llm an eine Qwen-VL-(DashScope-)Route leitet und Text zurückgibt.

1vor 2 MonatenVision, Sprache & MultimodalMIT
S

multimodal-bridge

spirit4471/multimodal-bridge

DeepSeek-Harness-Plugin-Bundle: die Tools qwen_vision (Bildverständnis mit Qwen-VL) und qwen_generate (Text-zu-Bild mit Qwen-Image) für rein textbasierte Modelle

1vor 2 MonatenVision, Sprache & MultimodalMIT
L

dsh-mingmu

lab-sku/dsh-mingmu

明眸 VisionBridge - Selbstentwickelte visuelle Brücke: Wenn ein blindes Modell Bilder empfängt, wird automatisch ein visuelles Modell zur Erkennung aufgerufen und der erkannte Text an das Hauptmodell zurückgegeben; nahtlos, konfigurierbar, verlustfrei bei Upgrades.

0vor 2 MonatenVision, Sprache & MultimodalMIT