Passer au contenu principal

Plugins

Parcourez, filtrez et installez des plugins DeepSeek-Harness.

82 plugins trouvés

J

dsh-mmroute

jmxsxwyzjdwl/dsh-mmroute

Transparent multimodal routing for text-only models: every image in every model call is fully transcribed (verbatim OCR, data, uncertainty zones, injection-hardened) by your own multimodal understander, with focused re-look via vision_relook and automatic retry on image-related failures. No bundled endpoints, no borrowed logins.

1il y a 26 joursVision, voix et multimodalMIT
H

dsh-vision-analysis

harvey-will/dsh-vision-analysis

DeepSeek Harness vision plugin: 8 analysis modes (describe, OCR, chart data, UI review, object detection, compare, code-gen, debug), any OpenAI- or Anthropic-compatible vision API, with a built-in free vision model and automatic rate-limit failover.

1il y a 3 joursVision, voix et multimodalMIT
E

dsh-sight

ericfetch/dsh-sight

Plugin DeepSeek Harness : déclarations directes de transfert d'images multimodales + effacement des images par session (remplacement de surface), avec une page de paramètres et des contrôles du composeur.

1le mois dernierVision, voix et multimodalMIT
Y

dsh-multimodal

yauntyour/dsh-multimodal

Chaînes multimodales par type de fichier : des modèles de traitement prédéfinis par joker convertissent les fichiers image, vidéo et audio en tokens de prompt avant qu'ils n'atteignent le modèle de session texte uniquement, avec des chaînes de repli par préréglage et une page de réglages Multimodal.

1il y a 2 moisVision, voix et multimodalMIT
A

dsh-image-plugins

alanzhao0128/dsh-image-plugins

Plugin multimodal pour DeepSeek Harness : comprendre des images et générer des images via des points de terminaison compatibles OpenAI ou DashScope configurables.

1il y a 2 moisVision, voix et multimodalMIT
Z

dsh-plugins

zjcdkj/dsh-plugins

Plugin out-of-tree DeepSeek Harness : donne des yeux à un modèle de codage textuel en routant les images vers une route Qwen-VL (DashScope) via ctx.llm et en retournant du texte.

1le mois dernierVision, voix et multimodalMIT
X

dsh-image-vision

xsoc1/dsh-image-vision

Pont de pièces jointes d'images dans le chat avec un outil view_image pour tout VLM compatible OpenAI (Ollama local ou cloud) : les images collées/déposées deviennent des marqueurs de chemin view_image avant d'atteindre les modèles DeepSeek texte uniquement.

1il y a 2 moisVision, voix et multimodal
W

mimo-vision

wulusai2333/mimo-vision

Outil `describe_image` : un pont de vision qui envoie les images à mimo-v2.5 via l'API opencode Zen (identifiant `OPENCODE_GO_API_KEY`, route gratuite d'abord avec repli payant) et renvoie des descriptions texte aux modèles texte seul, avec passe-plat natif et transcodage ImageMagick des formats SVG/TIFF/HEIC.

1il y a 2 moisVision, voix et multimodalMIT
R

dsh-vision-subagent

ruby1304/dsh-vision-subagent

La vision pour n'importe quelle route DSH : collez des images dans le composeur web avec analyse automatique selon l'intention, déléguez la lecture des images de l'espace de travail à un sous-agent de vision Kimi/MiniMax, et matérialisez les originaux collés pour les modifier.

1il y a 23 joursVision, voix et multimodalMIT
N

dsh-auto-vision

normanfxxkingrockwell/dsh-auto-vision

Pont de vision à découverte automatique pour les agents DeepSeek Harness texte seul : trouve automatiquement un modèle capable de traiter les images parmi vos fournisseurs configurés et renvoie les descriptions en texte brut via un outil de vision.

1il y a 18 joursVision, voix et multimodalMIT
L

dsh-eyes

leeminjing/dsh-eyes

Vision à la demande pour les modèles DeepSeek texte seul : envoyez des images et le modèle appelle un outil view_image adossé à n'importe quel endpoint de vision compatible OpenAI (Qwen/DashScope par défaut).

1il y a 2 moisVision, voix et multimodalMIT
K

dsh-mindseye

kanchengw/dsh-mindseye

Vision en plugin pour les modèles texte seul sur DSH, avec interaction native pour la compréhension et la génération d'images, l'automatisation d'interface, une mémoire de preuves en couches et un cache.

1le mois dernierVision, voix et multimodalMIT
1

dsh-vision-fallback

1helloman1/dsh-vision-fallback

Route les images du chat vers un modèle de vision fixe compatible OpenAI, renvoie des observations factuelles au modèle principal sélectionné et réutilise les observations par session à travers les rejeux, la compaction et les redémarrages.

1le mois dernierVision, voix et multimodalMIT
Z

dsh-voice

zhuiyueya/dsh-voice

Voix pour DeepSeek Harness (dsh) — saisie par reconnaissance vocale + lecture à voix haute (TTS) pour DeepSeek texte seul, sans clé API.

1il y a 2 moisVision, voix et multimodalMIT
S

multimodal-bridge

spirit4471/multimodal-bridge

Bundle de plugins DeepSeek Harness : outils qwen_vision (compréhension d'image Qwen-VL) et qwen_generate (texte-image Qwen-Image) pour les modèles texte seul.

1il y a 2 moisVision, voix et multimodalMIT
Y

dsh-plugin-vision-toolkit

yytbit/dsh-plugin-vision-toolkit

Boîte à outils de vision pour DeepSeek Harness -- outils CLI glance, ground, detect, crop pour que les agents texte seul comprennent les images.

1il y a 2 moisVision, voix et multimodalMIT
C

deepsee

chang416/deepsee

DeepSee : vision DeepSeek Harness, routage multi-modèles, et auto-vérifications visuelles Gemini avant livraison.

1il y a 2 moisVision, voix et multimodalMIT
Z

dsh-computer

zseven-w/dsh-computer

A headless-first macOS Computer Use driver for DeepSeek Harness with AX-first observations, window-bound multimodal evidence, host-owned approval, and evidence-backed action receipts

0il y a 9 joursMCP et connecteursMIT
C

dsh-voice-mimo

ch1bug/dsh-voice-mimo

Xiaomi MiMo-powered voice for DeepSeek Harness: browser 🎤/🧠/🔊 UI, voice_transcribe/voice_understand/voice_speak tools, configurable voice map (preset/voicedesign/voiceclone). Fork of zhuiyueya/dsh-voice (MIT), Settings pattern from Anionex/dsh-vision-toolkit (MIT).

0il y a 19 joursVision, voix et multimodalMIT
C

dsh-model-modality

ct-jyjntc/dsh-model-modality

Declare whether a configured third-party model accepts image (multimodal) input; writes the modality into the owning provider settings and verifies it through runtime model resolution.

0il y a 26 joursModèles et fournisseursMIT
B

dsh-llm-capabilities

bamboostrip/dsh-llm-capabilities

DSH plugin: auto-detect and configure model capabilities (reasoningEfforts + input modalities) for llm-pi-ai. Successor to dsh-reasoning-efforts.

0le mois dernierVision, voix et multimodalMIT
H

tokenlab-deepseek-harness-provider

hedging8563/tokenlab-deepseek-harness-provider

TokenLab provider bundle for DeepSeek Harness with native Responses, Messages and Chat routing plus full multimodal and async tools.

0le mois dernierMCP et connecteursMIT
B

dsh-plugin-88api-image

blackdm666/dsh-plugin-88api-image

88API Image Studio for DSH: four Image2 and Nano Banana models for text-to-image, multi-reference editing, 2K/4K output, and sequential batches.

0le mois dernierVision, voix et multimodalMIT
F

dsh-glm-vision

fightingfirefox/dsh-glm-vision

GLM 视觉模型插件:注册 glm-vision 供应商路由(glm-4.6v 系列,image+text 输入声明)并提供 glm_vision 工具,让 DeepSeek 等文本主模型直接调用智谱视觉模型看图。

0le mois dernierVision, voix et multimodalMIT