Passer au contenu principal

Plugins

Parcourez, filtrez et installez des plugins DeepSeek-Harness.

7 plugins trouvés

S

dsh-design-qa

sunxin-ai/dsh-design-qa

QA de fidélité de conception pour les modèles texte uniquement : un outil `deepseek_vision` emprunte un œil à n’importe quelle route vision compatible OpenAI, afin que le modèle puisse juger si une implémentation correspond à sa maquette — livré avec le benchmark derrière ce jugement (quatre fixtures, 23 défauts injectés, transcriptions brutes) et la discipline de questionnement dont il dépend.

44il y a 26 joursVision, voix et multimodalMIT
S

dsh-deepseek-vision

siegfly/dsh-deepseek-vision

Une route de fournisseur passerelle vision-langage : les images collées sont décrites par un modèle VL configurable (Qwen-VL par défaut) avant d'être transmises à DeepSeek.

9il y a 21 joursVision, voix et multimodalMIT
W

visual-review

wang-bool/visual-review

Affiche en ligne dans le chat DSH Web les images collées ou importées et donne la vision aux modèles texte seuls : l’outil visual_review, invocable par le modèle, appelle d’abord une API multimodale compatible OpenAI, puis bascule sur un worker local Qwen3-VL en cas d’échec.

3il y a 2 moisVision, voix et multimodalMIT
X

dsh-vision

xiaoshihou514/dsh-vision

Extension native de capacité de vision, utilisant soit Zhipu (gratuit) soit Qwen-VL (local).

2le mois dernierVision, voix et multimodalMIT
Z

dsh-plugins

zjcdkj/dsh-plugins

Plugin out-of-tree DeepSeek Harness : donne des yeux à un modèle de codage textuel en routant les images vers une route Qwen-VL (DashScope) via ctx.llm et en retournant du texte.

1le mois dernierVision, voix et multimodalMIT
S

multimodal-bridge

spirit4471/multimodal-bridge

Bundle de plugins DeepSeek Harness : outils qwen_vision (compréhension d'image Qwen-VL) et qwen_generate (texte-image Qwen-Image) pour les modèles texte seul.

1il y a 2 moisVision, voix et multimodalMIT
L

dsh-mingmu

lab-sku/dsh-mingmu

明眸 VisionBridge - Pont visuel développé en interne : lorsqu'un modèle aveugle reçoit une image, il appelle automatiquement un modèle visuel pour la reconnaître et renvoie le texte reconnu au modèle principal ; transparent, configurable, sans perte lors des mises à jour.

0il y a 2 moisVision, voix et multimodalMIT