Passer au contenu principal

Plugins

Parcourez, filtrez et installez des plugins DeepSeek-Harness.

82 plugins trouvés

L

modlens

liustack/modlens

Pont de vision pour les modèles texte seul : collez une image, obtenez des preuves JSON structurées (OCR, mise en page, sémantique).

4.1kil y a 5 joursVision, voix et multimodalMIT
Y

dsh-vision-router

ysr666/dsh-vision-router

Vision gratuite pour les agents texte seul : chaîne de vision intégrée sans clé, plus des outils pixel (questions-réponses, ancrage, recadrage, diff pixel, couleurs, OCR, tracé SVG, détourage, captures d'écran) ; collez une image pour l'utiliser.

1.1khierVision, voix et multimodalMIT
T

tongflow (dsh-tongflow)

tong-io/tongflow

Studio d'équipe de tournage TongFlow pour la production d'images, de voix, de musique et de vidéos : l'agent rédige des fichiers de workflow TongFlow par ressource (.tongflow.json) exécutés via les plugins TongFlow, avec un canevas de workflow intégré, une mise en page projet par plan/personnage/prise et un modèle manga-drama ; les sessions commençant par @tongflow ouvrent la vue Studio.

1kil y a 7 heuresFlux et automatisationAGPL-3.0
T

tongflow

tong-io/tongflow

Plugin studio TongFlow pour DeepSeek Harness (dsh) : modèle de projet façon équipe de tournage, workflows TongFlow rédigés par l'agent, génération multimédia déterministe, canevas intégré.

870le mois dernierVision, voix et multimodalAGPL-3.0
O

watch-skill

oxbshw/watch-skill

Les capacités de DeepWatch, installables dans un profil DeepSeek Harness existant

378il y a 18 joursVision, voix et multimodalMIT
Z

dsh-crew

zseven-w/dsh-crew

Répartissez le travail vers les agents DSH depuis Claude Code ou Codex : progression native des sous-agents, sessions worker sur l’hôte avec préréglages par niveau et pont multimodal pour la vision et la génération d’images.

153il y a 8 joursIntégrations et accès distantMIT
V

ark-cli (ark-managed-agents)

volcengine/ark-cli

Ajoute un onglet de paramètres Managed Agents et des outils MCP pour déléguer des tâches d'agent de longue durée aux Managed Agents cloud d'Ark.

139il y a 3 joursOutils et capacitésApache-2.0
V

ark-cli (ark-plan-api)

volcengine/ark-cli

Enregistre les routes Ark Agent Plan, Coding Plan et les modèles postpayés dans le sélecteur de modèle natif de DSH.

139il y a 3 joursModèles et fournisseursApache-2.0
V

ark-cli

volcengine/ark-cli

Plugin de fournisseur Volcengine Ark pour DeepSeek Harness (DSH) : enregistre les routes Agent Plan, Coding Plan et postpayées sur l'adaptateur natif pi-ai afin que les modèles Ark apparaissent dans le sélecteur de modèles.

112le mois dernierModèles et fournisseursApache-2.0
S

dsh-AuthInOne

stormycry-cryp/dsh-authinone

Ajoute la connexion de compte, la configuration d'API et de Provider personnalisé, le changement de modèle, le repli d'image pour les modèles textuels et l'attribution des jetons/coûts à DeepSeek Harness 47f.

105il y a 2 moisModèles et fournisseursMIT
S

dsh-design-qa

sunxin-ai/dsh-design-qa

QA de fidélité de conception pour les modèles texte uniquement : un outil `deepseek_vision` emprunte un œil à n’importe quelle route vision compatible OpenAI, afin que le modèle puisse juger si une implémentation correspond à sa maquette — livré avec le benchmark derrière ce jugement (quatre fixtures, 23 défauts injectés, transcriptions brutes) et la discipline de questionnement dont il dépend.

44il y a 26 joursVision, voix et multimodalMIT
J

picturereader

jing-hy/picturereader

« Lecture » d'images pour les modèles texte uniquement : réduction d'échelle + réduction de la profondeur de couleur + empreintes de structure/couleur transformées en grilles de texte renvoyées dans la conversation, permettant au modèle de zoomer, d'échantillonner et de faire de l'OCR de manière autonome comme un modèle multimodal ; entièrement local, sans dépendance à un modèle externe, fournit une compétence de méthodologie de lecture d'image et PaddleOCR en option.

37avant-hierVision, voix et multimodalMIT
O

dsh-vision

oil-oil/dsh-vision

Compréhension d'image quasi native pour DeepSeek Harness

24il y a 2 moisVision, voix et multimodalMIT
S

dsh-ros2

stvli/dsh-ros2

Boîte à outils de débogage ROS2 et analyse de vision d'état de robot pour DeepSeek Harness : énumération de node/topic/service/action/interface/TF, JSON de topologie du graphe complet, vérifications rosdep, builds à approbation validée et échafaudage de messages personnalisés, captures d'écran GUI et observation de vision multimodale, plus rendu offscreen RViz2 headless (maillages low-poly, lecture directe de pixels, passthrough GPU - rendu de mouvement à 30Hz) avec analyse temps réel VLM en parallèle.

22avant-hierOutils et capacitésMIT
J

dsh-visual-plugin

jyh20030112/dsh-visual-plugin

Donne la vision aux modèles textuels uniquement : transmet les images de l'utilisateur à un modèle de vision compatible OpenAI et affiche les descriptions dans un panneau droit de l'interface web.

16il y a 3 joursVision, voix et multimodalMIT
F

dsh-vision-proxy

flyvhidbwo/dsh-vision-proxy

Cerveau DeepSeek + transcription automatique d'images : attachez des images dans la GUI et chacune est transcrite par le modèle officiel deepseek-v4-flash-vision-exp par défaut (un cerveau V4-Pro en texte pur peut voir les images), avec n'importe quelle VLM compatible OpenAI ou Ollama local comme alternatives.

15le mois dernierVision, voix et multimodalMIT
M

dsh-provider-qoder

mo-n/dsh-provider-qoder

Connecte les abonnements Qoder à DeepSeek Harness, avec prise en charge des régions Global et Chine, de l'entrée multimodale et des appels d'outils.

13hierModèles et fournisseursMIT
W

dsh-mmx-bridge

welsione/dsh-mmx-bridge

Pont multimodal MiniMax : un seul outil `mmx_bridge` couvre la compréhension/génération d'images, la vidéo, la synthèse vocale, la musique, les pochettes, la recherche web et le quota ; prise en charge optionnelle de `web_search`/`read_image` ; lecteurs intégrés/aperçus d'images directement dans l'interface web (npm : `dsh-mmx-bridge`).

10il y a 15 joursOutils et capacitésMIT
S

dsh-deepseek-vision

siegfly/dsh-deepseek-vision

Une route de fournisseur passerelle vision-langage : les images collées sont décrites par un modèle VL configurable (Qwen-VL par défaut) avant d'être transmises à DeepSeek.

9il y a 21 joursVision, voix et multimodalMIT
M

dsh-iris

mokuyoaxis/dsh-iris

Espace de travail média et vision pour DeepSeek Harness : génération d'images, de vidéos et de parole, questions-réponses sur images et localisation d'éléments, OCR de longues images, diff de pixels, vérification par capture d'écran HTML et résumé de vidéos, avec des fournisseurs DashScope et compatibles OpenAI, des pools de modèles et un client de type workbench.

7hierOutils et capacitésMIT
5

dsh-vision

54xkeee/dsh-vision

Vision pour DeepSeek en mode texte seul via Doubao Web par défaut (gratuit, sans clé API — pilote votre Chrome connecté via un pont CDP Windows), avec quota Antigravity IDE (flash/pro) ou repli sur Gemini ; escalade automatique du niveau de détail, mémoire de preuves visuelles avec réhydratation après compaction, cache par hachage de contenu, et un panneau client bilingue.

7il y a 2 moisVision, voix et multimodalMIT
Y

deepseek-harness-plugins (vision-bridge)

yinxe/deepseek-harness-plugins

Permet aux modèles texte seul de voir les images : lorsqu'une image arrive avec un texte de remplacement comme \[image omitted because this model accepts text only], le modèle appelle l'outil vision_describe et le plugin transmet la référence de l'image et la question à un modèle multimodal, en réessayant avec un modèle de secours en cas d'échec. Configuré dans la page de paramètres et conservé via l'API officielle de paramètres.

6hierVision, voix et multimodalMIT
S

dsh-vision-bridge

sfyyy/dsh-vision-bridge

Vision à la demande pour les sessions DSH texte uniquement : les images deviennent des marqueurs, et un outil vision_describe envoie uniquement l'image et la question à un modèle de vision compatible OpenAI

5il y a 2 moisVision, voix et multimodalMIT
A

dsh-guide-dog

atropinoltt/dsh-guide-dog

Plugin multimodal propulsé par MiniMax : mode d'appel vocal en temps réel (conversation en streaming, interface dock flottant), mode vocal et saisie vocale par micro, ainsi que des outils de génération d'images/vidéos/musique/parole et d'inspection visuelle.

5il y a 2 moisVision, voix et multimodalMIT