Passer au contenu principal

Plugins

Parcourez, filtrez et installez des plugins DeepSeek-Harness.

86 plugins trouvés

G

deepseek-vision

gou-gee/deepseek-vision

Bundle visuel natif DeepSeek Harness : coller ou glisser une image, appeler un modèle visuel compatible OpenAI via le deepseek-vision-mcp hébergé.

4le mois dernierMCP et connecteursMIT
S

dsh-digipet

swaylq/dsh-digipet

Jeu d'élevage de style Digimon : faites éclore un œuf qui se nourrit de travail réel (tours, appels d'outils, erreurs) et évolue le long de quatre lignées ramifiées selon votre façon de travailler ; zéro jeton, invisible pour le modèle.

4le mois dernierJuste pour le plaisirMIT
G

deepseek-vision (dsh-plugin-deepseek-vision)

gou-gee/deepseek-vision

Bundle Vision MCP et DSH pour DeepSeek textuel : outils analyze_image, analyze_clipboard, compare_images et vision_status, page de paramètres visuelle, GLM-4.6V-Flash gratuit par défaut, mise en cache de résultats et tolérance aux limites de débit ; les clés restent hors des logs.

4il y a 14 joursVision, voix et multimodalMIT
F

dsh-plugin-deepeye

favio8/dsh-plugin-deepeye

Plugin de vision DeepEye pour DeepSeek Harness (DSH) : description d'image, OCR, VQA, mise en page d'UI et analyse du presse-papiers.

4le mois dernierVision, voix et multimodal
H

dsh-her-eyes

huashenglian/dsh-her-eyes

Un plugin dsh qui permet à l'IA d'invoquer automatiquement des VLM (modèles multimodaux) pour l'analyse visuelle.

4le mois dernierVision, voix et multimodalMIT
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

Station de travail omni-modale pour DSH : analyze_image sur une chaîne de basculement VLM ordonnée à plusieurs cartes, une boîte à outils de vision à six outils (zoom, échantillonnage de couleurs, diff de pixels, OCR, détection d'éléments, affichage en ligne) partageant le même résolveur d'images, generate_image via les protocoles OpenAI/DashScope/ComfyUI, generate_video asynchrone multi-cartes avec un constructeur /build-video-tool, et TTS speak/clone_voice sur sept fournisseurs, le tout piloté par une seule page de paramètres à enregistrement automatique.

3avant-hierVision, voix et multimodalMIT
M

dsh-iris

mokuyoaxis/dsh-iris

Espace de travail média et vision pour DeepSeek Harness : génération d'images, de vidéos et de parole, questions-réponses sur images et localisation d'éléments, OCR de longues images, diff de pixels, vérification par capture d'écran HTML et résumé de vidéos, avec des fournisseurs DashScope et compatibles OpenAI, des pools de modèles et un client de type workbench.

3il y a 14 heuresOutils et capacitésMIT
W

dsh-model-capabilities

wjz-p/dsh-model-capabilities

Ajoute un sélecteur de modalité d’entrée aux paramètres des modèles personnalisés dans la Web UI DeepSeek Harness.

3le mois dernierModèles et fournisseursMIT
W

visual-review

wang-bool/visual-review

Affiche en ligne dans le chat DSH Web les images collées ou importées et donne la vision aux modèles texte seuls : l’outil visual_review, invocable par le modèle, appelle d’abord une API multimodale compatible OpenAI, puis bascule sur un worker local Qwen3-VL en cas d’échec.

3le mois dernierVision, voix et multimodalMIT
S

dsh-plugin-multimodal

shinjiyu/dsh-plugin-multimodal

Annonce le collage d'image sur les routes DeepSeek en texte seul, décrit les pièces jointes avec un sidecar de vision et laisse les modèles de vision natifs intacts.

3le mois dernierVision, voix et multimodalMIT
H

dsh-vision-mix

haiziyao/dsh-vision-mix

Combine les API texte, vision et génération d'images en un seul modèle Mix avec routage automatique : les requêtes textuelles vont au modèle de chat, les images utilisateur et captures d'écran de l'agent vont au modèle de vision, les suivis continuent d'utiliser la même image de session, et les agents peuvent générer ou modifier des images avec un historique d'appels limité à la session.

3il y a 13 joursVision, voix et multimodalMIT
L

dsh-visibridge

lhbsaa/dsh-visibridge

Preuve visuelle structurée (OCR/mise en page/sémantique) plus un outil de capture par caméra USB pour une boucle de débogage « tirer-regarder-ajuster » ; backends : Ollama, DeepSeek, Xiaomi.

2il y a 28 joursVision, voix et multimodalMIT
S

dsh-llm-qwen-local

starefinger/dsh-llm-qwen-local

Plugin adaptateur LLM pour les modèles Qwen déployés localement derrière un point de terminaison vLLM compatible OpenAI, avec une bascule multimodale par modèle, des efforts de raisonnement entièrement configurables et une page de paramètres web pour modifier le déploiement depuis le frontend.

2il y a 6 joursModèles et fournisseursMIT
A

dsh-multi-model-provider

alexkaiqi/dsh-multi-model-provider

Pour DeepSeek Harness : enregistre des modèles, aide pour les portraits et sélectionne le modèle d'Agent depuis un catalogue sans secret.

2il y a 28 joursModèles et fournisseursMIT
S

dsh-collaboration

socialist-sister/dsh-collaboration

Suite de collaboration multi-agents : liste de spécialistes configurée par l'utilisateur, répartition persistante à la demande (team_call/team_message/team_status/team_close), instances clonées, relais en topologie en étoile, comparaison de modèles et pont de vision multimodale.

2le mois dernierFlux et automatisationMIT
I

dsh-tool-visual-primitives

inkshadewoods/dsh-tool-visual-primitives

Analyse les images de conversation via des invites spécifiques au mode (caption, UI, document, grounding, topologie, etc.) et injecte des preuves structurées avec des primitives de coordonnées (boîtes, points, références) sous forme de texte, avec mise en cache au niveau de la session pour réutilisation lors du replay et de la compaction.

2il y a 10 joursVision, voix et multimodalMIT
H

dsh-open-eyes

hyp6666/dsh-open-eyes

Pont de vision pour les routes DeepSeek texte seul qui analyse les images jointes et locales via des endpoints configurables OpenAI Responses, Chat Completions ou Anthropic Messages, tout en laissant natives les routes capables d’image.

2il y a 15 joursVision, voix et multimodalMIT
5

dsh-youreyes

54xkeee/dsh-youreyes

Boîte à outils de vision pour DeepSeek texte seul : outil `vision` appelable par le modèle, adaptateurs wrappers pour deepseek/opencode-go (v4 flash/pro), quota Antigravity IDE (default, flash/pro) / tout VLM compatible OpenAI / Gemini / canaux Ollama locaux, mémoire de preuves avec réhydratation par compactage, cache de hachage de contenu et panneau client bilingue.

2le mois dernierVision, voix et multimodalMIT
W

dsh-file-attachment

wszhoho/dsh-file-attachment

Drag-and-drop / paste / upload files and images; on non-multimodal models images are auto-described by a configured VLM.

1il y a 3 joursAméliorations UIMIT
M

dsh-bilibili

moxingovo/dsh-bilibili

DeepSeek Harness plugin: Bilibili keyword video search, video metadata, subtitle transcripts, direct play URLs, and multimodal frame viewing (bilibili_search / bilibili_video / bilibili_subtitles / bilibili_playurl / bilibili_frames). Anonymous by default

1il y a 27 joursVision, voix et multimodalMIT
J

dsh-mmroute

jmxsxwyzjdwl/dsh-mmroute

Transparent multimodal routing for text-only models: every image in every model call is fully transcribed (verbatim OCR, data, uncertainty zones, injection-hardened) by your own multimodal understander, with focused re-look via vision_relook and automatic retry on image-related failures. No bundled endpoints, no borrowed logins.

1il y a 14 joursVision, voix et multimodalMIT
H

dsh-vision-analysis

harvey-will/dsh-vision-analysis

DeepSeek Harness vision plugin: 8 analysis modes (describe, OCR, chart data, UI review, object detection, compare, code-gen, debug), any OpenAI- or Anthropic-compatible vision API, with a built-in free vision model and automatic rate-limit failover.

1il y a 11 joursVision, voix et multimodalMIT
E

dsh-sight

ericfetch/dsh-sight

DeepSeek Harness plugin: direct multimodal image transfer declarations + per-session image clearing (surface replace), with a settings page and composer controls.

1le mois dernierVision, voix et multimodalMIT
Y

dsh-multimodal

yauntyour/dsh-multimodal

Per-file-type multimodal chains: preset processing models per wildcard convert image/video/audio files into prompt tokens before they reach the text-only session model, with per-preset fallback chains and a Multimodal settings page.

1le mois dernierVision, voix et multimodalMIT