Passer au contenu principal

Plugins

Parcourez, filtrez et installez des plugins DeepSeek-Harness.

86 plugins trouvés

L

modlens

liustack/modlens

Pont de vision pour les modèles texte seul : collez une image, obtenez des preuves JSON structurées (OCR, mise en page, sémantique).

4.1kil y a 5 joursVision, voix et multimodalMIT
Y

dsh-vision-router

ysr666/dsh-vision-router

Vision gratuite pour les agents texte seul : chaîne de vision intégrée sans clé, plus des outils pixel (questions-réponses, ancrage, recadrage, diff pixel, couleurs, OCR, tracé SVG, détourage, captures d'écran) ; collez une image pour l'utiliser.

1.1khierVision, voix et multimodalMIT
A

dsh-vision-toolkit

anionex/dsh-vision-toolkit

Vision pour les modèles texte uniquement : collez une image et le modèle bascule vers la variante Vision Toolkit pour les questions-réponses sur images, la comparaison multi-images, l'OCR de captures longues, la reproduction d'UI à partir de captures, l'ancrage d'éléments et les différences de pixels. Aucune clé API par défaut — les images sont traitées par le service gratuit hébergé par l'auteur, 100 par machine et par jour ; configurable vers votre propre fournisseur.

887avant-hierVision, voix et multimodalMIT
E

Invoice-Downloader (dsh-invoice-downloader)

ethanyoq/invoice-downloader

Téléchargement local de factures IMAP, OCR, archivage et résumés de remboursement Excel pour DeepSeek Harness.

479il y a 8 joursOutils et capacitésApache-2.0
O

watch-skill

oxbshw/watch-skill

Les capacités de DeepWatch, installables dans un profil DeepSeek Harness existant

378il y a 18 joursVision, voix et multimodalMIT
Z

dsh-ios

zseven-w/dsh-ios

Un simulateur iOS ou un iPhone connecté en USB directement dans la conversation : 22 outils d'agent pour démarrer, compiler, piloter l'UI par l'identité d'accessibilité ou le texte OCR, effectuer des actions sur des lignes de liste et le rechargement à chaud de SwiftUI preview, plus un panneau latéral en streaming que vous pouvez toucher et faire glisser.

309il y a 8 joursOutils et capacitésMIT
Z

dsh-android

zseven-w/dsh-android

Un appareil Android en direct dans la conversation — émulateur ou téléphone USB, piloté entièrement via adb : 20 outils d'agent pour le streaming, la compilation et l'exécution Gradle, l'interaction avec l'arbre UI ou le texte OCR, logcat, les processus et la mémoire, plus un panneau de navigation à trois boutons.

167il y a 8 joursOutils et capacitésMIT
E

invoice-downloader

ethanyoq/invoice-downloader

Téléchargement local de factures IMAP, OCR, archivage et bundle récapitulatif Excel pour DeepSeek Harness

132le mois dernierOutils et capacitésApache-2.0
T

dsh-openmaic

thu-maic/dsh-openmaic

OpenMAIC : salles de classe, diapositives, widgets interactifs et enseignement socratique.

84il y a 2 moisOutils et capacitésMIT
W

dsh-openbiliclaw

whiteguo233/dsh-openbiliclaw

Panneau consommateur OpenBiliClaw pour DSH : recommandations, listes enregistrées, dialogue socratique, vues de profil et outils Agent Bridge.

60il y a 22 joursAméliorations UIBSD-3-Clause
J

picturereader

jing-hy/picturereader

« Lecture » d'images pour les modèles texte uniquement : réduction d'échelle + réduction de la profondeur de couleur + empreintes de structure/couleur transformées en grilles de texte renvoyées dans la conversation, permettant au modèle de zoomer, d'échantillonner et de faire de l'OCR de manière autonome comme un modèle multimodal ; entièrement local, sans dépendance à un modèle externe, fournit une compétence de méthodologie de lecture d'image et PaddleOCR en option.

37avant-hierVision, voix et multimodalMIT
Y

dsh-computer-use-win

yu-tao-li/dsh-computer-use-win

Utilisation de l'ordinateur Windows pour DeepSeek Harness : un serveur MCP stdio sur un backend PowerShell UIA exposant 22 outils de bureau (arborescence UIA, captures d'écran, saisie typée, OCR, gestion de fenêtres, failsafe).

19il y a 5 joursOutils et capacitésMIT
F

dsh-vision-proxy

flyvhidbwo/dsh-vision-proxy

Cerveau DeepSeek + transcription automatique d'images : attachez des images dans la GUI et chacune est transcrite par le modèle officiel deepseek-v4-flash-vision-exp par défaut (un cerveau V4-Pro en texte pur peut voir les images), avec n'importe quelle VLM compatible OpenAI ou Ollama local comme alternatives.

15le mois dernierVision, voix et multimodalMIT
Y

dsh-pdf-mineru

yurzi/dsh-pdf-mineru

Analyse de documents DSH indépendante du fournisseur, propulsée par MinerU, avec tâches d'arrière-plan natives, résultats immuables et fusion sécurisée des requêtes.

11avant-hierOutils et capacitésMIT
S

dsh-docs

sqhao-o/dsh-docs

Intelligence documentaire locale pour PDF, Office, images et OCR pour DeepSeek Harness.

10il y a 2 moisOutils et capacitésMIT
T

DSH-FormatForge (dsh-formatforge)

tianbuyu-wwx/dsh-formatforge

FormatForge : forge 30+ formats de fichiers (PDF, DOCX, PPTX, XLSX, EML, EPUB, TOML, archives) en texte lisible par l'IA via une boîte de réception glisser-déposer, les outils ff_translate/ff_formats/ff_result et une CLI ; les PDF numérisés se rabattent sur un OCR local ou une indication d'amélioration pour le modèle de session.

9il y a 3 joursOutils et capacitésMIT
L

dsh-vision

linenxi-ctrl/dsh-vision

Plugin de vision externe pour DeepSeek Harness : panneau de configuration via le bouton baleine, reconnaissance d'image avec réponse automatique, et outils de capture d'écran/reconnaissance pour l'agent.

9il y a 2 moisVision, voix et multimodalMIT
F

dsh-free-vision

fuzzysoul/dsh-free-vision

Pont de vision gratuit pour les modèles texte uniquement : compréhension d'images, OCR, analyse d'interface et de débogage via des fournisseurs de niveau gratuit (Qwen3-VL-Flash, Doubao, DeepSeek-OCR) avec une interface graphique de paramètres.

8le mois dernierVision, voix et multimodalMIT
M

dsh-iris

mokuyoaxis/dsh-iris

Espace de travail média et vision pour DeepSeek Harness : génération d'images, de vidéos et de parole, questions-réponses sur images et localisation d'éléments, OCR de longues images, diff de pixels, vérification par capture d'écran HTML et résumé de vidéos, avec des fournisseurs DashScope et compatibles OpenAI, des pools de modèles et un client de type workbench.

7hierOutils et capacitésMIT
5

dsh-vision

54xkeee/dsh-vision

Vision pour DeepSeek en mode texte seul via Doubao Web par défaut (gratuit, sans clé API — pilote votre Chrome connecté via un pont CDP Windows), avec quota Antigravity IDE (flash/pro) ou repli sur Gemini ; escalade automatique du niveau de détail, mémoire de preuves visuelles avec réhydratation après compaction, cache par hachage de contenu, et un panneau client bilingue.

7il y a 2 moisVision, voix et multimodalMIT
C

dsh-learning-mode (plugin)

chplus0/dsh-learning-mode

Preset d'agent Learning Mode : un agent de code qui enseigne en codant — explications concrètes ancrées dans des scénarios, guidage socratique, et blancs de pratique TODO(你), modelé sur le style de sortie Learning de Claude Code ; installable via dsh plugin add (dsh-learning-mode sur npm).

6il y a 2 moisOutils et capacités
S

macos-computer-use-kit

sur-cai/macos-computer-use-kit

Utilisation d'ordinateur macOS AX-first pour DeepSeek Harness : instantanés d'accessibilité avec références stables, saisie en arrière-plan, frappe Unicode, menus, applications, captures set-of-mark, OCR sur l'appareil, actions vérifiées et garde-fous sémantiques Jev (TypeSafe System One) en option — 1

5il y a 9 joursOutils et capacitésMIT
S

macos-computer-use-kit (dsh)

sur-cai/macos-computer-use-kit

Usage de l'ordinateur macOS avec l'accessibilité d'abord pour DeepSeek Harness : instantanés d'accessibilité avec références stables, saisie en arrière-plan, frappe Unicode, menus et applications, captures d'écran avec marquage, OCR embarqué et actions vérifiées — 11 outils reliés à la CLI macos-cu.

5il y a 9 joursOutils et capacitésMIT
G

dsh-ocr-local

grelvan/dsh-ocr-local

Fallback OCR local pour les routes en texte seul : lorsque le modèle de session déclare qu'il ne peut pas accepter d'images, l'image jointe est mise en cache localement et son chemin est injecté pour que le modèle puisse appeler ocr_image — PP-OCRv5 + ONNX Runtime sur CPU, sans clé API, les images ne quittent jamais la machine. Silencieux lorsque le modèle peut voir les images.

5il y a 5 joursVision, voix et multimodal