Passer au contenu principal

Plugins

Parcourez, filtrez et installez des plugins DeepSeek-Harness.

30 plugins trouvés

F

dsh-prompt-enhancer

fishsb/dsh-prompt-enhancer

Amélioration de prompts en un clic (5 modes, chaîne de mémoire, repli multi-modèles) plus reconnaissance vocale (Qwen3-ASR cloud / SenseVoice hors ligne, arrêt automatique au silence) pour le compositeur, avec redémarrage du service DSH en un clic.

82il y a 5 joursOutils et capacités
P

dsh-voice-scribe

pensivefei/dsh-voice-scribe

Saisie vocale pour l'interface web : appuyez sur Alt (ou Alt+Space) pour démarrer/arrêter la dictée, Web Speech du navigateur (zéro config) ou ASR cloud compatible OpenAI, polissage optionnel via le LLM configuré par DSH, interface de paramètres.

34il y a 3 joursVision, voix et multimodalMIT
W

dsh-ears

wiziscool/dsh-ears

Plugin de saisie vocale pour DeepSeek Harness (dsh) : un bouton microphone dans le compositeur transforme la parole en brouillon transcrit, avec un choix de backends de reconnaissance vocale, un peaufinage optionnel via les propres routes LLM de dsh et une page de paramètres native.

21il y a 21 heuresVision, voix et multimodalMIT
Q

dsh-voice-mode (dsh-voice-mode)

qishuilalala/dsh-voice-mode

Mode voix duplex intégral pour l'interface Web DeepSeek Harness : bascule (envoi automatique après 2 s de pause) ou dictée push-to-talk dans un brouillon modifiable avec ASR streaming zipformer2, mot de réveil optionnel ; lecture phrase par phrase via Edge TTS avec sous-titres en direct, et la parole interrompt la lecture et le tour en cours (vrai barge-in). ASR sur appareil, aucune clé API requise.

15il y a 6 heuresVision, voix et multimodalMIT
D

dsh-video-lens

dundunhan/dsh-video-lens

Donne aux agents DeepSeek Harness textuels la compréhension vidéo : échantillonnage de trames contextuel + VLM + transcription ASR optionnelle fusionnés en preuves de timeline. / Plugin de compréhension vidéo pour modèles texte uniquement (échantillonnage de trames contextuel + VLM + transcription vocale optionnelle).

13le mois dernierVision, voix et multimodalMIT
B

dsh-voice-ai-girlfriend-plugin

beiyege-01/dsh-voice-ai-girlfriend-plugin

Petite amie IA vocale pour l’interface Web : entrée micro FunASR, réponses parlées Qwen3-TTS, fenêtre d’animation compagnon et chat QQ bidirectionnel (texte/voix/image push) via NapCat.

12il y a 19 joursVision, voix et multimodal
C

dsh-bilibili

czx2244/dsh-bilibili

Analyse de vidéos Bilibili : métadonnées, transcription (repli ASR via Bijian/sherpa-onnx/whisper.cpp), commentaires, danmaku, et images clés nettes avec descriptions de vision locales optionnelles.

9il y a 2 moisOutils et capacitésMIT
I

dsh-video-understand

ilps2/dsh-video-understand

Outil de compréhension vidéo à faible coût : un outil video_understand transforme un lien Bilibili / BV / une vidéo locale en couche d’informations AVIS (ASR + structure de scène + suivi d’objets + étiquettes YOLO) et renvoie un résumé + Q&R. Routage dynamique inter-couches guidé par les questions (L0 ASR / L1 suivi d’objets / L2 VLM sur image clé), réutilisation de la couche sémantique pour les questions répétées, plafond de budget par question. Moteur Python : la couche principale nécessite faster-whisper / opencv / yt-dlp (~200-300MB) ; la couche sémantique optionnelle ajoute ~2GB de torch / transformers / ultralytics. Un doctor --fix inclus configure le venv et installe les deux.

8le mois dernierOutils et capacités
S

dsh-voice

stardustlc666/dsh-voice

Outils vocaux : synthèse vocale neuronale gratuite avec edge-tts, transcription ASR compatible OpenAI, liste des voix, aperçu des voix par lot et autodiagnostic de l'état.

4il y a 6 heuresVision, voix et multimodalMIT
H

dsh-voice

haoku123/dsh-voice

Mode vocal full-duplex pour l'interface web : dictée par pression pour basculer ou maintien (touche d'envoi ou `Ctrl`) avec sous-titres en direct, ASR SenseVoice côté hôte via sherpa-onnx, réponses parlées phrase par phrase, et parler interrompt la lecture et le tour en cours (vraie interruption). Aucune clé API.

4le mois dernierVision, voix et multimodalMIT
W

dsh-hold-to-talk

wangzhanchao883/dsh-hold-to-talk

Saisie à une main, sans clavier, pour la zone de rédaction : maintenez le bouton de la souris enfoncé sur la zone de saisie, parlez, relâchez — le texte atterrit dans le brouillon, et glisser vers le haut annule sans laisser une phrase à moitié écrite. Pas de bouton micro à viser ni de raccourci à mémoriser ; la main n'a jamais à quitter la zone de saisie, ce qui est tout l'intérêt quand l'autre main est occupée. La reconnaissance fonctionne entièrement hors ligne (SenseVoice via sherpa-onnx, aucune clé API, l'audio ne quitte jamais la machine).

3il y a 20 heuresVision, voix et multimodalMIT
N

voco-input-sh

nothree-code/voco-input-sh

Saisie vocale pour l'interface Web : un bouton micro qui lance la reconnaissance vocale hors ligne locale VocoType et insère automatiquement le texte reconnu dans le compositeur (déploiement automatique, déduplication, dictée continue).

3il y a 19 joursVision, voix et multimodalMIT
B

dsh-voice-call

biliye/dsh-voice-call

Assistant d'appel vocal pour l'interface web DSH : une boule d'appel flottante et déplaçable, un VAD côté navigateur qui envoie chaque prise de parole après une pause, la reconnaissance vocale FunASR HTTP ou en streaming, des réponses TTS MiniMax ou compatibles OpenAI, un mode optionnel à mot d'éveil avec mise en veille automatique, et la répartition de tâches vers des sessions de sous-agents séparées avec progression, arrêt et rapports de fin parlés.

2il y a 4 joursVision, voix et multimodalMIT
P

muxiva-dsh-voice

piyotahu/muxiva-dsh-voice

Voix full-duplex privilégiant le local pour DeepSeek Harness, orchestrée par Muxiva

2il y a 2 moisVision, voix et multimodalApache-2.0
P

dsh-voice-call

pandapolo/dsh-voice-call

Appels vocaux initiés par l’agent : `offer_call` fait sonner l’humain (接听/拒接/稍后再说) ; les appels acceptés sont synthétisés et lus localement via CrispASR + Qwen3-TTS (9 voix, 2 dialectes chinois), et les appels refusés renvoient la décision à l’agent.

2il y a 3 joursVision, voix et multimodalMIT
1

dsh-wsl-media

173787247/dsh-wsl-media

Local media/doc pipeline: ffprobe, extract, thumbnail, PDF, ASR, pandoc, OCR, exif (allowRoots include IM inbox).

1il y a 3 joursDéveloppement et outils de pluginsMIT
1

dsh-wsl-im

173787247/dsh-wsl-im

Bridges Feishu, WeCom, DingTalk, QQ, Slack, Discord, Telegram and Mattermost into dsh agents (outbound WS/Stream/Gateway/long-poll/webhook), with im_status, optional local Whisper ASR, plain-text outbound for QQ/DingTalk/Telegram/Mattermost, and env CSV allowlists (DSH_IM_*_ALLOWED_USER_IDS). Empty allowedUserIds means EVERYONE can drive your agent — set a whitelist before exposing a bot.

1il y a 3 joursDéveloppement et outils de pluginsMIT
M

dsh-minimax-asr

moluyao/dsh-minimax-asr

MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选

1il y a 19 joursVision, voix et multimodalMIT
F

dsh-funasr-voice

fenglin-ai/dsh-funasr-voice

Offline voice input for the DSH Web UI: mic to local FunASR (SenseVoiceSmall), one-click install, no cloud.

1le mois dernierVision, voix et multimodalMIT
S

dsh-voice-input-cn

schumchanvi/dsh-voice-input-cn

Saisie vocale prête pour la Chine pour le composer. Nécessite un pont Python local (pip install dashscope websockets, exécuter bridge/voice-bridge.py) — le plugin seul ne fonctionne pas. Le micro du navigateur diffuse du PCM 16 kHz au pont, qui exécute Alibaba Cloud DashScope ASR (paraformer-realtime-v2) ; le texte intermédiaire remplit le brouillon au curseur, arrêt automatique au silence, envoi automatique optionnel.

1il y a 15 joursVision, voix et multimodalMIT
A

dsh-audio-copilot

ai-yucheng/dsh-audio-copilot

Audio Copilot for DeepSeek Harness: transcribe audio (ASR) and synthesize speech (TTS) — gives text-only agents ears and a voice. Windows-local SAPI TTS out of the box; OpenAI-compatible ASR/TTS endpoints configurable. Includes an in-composer voice-input

1le mois dernierVision, voix et multimodalMIT
B

dsh-asr-voice

bittersmilezzz/dsh-asr-voice

开口即成文 · Speak-to-prompt for DeepSeek Harness:云端 ASR 语音识别 + 提示词优化 + 填入草稿/自动发送,跨平台 macOS / Windows。

0il y a 17 joursVision, voix et multimodalMIT
R

dsh-voice-input

rio-promax/dsh-voice-input

DSH voice input plugin: browser realtime + VAD dictation + local/cloud ASR + DeepSeek AI polish

0il y a 20 joursVision, voix et multimodalMIT
J

dsh-voice-input-qwen-asr

jsoncode/dsh-voice-input-qwen-asr

Voice input plugin (dual-face): mic button beside the composer send action, live recording bubble streaming PCM to a local Qwen3-ASR python service managed by the host, plus an ASR environment settings page (clone runtime/model repos, create venv, run ser

0il y a 27 joursVision, voix et multimodal