Plugins
Parcourez, filtrez et installez des plugins DeepSeek-Harness.
30 plugins trouvés
dsh-prompt-enhancer
fishsb/dsh-prompt-enhancer
Amélioration de prompts en un clic (5 modes, chaîne de mémoire, repli multi-modèles) plus reconnaissance vocale (Qwen3-ASR cloud / SenseVoice hors ligne, arrêt automatique au silence) pour le compositeur, avec redémarrage du service DSH en un clic.
dsh-voice-scribe
pensivefei/dsh-voice-scribe
Saisie vocale pour l'interface web : appuyez sur Alt (ou Alt+Space) pour démarrer/arrêter la dictée, Web Speech du navigateur (zéro config) ou ASR cloud compatible OpenAI, polissage optionnel via le LLM configuré par DSH, interface de paramètres.
dsh-ears
wiziscool/dsh-ears
Plugin de saisie vocale pour DeepSeek Harness (dsh) : un bouton microphone dans le compositeur transforme la parole en brouillon transcrit, avec un choix de backends de reconnaissance vocale, un peaufinage optionnel via les propres routes LLM de dsh et une page de paramètres native.
dsh-voice-mode (dsh-voice-mode)
qishuilalala/dsh-voice-mode
Mode voix duplex intégral pour l'interface Web DeepSeek Harness : bascule (envoi automatique après 2 s de pause) ou dictée push-to-talk dans un brouillon modifiable avec ASR streaming zipformer2, mot de réveil optionnel ; lecture phrase par phrase via Edge TTS avec sous-titres en direct, et la parole interrompt la lecture et le tour en cours (vrai barge-in). ASR sur appareil, aucune clé API requise.
dsh-video-lens
dundunhan/dsh-video-lens
Donne aux agents DeepSeek Harness textuels la compréhension vidéo : échantillonnage de trames contextuel + VLM + transcription ASR optionnelle fusionnés en preuves de timeline. / Plugin de compréhension vidéo pour modèles texte uniquement (échantillonnage de trames contextuel + VLM + transcription vocale optionnelle).
dsh-voice-ai-girlfriend-plugin
beiyege-01/dsh-voice-ai-girlfriend-plugin
Petite amie IA vocale pour l’interface Web : entrée micro FunASR, réponses parlées Qwen3-TTS, fenêtre d’animation compagnon et chat QQ bidirectionnel (texte/voix/image push) via NapCat.
dsh-bilibili
czx2244/dsh-bilibili
Analyse de vidéos Bilibili : métadonnées, transcription (repli ASR via Bijian/sherpa-onnx/whisper.cpp), commentaires, danmaku, et images clés nettes avec descriptions de vision locales optionnelles.
dsh-video-understand
ilps2/dsh-video-understand
Outil de compréhension vidéo à faible coût : un outil video_understand transforme un lien Bilibili / BV / une vidéo locale en couche d’informations AVIS (ASR + structure de scène + suivi d’objets + étiquettes YOLO) et renvoie un résumé + Q&R. Routage dynamique inter-couches guidé par les questions (L0 ASR / L1 suivi d’objets / L2 VLM sur image clé), réutilisation de la couche sémantique pour les questions répétées, plafond de budget par question. Moteur Python : la couche principale nécessite faster-whisper / opencv / yt-dlp (~200-300MB) ; la couche sémantique optionnelle ajoute ~2GB de torch / transformers / ultralytics. Un doctor --fix inclus configure le venv et installe les deux.
dsh-voice
stardustlc666/dsh-voice
Outils vocaux : synthèse vocale neuronale gratuite avec edge-tts, transcription ASR compatible OpenAI, liste des voix, aperçu des voix par lot et autodiagnostic de l'état.
dsh-voice
haoku123/dsh-voice
Mode vocal full-duplex pour l'interface web : dictée par pression pour basculer ou maintien (touche d'envoi ou `Ctrl`) avec sous-titres en direct, ASR SenseVoice côté hôte via sherpa-onnx, réponses parlées phrase par phrase, et parler interrompt la lecture et le tour en cours (vraie interruption). Aucune clé API.
dsh-hold-to-talk
wangzhanchao883/dsh-hold-to-talk
Saisie à une main, sans clavier, pour la zone de rédaction : maintenez le bouton de la souris enfoncé sur la zone de saisie, parlez, relâchez — le texte atterrit dans le brouillon, et glisser vers le haut annule sans laisser une phrase à moitié écrite. Pas de bouton micro à viser ni de raccourci à mémoriser ; la main n'a jamais à quitter la zone de saisie, ce qui est tout l'intérêt quand l'autre main est occupée. La reconnaissance fonctionne entièrement hors ligne (SenseVoice via sherpa-onnx, aucune clé API, l'audio ne quitte jamais la machine).
voco-input-sh
nothree-code/voco-input-sh
Saisie vocale pour l'interface Web : un bouton micro qui lance la reconnaissance vocale hors ligne locale VocoType et insère automatiquement le texte reconnu dans le compositeur (déploiement automatique, déduplication, dictée continue).
dsh-voice-call
biliye/dsh-voice-call
Assistant d'appel vocal pour l'interface web DSH : une boule d'appel flottante et déplaçable, un VAD côté navigateur qui envoie chaque prise de parole après une pause, la reconnaissance vocale FunASR HTTP ou en streaming, des réponses TTS MiniMax ou compatibles OpenAI, un mode optionnel à mot d'éveil avec mise en veille automatique, et la répartition de tâches vers des sessions de sous-agents séparées avec progression, arrêt et rapports de fin parlés.
muxiva-dsh-voice
piyotahu/muxiva-dsh-voice
Voix full-duplex privilégiant le local pour DeepSeek Harness, orchestrée par Muxiva
dsh-voice-call
pandapolo/dsh-voice-call
Appels vocaux initiés par l’agent : `offer_call` fait sonner l’humain (接听/拒接/稍后再说) ; les appels acceptés sont synthétisés et lus localement via CrispASR + Qwen3-TTS (9 voix, 2 dialectes chinois), et les appels refusés renvoient la décision à l’agent.
dsh-wsl-media
173787247/dsh-wsl-media
Local media/doc pipeline: ffprobe, extract, thumbnail, PDF, ASR, pandoc, OCR, exif (allowRoots include IM inbox).
dsh-wsl-im
173787247/dsh-wsl-im
Bridges Feishu, WeCom, DingTalk, QQ, Slack, Discord, Telegram and Mattermost into dsh agents (outbound WS/Stream/Gateway/long-poll/webhook), with im_status, optional local Whisper ASR, plain-text outbound for QQ/DingTalk/Telegram/Mattermost, and env CSV allowlists (DSH_IM_*_ALLOWED_USER_IDS). Empty allowedUserIds means EVERYONE can drive your agent — set a whitelist before exposing a bot.
dsh-minimax-asr
moluyao/dsh-minimax-asr
MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选
dsh-funasr-voice
fenglin-ai/dsh-funasr-voice
Offline voice input for the DSH Web UI: mic to local FunASR (SenseVoiceSmall), one-click install, no cloud.
dsh-voice-input-cn
schumchanvi/dsh-voice-input-cn
Saisie vocale prête pour la Chine pour le composer. Nécessite un pont Python local (pip install dashscope websockets, exécuter bridge/voice-bridge.py) — le plugin seul ne fonctionne pas. Le micro du navigateur diffuse du PCM 16 kHz au pont, qui exécute Alibaba Cloud DashScope ASR (paraformer-realtime-v2) ; le texte intermédiaire remplit le brouillon au curseur, arrêt automatique au silence, envoi automatique optionnel.
dsh-audio-copilot
ai-yucheng/dsh-audio-copilot
Audio Copilot for DeepSeek Harness: transcribe audio (ASR) and synthesize speech (TTS) — gives text-only agents ears and a voice. Windows-local SAPI TTS out of the box; OpenAI-compatible ASR/TTS endpoints configurable. Includes an in-composer voice-input
dsh-asr-voice
bittersmilezzz/dsh-asr-voice
开口即成文 · Speak-to-prompt for DeepSeek Harness:云端 ASR 语音识别 + 提示词优化 + 填入草稿/自动发送,跨平台 macOS / Windows。
dsh-voice-input
rio-promax/dsh-voice-input
DSH voice input plugin: browser realtime + VAD dictation + local/cloud ASR + DeepSeek AI polish
dsh-voice-input-qwen-asr
jsoncode/dsh-voice-input-qwen-asr
Voice input plugin (dual-face): mic button beside the composer send action, live recording bubble streaming PCM to a local Qwen3-ASR python service managed by the host, plus an ASR environment settings page (clone runtime/model repos, create venv, run ser