Plugins
Parcourez, filtrez et installez des plugins DeepSeek-Harness.
125 plugins trouvés
Deepseek-Continuity
linxuhao/deepseek-continuity
Génération locale d'images, de voix, de musique et d'effets sonores, plus transcription, avec identité épinglée : les personnages, animaux, objets et voix d'acteurs sont définis une fois et réutilisés à chaque appel ultérieur ; les sorties dégénérées (image presque plate, audio silencieux) sont rejetées au lieu d'être renvoyées comme succès, et une ligne générée peut être relue comme texte, ce qui rend visible un clone qui aurait avalé sa fin. Les moteurs se déchargent en veille, et la génération d'images et la transcription peuvent chacune être dirigées vers une API de type OpenAI au lieu du backend Vulkan local.
voco-input-sh
nothree-code/voco-input-sh
Saisie vocale pour l'interface Web : un bouton micro qui lance la reconnaissance vocale hors ligne locale VocoType et insère automatiquement le texte reconnu dans le compositeur (déploiement automatique, déduplication, dictée continue).
dsh-stt-input
baisama-cloud/dsh-stt-input
Saisie vocale de reconnaissance vocale pour l'interface Web : un bouton micro dans le compositeur transcrit la parole en brouillon via l'API Web Speech du navigateur (sans configuration) ou une API Whisper compatible OpenAI (OpenAI / Groq), avec modèle et langue sélectionnables dans Paramètres.
dsh-plugin-notify
huguangyu666/dsh-plugin-notify
Boîte d'envoi de notifications : l'agent notifie de façon proactive par toast, voix TTS en chinois ou effets sonores (explosion, victoire, alarme) ; une fenêtre de confirmation de 60 s vous rappelle par la voix, avec amplification du volume et un panneau de réglages.
dsh-voice
jesse-njx/dsh-voice
Notes vocales en entrée, réponses parlées en sortie : dictez de l'audio qui devient des messages utilisateur (transcription), faites lire les réponses à voix haute par l'agent (synthèse vocale), local-first sous ~/.dsh/voice.
dsh-mic-input
qt-chen/dsh-mic-input
Saisie vocale au micro pour le composeur : transcription en direct via la Web Speech API du navigateur, déduplication/poursuite automatique, ponctuation intelligente, réglages de langue et d'envoi automatique.
dsh-voice-call
biliye/dsh-voice-call
Assistant d'appel vocal pour l'interface web DSH : une boule d'appel flottante et déplaçable, un VAD côté navigateur qui envoie chaque prise de parole après une pause, la reconnaissance vocale FunASR HTTP ou en streaming, des réponses TTS MiniMax ou compatibles OpenAI, un mode optionnel à mot d'éveil avec mise en veille automatique, et la répartition de tâches vers des sessions de sous-agents séparées avec progression, arrêt et rapports de fin parlés.
dsh-tool-lipsync
yu-wenchao/dsh-tool-lipsync
Plugin gratuit de génération vidéo lip-sync pour DSH avec plus de 3000 voix et plus de 500 langues.
dsh-messenger-gateway
goodandready/dsh-messenger-gateway
Passerelle Telegram pour DeepSeek Harness : sessions bidirectionnelles, pilotage de conversation, routage vers le canal d'origine, et notes vocales TTS envoyées sous forme de messages audio Telegram.
dsh-voice-agent (voice-app)
wayneyu430/dsh-voice-agent
Un agent frontal vocal conversationnel pour dsh : parlez naturellement via ByteDance Duplex, déléguez les requêtes à des tâches d'arrière-plan et écoutez leurs résultats asynchrones rapportés par la voix.
dsh-voice-chat
maoyuching/dsh-voice-chat
Chat vocal façon Doubao pour DSH : maintenir le micro du composeur convertit la parole en texte et l'envoie automatiquement, et les réponses de l'IA sont lues à voix haute. Condensation optionnelle par LLM (les longues réponses sont résumées en courtes phrases parlées, en suivant le modèle de la conversation en cours), nettoyage du texte adapté au TTS, voix Edge TTS sélectionnables, arrêt automatique au silence réglable et réglages intégrés à la boîte de dialogue des paramètres de DSH.
dsh-tts
goodandready/dsh-tts
Lit les réponses de l'agent dans l'interface web de DeepSeek Harness via une chaîne de secours de fournisseurs (OpenAI, ElevenLabs, Google, Azure, Groq, Deepgram, OpenRouter, Edge, Piper, eSpeak), de sorte qu'un fournisseur en échec ou limité en débit bascule vers le suivant au lieu de rester silencieux.
muxiva-dsh-voice
piyotahu/muxiva-dsh-voice
Voix full-duplex privilégiant le local pour DeepSeek Harness, orchestrée par Muxiva
dsh-voice-call
pandapolo/dsh-voice-call
Appels vocaux initiés par l’agent : `offer_call` fait sonner l’humain (接听/拒接/稍后再说) ; les appels acceptés sont synthétisés et lus localement via CrispASR + Qwen3-TTS (9 voix, 2 dialectes chinois), et les appels refusés renvoient la décision à l’agent.
dsh-fish-tts
mari23333/dsh-fish-tts
Lit à voix haute les réponses de l’assistant uniquement via l’API Fish Audio (clé à fournir soi-même) : lecture par message, bascule de lecture automatique et page de réglages pour le modèle, le reference_id de la voix, la clé API chiffrée et le proxy.
dsh-live2d-voice
john-walks-slow/dsh-live2d-voice
Live2D session view with realtime voice: continuous voice input, streaming TTS, subtitle translation, multi-model catalog, standalone entry / Live2D 实时语音会话视图:连续语音输入、流式 TTS、字幕翻译、多模型目录、独立入口
dsh-onebot
mario841859784/dsh-onebot
QQ channel for dsh via OneBot 11 (NapCat and friends): reverse or forward WebSocket, DM and group chats, image and voice transcription, t2i text-image cards, merged forwards, and a settings page.
dsh-claude-slider
yicun0316/dsh-claude-slider
Replaces the reasoning-effort dropdown with a draggable snapping slider, and draws 13 canvas effects across five style families (thrust, fluid, fantasy, tech, texture) with three tiers that unlock as the effort level rises. Custom mode combines 10 particle forms with 8 flow trajectories; 9 accent presets and a hex picker recolor every effect, and optional key sounds cover two voice clips, a synthesized duck squeak, a mechanical click and a local audio file.
dsh-wx-bridge
zhy5/dsh-wx-bridge
Drive your local DSH from WeChat: a self-hosted iLink bridge over a persistent ACP session (context lives in DSH and is resumable), phone conversations grouped into the desktop workspace, with image recognition, file messages (Excel/Word/PDF, parsed by the agent itself) and voice transcripts. Access defaults to strict (only registered devices are served); the phone channel's permission preset is wide by design - see the README security section before sharing the bot.
dsh-multi-tts
wyr-233/dsh-multi-tts
Per-reply read-aloud with a multi-provider settings page — MiniMax or any OpenAI-compatible /audio/speech endpoint, with voice, emotion, speed and model selection plus an auto-read toggle.
dshgo
xiazhi88/dshgo
Proxies the loopback-only dsh web onto a LAN port so phones and other machines can reach it, with an optional access password that browsers type in and the bundled Android client unlocks with biometrics. Adds a LAN-access settings page with QR codes, inlines dsh-web-mobile (MIT, attribution kept) for the mobile layout, and the Android client in the same repository adds finish/approval notifications, voice input and a home-screen widget.
dsh-live-voice
victorwads/dsh-live-voice
Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.
dsh-minimax-asr
moluyao/dsh-minimax-asr
MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选
dsh-voice-talk
duoduoqian708/dsh-voice-talk
Voice conversation mode for the DSH Web GUI: tap the mic to start a full-screen call, talk hands-free, and hear each reply read aloud as it streams. Bilingual (Chinese/English) UI, light and dark themes, adjustable speech rate, and switchable voices.