Passer au contenu principal

Plugins

Parcourez, filtrez et installez des plugins DeepSeek-Harness.

25 plugins trouvés

P

dsh-omi-voice

polinnizhong/dsh-omi-voice

Lecture à voix haute dans le chat pour DeepSeek Harness : touchez pour lire, mettre en pause et reprendre les réponses de l'IA avec des voix Doubao TTS naturelles (BYOK) ; lit uniquement la réponse finale, code, tableaux et diagrammes filtrés ; moteur local, le plugin ne conserve aucune clé d'API.

74le mois dernierVision, voix et multimodalMIT
1

dsh-plugin-tts

1624318455/dsh-plugin-tts

Lit à voix haute les réponses de l'assistant via Edge TTS gratuit ou vos propres modèles vocaux RVC : boutons de lecture à voix haute + lecture automatique, lecture progressive par blocs adaptatifs (lectures longues sans coupure), installation en un clic de packs vocaux depuis un registre, et un runtime RVC portable.

21il y a 6 joursVision, voix et multimodalMIT
P

dsh-talk

perrylink/dsh-talk

Entrée/sortie vocale pour DeepSeek Harness — reconnaissance vocale et synthèse vocale via le microphone et la sortie audio.

16il y a 8 joursVision, voix et multimodalApache-2.0
Q

dsh-voice-mode (dsh-voice-mode)

qishuilalala/dsh-voice-mode

Mode voix duplex intégral pour l'interface Web DeepSeek Harness : bascule (envoi automatique après 2 s de pause) ou dictée push-to-talk dans un brouillon modifiable avec ASR streaming zipformer2, mot de réveil optionnel ; lecture phrase par phrase via Edge TTS avec sous-titres en direct, et la parole interrompt la lecture et le tour en cours (vrai barge-in). ASR sur appareil, aucune clé API requise.

15il y a 6 heuresVision, voix et multimodalMIT
P

dsh-plugin-xiaomi-mimo-tts

ppy-web/dsh-plugin-xiaomi-mimo-tts

Ajoute la synthèse vocale Xiaomi MiMo à DSH Web avec la lecture à voix haute des messages de l'assistant, la diffusion PCM, des voix prédéfinies et la conception de voix personnalisées, un repli sur la synthèse vocale du navigateur, des commandes de lecture et des sons d'interface en option.

11avant-hierVision, voix et multimodalMIT
Y

dsh-tts-bridge

yuuyuko-uu/dsh-tts-bridge

Lit les conversations DSH à voix haute en utilisant la lecture vocale intégrée de la page web DeepSeek, pilotée par une petite extension de navigateur.

4il y a 3 joursVision, voix et multimodal
H

dsh-omni-workstation

huashenglian/dsh-omni-workstation

Station de travail omni-modale pour DSH : analyze_image sur une chaîne de basculement VLM ordonnée à plusieurs cartes, une boîte à outils de vision à six outils (zoom, échantillonnage de couleurs, diff de pixels, OCR, détection d'éléments, affichage en ligne) partageant le même résolveur d'images, generate_image via les protocoles OpenAI/DashScope/ComfyUI, generate_video asynchrone multi-cartes avec un constructeur /build-video-tool, et TTS speak/clone_voice sur sept fournisseurs, le tout piloté par une seule page de paramètres à enregistrement automatique.

3il y a 14 joursVision, voix et multimodalMIT
N

dsh-plugin-speech

nakamuraia/dsh-plugin-speech

Lit à voix haute les réponses de l'assistant dans DeepSeek Harness : fournisseurs de synthèse texte-vers-parole avec lecture en streaming.

3il y a 18 joursVision, voix et multimodalMIT
L

dsh-voco

lgquan/dsh-voco

Conversations vocales continues pour DSH avec écoute mains libres, push-to-talk, reconnaissance vocale, réponses TTS et délégation d'Agent en arrière-plan.

3le mois dernierVision, voix et multimodalMIT
T

dsh-gsv

taoruiliu19/dsh-gsv

TTS local en temps réel pour DeepSeek Harness : préréglages vocaux, lecture automatique, assistant de configuration du moteur, bouton de lecture à voix haute et panneau de réglages pour le moteur GSV-TTS-Lite.

3le mois dernierVision, voix et multimodalMIT
L

Deepseek-Continuity

linxuhao/deepseek-continuity

Génération locale d'images, de voix, de musique et d'effets sonores, plus transcription, avec identité épinglée : les personnages, animaux, objets et voix d'acteurs sont définis une fois et réutilisés à chaque appel ultérieur ; les sorties dégénérées (image presque plate, audio silencieux) sont rejetées au lieu d'être renvoyées comme succès, et une ligne générée peut être relue comme texte, ce qui rend visible un clone qui aurait avalé sa fin. Les moteurs se déchargent en veille, et la génération d'images et la transcription peuvent chacune être dirigées vers une API de type OpenAI au lieu du backend Vulkan local.

3il y a 12 joursVision, voix et multimodalMIT
J

dsh-voice

jesse-njx/dsh-voice

Notes vocales en entrée, réponses parlées en sortie : dictez de l'audio qui devient des messages utilisateur (transcription), faites lire les réponses à voix haute par l'agent (synthèse vocale), local-first sous ~/.dsh/voice.

3il y a 2 moisVision, voix et multimodalMIT
B

dsh-voice-call

biliye/dsh-voice-call

Assistant d'appel vocal pour l'interface web DSH : une boule d'appel flottante et déplaçable, un VAD côté navigateur qui envoie chaque prise de parole après une pause, la reconnaissance vocale FunASR HTTP ou en streaming, des réponses TTS MiniMax ou compatibles OpenAI, un mode optionnel à mot d'éveil avec mise en veille automatique, et la répartition de tâches vers des sessions de sous-agents séparées avec progression, arrêt et rapports de fin parlés.

2il y a 4 joursVision, voix et multimodalMIT
P

dsh-voice-call

pandapolo/dsh-voice-call

Appels vocaux initiés par l’agent : `offer_call` fait sonner l’humain (接听/拒接/稍后再说) ; les appels acceptés sont synthétisés et lus localement via CrispASR + Qwen3-TTS (9 voix, 2 dialectes chinois), et les appels refusés renvoient la décision à l’agent.

2il y a 3 joursVision, voix et multimodalMIT
M

dsh-fish-tts

mari23333/dsh-fish-tts

Lit à voix haute les réponses de l’assistant uniquement via l’API Fish Audio (clé à fournir soi-même) : lecture par message, bascule de lecture automatique et page de réglages pour le modèle, le reference_id de la voix, la clé API chiffrée et le proxy.

2avant-hierVision, voix et multimodalMIT
W

dsh-multi-tts

wyr-233/dsh-multi-tts

Per-reply read-aloud with a multi-provider settings page — MiniMax or any OpenAI-compatible /audio/speech endpoint, with voice, emotion, speed and model selection plus an auto-read toggle.

1il y a 21 joursVision, voix et multimodal
V

dsh-live-voice

victorwads/dsh-live-voice

Local-first voice conversations for DSH, with local speech recognition and synthesis and optional external providers.

1il y a 17 joursVision, voix et multimodalGPL-3.0
M

dsh-minimax-asr

moluyao/dsh-minimax-asr

MiniMax 语音识别(asr-1.0)+ 语音合成(speech-2.8-hd)的 DeepSeek Harness 全局插件:转写工具、任务结束后用喇叭念一句的播报、实时免手对话、303 个音色可选

1il y a 19 joursVision, voix et multimodalMIT
Z

dsh-voice

zhuiyueya/dsh-voice

Voix pour DeepSeek Harness (dsh) — saisie par reconnaissance vocale + lecture à voix haute (TTS) pour DeepSeek texte seul, sans clé API.

1il y a 2 moisVision, voix et multimodalMIT
F

dsh-say

fangqian616/dsh-say

Speaks your agent's reports in a voice you choose, compressing long reports before speaking. Character voices need no training - a 3-10 second reference clip clones one, and community-trained models work too - and no 6.4 GB GPT-SoVITS install: the plugin installs its own runtime and voice. An existing GPT-SoVITS can be used instead, and it is the same voice model.

0il y a 11 joursVision, voix et multimodal
L

dsh-voice-alert

loyalchiiina/dsh-voice-alert

Speaks or plays a sound at the end of every turn and plays a failure cue when a tool call or a turn errors. Ships 20 built-in effects (10 alert chimes + 10 nature sounds) and defaults to effect mode, so it needs no API key and no audio files; an optional Volcengine voice-clone route generates the three announcement clips in one click. Plays through winmm/waveOut as-is, never changing the system volume or mute state. Windows only.

0il y a 4 joursVision, voix et multimodalMIT
C

dsh-voice-mimo

ch1bug/dsh-voice-mimo

Xiaomi MiMo-powered voice for DeepSeek Harness: browser 🎤/🧠/🔊 UI, voice_transcribe/voice_understand/voice_speak tools, configurable voice map (preset/voicedesign/voiceclone). Fork of zhuiyueya/dsh-voice (MIT), Settings pattern from Anionex/dsh-vision-toolkit (MIT).

0il y a 19 joursVision, voix et multimodalMIT
K

dsh-kitt-voice

kittcat-lab/dsh-kitt-voice

Voice for the DeepSeek Harness: speak to the agent, hear it back, and see what it is doing from a floating window that stays on top of whatever you are running.

0il y a 28 joursVision, voix et multimodalMIT
G

dsh-plugins

genesis-agents/dsh-plugins

A source library for DeepSeek Harness: 72 feeds on an hourly timer, a reader with transcripts and translation, and a publisher that turns what it collects into a podcast, a digest, or a report

0le mois dernierFlux et automatisationMIT